Modelos / SEÑAL VERIFICADA
DeepSeek V4 Flash: el modelo de 0,28 dólares que baja el piso de los agentes de código
DeepSeek lanzó a fines de julio la API de V4-Flash a 0,14 dólares por millón de tokens de entrada y 0,28 de salida, con agentes de código más fuertes a ese precio, según la documentación oficial de precios.

El precio de correr agentes de código sigue bajando, y DeepSeek acaba de mover el piso otra vez. A fines de julio de 2026 lanzó la API de V4-Flash (variante 0731) a 0,14 dólares por millón de tokens de entrada y 0,28 por millón de salida, con agentes de código más fuertes como cabeza de playa, según la documentación oficial de precios.
La cifra importa por cómo funcionan los agentes. El costo de una tarea se multiplica por cada llamada a herramientas (tool calling) y cada reintento de un flujo agéntico, así que el precio por token de salida define buena parte de la economía de producción. A 0,28 dólares de salida, correr agentes de código deja de ser un gasto que solo cierras en dólares baratos, y más en LATAM, donde el tipo de cambio pesa cada decisión.
En el panel de Model Watch de Agéntico Hoy, DeepSeek V4 Pro aparece como el modelo de pesos abiertos más barato del top 22 medido en TerminalBench (46,2%) y Tau2 (96,2%). Flash baja aún más ese piso. El análisis de Simon Willison sobre DeepSeek V4 ya documentaba el par 0,14/0,28 de Flash frente a 1,74/3,48 de Pro, una brecha que cambia qué modelos conviene poner en producción para tareas repetitivas.
Para quien construye agentes desde la región, el movimiento es directo: un modelo que ya era competitivo en calidad ahora separa aún más la curva de costo de la de capacidad. Cuando el salto de precio entre un modelo y otro se vuelve tan estrecho, la pregunta deja de ser si el modelo sirve y pasa a ser cuánto puedes automatizar antes de que el costo total importe.
Para más detalles:
