DeepSeek lanza su último modelo V4-Flash, con un costo por tarea de solo aproximadamente 3 centavos de dólar, el más bajo entre los modelos grandes principales a nivel mundial. El precio de V4-Flash es de 0,14 dólares por millón de tokens de entrada y 0,28 dólares por millón de tokens de salida; el costo total calculado es significativamente inferior al de sus competidores, equivalente solo a aproximadamente 1/105 del Claude Fable 5 de Anthropic. DeepSeek está preparando su IPO, y sus ingresos anuales recurrentes por servicios en la nube API ya alcanzan entre 400 y 500 millones de dólares, con un margen bruto superior al 50%. La competencia en la industria de la IA está pasando de la rendimiento del modelo a la batalla por los costos de inferencia y la eficiencia comercial, lo que promete una reducción de orden de magnitud en el costo marginal para las empresas que implementan aplicaciones de IA.Autor del artículo, fuente: Wall Street Journal
DeepSeek lanza su último modelo V4-Flash, llevando nuevamente la competencia de costos de los modelos de IA al primer plano.
El último cálculo de la institución de investigación Artificial Analysis muestra que el costo promedio por tarea completada de V4-Flash es de solo aproximadamente 3 centavos de dólar, el más bajo entre los modelos grandes principales actuales del mundo, equivalente a solo aproximadamente 1/105 del costo de Claude Fable 5 de Anthropic. Esto significa que, en muchas tareas generales, el costo marginal para las empresas al implementar aplicaciones de IA podría seguir disminuyendo, y vuelve a generar el debate del mercado sobre la rentabilidad de los enormes gastos de capital en IA.
Es importante destacar que el lanzamiento de V4-Flash coincide con la aceleración del proceso de comercialización de DeepSeek. Según informes citando fuentes informadas, DeepSeek está preparando una posible IPO. Sus ingresos anuales recurrentes (ARR) generados a través del servicio en la nube de API de modelos de IA ya alcanzan entre 400 millones y 500 millones de dólares, con un margen bruto superior al 50%.
V4-Flash continúa la estrategia一贯 de la empresa de bajo costo y alta eficiencia, reforzando aún más su enfoque competitivo basado en precios y eficiencia.
V4-Flash: Solo 3 centavos de dólar por tarea, el mejor rendimiento de costo entre los modelos principales globales
Según los datos de Artificial Analysis, el precio de V4-Flash es de $0.14 por millón de tokens de entrada y $0.28 por millón de tokens de salida.
Sin embargo, la institución señala que, en comparación con el precio simplemente listado, el "costo por tarea completada (Cost per Task)" refleja mejor el costo real de uso del modelo. Este indicador considera integralmente el total de tokens de entrada y salida consumidos por el modelo al completar la misma tarea, por lo que es más relevante.
Según este cálculo, el costo promedio por tarea de V4-Flash es de aproximadamente 3 centavos de dólar, el más bajo entre los modelos principales a nivel mundial.
Para comparación, Moonshot AI's Kimi K3 cuesta aproximadamente 86 centavos de dólar, OpenAI GPT-5.6 Sol cuesta aproximadamente 1.86 dólares, y Anthropic Claude Fable 5 cuesta aproximadamente 3.15 dólares. El costo de V4-Flash es solo aproximadamente 1/105 del de estos últimos.
Artificial Analysis enfatiza aún más que, si un modelo con un precio por token unitario bajo requiere generar más contenido o atravesar más pasos de interacción durante la ejecución de tareas, su costo final de uso puede ser superior al de un modelo con precio más alto pero mayor eficiencia. Por lo tanto, el "costo por tarea completada" refleja con mayor precisión la relación calidad-precio del modelo que un solo indicador de precio.
Salida a bajo precio: la competencia en IA pasa de "competir por rendimiento" a "competir por relación calidad-precio"
En comparación con el rendimiento, la ventaja de costos de V4-Flash es lo que más ha atraído la atención del mercado en esta ocasión.
Durante el último año, el foco de la competencia en la industria de la IA ha pasado gradualmente de la capacidad del modelo a los costos de inferencia y la eficiencia comercial. A medida que la escala de las aplicaciones de IA empresarial sigue creciendo, los costos de operación del modelo se han convertido en un factor importante en las decisiones de compra.
Cuando un modelo puede completar una tarea por aproximadamente 3 centavos de dólar, mientras que algunos modelos de gama alta tienen un costo de varios dólares, el costo total de uso para empresas al implementar escenarios de alta frecuencia como atención al cliente, automatización de oficina y asistencia en código puede disminuir en órdenes de magnitud.
Esto vuelve a tocar el tema que sigue preocupando a Wall Street: ¿podrán las enormes inversiones en IA generar finalmente retornos comerciales suficientes?
A principios de 2025, tras el lanzamiento del modelo R1 de DeepSeek, el mercado reevaluó temporalmente la necesidad de invertir en infraestructura de IA global, provocando fuertes volatilidades en las acciones tecnológicas. Hoy, V4-Flash vuelve a destacar su costo de operación extremadamente bajo como principal ventaja, lo que significa que la competencia en la industria de la IA está pasando de "¿qué modelo es más potente?" a "¿quién puede ofrecer capacidades suficientemente buenas a menor costo?". La discusión sobre el retorno de la inversión en IA podría volver a intensificarse.
