A DeepSeek lançou o novo modelo V4-Flash, com custo por tarefa de apenas cerca de 3 centavos de dólar, o mais baixo entre os principais modelos globais. O V4-Flash é precificado em US$ 0,14 por milhão de tokens de entrada e US$ 0,28 por milhão de tokens de saída, com custo total estimado significativamente inferior ao dos concorrentes, equivalente a aproximadamente 1/105 do Anthropic Claude Fable 5. A DeepSeek está se preparando para um IPO, e sua receita anual recorrente proveniente dos serviços de API em nuvem já atingiu US$ 400 milhões a US$ 500 milhões, com margem bruta superior a 50%. A competição no setor de IA está passando de desempenho de modelos para disputa por custos de inferência e eficiência comercial, com perspectiva de redução em ordens de grandeza no custo marginal para empresas implementarem aplicações de IA.Autor e fonte do artigo: Wall Street Journal
DeepSeek lança o novo modelo V4-Flash, trazendo novamente à tona a competição de custos em modelos de IA.
A最近的研究 por Artificial Analysis mostra que o custo médio por tarefa concluída do V4-Flash é de apenas cerca de 3 centavos de dólar, o mais baixo entre os principais modelos grandes globais atuais, equivalente a aproximadamente 1/105 do Claude Fable 5 da Anthropic. Isso significa que, em muitas tarefas gerais, o custo marginal para empresas implantarem aplicações de IA pode diminuir ainda mais, reacendendo novamente o debate do mercado sobre a rentabilidade dos enormes gastos de capital em IA.
É importante notar que o lançamento do V4-Flash ocorre justamente quando o processo de comercialização da DeepSeek está acelerando. Segundo relatos citando fontes informadas, a DeepSeek está se preparando para uma possível IPO. Sua receita anual recorrente (ARR) proveniente de serviços em nuvem de API de modelos de IA já atingiu entre 400 milhões e 500 milhões de dólares, com margem bruta superior a 50%.
O V4-Flash lançado nesta ocasião continua a abordagem tradicional da empresa de baixo custo e alta eficiência, reforçando ainda mais sua estratégia de competição de mercado impulsionada por preço e eficiência.
V4-Flash: custo por tarefa de apenas 3 centavos de dólar, liderando em custo-benefício entre os principais modelos globais
De acordo com os dados da Artificial Analysis, o V4-Flash é precificado em US$ 0,14 por milhão de tokens de entrada e US$ 0,28 por milhão de tokens de saída.
No entanto, a instituição destacou que, em comparação com o preço simples, o "Custo por Tarefa" reflete melhor o custo real de uso do modelo. Esse indicador considera o total de tokens de entrada e saída consumidos pelo modelo ao concluir uma mesma tarefa, tornando-se mais relevante como referência.
Segundo esse cálculo, o custo médio por tarefa do V4-Flash é de aproximadamente 3 centavos de dólar, o mais baixo entre os principais modelos globais.
Para comparação, o Moonshot AI Kimi K3 custa cerca de 86 centavos de dólar, o OpenAI GPT-5.6 Sol cerca de 1,86 dólares e o Anthropic Claude Fable 5 cerca de 3,15 dólares. O custo do V4-Flash é apenas cerca de 1/105 do último.
A Artificial Analysis enfatiza ainda mais que modelos com preço unitário de token mais baixo podem, em última análise, ter custos de uso superiores a modelos com preços mais altos, mas maior eficiência, caso exijam a geração de mais conteúdo ou mais etapas de interação durante a execução da tarefa. Portanto, o "custo por tarefa concluída" é um indicador mais preciso do valor do modelo do que um único preço unitário.
Saída de baixo custo: a competição em IA passa de "competir por desempenho" para "competir por custo-benefício"
Em comparação com o desempenho, a principal atenção do mercado para o V4-Flash é sua vantagem de custo.
No último ano, o foco da competição no setor de IA passou gradualmente da capacidade dos modelos para os custos de inferência e eficiência comercial. À medida que a escala das aplicações de IA empresarial continua a crescer, os custos de operação dos modelos estão se tornando um fator importante na tomada de decisões de aquisição.
Quando um modelo pode realizar uma tarefa por cerca de 3 centavos de dólar, enquanto alguns modelos de alto desempenho custam vários dólares, o custo total de uso para empresas ao implantar cenários de alta frequência, como atendimento ao cliente, automação de escritório e auxílio em código, pode diminuir em uma ordem de grandeza.
Isso também toca novamente na questão que continua a atrair a atenção de Wall Street: se os enormes investimentos em IA finalmente poderão gerar retornos comerciais suficientes.
No início de 2025, após o DeepSeek lançar o modelo R1, o mercado reavaliou temporariamente a necessidade de investimentos em infraestrutura de IA global, provocando forte volatilidade nas ações de tecnologia. Hoje, o V4-Flash novamente apresenta custos operacionais extremamente baixos como principal diferencial, indicando que a competição no setor de IA está avançando da pergunta "qual modelo é mais poderoso" para "quem consegue fornecer capacidade suficientemente boa com menor custo", o que pode reacender o debate sobre o retorno sobre o investimento em IA.
