O último modelo de IA da DeepSeek é o mais barato para operar entre os modelos conhecidos. A diferença de custo não é marginal.
Os números que assustaram Wall Street
O modelo R1 da DeepSeek, lançado em janeiro de 2025, opera a aproximadamente US$ 0,14 por milhão de tokens. Para contexto, a oferta comparável da OpenAI estava precificada em US$ 7,50 por milhão de tokens na época. Isso representa uma redução de custo de 98%.
O modelo V4-Pro mais recente, lançado em abril de 2026, custa $0,87 por milhão de tokens para saída e $0,435 para entrada. Esses valores representam uma redução de 34x em comparação com principais concorrentes. A empresa fixou permanentemente esses preços desde o final de maio de 2026.
Há também a variante V4-Flash, voltada para cargas de trabalho com orçamento limitado, por cerca de US$ 0,14 por milhão de tokens. Isso é afirmado como 35 vezes mais barato que alternativas ao GPT-5.5. Análises de terceiros confirmaram que os modelos DeepSeek operam, em geral, de 20 a 50 vezes mais baratos que os principais modelos fechados.
O V4-Pro Max está na extremidade premium da linha da DeepSeek, com um preço combinado de aproximadamente US$ 2,17 por milhão de tokens, confirmado por múltiplos fornecedores de benchmarking.
Os benchmarks de desempenho do V4-Pro competem com o Claude Opus 4.6 e o GPT-5.5, dois dos modelos mais capazes do mercado.
Como eles conseguiram
DeepSeek utiliza uma abordagem Mixture-of-Experts (MoE). Em vez de ativar todos os parâmetros do modelo para cada consulta, as arquiteturas MoE encaminham cada solicitação apenas para o subconjunto mais relevante da expertise do modelo. Isso significa menos computação por consulta, o que resulta em custos mais baixos por consulta.
O modelo anterior V3 do DeepSeek supostamente custou US$ 5,576 milhões em aluguel de GPUs para treinamento, em comparação com centenas de milhões (e às vezes bilhões) que laboratórios baseados nos EUA têm gastado em sessões de treinamento.
O modelo também é totalmente de código aberto sob a licença MIT, o que significa que qualquer pessoa pode implantá-lo, modificá-lo ou construir sobre ele sem pagar taxas de licenciamento.
Por que a criptomoeda e os mercados mais amplos devem se importar
O impacto de mercado mais imediato foi sentido em janeiro de 2025, quando as ações da Nvidia experimentaram quedas notáveis à medida que os investidores reajustaram suas expectativas sobre a demanda futura por hardware de computação de alto desempenho.
Para o setor de cripto especificamente, projetos de IA descentralizados historicamente enfrentaram limitações devido aos custos econômicos de inferência. Quando executar um modelo custa US$ 7,50 por milhão de tokens, redes de computação descentralizadas têm dificuldade para competir com provedores de nuvem centralizados. A US$ 0,14 por milhão de tokens, a equação muda drasticamente.
Redes DePIN focadas em computação GPU, como Render, Akash e io.net, podem ver suas propostas de valor mudarem. A IA mais barata reduz o premium que os usuários pagarão por computação, enquanto expande o mercado total endereçável, tornando aplicações baseadas em IA viáveis para uma gama muito mais ampla de casos de uso.

