Na noite de terça-feira desta semana, DeepSeek A plataforma aberta anunciou que planeja ajustar novamente os preços da API de grandes modelos, com este novo ajuste sendo uma redução bem-vinda.

Preços em horário de baixa: entrada (cache hit) 0,02 yuan, entrada (cache miss) 1 yuan, saída 4 yuan (unidades: yuan / milhão de tokens). Preços em horário de pico permanecem o dobro dos horários de baixa: cache hit 0,04 yuan, cache miss 2 yuan, saída 8 yuan.

Este ajuste afeta apenas a série V4-Flash; os preços da V4-Pro, de posicionamento mais alto, permanecem inalterados. Os novos preços entrarão em vigor em 10 de setembro, às 12:00 (horário de Pequim).
A oficial também esclareceu que os horários de pico são das 9:00 às 12:00 e das 14:00 às 18:00, de segunda a sexta-feira, horário de Pequim; o restante é considerado horário de baixa.
Anteriormente, DeepSeek O aumento desencadeou ampla discussão. A explicação oficial foi que visa alocar recursos de forma mais razoável e incentivar os usuários a ajustarem os horários de execução das tarefas. O público em geral acredita que é DeepSeek V4 Flash 0731 tem excelente custo-benefício, atraindo um grande número de chamadas de usuários globais, e DeepSeek Computational power insufficient.
Em comparação vertical, antes do aumento de preço em 17 de agosto à meia-noite, o Flash tinha preço único de 0,02 yuan (acerto no cache) / 1 yuan (falha) / 2 yuan (saída). Inclua agora os novos preços:

Ou seja, os dois preços do lado de entrada retornaram aos níveis anteriores ao aumento, enquanto a saída permaneceu duas vezes maior. Se compararmos as diferenças com base nos horários de pico, a discrepância é ainda maior: o novo preço de pico é de 0,04 / 2 / 8 yuan, em comparação com os níveis anteriores ao aumento de 0,02 / 1 / 2 yuan, representando respectivamente 2 vezes, 2 vezes e 4 vezes.
Portanto, se os usuários realmente podem retornar ao estado anterior de “usar livremente” depende de três variáveis em suas aplicações: taxa de acerto de cache, proporção de entrada/saída e o grau de deslocamento possível das tarefas. Em cenários com alta taxa de acerto de cache, como contextos longos, prompts de sistema fixos e chamadas cíclicas de Agent, a redução será significativa; já em cenários focados principalmente na geração de saídas, a percepção será limitada. Como é bem conhecido DeepSeek A taxa de acerto do cache da API é relativamente alta, por isso as reações atuais das pessoas são bastante otimistas.
Este降价 não é um evento isolado; ontem à tarde, DeepSeek Anunciado no grupo oficial de comunicação: a versão intermediária V4.1 Flash está em teste interno: o nome do modelo é deepseek-v4.1-flash-expires-on-0910, a base_url permanece inalterada, limite de 20 concorrências por conta, e a cobrança permanece igual à da V4 Flash.
Além do multimodal nativo e da velocidade de inferência extremamente rápida, a equipe oficial também afirmou que a atualização da arquitetura reduziu os custos. Isso demonstra que, por meio da otimização de engenharia e tecnologia do próprio modelo grande, DeepSeek Temos estado sempre tentando melhorar o problema do custo de inferência.
O nome do modelo "expires-on-0910" indica que o novo modelo será automaticamente expirado e desativado em 10 de setembro — o mesmo dia em que o desconto entrará em vigor.
Este mês, empresas de ponta em IA atualizaram seus grandes modelos. DeepSeek Se a versão oficial V4.1 puder trazer um salto significativo de capacidade, combinado com este redução de preço, talvez possamos ter mais um grande impulso.
Este artigo é do canal oficial do WeChat "Machine Heart" (ID: almosthuman2014), autor: Machine Heart focada em grandes modelos, edição: Equipe de edição da Machine Heart
