Pagkatapos ng paglulunsad ng DeepSeek V4 Flash, naging numero uno sa bilang ng mga pagtawag sa platform na OpenRouter, at ang mga developer sa buong mundo ay nagmigrasyon sa malaking antas patungo sa mga Chinese AI model. Ang araw-araw na paggamit sa mga platform tulad ng OpenCode ay tumataas ng 30%, at bumaba ang buwanang gastos sa inference ng 60% hanggang 85% para sa mga海外 AI startup pagkatapos ng migrasyon. Ang kabuuang bilang ng mga pagtawag sa mga lokal na model ay patuloy na lumampas sa kabuuang bilang ng mga sariling model ng mga American vendor sa maraming linggo, at ang mga developer mula sa Amerika at Europa ay bumubuo ng halos kalahati. Ang global na pagbabago sa malalaking model na dulot ng value-for-money ay nagpapabagsak sa matagal nang dominasyon ng pricing power ng Silicon Valley.May-akda ng artikulo, pinagkunan: Phoenix News Technology
Buod: Matagal nang pinamumunuan ng mga kumpanya mula sa Silicon Valley ang pagtukoy ng presyo sa pandaigdigang merkado ng malalaking modelo. Ang DeepSeek, sa pamamagitan ng kanyang double advantage sa performance at presyo, ay naglikha ng presyur sa merkado ng mga developer sa labas ng bansa.
Nakakatanggap ng malaking pagmamahal sa social media ang isang AI comic art sa loob ng ilang araw, kung saan ang karakter, bagaman si Liang Wenheng, ay binigyan ng comic-style na pagpapakita, lalo na sa anyo na katulad ng mga karakter tulad ng Superman. Ito ay pinagtatalunan ng mga netizen bilang ang imahe ni Liang Wenheng sa pananaw ng mga developer sa labas ng bansa.
Nais ipakita ng komiks na noong nakaraang weekend (Hulyo 31), matapos ma-launch ang opisyal na bersyon ng DeepSeek V4 Flash, nagbago nang may ekstremong halaga ang paggamit ng AI ng mga developer sa buong mundo.
Ang海外独立大模型评测社区Artificial analysis, pagkatapos makasagawa ng pagsusuri sa higit sa isang daan na malalaking modelo, ay unti-unting nagembulo ng isang tsart, kung saan ang DeepSeek-V4-Flash ay naging isang hangganan sa tsart.

Ang pinakabagong lingguhang estadistika ng OpenRouter ay nagpapakita na ang DeepSeek-V4-Flash ay nasa unang lugar sa bilang ng mga pagtawag sa modelo, habang ang V4-Pro ay nananatili sa top lima, at patuloy na nagmamigrasyon ang mga developer sa buong mundo ng malaking dami ng traffic sa pagpapatakbo sa mga interface ng modelo ng Chinese AI company na ito.
Si Jay (Jaya Kumar), CEO ng OpenCode, ay nag-post din noong Agosto 1 na tumataas ang paggamit ng 30% araw-araw pagkatapos ng paglunsad ng DeepSeek V4 Flash, at tumataas din ang mga bagong subscriber ng OpenCode Go ng 30%.
Mahigit isang mahabang panahon, ang mga alituntunin sa pandaigdigang merkado ng malalaking modelo ay isinulat ng mga malalaking kumpanya sa Silicon Valley. Ang OpenAI, Anthropic, at Google ang nagtatakda ng mga pamantayan sa performance, habang pinanatili nila ang kontrol sa pagtatakda ng presyo; ang mataas na gastos sa pagpapatakbo ay nagtatayo ng mataas na hadlang para sa mga startup sa AI. Para sa mga developer sa ibang bansa na naghahanap ng matatag at mataas na kalidad na serbisyo sa malalaking modelo, tila walang choice kundi tanggapin ang mga tawag mula sa mga saradong kumpanya.
Ngayon ay dumating ang hindi maaaring balikan na punto ng pagbabago sa industriya. Sa pamamagitan ng patuloy na pagpapabuti ng kakayahan ng modelo at ekstremong pinababawas na presyo ng cloud API, ang DeepSeek ay nagtatayo ng malinaw na “kill line” sa pandaigdigang merkado ng mga developer.
DeepSeek V4 Flash ay bumalik sa numero uno, ang mga malaking modelo ng China ay nakuha ang limang pinakamataas
Ang tinatawag na "kill line" ay hindi lamang tumutukoy sa isang hangganan sa performance, kundi sa kritikal na punto kung saan nagkakasundo ang performance at presyo: ang mga modelo na may mas mataas na presyo kaysa kay DeepSeek sa parehong antas ng kakayahan ay magkakaroon ng patuloy na pagkawala ng mga maliit at katamtamang developer; habang ang mga produkto na mas mahina ang performance kaysa kay DeepSeek ngunit mas mataas ang gastos ay magkakaroon ng mabilis na pagbabawas sa kanilang espasyo sa pamilihan.
Ang pinakabagong datos sa pagtawag ng OpenRouter sa public token para sa pagsusuri ay nagpapakita na ang DeepSeek-V4-Flash ay nakuha ang unang lugar sa bilang ng pagtawag sa isang modelo, habang ang pangalawa hanggang ikalimang lugar ay kinabibilangan ng Xiaomi MiMo-V2.5, Tencent Hy3, DeepSeek V4 Pro, at Zhipu GLM5.2. Kapag isinama ang kabuuang dami ng pagtawag sa lahat ng lokal na modelo, ito ay patuloy na lumampas sa kabuuang pagtawag sa mga saradong modelo ng mga Amerikanong kumpanya. Sa mga pagbisita, ang mga developer mula sa Estados Unidos at Europa ay bumubuo ng halos kalahati, at maraming automated Agent projects, mga tool para sa pagtutulong sa code, at mga aplikasyon para sa pagproseso ng mahabang teksto ay aktibong nagpapalit ng default model sa DeepSeek.

Sa kabaligtaran, ang pagtaas ng paggamit sa pangunahing bersyon ng Claude at sa flagship model ng Gemini ay patuloy na bumababa, habang ang bahagi ng merkado ng mga tradisyonal na lider na saradong modelo sa panlabas ay patuloy na bumababa. Ilang mga founder ng AI startup sa panlabas ay nagbigay ng pagsusuri sa platform na X: Pagkatapos makapag-migrate ang kanilang team patungo sa DeepSeek, bumaba ang kanilang buwanang gastos sa inference ng 60% hanggang 85%. Para sa mga maliit na kompanya ng AI na hindi pa nakakakita ng kita at may limitadong cash flow, ang malaking pagkakaiba sa gastos na ito ay sapat upang matukoy kung makakapagpatuloy ang proyekto.
Dumadivide ang merkado sa dalawang grupo: ang mga malalaking multinational na korporasyon, dahil sa pagpapahalaga sa pagkakasunod sa datos at panganib sa supply chain, ay patuloy na umaasal sa mga serbisyo ng lokal na tagapagbigay tulad ng OpenAI at Google; ngunit ang mas maluwag at napakasensitibo sa gastos na grupo ng maliit at katamtamang developer, ay nagsimulang magdagdag ng malawakang paglipat.
Sa tingin ng maraming obserbador ng industriya, ang datos ng OpenRouter ay nagbukas ng isang layer ng industriya: noong nakaraan, maraming koponan ay pumili ng mga modelo mula sa mga malalaking kumpanya sa Silicon Valley, hindi dahil naniniwala sila na ang kanilang performance ay hindi maaaring palitan, kundi dahil sa matagal nang kakulangan ng mga alternatibong opsyon na may sapat na value for money. Kapag lumabas ang mga mura ngunit may kakayahan sa unang antas na mga modelo, agad na umiikot ang pagpili sa demand side.
Totoo na may natural na hangganan ang data ng mga third-party aggregation platform. Ang dami ng traffic ay hindi katumbas ng kita ng isang kumpanya, dahil ang malaking bahagi ng pagtawag ay nakatuon sa mga mura at lightweight na bersyon ng Flash; samantala, ang sample ng platform ay hindi nakakatawag sa merkado ng malalaking kliyente sa gobyerno at negosyo. Ngunit hindi maikakaila na ang komunidad ng mga developer ay ang pinagmulan ng inobasyon sa industriya ng AI—kung makakadaku ka sa mga developer, ikaw ang makakadaku sa pundasyon ng hinaharap na ecosystem ng aplikasyon.
Patuloy na ang hari ng value for money
Sa araw ng paglalabas ng DeepSeek V4 Flash, sinubukan ng Artificial analysis ang 128 malalaking modelo. Mula rito, nagmula ang terminong “斩杀线” (斩杀线); ang mga developer ay karaniwang naniniwala na ang simpleng mababang presyo ay walang kompetisyon, at ang simpleng mataas na performance ay mahirap linisin ang umiiral na merkado; ang tanging paraan upang patuloy na magdulot ng presyur sa mga kalaban ay kung ang modelo ay makakamit ng performance na katumbas ng top-tier, samantalang ang presyo ay may malaking pagkakaiba.
Ang pagsusuri sa pag-unlad ng pricing strategy ng DeepSeek ay nagpapakita nang malinaw kung paano ito nagtatayo ng mga hadlang sa presyo. Noong Mayo 2026, ang DeepSeek-V4-Pro ay inanunsyo ang permanenteng pagbaba ng presyo ng 75%, na nagpapalit sa maikling promosyon sa isang matatag na pangmatagalang pricing benchmark, na bumabagsak sa pinakamababang presyo ng mga premium inference model sa buong mundo; pagkatapos ay ipinakilala ang V4-Flash, na kasama ang mekanismo ng conversation caching at ang stratihya ng iba’t ibang presyo batay sa peak at off-peak, na nagpapababa pa ng gastos sa input Token sa mga sitwasyon kung де кеш ay nakakamit.
Ang komparasyon sa pahalang ng mga presyo ng open cloud API ng mga pangunahing malalaking modelo (bawat milyong token, sa dolyar): ang presyo ng output ng DeepSeek V4-Flash ay $0.28 / milyong token; kahit na pagkatapos ng maraming pagbabago sa presyo, ang output pricing ng GPT-5.6 Luna ay humigit-kumulang $1.20 / milyong token. Ang Claude Sonnet at Gemini, bilang mga flagship model sa parehong antas, ay may mas mataas na presyo—maraming beses o halos sampung beses ang presyo ng DeepSeek.
Ang mga datos na ito ay nagdulot ng pagkakasundo sa mga developer sa abroad: ang karamihan sa mga negosyong nakatuon sa C-end at maliit na B-end ay walang komersyal na kakayahang mag-ambag ng maliliit na pagpapabuti sa performance habang naghihintay ng sampung beses na mas mataas na gastos sa pagpapatakbo. Ang anumang kalaban na nasa “linya ng pagkakasawi” na ito ay may dalawang pagpipilian lamang: aktibong bawasan ang presyo nang malaki, o buong-buo nang tumigil sa pagtutok sa merkado ng mga developer na pangkalahatan at mag-focus sa mga mataas na klaseng kliyente na may sapat na budget at nagtataglay ng malakas na supply chain.
Sa harap ng patuloy na paghahati-hati ng trapiko, inabot ng OpenAI ang presyo ng mga modelo sa GPT; binago ng European vendor na Mistral ang kanilang komersyalisasyon na plano, gumagamit ng libreng open-source na estratehiya kasama ang mga diskwento sa cloud upang panatilihin ang kanilang base ng mga developer; at sa pagkakataong ito, pinilit ng maraming maliliit at katamtamang serbisyong open-source na muling kalkulahin ang kanilang gastos at tumigil sa pangarap na kumita sa mataas na margin ng API.
Mas mahalaga pa, matagal nang kilala ng industriya ang DeepSeek dahil sa kanyang mababang presyo. Hindi ito nagpapatakbo ng patakaran sa subsidy sa pamamagitan ng pakikidigma sa presyo, kundi sa pamamagitan ng patuloy na inhenyeriya sa ilalim, tulad ng epektibong arkitektura sa pag-iisip, dinamikong KV cache, pag-schedule sa mga tuktok at talon ng trapiko, at mga solusyon para sa pagpapabuti ng mahabang teksto upang bawasan ang gastos sa bawat Token na pag-iisip. Sinabi ni Liang Wenhong sa loob na ang patakaran sa mababang presyo ay nagpapahintulot sa higit pang mga developer na gamitin ang DeepSeek, at ito ay nagsisilbing inspirasyon sa loob.
Ang pagkakaroon ng break-even point sa value-for-money ay nagdudulot ng bagong industriyal na tanong: ang pangunahing pamantayan sa kompetisyon ng malalaking modelo ay nagpapalit. Noon, ang industriya ay nagkakaroon ng kompetisyon sa bilang ng parameter, computing power sa pagtatrabaho, at pagsusuri sa Benchmark; ngayon, ang unang indikador na sinusuri ng mga developer ay kung gaano karaming epektibong output ang maaaring makakuha sa bawat yunit ng gastos.
48 na oras na nagpapagulo sa social media
Ang datos tungkol sa performance at presyo ay nagtatapos sa totoong reputasyon ng komunidad. Ang X, ang Reddit r/LocalLLaMA, ang HackerNews, at ang LMSYS Arena ay ang pangunahing mga battlefield ng opinyon sa abroad, kung saan ang maraming direktang developer at AI na mga entrepreneur sa X ay patuloy na nagpapalabas ng mga real-world test results, na nagpapalakas sa pagtaas ng populär na DeepSeek, na nagpapakita ng malinaw na paghahati-hati ng opinyon.
Kasi, isang araw bago ang opisyal na paglalabas ng DeepSeek V4 Flash, inanunsyo ng OpenAI ang pagbaba ng 80% sa presyo ng API ng GPT5.6 Luna. Sa susunod na araw, may nag-post ng screenshot ng DeepSeek sa komento, at may nagsalita ng pasasalamat sa mga malalaking model ng China, sinasabing dahil sa mga malalaking model ng China, natakot ang OpenAI, na nakakatulong sa mga developer.
Mayroon din maraming indibidwal na developer na nagpapahayag ng kanilang pagmamahal sa DeepSeek, hindi lamang dahil sa mataas na halaga kundi pati na rin dahil sa mabilis na response time at magandang user experience na “smooth”.
May kaunting pagkakaiba-iba sa mga opinyon ng mga analista mula sa Wall Street. Ang mga optimista ay naniniwala na ang presyong kompetisyon na itinatag ng DeepSeek ay nagpapabilis sa pagpapatupad ng AI at nagbabawas sa mga hadlang sa pag-inovate sa buong mundo; samantalang ang mga pesimista ay nag-aalala na ang patuloy na digmaan sa presyo ay magpapaliit sa kita ng buong industriya at magpapahina sa pondo para sa matagalang pagpapalawak ng pag-aaral ng mga modelo.
Ang hangganan ng halaga na tinukoy ng DeepSeek ay nagpapakita ng direktang pagkakasalubong ng dalawang landas sa pag-unlad ng mga malalaking modelo sa buong mundo.
Isang landas ay kinakatawan ng mga malalaking kumpanya sa Silicon Valley: malaking pondo para sa pag-train ng sariling flagship model, pagpapanatili ng mataas na margin, pagtutok sa mga malalaking kumpanya bilang customer, pagkuha ng kita sa pamamagitan ng mga mataas na halagang ToB order, at pagpaprioritize ang pagpapataas sa limitasyon ng kakayahan, na may mas mabagal na reaksyon sa pagbabago sa presyo para sa mas makabuluhang developer market. Ang isa pang landas ay kinakatawan ng DeepSeek: paggamit ng engineering optimization upang bawasan ang gastos sa inference, pagpapahalaga sa open-source ecosystem at cloud services, pagpapatakbo sa modelo ng maliit na margin ngunit malaking volume, pagpaprioritize ang pagkuha sa developer community, pagpapalawak ng gastos sa pamamagitan ng scale effect, at pagpapabilis ng paglago sa global market share sa pamamagitan ng value for money.
Walang tiyak na tama o mali sa dalawang landas, ngunit ang pag-usbong ng DeepSeek ay patotoo sa isang pangunahing katotohanan: ang pakikilaban sa malalaking modelo ay hindi na lamang tumutok sa pagpapalaki ng gastos. Ang pagpapakilala ng computing power ay simpleng pundasyon; ang efficiency sa pagpapaliwanag, ang pagtatakda ng presyo para sa komersyalisasyon, at ang estratehiya sa ekosistema ay maaari ring baguhin ang bahagi ng merkado.
Hindi pa tapos ang global na pagbabago sa malalaking modelo na sinimulan ng halaga. Ang pagtatalo sa presyo ay tanging pagsisimula; ang matagal na pagtatalo sa pagpapabuti ng kakayahan ng modelo, serbisyo sa global na antas, mga solusyong pagsunod sa batas, at mga modelo ng pagkakaroon ng kita ang magdedesisyon kung sino ang makakapagtatag ng sarili. Noong Lunes (Agosto 3), inilabas nang bukas ni MiniMax ang pangkalahatang video model na H3, na may layuning muling isulat ang epekto ni DeepSeek sa larangan ng multimodal; sa parehong araw, inilunsad din ng Alibaba ang Qwen3.8-Max na malaking modelo, na may kabuuang 2.4 trilyon na parameter—ang pinakamalakas na modelo sa pamilya ng Qwen hanggang ngayon. Ang mga timbang ng modelo ay bubuksan nang bukas susunod na linggo.
Para sa mga milyon-milyong AI developer sa buong mundo, ang pinakamadaling makita ay nangyari na: mas maraming pagpipilian, bumababa ang gastos, at bumababa ang hadlang sa pag-inovate.
