Kamakalawa lang ng DeepSeek ang digmaan sa presyo ng AI para sa lahat ng iba sa mesa. Ipinakilala ng startup na base sa Hangzhou ang kanyang V4.1 Flash model noong Setyembre 10, ipinakilala ang isang sistema na may 552 bilyong parameter na nagpapangako na lalampas sa mga pangunahing kalaban habang mas mababa ang gastos sa pagpapatakbo.
Sinabi ng agad-agad na reaksyon ng merkado ang kuwento bago makita ang anumang benchmark chart. Bumaba ng higit sa 8% ang mga bahagi ng mga kompetidor sa AI sa Tsina na MiniMax at Z.ai pagkatapos ng pahayag, habang bumaba nang higit sa 2% ang stock ng Alibaba.
Ano ang nagiging iba sa V4.1 Flash
Gumagamit ang modelo ng arkitekturang mixture-of-experts, na isang magandang paraan ng pagsasabi na ito ay nagpapagana lamang ng isang maliit na bahagi ng kabuuang mga parameter nito para sa anumang ibinigay na gawain. Ang resulta ay mataas na performance nang walang computational overhead ng pagpapagana ng lahat ng neurons nang sabay-sabay.
Ginawa ng DeepSeek ang V4.1 Flash na may native na multimodal na kakayahan, ibig sabihin ay nakakahandle ito ng teksto, imahe, at iba pang uri ng data nang direkta. Lalo itong pinabuting ng kumpanya para sa mga gawain sa coding at sa mga proseso na tinatawag ng industriya bilang “agentic”, kung saan ang mga sistema ng AI ay nagpaplano at nagpapatupad nang awtomatiko ng mga multi-step na proseso.
Ang mga claim sa performance ay nakakatangi, ngunit ang pricing ang lugar kung saan naging tunay na disruptive ang bagay. Ang mga nakaraang model ng DeepSeek ay may presyo na halos $0.14 bawat milyong input tokens at $0.28 para sa output tokens. Ang mga nakaraang model ng DeepSeek tulad ng V4-Flash ay natuklasang mas mura ng higit sa 100 beses na i-run kaysa sa mga katumbas na alternatibo, na may average na halos 3 sent bawat pagsubok kumpara sa $3.15 para sa Anthropic’s Claude Fable 5.
Inaasahan na mas magiging mas mabuting performa ng V4.1 Flash kaysa sa Moonshot’s Kimi K3 sa mas malaking mababang presyo.
Isang pattern ng kalkuladong pagkakainggit
Ang V3 model ng kumpanya ay tinuruan sa 2,000 Nvidia H800 GPUs sa isang inaprubahang gastos ng $5.6 milyon. Para magkaroon ng pananaw, ang mga namumunong AI lab sa US ay nag-spent ng mga hundreds ng milyon, minsan ay bilyon, para turuan ang kanilang pangunahing mga model.
Noong 2025, ang estratehiya ni DeepSeek na pagsuporta sa mababang gastos sa inference at mga modelo na may bukas na pag-access ay nag-trigger ng malalaking pagbaba ng presyo sa buong sektor ng teknolohiya. Ang mas malawak na implikasyon ay mahirap kalimutan: ang ecosystem ng AI ng China ay nagpapalabas ng mga modelo na may kalidad na pandaigdigang antas, kahit na gumagana sa ilalim ng mga pagbabawal sa pag-export ng chip mula sa US.
Ano ang ibig sabihin nito para sa merkado ng AI
Ang mga reaksyon ng stock market sa paglunsad ng V4.1 Flash ay nagpapakita na seriyoso ng mga investor ang banta. Ang pagbaba ng higit sa 8% sa MiniMax at Z.ai ay nagpapakita ng tunay na pag-aalala na ang pricing strategy ng DeepSeek ay maaaring magbawas ng margin sa buong sektor ng AI sa China. Kahit ang Alibaba, na may mas malawak na diversipikadong negosyo, ay nadama ang pagkabigla.
Ang mga ulat na handa na si DeepSeek para sa IPO sa STAR Market ng Shanghai ay nagdaragdag ng isa pang dimensyon sa larawan. Ang isang pampublikong listing ay magbibigay sa kumpanya ng access sa malaking kapital habang nagbibigay ng benchmark sa valuation na maaaring paayusin pa ang paraan kung paano isipin ng mga investor ang sektor ng AI.
