Hindi ang model score ang tunay na pagpapakita, kundi ang direksyon na pinili ni Yang Zhilin: open weights + long context + agent cluster—isang daan na magkakaiba sa OpenAI.May-akda ng artikulo, pinagkukunan: 0x9999in1, ME News
Live na Ngayon sa KuCoin ang Midnight (NIGHT)!
TL;DR
- Noong Hulyo 16, 2026, inilabas ng Moonshot ang Kimi K3, na may 2.8 trilyon na parameter at 1,000,000 token na konteksto, at nakakuha ng komprehensibong marka na 57.1 mula sa Artificial Analysis, nasa ika-4 sa buong mundo, lalong higit pa sa Claude Opus 4.8.
- Ang tagapagtatag, Yang ZhiLin, ay 34 taong gulang, nagtapos sa Tsinghua bilang undergraduate at may doktorado mula sa CMU, at ang unang may-akda ng Transformer-XL at XLNet, isa sa kaunting tao na nagsagawa ng kanyang sariling papel bilang produkto.
- Nakumpleto ng Moon Shadow ang kanilang bagong pagsasamantala ng halos $2 bilyon noong Mayo 2026, na nagdulot ng pagtaas ng valuation sa higit sa $20 bilyon—nag-double ang halaga sa loob ng tatlong buwan.
- Sa araw ng pagpapakilala ni K3, bumaba ang Nasdaq ng higit sa 1.4%, at nag-weak ang NVIDIA nang sabay—ang isang pagpapakilala ng isang Chinese startup, una naming tinulungan ang emosyon sa US stock market.
- Ngunit ang K3 ay hindi na "napakababa ang presyo": $3/$15 bawat milyong token, halos tatlong beses ang presyo ng nakaraang K2.6, na nagtuturo ng pagbabago sa panahon ng "mura na AI ng China".
- Ang rate ng hallucination ng K3 ay nasukat ng isang independiyenteng pagtataya na tumaas hanggang 51%, ang output ay mahaba, at ang open weights ay inilatag sa July 27, hindi perpekto ang kuwento.
- Hindi ang model score ang tunay na pagpapakita, kundi ang direksyon na pinili ni Yang Zhilin: open weights + long context + agent cluster—isang daan na magkakaiba sa OpenAI.
Isang drummer, bakit kayang lumikha ng fourth largest model sa mundo?
Una sa kongklusyon. Hindi lang lucky si Yang ZhiLin.
Siya ay isa sa kaunting mga tao na "mula sa teorya hanggang sa produkto".
Transformer-XL, XLNet, dalawang papel, unang may-akda. Hindi ito karaniwang mga papel. Ito ay isa sa mga pundasyon ng lahat ng malalaking modelo ngayon para sa paghahandle ng mahabang sequence.
Maraming nag-isulat ng papel. Kaunti ang nagiging kompanya mula sa mga papel. Ang nagawa ang kompanyang nasa top four sa buong mundo, maaaring bilangin sa isang kamay.
Ipinanganak noong 1992, mula sa Shantou, Guangdong. Baccalaureate sa Department of Computer Science ng Tsinghua University, habang sumusulat ng code, naglalaro rin siya ng drum at sumusulat ng kanta sa campus rock band na Splay. Nakuha ang PhD sa Carnegie Mellon University sa loob ng apat na taon. Nagtrabaho na sa Google Brain at Meta AI, at kasama sa listahan ng kanyang mga kasamahan ang Bengio at ang LeCun.
24 taong gulang, co-founder ng unang AI company. Noong Marso 2023, itinatag ang Moonshot AI.
Ang resume na ito ay isang makabagong halimbawa sa Silicon Valley. Sa China, halos iisa lamang ito.
Bakit ginagawang mahalaga ito?
Sa daan ng malalaking modelo, ang "binasa ko ang lahat ng kaugnay na papel" at "ang mga papel na ito ay aking sinulat" ay dalawang magkakaibang potensyal. Ang una ay ang kurba ng pagkatuto, habang ang pangalawa ay ang unang intuisyon. Kay PANG Zhilin ay ang pangalawa.
Ang Transformer-XL ay naglutas ng problema ng "hindi kayang tandaan ang sobrang habang sequence". Ang XLNet naman ay naglalayong lumampas sa pre-training paradigm ng BERT. Sa panghabaang pagpapatuloy ng dalawang bagay na ito ay ang pinakamalabas na produkto label ng Kimi ngayon: mahabang konteksto.
Mula sa mga 200,000 na salita na ang pangunahing tatak ng early Kimi AI Assistant, patungo sa mga 2,000,000 na salita, at pagkatapos ay direktang 1M token (tungkol sa 1,000,000 na token) sa K3.
Hindi ito isang marketing topic. Ito ay natural na pagpapalawak ng kanyang akademikong karera.
Saan talaga kusang lakas at kahinaan ng Kimi K3?
Tingnan muna ang mga katotohanang datos.
Ipinahayag ng Kimi K3 noong Hulyo 16, 2026. 2.8 trilyon kabuuang parameter, sparse MoE architecture, 16 na eksperto ang aktibado bawat token sa 896 na eksperto. Ang context window ay 1,048,576 na token. Nakakatutok na suporta sa visual.
Independent third-party Artificial Analysis Intelligence Index v4.1 score: 57.1, ranked 4th globally.
Ang mga naka-una sa tatlo ay si Claude Fable 5 (59.9), GPT-5.6 Sol (58.9), at ang Kimi K3, na sinundan nang malapit ni Claude Opus 4.8 (55.7). Sa ibaba, ang Grok 4.5 ay 53.8, ang GLM-5.2 ay 51.1, at ang DeepSeek V4 ay 44.3.
Ito ang unang pagkakataon na ang isang Chinese model ay talagang naka-iskwalipikasyon sa unang tier ng pandaigdigang kompetisyon.
Tingnan ang mga sub-item. GPQA Diamond: 93.5%. Terminal-Bench 2.1: 88.3%, halos katumbas ng 88.8% ng GPT-5.6 Sol. BrowseComp: 91.2%. Sa Frontend Code Arena ng Arena.ai, nakuha ng K3 ang unang pwesto, na nag-over sa Claude Fable 5. Parehong nasa unang pwesto sa AutomationBench-AA, 53%.
Sa independiyenteng marka ng GDPval-AA v2 na sumusukat sa "kaalaman sa aktwal na ekonomikong halaga," tumaas ang Elo ng K3 mula sa 1190 ng nakaraang bersyon na K2.6 patungo sa 1668, na lumampas sa Claude Opus 4.8 na 1600, GLM-5.2 na 1514, at GPT-5.5 na 1494.
Ang jump ay 478 Elo. Sobrang malakas.
Saan naman kahinaan nito?
mataas ang rate ng hallucination. Ipinakita ng Artificial Analysis na ang hallucination rate ng K3 ay 51%, mas mataas kaysa sa nakaraang bersyon. Tumaas ang accuracy, ngunit tumataas din ang "probabilidad ng pagkakasabi ng kalokohan."
Masyadong mahaba. Nag-output ang K3 ng 130 milyong token sa buong AA evaluation, habang ang industry average ay 63 milyon. Dalawang beses. Sinubukan ni Simon Willison ang simpleng SVG task na "draw a goose" at nag-spent ng halos $0.25.
Nakataas ang pagpapalabas ng open weights. Walang checkpoint, walang license, walang model card, at walang teknikal na ulat sa araw ng pagpapalabas. Sinasabing ipapalabas ng Moonshot bago ang July 27—anim na araw mula sa pagkasulat ng artikulong ito. Bago pa man ito, ang K3 ay maaaring gamitin lamang sa pamamagitan ng API at App, at ito ay isang "hosted model" sa本质上.
Walang SWE-bench Pro/Verified score. Ang mga test set na pinili ng Moonshot tulad ng DeepSWE at FrontierSWE ay hindi pa maaaring i-replicate ng mga third party.
Kaya ang K3 ay isang "totoong magandang model, ngunit hindi pa perpekto." Dapat ipaalala ito nang malinaw, at huwag itong ipagpalaki.
Mas mahalagang signal: Hindi na ang Chinese AI "kabuuan"
Ito ang pinakamadaling nakakalimutan ngunit posibleng pinakamahalagang bagay sa K3.
Presyo ng API ng K3: $3 bawat milyong input token, $15 bawat milyong output token, $0.30 para sa cached input.
Ilang ilang ang dating Kimi K2.6? $0.95 / $4.00.
Tumaas ng halos 3 beses.
Ano ang kahulugan ng presyong ito? Base sa pagkakasunod-sunod sa antas ng Claude Sonnet. Ibig sabihin, tinanggihan ng Moonshot ang pinakamalaking kahusayan ng China sa mga malalaking modelo sa nakaraang ilang taon—ang extremong mababang presyo.
Bakit?
Dahil sa 2.8 trilyong parameter, laging bukas na deep thinking mode, at 1M context, hindi maabot ang pagbaba ng gastos. Dahil din sa posisyon ng K3 ay hindi na "isang assistant na mura para sa iyo," kundi "isang agent-level base na tumutugon diretso sa Claude Opus at GPT-5.6."
Kahit na tumaas ng tatlong beses, ang bawat gawain ng Artificial Analysis ay nagkakahalaga lamang ng halos $0.94, na kalahati lang ng $1.80 ng Claude Opus 4.8, at pareho na lang sa $1.04 ng GPT-5.6 Sol.
Half-price comparison, same tier.
Ito ang dahilan kung bakit umimik ang US stock market noong July 17.
Sa araw na iyon, bumaba ang Nasdaq ng higit sa 1.4%. Sinunod din ni NVIDIA ang pagbebenta. Ang isang pagpapakilala ng isang Chinese startup ay direktang nakaapekto sa emosyon ng US market.
Hindi ito isipin sa loob ng dalawang taon. Dalawang taon ang nakalipas, ang pagpapalabas ng mga modelong Tsino ay mayroong maliliit o walang epekto sa US market.
Narito na. Dahil nagbago na ang narrative.
Ang kuwento ay nagbago mula sa “Ang Amerika ang nagtatayo ng mga harapan, samantalang ang Tsina ay sumusunod,” patungo sa “Ang Tsina ay nagtatayo rin ng mga harapan, at kahit na may mas malaking timbang, mas mura pa ito ng kalahati.” Ang kuwentong ito ay direktang, matagal, at struktural na nagpapababa sa kakayahan ng mga pribadong lab na tulad ng Anthropic at OpenAI na tatakasan ang presyo.
Sa likod ng pagtataya ng $20 bilyon: Ang taya na nag-doble ng apat beses sa loob ng tatlong buwan
Ang ritmo ng pagsasalapi ay nagkukuwento rin ng parehong kuwento.
Sa dulo ng 2024, ang pagtataya ng Moonshot ay humigit-kumulang $3.3 bilyon. Hanggang Mayo 2026, naganap ang isang bagong pagsasalakay ng pondo na halos $2 bilyon, na nagdulot ng pagtataya na hihigit sa $20 bilyon.
Napapalit ang tatlong buwan sa apat na beses.
Sinabi ni Yang Zhilin sa itself sa Zhongguancun Forum noong Marso 2026—“Sa mga susunod na taon, lalong laloang magiging pinamumunuan ng AI ang mas maraming mga pag-aaral.” Ipinakita niya muli sa GTC noong 2026 ang tatlong ruta teknikal: Token efficiency, long context, at scalable expansion ng agent clusters.
Sundin ang tatlong ito upang maunawaan ang taya ng Moonshot.
Ang token efficiency ay tumutukoy sa dalawang bagong mekanismo ng K3: Kimi Delta Attention at Attention Residuals, na sinasabing nagpabilis ng pag-decode ng hanggang 6.3 beses.
Mahabang konteksto, tumutukoy sa pagpapabilis mula sa 200,000 na salita hanggang sa 1M na token.
Ang agent cluster ay tumutukoy sa K3 na malinaw na ipinagkakaloob bilang "agentic reasoning model"—na likha para sa mahabang chain ng mga gawain, pag-navigate sa codebase, at pagtawag ng mga tool, hindi para sa pag-uusap.
Ang mga ruta na ito ay ang pagtaya ni Yang Zhilin sa "huling anyo ng AI".
Nagbanta siya na ang isang malaking modelo ay hindi ang dulo, kundi ang cluster ng mga agent na dinamikong nagpapagawa at nagco-coordinate ang tunay na dulo.
Tama ba ang pagtataya na may sagot sa loob ng dalawang taon.
Ang pagbubukas ng agham ay ang tunay na palisada ng China sa AI
Dito ay kailangang banggitin ang mas malaking konteksto.
Sa panahong ito, isang obserbasyon mula sa isang海外 AI researcher ang naging malawakang nakakalat sa komunidad, na nagsasabi na ang dahilan kung bakit patuloy na nakakapaglabas ng mga modelo tulad ng GLM-5.2 at Kimi K3 ang mga Chinese lab ay hindi dahil sa mas maraming computing power, kundi dahil sa pagkakaroon ng pagkakawanggawa—hindi lamang ang pagkakawanggawa ng weights, kundi ang buong ecosystem.
May isang malalim na obserbasyon dito: Ang malaking bahagi ng pag-train ng mga modelo sa mga pinakamataas na laboratoryo sa Tsina ay ginagawa ng mga intern. At ang mga undergraduate at graduate student na ito ay may malalim na pag-unawa sa mga detalye ng pag-train, at ang kanilang pagkakaroon ng pagkakataon na magbahagi ay 100 beses mas mataas kaysa sa kanilang mga katumbas sa Amerika.
Sa kabilang panig, ang mga advanced lab sa Estados Unidos ay halos hindi nagpapakilala ng mga intern. Ang mga doktorante sa Stanford at Berkeley ay kailangang magpapakapagod para makakuha ng isang pagkakataon na magtrabaho sa isang modelo ng "tamang laki". Ang karamihan sa mga recipe ay nakasara ng isang maliit na grupo ng mga may-ari ng pribilehiyo.
Hindi ito pagtatampok ng China at Estados Unidos. Ito ay pagtatampok ng bukas at saradong agham.
Ang pagkakaroon ng Kimi K3 ay ang pinakamahusay na paliwanag sa argumentong ito.
Isang 34-taong-gulang na manunulat na may-ari ng isang startup, gumamit ng kanyang sariling papel bilang pundasyon, at kasama ang isang grupo ng mga kabataan na nag-aaral o bago lang maggradwate, nilikha ang ika-4 pinakamalaking modelo sa buong mundo.
Hindi malamang mangyari ang bagay na ito sa loob ng OpenAI. Hindi dahil wala kayang kakayahan ang tao, kundi dahil hindi pinapayagan ng mekanismo.
Totoo, ang pagpapahintulot ng K3 sa pagpapahintulot ng open weights hanggang Hulyo 27 ay isang signal din—ang mga pro-open ay naghuhula, nagsasagawa ng kalkulasyon, at pinipilit na huminga ng isang hakbang pabalik dahil sa komersyalisasyon. Ang kilos na ito ay dapat bantayan, ngunit hindi ito magpapalit sa pangkalahatang direksyon.
Ang DeepSeek V4 ay patuloy na bukas sa ilalim ng MIT License. Ang GLM-5.2 ay nandito rin. Ang pwersang Tsino ng mga bukas na timbang ay hindi nagkakalat.
How far can a drummer go?
Balik sa tao na si Yang Zhilin.
Isang teknolohikal na entrepreneur na galing sa pagiging drummer ng rock, isang kakaibang tao sa Chinese AI community. Hindi siya tulad ng karaniwang "elite na siyentipiko mula sa Tsinghua" o karaniwang "elite na balikbayan mula sa Silicon Valley".
Kakaunti ang kanyang mga pampublikong pahayag, ngunit mataas ang density nito. Sa pagsasalita niya sa GTC 2026, malinaw niyang ipinakita ang teknikal na road map—muling istruktura ang optimizer, muling istruktura ang attention mechanism, at muling istruktura ang residual connections. Ito ay hindi PR language, kundi teknikal na pagpapasya.
Kinikilala rin niya ang mga kahinaan ng Moonshot. Isinulat nang malinaw sa sariling blog post ng K3: mayroon pa ring pagkakaiba sa UX kumpara sa Claude Fable 5 at GPT-5.6 Sol; sensitibo sa nakaraang kasaysayan ng pag-iisip; at "labis na aktibo" sa mga ambigong gawain.
Isang tapat na CEO, isang mananaliksik na isinama ang kanyang thesis sa produkto, isang batang tim na pinagsasama ng mga kaugnay sa Tsinghua University, kasama ang isang malinaw na teknikal na landas. Ito ang batayan ng Moonshot ngayon.
Hindi ito perpekto. Maaari itong magkamali. Ang kanyang landas para sa komersyalisasyon ay hindi pa ganap na nalalampasan—kaya ba niyang mapanatili ang paglago kahit tumaas ang presyo ng 3 beses, kaya ba niyang bawasan ang gastos sa computing power para sa 1M na konteksto, kailan ba talaga matutupad ang Agent form—lahat ng ito ay mga tanong.
Pero totoo ito. Hindi ito isang PPT company, hindi ito isang bubble ng valuation, at hindi ito batay sa isang pansamantalang hype.
Wakas: Ang pagtalon ng Nasdaq ay isang simula lamang
Noong Hulyo 17, 2026, bumaba ang Nasdaq ng 1.4%.
Maaaring sabihin ng ilan, ano na ang pagbaba ng 1.4%, laging nagkakaroon ng pagbabago ang merkado.
Ngunit kung susuriin mo ang sanhi at epekto: isang Chinese startup ang naglabas ng isang model, na pinagsusuri ng seriyoso ng Reuters, CNBC, at Simon Willison sa iisang araw, na nagresulta sa pagbaba ng presyo ng NVIDIA, at na isinama nang direkta ng Artificial Analysis sa top 4 sa buong mundo.
Hindi ito nagawa noon.
Nangangahulugan ito ng isang bagay: Ang pagkakapareho at pagkakaroon ng kapangyarihan sa pagpapresyo ng AI ay nagsisimulang umalis mula sa San Francisco Bay Area. Hindi ito buong paglipat, kundi ang pagkakaroon ng paglipat.
Hindi si Yang Zhilin ang tanging tagapagtaguyod. Ang team ng DeepSeek, ang Zhipu, at ang Alibaba Tongyi ay mga tagapagtaguyod din. Pero siya ay talagang pinakamakapangyarihan at pinakakaraniwang simbolo sa siklo na ito—isang 34-taong-gulang na binata na nauunawaan ang teorya, ang produkto, ang pagkakabukas, at ang komersyalisasyon, at kahit na naglalaro ng drum.
Mayroong susunod na henerasyon ng modelo. Dumadating ang K4, K5. Palaging makakasalungat at mapapalitan ang puntos.
Ang tunay na natitirang bagay ay kaya ba nating panatilihin ang bukas na daan na ito.
Kung matatagpuan ito, ang AI ay hindi maging AI ng tatlong kumpanya.
Kung hindi mo kayang ipanatili, tayo ay mula sa lumang pagsasarilí, umuusbong sa bagong pagsasarilí.
Tungkol kay Yang Zhilin mismo—baka hindi siya mag-alala sa mga malalaking istorya. 34 taong gulang, $20 bilyon ang value ng kanyang kumpanya, mayroon siyang isang sa mga unang apat na modelo sa buong mundo, at ang kanyang team ay galing sa mga kabataan na kayang kausapin niya. Sa posisyong ito, sapat na siya para magpatuloy sa pag-drum, pag-sulat ng mga papel, at paggawa bilang isa sa mga kaunting tao na "nagpapalit ng kanilang papel sa produkto."
Kailan nangyari ang pangalawang pagtalon ng Nasdaq?
Hindi malalayong maghintay.
Mga sanggunian
- Reuters, "Ang Moonshot ng China ay inilunsad ang pinakamalaking bukas na AI model sa mundo, nakakalapit sa mga kalaban sa US", 2026-07-17
- CNBC, "Ang Moonshot AI ng China ay ipinakilala ang Kimi K3 na kumakapareho sa OpenAI at Anthropic", 2026-07-17
- Ang AI Rankings, "Kimi K3: Benchmarks, Pricing & Review — Moonshot's 2.8T Frontier Model", 2026-07
- Ang Decoder, "Ang bukas na modelo ni Kimi, K3, ay malapit na sa GPT-5.6 Sol at Fable 5 habang nagpapahiwatig ng wakas ng sobrang mura na Chinese AI", 2026-07
- Artificial Analysis, "Kimi K3 Model Card & Intelligence Index v4.1", 2026-07
- Wall Street Journal, "Si Yang Zhilin, tagapagtatag ng Kimi: Ang pag-unlad ng AI ay papasok sa panahon na pinopanatili ng AI, at ang halaga ng kumpanya ay umabot na sa $18 bilyon," 2026-03-25
- Panahon ng Intelektwal na Ulo, "Pagsasalita ni Yang Zhilin sa GTC 2026: Unang Buong Paglalahad ng Tech Roadmap ng Kimi Model", 2026-03-18
- China AI Atlas, "Profile ni YANG Zhilin (杨植麟)"
