Ayon sa pagmamasid ni Beating, sinipi ng Financial Times ng Britain ang tatlong mapagkakatiwalaang pinagkunan na nagsimula na ang ByteDance sa pre-training ng isang malaking modelo na may hanggang 10 trilyon na parameter. Ang proyekto ay nasa maagap na yugto pa at ang huling sukat ay hindi pa nakukumpirma. Kung ituturuan sa maximum, ito ay magiging higit sa tatlong beses ang laki ng Kimi K3 at magiging pinakamalaking modelo na kilala sa ilalim ng mga Chinese team. Direktang isinampa ng ByteDance ang laki ng modelo sa paligid ng flagship ni Anthropic. Hindi pa naglabas ng Anthropic ng bilang ng parameter para sa Mythos 5, ngunit sinipi ng Financial Times ang mga estimasyon ng industriya na ang Mythos 5 ay humigit-kumulang 8 trilyon na parameter, habang ang Fable 5 ay humigit-kumulang 5 trilyon. Kung matutupad ng bagong modelo ng ByteDance ang 10 trilyon, kahit sa sukat lamang ng parameter, nasa parehong antas na ito ang pinakamalalim na closed-source models sa Estados Unidos. Ang modelo ay kasalukuyang nasa pre-training (pagtuturo sa pangunahing kakayahan ng modelo gamit ang malaking dami ng data). Ayon sa Financial Times, ang yugtong ito ay karaniwang nangangailangan ng 3 hanggang 6 na buwan, at kailangan pa ng post-training bago ito mabigay. Mas maraming parameter ay hindi nangangahulugan na mas malakas ang kakayahan—ang huling performans ay nakadepende sa arkitektura, data sa pagtuturo, at paraan ng pagtuturo. Noong nakaraan, ipinahayag ni Zhang Yiming sa loob ng Seed ang kanyang pagtutol sa distilasyon ng mga modelo ng kalaban, at inutos sa kanyang team na tanggapin ang pansamantalang pagkakaligtaan at magpursige sa sariling pagbuo upang makarating sa unang antas sa mundo. Ang bagong modelo na may hanggang 10 trilyon na parameter ay ang pinakamalikhaing pagtutok sa sukat na ginawa ng ByteDance hanggang sa kasalukuyan.
Binubuo na ng ByteDance ang pagtuturo sa AI model na may 10 trilyong parameter, malapit na sa sukat ng Anthropic
MarsBitI-share
Simulan na ng ByteDance ang pre-training ng isang malaking AI model na may hanggang 10 trilyon na parameter, ayon sa mga ulat sa AI + crypto news. Ang model, kung matatapos sa pinakamataas na limitasyon, ay lalampas sa Kimi K3 ng higit sa tatlong beses at magiging kapareho ng rumor na 8 trilyon-parameter na Mythos 5 ng Anthropic. Inaasahan na magtratrabaho ang pre-training phase sa loob ng 3 hanggang 6 na buwan, kasunod ng karagdagang pagtuturo. Pinush ni CEO Zhang Yiming ang pagsasagawa ng pananaliksik sa loob ng kompanya, na naglalayong makipagkumpitensya sa pandaigdigang labanan sa AI. Ginagawang malaking pag-unlad ng mga crypto news outlet ang hakbang na ito sa sektor ng teknolohiya.
Source:Ipakita ang original
Disclaimer: Ang information sa page na ito ay maaaring nakuha mula sa mga third party at hindi necessary na nagre-reflect sa mga pananaw o opinyon ng KuCoin. Ibinigay ang content na ito para sa mga pangkalahatang informational purpose lang, nang walang anumang representation o warranty ng anumang uri, at hindi rin ito dapat ipakahulugan bilang financial o investment advice. Hindi mananagot ang KuCoin para sa anumang error o omission, o para sa anumang outcome na magreresulta mula sa paggamit ng information na ito.
Maaaring maging risky ang mga investment sa mga digital asset. Pakisuri nang maigi ang mga risk ng isang produkto at ang risk tolerance mo batay sa iyong sariling kalagayang pinansyal. Para sa higit pang information, mag-refer sa aming Terms ng Paggamit at Disclosure ng Risk.