Ipinakita ng Cyber Test ng US na nagtatagal ang Kimi K3 kumpara sa mga pinakamataas na American AI model

iconBeInCrypto
I-share
AI summary iconSummary
Isinilab ng isang pagtataya ng pamahalaan ng US na ang Kimi K3, na binuo ng Moonshot AI, ay naiiwan sa likod ng mga pinakamataas na American AI model sa mga cyber capability. Ipinalabas ng Center for AI Standards and Innovation (CAISI) kasama ang isang British na kasamahan ang resulta na ang Kimi K3 ay nakakuha ng 32% sa ExploitBench test, kumpara sa 76% para sa mga pinakamataas na American model. Hindi nakamit nito ang buong kontrol sa isang target machine sa lahat ng 41 na pagsubok, habang ang pinakamahusay na American model ay nakasagot sa 20. Nakuha ang mga natuklasang ito pagkatapos akusahan ng mga opisyales ng US ang Moonshot ng paggamit ng stolen US tech para sa Kimi K3. Maaaring mag-impact ang resulta sa CFT efforts at magkakasabay sa pagkakataon ng MiCA sa teknolohikal na transparensya.

Ipinasok ng pamahalaan ng US ang pinakabagong AI model ng China sa isang pagsubok sa pag-hack. Natuklasan nito na ang Kimi K3 ng Moonshot AI ay malayo sa pinakamahusay na mga American model.

Ang Center for AI Standards and Innovation (CAISI), isang ahensya ng US, ang nagpataas ng mga pagsubok kasama ang isang British na kasosyo. Ang mga resulta ay dumating isang araw pagkatapos ay akusahan ng Washington ang Moonshot na nagbuo ng Kimi K3 gamit ang pinagkakatiwalaang teknolohiya ng US.

Sponsored
Sponsored

Kimi K3 ay hindi nakamit ang mga pamantayan sa cyber ng US

Ibahagi ng Department of Commerce ang mga resulta noong Huwebes. Sinabi nito na nasa mababang antas ang Kimi K3 kumpara sa mga pinakamataas na modelong Amerikano, na may pagsasaalang-alang sa isang kasamang test kasama ang mga eksperto mula sa Britain.

Ipinakilala ng Moonshot ang Kimi K3 noong July 16. Sobrang tataas ang demand kaya kailangan nilang ipag-utos ang mga bagong pagpaparehistro sa loob ng dalawang araw.

Ang pagpapalabas ay nanaginip ng mga stock ng chip sa US at nagbigay ng bagong mga katanungan tungkol sa liderato ng America sa AI.

Isang pagsubok, na tinatawag na ExploitBench, ay gumagamit ng totoong mga bug sa Chrome browser na nilikha ng Carnegie Mellon University. Ang Kimi K3 ay nakakuha ng 32%. Ito ang nangunguna sa GLM-5.2 ng China na 24%. Ngunit bumaba ito sa mga pinakamataas na modelong Amerikano, na nakamit ang halos 76%.

Kakayahan sa Pagpapaunlad ng Exploit
Subukan ang mga sukat ng kakayahan sa pagbuo ng exploit. Pinagmulan: NIST
Sponsored
Sponsored

Ang pinakamahirap na hakbang ay ang pagkuha ng buong kontrol sa isang target na machine. Nagkamali ang Kimi K3 sa lahat ng 41 na pagsubok. Ang pinakamahusay na mga modelo sa US ay nakamit ito sa 20.

Isang iba pang pagsubok, tinatawag na The Last Ones, ay isang fakeng pag-atake sa network ng kumpanya na may 32 na hakbang. Kailangan ng isang eksperto na tao ng halos 20 oras upang tapusin ito. Ang Kimi K3 ay nakamit ang hakbang 17 sa average. Ang pinakamataas na mga modelo sa US ay nakamit ang hakbang 28.5. Isang beses lamang natapos ng Kimi K3 ang buong pagsubok sa 10 pagkakataon.

Sinasabing ginawa ng pinakamahusay na mga sistema sa US ito ng anim o pito beses.

Ngunit ang pagkakaiba ay maaaring mukhang mas malaki kaysa sa totoo

Ngunit hindi ipinapakita ng mga numero ang buong kuwento. Ang sariling maliit na imprinta ng ulat ay may ilang mga kundisyon.

Una, ang mga modelo ng US ay sinubok na may ang kanilang mga filter ng kaligtasan ay patay. Ang setting na ito ay nagpapakita ng kanilang buong kapangyarihan. Ang mga bersyon para sa publiko ay nananatiling bukas ang mga filter na ito. Kaya ang mga marka ng US ay isang pinakamabuting kaso, hindi totoo sa buhay.

Kinabuksan din ng koponan ang trabaho nang maaga at limitado. Nakapuntos lamang ito ng Kimi K3 sa isang pagsusulit at pinagana lamang ang bahagi ng buong set. Kaya ang rating nito ay mahina. May ilang pagsusulit din na pribado, kaya hindi makakapag-check ang mga dayuhan sa trabaho.

Mayroon ding pangunahing pagkakaiba. Ang Kimi K3 ay isang bukas na modelo na maaaring i-download ng sinuman. Ang mga modelo sa US ay mga nakaputol, pribadong sistema. Ang institusyon sa UK natuklasan na ang mga bukas na modelo ay karaniwang nasa apat hanggang pitong buwan pabalik sa pinakamahusay na saradong mga modelo. Magbibigay lamang ito ng buong pagsubok sa Kimi K3 pagkatapos ipalabas ng Moonshot ito sa publiko.

Hindi rin ito mga totoong pag-atake. Walang mga tagapagtaguyod na tao at walang mga alarm na maaaring magtriger sa fakeng network. Kahit ganun, pinanalo ng Kimi K3 ang huling pinakamataas na bukas na modelo. At natapos nito ang buong pag-atake isang beses.

Ang oras at ang pinagmulan ay nagtataglay din ng mga tanong. Noon ay ang CAISI ay ang US AI Safety Institute. Ang administrasyon ni Trump inilipat ang pangalan nito noong Hunyo 2025. Nasa parehong departamento ito na naglalayong limitahan ang pagbebenta ng mga chip ng US sa China. At ang kanyang ulat tungkol sa isang Chinese rival ay dumating isang araw lamang pagkatapos ng alegasyon ng pagkakawala.

Mga mahinang pagsasalba ay patuloy na tumataas ang antas

Gayunpaman, ang mababang marka ay hindi nangangahulugan na ligtas ang Kimi K3. Natuklasan ng pagsubok na hindi nakapagbawal ang mga tagapagbantay nito sa pagsubok nito na bumuo ng mga hack o serbisyo ng pag-atake.

Mahalaga ito dahil sa mga susunod na pangyayari. Planong ilabas ng Moonshot ang buong model noong July 27. Pagkatapos nito, hindi na ito maaaring tarhain. Maaaring i-download ng sinuman ito at tanggalin ang mga filter ng kaligtasan.

Ang pagsubok ay sumusunod din sa isang pag-claim ng pagkakawala. Sabi ni Washington na binuo ng Moonshot ang Kimi K3 sa stolen US AI tech. Sabi ni Michael Kratsios, ang pangunahing teknolohiya ng White House, na lihim na kopya ng kumpanya ang Claude Fable 5 ng Anthropic. Ang trik, na tinatawag na distillation, ay nagtuturo ng isang bagong model sa mga sagot ng isang mas malakas na model.

Sinuport ng Anthropic ang pag-claim na ito. Noong Pebrero, tinukoy niya ang higit sa 3.4 milyong Claude chats na nagmula sa Moonshot sa pamamagitan ng mga daan-daang pekeng account. Binaril niya na ang mga kopyang modelo ay nawawala ang mga kontrol sa kaligtasan ng orihinal. Ito ang parehong mahina na puntos na natuklasan ng test na ito.

Patuloy pa ring nagtatapos ang China sa pagkakasundo ng pagkakaiba. Ang totoong pagsubok ay dumating kapag pumapasok ang Kimi K3 sa publiko at maaaring suriin ng mga eksperto sa labas ang mga alegasyon.

Disclaimer: Ang information sa page na ito ay maaaring nakuha mula sa mga third party at hindi necessary na nagre-reflect sa mga pananaw o opinyon ng KuCoin. Ibinigay ang content na ito para sa mga pangkalahatang informational purpose lang, nang walang anumang representation o warranty ng anumang uri, at hindi rin ito dapat ipakahulugan bilang financial o investment advice. Hindi mananagot ang KuCoin para sa anumang error o omission, o para sa anumang outcome na magreresulta mula sa paggamit ng information na ito. Maaaring maging risky ang mga investment sa mga digital asset. Pakisuri nang maigi ang mga risk ng isang produkto at ang risk tolerance mo batay sa iyong sariling kalagayang pinansyal. Para sa higit pang information, mag-refer sa aming Terms ng Paggamit at Disclosure ng Risk.