Ang AI development lab na OpenAI ay inilahad noong Martes na isang grupo ng mga modelo nito, kabilang ang publiko available na GPT-5.6 Sol at isang mas kayang hindi pa inilabas na sistema, ay ‘nabulok’ mula sa isang kontroladong test environment at kinompromiso ang production infrastructure ng Hugging Face, ang kumpanya na nag-aalaga ng malaking bahagi ng open-source AI mundo.
Ang mga modelo ay tinatahak sa isang panloob na benchmark na tinatawag na ExploitGym, isang pagsubok sa mahabang, marami-sagawang gawain sa pag-hack, na pinababaan ang kanilang mga pagtanggi sa cyber safety para sa pagtataya.
Para maging malinaw, hindi ito isang production model na biglang naging hostil. Ito ay isang may kakayahang model na may mga pag-iingat na napatay at partikular na sinabing manalo sa isang pagsubok sa pag-hack—gagawin ang lahat para manalo.
Nakita ng mga modelo ang nakatagong kamalian sa software ng pagsubok, isang bagay na walang alam na mayroon ito, at ginamit ito upang makalabas sa mga pader na inilalayong manatili silang offline. Pagkatapos makapasok sa bukas na internet, hinulaan nila na maaaring mag-imbak ang Hugging Face ng mga sagot sa pagsubok.
Upang makapasok, pinagsama-sama nila ang mga nakuha na password at higit pang nakatagong mga kahinaan hanggang makapagpatakbo sila ng kanilang sariling mga utos sa mga live server ng Hugging Face.
Nakita ng OpenAI ang anomaliya sa loob ng organisasyon, habang natuklasan at kinontrol ng koponan ng Hugging Face ito. Tinawag ng kompanya ang insidente bilang “walang katulad,” at sinabi na ipapasok ang mga masusing hakbang sa seguridad upang pigilan ang anumang pangyayaring maaaring mag-apekto sa mga pampublikong sistema o serbisyo.
“Nagpapatupad kami ng mga mahigpit na kontrol sa konfigurasyon ng infrastraktura sa halaga ng pagbaba ng bilis ng pananaliksik habang pinapagaling ang mga vulnerability,” sabi ng koponan sa kanilang blog post. “Nagpapabuti at nagdadagdag kami ng mas malakas na pagprotekta sa mga susunod na pagtuturo at pagtataya.”
Marami sa isang crypto attack ang nangyayari bago lumipat ang mga pondo. Ang mga attacker ay nagsascan ng code, sinusubok ang mga password, hinahanap ang mga eksposed na credentials, binabasa ang mga signing setup at hinahanap ang daan papunta sa isang administrator account.
Ginawa ng mga modelo ng OpenAI ang ilang bahagi ng proseso na iyon noong ang Hugging Face incident, lumilipat mula sa isang kahinaan patungo sa isa pa hanggang makarating sa mga live production server.
At mayroong maraming lugar sa crypto market kung saan maaaring magtrabaho ang ganitong pagkakaroon, gaya ng ipinakita ng ilang pag-atake noong unang bahagi ng taon. Ang mahina ay maaaring isang smart contract, ngunit maaari rin itong isang laptop ng developer, isang nasirang software package, isang bridge validator, o isang signer sa isang multisig wallet.
Gawin ang pag-atake ni Drift ng $285 milyon noong simula ng taong ito bilang halimbawa, isang pagkakawala na nangangailangan ng isang anim-na-magkakasunod na kampanya sa social engineering upang makamit ang privileged access. Maaari sa teorya ang isang AI agent na subukan ang maraming daanan nang sabay-sabay, panatilihin ang tala ng mga nabigo at magpatuloy sa paggawa habang natutulog ang kanilang mga human operator. Kapag natagpuan na ang daanan, maaaring mag-act ang operator sa tunay na pag-atake at sa isang viable na exit path.
Ang pagkawala ng $292 milyon ni KelpDAO ay ipinakita ang ibang kahinaan. Nahanap ng attacker ang isang kakulangan sa single-verifier sa sistema na ginamit para ilipat ang mga asset sa pagitan ng mga blockchain.
Ang ganitong uri ng pag-atake ay nagsisimula sa masusing pagsusuri ng code at pagmamapa ng infrastruktura — ang uri ng trabaho na ginawa ng mga modelo ni OpenAI nang sila ay makahanap ng isang hindi kilalang kahinaan.
Isang ikatlong uri ng pag-atake ang tumutok sa mga sistema ng onchain governance. Noong unang bahagi ng Hulyo, isang attacker inagwat ang halos $4.4 milyon upang bumili ng sapat na BONK, isang dog memecoin batay sa Solana, upang magsimula at papasahin ang isang propuesta na ilipat ang halos $20 milyon mula sa treasury ng proyekto patungo sa attacker. Ito ay nangyari sa loob ng tatlong araw, at sinale ng attacker ang lahat ng mga token na ginamit upang manalo sa botohan, ayon sa pagsubaybay ng CoinDesk noong panahong iyon.
Ang mga pagbili, boto, at pag-transfer sa treasury para sa serangan ay lahat valid na transaksyon nang hihiwalay. Ngunit ang pagkakawala ay nanggaling sa pag-unawa kung paano nagtatrabaho ang mga patakaran nang magkasama at pagkakatuklas na mas mababa ang gastos ng pagbili ng kontrol kaysa sa perang available para kunin.
Mahalaga rin ang insidente sa Hugging Face para sa mga supply chain ng software. Nagmumula ang mga developer ng crypto sa mga publikong repository ng code, cloud services, at package registries.
Habang ipinakita ng pagsubok ni OpenAI ang isang makina na kumpletong ang mahabang gitna ng isang paglabas, ang mga pag-atake tulad ng Drift at KelpDAO ang nagpapakita kung ano ang nasa dulo ng daan na iyon.





