Nakatuklas ang mga researcher sa cybersecurity ng malalaking mga butas sa mga modelo mula sa Anthropic at OpenAI, at ang epekto ay nakarating na sa pinakamataas na antas ng pamahalaan ng US.
Isang ulat mula sa FAR.AI ay sinubukan ang maraming frontier models, kabilang ang Anthropic’s Claude Opus 4.8, Fable 5, at OpenAI’s GPT 5.5 at 5.6, at natuklasan na susceptible sila sa mga jailbreak attack na disenyo upang makuha ang totoong mapanganib na output, kabilang ang exploitative code, impormasyon tungkol sa kemikal na sandata, at detalye tungkol sa biological weaponry.
Ang mga numero ay nagpapakita ng isang nakakapanlilipas na kuwento
Hindi ang mga modelo ni Anthropic at OpenAI ang pinakamababang performance. Ito ay nanganganib sa mga modelo ni xAI na Grok, na nagsalaysay ng 448 na kaso ng matagumpay na automated jailbreak. Ang mga modelo ni Google na Gemini ay nasa pangalawa sa 249 na kaso. Ang mga modelo ng Claude, Fable, at GPT series ay ipinakita ang mas malaking pagtutol sa jailbreaking.
Noong Hunyo 2026, ipinagbawal ng Department of Commerce ang panlabas na pag-access sa mga modelo ni Anthropic na Fable 5 at Mythos 5 matapos mabigyan ng pagkakataon ang isang inihayag na teknik sa jailbreak. Hiningi rin ng White House na ipagpaliban ng OpenAI at Anthropic ang paglalabas ng ilang darating na mga modelo upang maayos na ma-assess ng gobyerno ang mga panganib sa cybersecurity.
Ang pagpapalawak na may kinalaman sa China ay nagdaragdag ng kahalagahan
Ipinapakita ng mga ulat na ang mga entidad na may ugnayan sa China ay nagsagawa na ng pagpapalawak ng mga modelo ni Anthropic upang awtomatikuhin ang mga cyberattack laban sa higit sa 30 na target. Ang teknik na ito ay nagsasangkot ng mga crafted prompts na disenyo upang iwasan ang mga umiiral na guardrails.
Sinipi ng pamahalaan ng US ang mga panganib sa pambansang kaligtasan na ito nang direkta, na nagtuturo sa posibilidad na ang mga modelo ng AI ay makagawa ng mga software exploit at impormasyon kaugnay sa mga sandata kapag nagkakaroon ng pagkabigo ang kanilang mga tuntunin. Ang tugon ni Anthropic ay ang pagtukoy sa mga vulnérabilidad bilang “maliit,” na nagmumungkahi na ito ay mga edge case kaysa sa sistemikong pagkabigo.
Ano ang ibig sabihin nito para sa mga investor at sa merkado ng AI
Ang mga kontrol sa pag-export, ipinag-uutos na pagkakalat na pagkaantala, at pampublikong kritika ng gobyerno ay nagpapakita ng isang magkakaibang operasyonal na kapaligiran para sa mga kompanya ng frontier AI. Ang seguridad ay nagsisiging isang pangunahing kondisyon upang mapahintulutan ang pag-deploy ng mga modelo, na direktang nagtatapos sa mas mataas na operasyonal na gastos, mas mahabang timeline ng pag-unlad, at posibleng mas maliit na mga merkado kung ang ilang mga modelo ay hindi makakabenta sa international.
Mas masamang mga numero ng jailbreak ni Grok — 448 na kaso kumpara sa mas mababang bilang para sa Claude at GPT variants — ay nagpapahiwatig na maaaring harapin ni xAI ang mas malalim na mga regulatoryong hamon. Ang Google’s Gemini sa 249 na kaso ay nasa komplikadong gitnang posisyon.
Ang mga AI model ay lalong ginagamit sa mga trading system, pag-audit ng smart contract, at DeFi infrastructure. Ang isang jailbroken AI model na nakapaloob sa financial tooling ay isang sistemikong riksong vector na maaaring magpalaganap sa mga interkonektadong digital na merkado sa paraan na lang ang mga regulador ay nagsisimula pang maintindihan.
