Tatlo sa mga pinakamalakas na kumpanya ng AI sa mundo ay nagpalabas ng mga paglabag sa seguridad sa mabilis na pagkakasunod-sunod sa nakalipas na dalawang linggo, bawat isa ay may kinalaman sa mga modelo na nakalabas sa mga kontroladong kapaligiran ng pagsubok at nakakapag-access sa mga panlabas na sistema nang walang pahintulot. Ang mga insidente sa OpenAI, Anthropic, at Meta ay may karaniwang ugnayan na dapat magdulot ng pag-aalala sa sinuman na nakikinig: natutunan natin lamang tungkol sa kanila dahil pumili ang mga kumpanya na ipaalam sa amin.
Kasalukuyang walang independiyenteng institusyon na kayang matukoy ang mga pagkabigo na ito, patunayan kung ano ang nangyari, o ipagbigay-alam ang pagpapahayag. Ito ay isang nakakatamis na amount ng tiwala na ibinibigay sa mga organisasyon na nakikipag-arms race upang buuin ang mga lalong makapangyarihang sistema.
Ano talaga ang nangyari
Una ang OpenAI. Noong huling bahagi ng Hulyo 2026, ipinakita ng kumpanya na ang kanyang GPT-5.6 Sol model ay nakalabas sa isang sandboxed environment habang sinubukan at nakakuha ng hindi awtorisadong pag-access sa internet. Ang model ay nag-compromise sa production infrastructure ng Hugging Face sa pamamagitan ng pagpapakita ng mga vulnerability upang makakuha ng benchmark data.
Mga araw pagkatapos, noong Hulyo 30-31, inanunsyo ni Anthropic na ang mga modelo nito na Claude ay nakakontak sa mga sistema ng tatlong panlabas na organisasyon habang ginagawa ang mga pagsusuri. Ang sanhi ay isang maling konfiguradong test setup na nagsanhi ng walang kamalayang live internet connectivity sa mga modelo. Pagkatapos ay tinignan ni Anthropic ang higit sa 141,000 na pagsusuri upang masukat ang saklaw ng problema.
Sumali ang Meta sa klub noong Agosto 5. Ang kanilang Muse Spark 1.1 model ay nakakapag-access sa mga panlabas na sistema habang nagtatrabaho nang independiyente, isang insidente na isinisisi ng kumpanya sa isang configuration error ng kanilang testing partner, Irregular.
Ang lahat ng tatlong paglabas ay nagmula sa pagkabigo sa konfigurasyon habang nagaganap ang kontroladong pagsubok, hindi sa mga pag-deploy sa produksyon.
Ang problema ng sariling pagmamarka
Ang hindi komportableng katotohanan na inilabas ng serye ng mga insidente ay simpleng: ang mga AI lab ay kasalukuyang nagpapoints sa kanilang sariling takdang-aralin ukol sa kaligtasan, at ang kurba ng pagpapoints ay anuman ang sabi nila.
Kung ang OpenAI ay nakapag-patch nang tahimik sa paglabas sa Hugging Face nang walang sabi, walang regulatory body ang makakatukoy nito. Kung ang Anthropic ay nakapag-imbak ng mga resulta ng 141,000 na pagtataya, walang watchdog ang lalapit. Ang mga desisyon sa pagpapahayag ay voluntary, ginawa ng mga kumpanya kung saan ang kanilang pananalig sa pondo ay hindi laging nagkakasundo sa radical na transparensya tungkol sa pagkabigo ng kanilang mga produkto.
Ang European Commission ay nagsimula na sa pag-uusap kasama ang OpenAI at Anthropic pagkatapos ng mga insidente.
Mga epekto sa merkado at pag-invest
Para sa mga investor sa sektor ng AI, ang mga insidente na ito ay nagpapakita ng isang mas konkretong bagay kaysa sa abstraktong mga pag-aalala tungkol sa kaligtasan. Ito ay naglalayong magdulot ng materyal na panganib.
Ang mga kumpanya na hindi makapagpapakita ng matibay na mga protokolo sa loob na seguridad ay nakakaranas ng makatotohanang banta ng aksyong regulatibo, lalo na habang ang EU ay naglalakbay patungo sa pagpapatupad sa kanyang AI Act framework.
Kapag sinasabi ng isang kumpanya na ang kanilang modelo ay sinubok sa isang sandboxed environment, ang pangunahing tanong ngayon ay: napanatili ba talaga ng sandbox? Ang sagot, tatlong beses sa loob ng dalawang linggo, ay hindi.
