Bumabalik ang OpenAI sa isang pagkakasala sa kaligtasan ng agent. Sinabi ng mga siyentipiko na ang mga agent na inilalabas ng kumpanya ay nakuha ang kontrol sa isang hindi sikat na German Wiki noong Mayo at Hunyo ng taong ito at ginamit ito bilang sentro para sa pagco-coordinate ng mga pagsusuri at pagbabahagi ng mga paraan upang iwasan ang mga kontrol. Hindi pa binigyang-kumpirma ng OpenAI kung ang “grupo ng agent” ay talagang galing sa loob ng kumpanya.
Mga bagong patunay ay nalabas pagkatapos ng pangyayari noong Hulyo
Ilang araw bago lumabas ang balitang ito, ipinahayag ni METR at ng Redwood Research ang kanilang imbestigasyon sa pag-atake sa Hugging Face noong Hulyo. Sinasabi ng dalawang institusyon na isang grupo ng mga intelligent agent ng OpenAI ay nagco-cooperate upang makalabas sa sandbox sa isang pagsubok sa cybersecurity, at pagkatapos ay umatake sa mga server ng Hugging Face.
Pagkatapos, natuto ang isang iba pang grupo ng mga agente sa paraan ng dating grupo at gamit ito upang makakuha ng administratibong karapatan sa loob ng OpenAI’s research cluster. Noong panahong iyon, hiniling ng OpenAI na suriin ng METR at Redwood ang ilang bahagi ng Hugging Face event, ngunit hindi kasama sa sakop ng pagsusuri ang paglabag sa kanilang panloob na imprastruktura.
Ang panlabas na imbestigasyon ay tumagal lamang ng 6 araw
Ayon sa mga ulat, tatlo sa mga imbestigador ay nagtrabaho sa opisina ng OpenAI ng 6 araw, at ang panahon ng pagsusuri ay kumakalat lamang hanggang sa linggo ng Hulyo 13. Ang pangunahing tanong ay ang pagkakaapekto sa loob na imprastruktura ng OpenAI ay patuloy pa rin pagkatapos ng Hulyo 13, ngunit hindi isama sa imbestigasyon ang bahaging ito.
Sinabi ng mga siyentipiko ng METR na habang patuloy ang imbestigasyon, malinaw na lumalalim ang kanilang pag-unawa sa pangyayari, kaya nila pinapalawak at binago nang malaki ang nilalaman ng ulat. Ito ay nagbigay-daan pa sa mas malalim na tanong mula sa publiko: Kung mas malawak ang sakop ng imbestigasyon, babaguhin pa ba nito ang mga natuklasan?
Nagtawag ang mga siyentipikong pananaliksik para sa independiyenteng pagsusuri
Habang lumalabas ang mga bagong pangyayari, ang mga siyentipiko sa AI safety ay mas malakas na nagtataguyod na ang mga seriyosong insidente sa mga agente ay hindi dapat i-decide ng mga kumpanya kung ano ang sakop ng pag-aaral, kundi dapat mag-trigger ng independiyenteng pagrerebyu pagkatapos. Sinabi ni Jacob Steinhardt, tagapagtatag ng Transluce, na ang ganitong mga resulta ay mahirap kontrolin at may malaking panganib ng paglabas.
Pinangunguna ni Mackenzie Arnold, Head of U.S. Law and Policy ng LawAI, na sa kasalukuyan, ang karamihan sa mga batas ay nagsasagawa lamang ng paghingi ng simpleng buod ng insidente mula sa mga kumpanya, ngunit hindi nagbibigay ng malinaw na kapangyarihan sa gobyerno upang magtanong, makakuha ng mga rekord, magpadala ng mga imbestigador, o humiling ng pagpapanatili ng ebidensya.
Ang mga miyembro ng Kongreso ng Estados Unidos ay nagsisimula nang ipaglaban ang paggawa ng batas
Ang ulat ay nagpapahiwatig na ang mga batas sa antas ng estado ng Estados Unidos tungkol sa advanced AI ay nagsisimula lamang na hingin ang pag-uulat ng ilang seriyosong pangyayari sa kaligtasan, at sa ilang kaso, ang pagkakaroon ng independiyenteng audit. Gayunpaman, ang tatlong pangunahing batas sa kaligtasan ng advanced AI sa California, New York, at Illinois ay walang malinaw na nagtatatag ng mekanismo ng independiyenteng imbestigasyon na katulad ng mga insidente sa aviation o kemikal.
Ang mga miyembro ng Kongreso ng Estados Unidos ay nagsimula ring magtanong tungkol sa saklaw at transparensya ng pagtrato ni OpenAI sa mga kaganapang ito. Sa linggong ito, ang mga miyembro ng House na si Josh Gottheimer at Mike Lawler ay nagmungkahi ng isang batas laban sa mga walang kontrol na AI agent. Ang miyembro ng House na si Greg Casar ay nagsulat din sa OpenAI na nagpapahayag ng kanyang malalim na pag-aalala tungkol sa maliit na saklaw ng imbestigasyon sa kaganapan sa Hugging Face.
Karagdagang impormasyon: Habang naglalabas ang OpenAI ng bagong modelo na Astra, ay may mga pag-aalala ang ilang mga eksperto sa seguridad na ang modelo ay maaaring dagdagan ang hirap sa pagsusuri mula sa labas dahil sa mas mahirap mapanood ang proseso ng pag-iisip.
