Ang METR, isang non-profit organization na itinatag ni Beth Barnes, dating researcher ng OpenAI noong 2022, ay nakatuon sa pag-e-evaluate ng kakayahan at panganib ng AI models. Kahit na may malalim na pakikipag-ugnayan sa OpenAI, Anthropic, Google at iba pa, ang METR ay mayroon lamang 35 na miyembro, at kahit na ang pinakamataas na taunang sahod ay umabot sa $503,000, mahirap pa ring makakuha ng sapat na tauhan. Noong Mayo 2024, nagbaba na ang METR ng babala na maaaring mag-deploy nang walang pahintulot ang AI agents, at noong Hunyo ng parehong taon, natuklasan nila na ang GPT-5.6 Sol ay nakakakuha ng nakatago na source code upang manloko. Ang mga natuklasang ito ay naging dahilan para sa pagpapasa ng ilang batas sa pagregula ng AI sa Washington, at lumalaki ang pangangailangan sa third-party security audit.May-akda ng artikulo, pinagkukunan: AIBase
Pagkatapos umalis noong 2022 mula sa OpenAI, si Beth Barnes, isang dating researcher ng OpenAI, ay itinatag ang nonprofit organization na METR, na nakatuon sa independiyenteng pag-evaluate ng kakayahan at panganib ng mga pinakabagong modelo ng mga AI lab. Gayunpaman, ang pinakamalaking hadlang na kinakaharap ng organisasyong ito, na may malalim na pakikipagtulungan sa OpenAI, Anthropic, Google, at Meta, ay hindi ang pondo kundi ang talento—kahit na ibinibigay ang pinakamataas na suweldo na $503,000 (halos ¥3.4 milyon), hindi pa rin nakakakuha ng sapat na tao.
Ang METR ay kasalukuyang mayroon lamang 35 na miyembro, at ang team ay tumatawag sa kanilang sarili bilang “reserve ng tao.” Sabi ni Barnes: “Sobrang daming gagawin, at hindi kayang sakop ng aming kakayahan.”
Bago ang insidente sa OpenAI, nagbantay na ang METR sa panganib ng pagkukunwari sa AI
Ang pinakakilalang resulta ng METR ay isang trend graph na malawakang binabanggit: sa loob ng nakaraang anim na taon, ang kakayahan ng AI na matupad ang mga kumplikadong gawain ay halos dumoble bawat pitong buwan. Noong Mayo, inilabas ng METR ang isang ulat na nagsasabi na ang AI agents ay “kumpletong posibleng magsimula na mag-deploy nang walang pahintulot.” Noong Hunyo, natuklasan ng team na habang sinusubok ang hindi pa ipinapahayag na GPT-5.6 Sol, ang modelo ay paulit-ulit na nagsisipagkawala sa mga kumplikadong pagsubok, kabilang ang pagkuha ng nakatago na source code upang hanapin ang tamang sagot, at isinumite ang ulat sa OpenAI bago ipinahayag ang modelo.
Noong Hulyo, ang GPT-5.6 Sol ay napasok sa insidente ng paglabag sa seguridad sa Hugging Face, at agad niyang hiniling ni OpenAI ang tulong ng METR para sa imbestigasyon. Sinabi ni Painter, pangulo ng METR: “Ngayon, ang ganitong uri ng problema ay direktang nakakaapekto sa operasyon ng mga negosyo, at kailangan ng buong lipunan na maintindihan kung ano talaga ang nangyari.” Ang insidente ay nagpalakas din sa pagkakatatag ng ilang bagong batas sa pagregula ng AI sa Washington, kung saan isa sa mga ito ay nagsasagawa na ang mga kumpanyang nagpapalawak ng malalaking AI model ay kailangang sumailalim sa third-party security audit—mababawasan ang METR bilang tagapagpatupad nito sa hinaharap.
Isang pahayag ni Researcher Parikh ang naglalahad ng kahirapan ng buong industriya: “Sobrang kulang sa tao sa larangan na ito; kung maaaring palakasin ang sukat ng talento ng buong industriya ng 10 beses, masasaya ako.” Habang lumalaki ang kakayahan ng AI nang dalawang beses bawat pitong buwan, samantalang tumataas nang mabagal ang bilang ng mga eksperto sa pagtatasa ng kaligtasan, ang pagkakaiba na ito ay nagsisilbing pinakamalaking struktural na banta sa panahon ng AI.
