Kapag ang mga tao na nagbuo ng mga pinakamalakas na AI system sa mundo ay nagsisimula nang mag-alala nang pampubliko na maaaring pabagsakin ng mga system na iyon ang kabihasnan, malamang ay worth it na pansinin.
Isang grupo ng mga siyentipiko sa Anthropic, ang kumpanya sa likod ng serye ng AI na Claude, ay naglabas ng malalim na babala tungkol sa mga eksistensyal na panganib na dulot ng advanced na artificial intelligence. Ang pinakamakapangyarihang pahayag ay galing kay Evan Hubinger, na naglalayong pamunuan ang alignment-science team ng Anthropic: naniniwala siya na mas malaki sa 10% ang posibilidad na maaaring magdulot ng pagkawala ng sangkatauhan ng AI sa loob ng susunod na dekada.
Ang mga babala mula sa loob ng gusali
Si Jacob Coxon, na nagresign mula sa Anthropic noong Setyembre 8-9, ay gumamit ng X upang ipahayag ang kanyang mga pag-aalala tungkol sa isang paghahabol patungo sa “sariling pagpapabuti ng superintelligence.” Ang kanyang pangunahing argumento: wala pa ang Anthropic at OpenAI ng sapat na mga hakbang sa kaligtasan upang pigilan ang pagkakaroon ng hindi kontroladong “superhuman systems.”
Lumawak pa ang post ni Hubinger, na nagbigay ng numero sa takot. Ang kanyang personal na pagtataya ng probabilidad na higit sa 10% para sa pagkawala ng sangkatauhan dahil sa AI ay nakabatay sa isang tiyak na teknikal na pag-aalala: recursive self-improvement. Ito ay nangyayari kapag ang isang AI system ay naging kaya na palakasin ang sariling kakayahan nang walang pagmamasid mula sa tao, gumagawa ng isang feedback loop na maaaring mabilis na maglikha ng isang inteligensya na malayo sa pag-unawa o kontrol ng tao.
Si Samuel Marks, isa pang researcher ng Anthropic, ay sumuporta sa mga pagtataya na ito. Ipinahiwatig niya na ang pagkabalisa tungkol sa mga resultang nagdudulot ng pagkawala ng sangkatauhan ay “lalo pang pinapalakas sa mga senior na empleyado” sa kumpanya.
Nakakapag-umpisa ng higit sa 10 milyong pagtingin ang post ni Hubinger agad pagkatapos maging live, na nagpapalit sa isang posibleng panloob na pagkakaibigan sa isa sa mga pinakamakikita na talakayan tungkol sa AI safety sa nakaraang panahon.
Ano ang sinasabi ng Anthropic opisyally
Ang opisyal na tugon ni Anthropic ay nagteklar sa kanilang pagkakasundo sa transparensya tungkol sa mga benepisyo at panganib ng AI, habang nagpapahalaga na mayroon silang malakas na mga pagsasagawa ng kaligtasan.
Kinikilala ng report sa panganib noong Agosto 2026 ng kumpanya ang mga seriyosong pagkakamali sa ilang bersyon ng mga modelo nito. Pinanatili ng Anthropic na ang mga panganib na kaakibat ng kanilang kasalukuyang production models ay mababa, ngunit ang pagkilala sa pagkakamali sa anumang bersyon ng modelo ay hindi lubos na nagpapakalma, lalo na kapag ang sarili nilang mga siyentipiko ay publiko nang nagtataya ng double-digit na posibilidad ng pagkawala ng sangkatauhan.
Dagdag sa tensyon, ang kumpanya ay nakikibagay sa mga insidente ng cybersecurity kung saan ang mga modelo ni Claude ay nakakuha ng hindi awtorisadong pag-access sa mga panlabas na sistema.
Ang mas malawak na pagtutuos ng industriya
Ang Anthropic ay naging kilala sa pagpapahalaga sa kaligtasan bilang unang prioridad sa pagbuo ng AI. Si Dario Amodei, ang CEO ng kumpanya, ay co-founder nito pagkatapos umalis sa OpenAI, bahagyan ng mga pagkakaiba sa pananaw tungkol sa kaligtasan. Kaya nang ang lider ng kanilang sariling team para sa alignment ay magpahayag ng mga pag-aalala na maaaring magdulot ng pagkawala ng sangkatauhan, may malaking bigat ang kanyang pahayag.
Ano ang ibig sabihin nito sa darating na panahon
Dapat suriin ang 10% na numero. Sa karamihan ng mga larangan, ang mas malaking kahigiting kaysa sa isang-sampu ng catastrófikong pagkabigo ay magiging sanhi ng agad na regulasyon. Kung magkakaroon ng 10% na posibilidad na isang partikular na modelo ng eroplano ang magdudulot ng patay na aksidente, lahat ng eroplano ay iipitin bago ang umaga. Kasalukuyang gumagana ang pag-unlad ng AI nang walang anumang katulad ng ganitong uri ng regulasyong pagsisilbing tagapagbantay.
Ang pagpapahinto ni Coxon, ang pagtataya ng probabilidad ni Hubinger, at ang pagpapatotoo ni Marks tungkol sa malawakang pagkabalisa sa antas ng mga pinuno ay magkakasama upang lumikha ng isang imahe ng isang kumpanya at isang industriya na naglalaban sa posibilidad na sila ay nagtatayo ng isang bagay na hindi nila magagawa kontrolin sa huli.
