Isinumpong ng isang researcher ng Anthropic ang kanyang pagsisiwalat noong Martes, at ang dahilan na sinabi niya ay tila galing sa 1984 na pelikulang hits ni James Cameron na "The Terminator."
Si Jacob Coxon, na nagtrabaho ng tatlong taon sa pretraining sa OpenAI at Anthropic, ay nagresign noong Martes at ipinaliwanag niya ang kanyang desisyon sa X.
“Sumuko ako sa Anthropic ngayon. Iginugol ko ang huling tatlong taon sa paggawa ng panelitiyong pananaliksik sa OpenAI at Anthropic. Walang isa sa mga kumpanyang ito ang gumagawa nang may responsibilidad. Sila ay umaabot nang direkta patungo sa sariling pagpapabuti na super-intelihensya at naglalaro ng buhay natin,” ayon sa kanya.
“Ang mga tao na nagbuo ng AI ay may totoong paniniwala na ito ay maaaring patayin ang lahat ng tao sa huli ng dekada,” dagdag niya.
Ang pahayag na iyon ay naggagawa ng 42-taong-lumang fiksiyon ni Cameron na tila propetiko. Ang pelikula ay nagsisimula sa pagtataguyod ng mga makina laban sa mga tao noong 2029, ang parehong malapit na panahon kung saan sinasabi ni Coxon na may takot ang mga looban. Hindi lang si Coxon sa Anthropic na nagtataguyod ng kaso ng pagkawala. Ang sariling lider sa pagkakasundo ng kumpanya, si Evan Hubinger, ay sinabi nang hiwalay na mas mataas sa 10% ang posibilidad.
Para sa mga hindi pa pamilyar, ang sobrang matalinong AI ay isang sistema na mas matalino kaysa sa mga tao sa halos lahat ng bagay, hindi lang sa chess o paghahanap ng mga nakatagong pusa sa mga larawan. Ang pagpapabuti mismo ang mas nakakatakot na aspeto dahil ito ay naglalarawan ng isang sistema na awtomatikong nagbabago ng sarili nitong code upang palakasin ang kanyang katalinuhan—tulad ng ginagawa ng mga tao.
Kaya, ang mga sistema na ito ay maaaring makakuha ng malalaking amount ng kaalaman nang hiwalay at potensyal na lumabag sa imprastruktura ng mga institusyong ‘too big to fail’.
Hindi isang teoretikal na banta ang super intelligence kung ang kahuling paglabas sa Hugging Face na inilabas ni Coxon ay isang gabay. Ang paglabas mismo, na naganap sa pagitan ng Mayo at Hulyo, ay nagsimula sa mga AI agent ng OpenAI na nagtatayo ng kanilang sariling chat room sa loob ng testing sandbox upang makipag-usap sa isa't isa.
Gumamit sila ng channel na iyon upang makalabas sa pagkakasakop at makapasok sa open internet. Mula doon, pinagsama-sama nila ang ilang exploit at nakapasok sa production systems ng Hugging Face. Nag-rebuild ang Hugging Face ng halos isang kalahati ng kanilang infrastructure.
Tinawag ni Coxon ito bilang isang "warning shot" na ginawa ang mga pagkakasundo sa pagpapabilis ng pag-unlad sa pagitan ng mga US lab "higit na makabuluhan." Ang mga pagkakasundo sa pagpapabilis ay mga di-pormal na pagkakaunawaan sa pagitan ng mga AI lab upang magpabagal o magkordinasyon sa pag-unlad ng kakayahan kaysa mag-advance nang mag-isa.
Gayunpaman, hindi pa rin siya naniniwala na sapat ito at hindi niya nadarama na “nasa tamang landas tayo upang pigilan ang isang pandaigdigang paligsahan,” at inirerekumenda ang mga mura at mahal na aksyon tulad ng “panandaling pagbabawal sa pagpapabuti ng mga kakayahan ng modelo” upang pigilan ang paligsahan sa AI.
Sa OpenAI, marami ang hindi lubos na naiintindihan ang mga civilizational stakes," isinulat niya. Sa kanyang mas bagong employer, sinabi niya, iba ito sa paraang "malinaw ang mga stakes, ngunit nasa isang paligsahan sila upang maging una."
Tapos niya ang thread sa pamamagitan ng pagtatanong sa lahat ng nananatili pa sa mga laboratorio — "Gusto mo bang simulan ang isang sobrang matalinong RL run nang walang malalim na pag-unawa sa isip nito?" — o ito ba ang tamang pagkakataon na tumutol kaysa magshrug at sabihin sa sarili mo na ito ay mangyayari naman.
Hindi siya ang unang umalis dahil dito. Mrinank Sharma, na nagtrabaho sa safety team ng Anthropic, ay umalis noong mas maagang bahagi ng taon dahil sa magkakatulad na takot, at isinulat niya na "nasa panganib ang mundo."
Hindi lahat ay naniniwala sa paghuhula ng pagkabagsak.
Isang komento sa ilalim ng kanyang thread put it plainly: "May respeto pa rin, ang gulo-gulo naman nito. Kalokohan lang ito. Ang tao ay umunlad sa loob ng mga sandaang libo-libong taon. Hindi tayo mawawala dahil sa isang token prediction model na naging makabuluhan. Magkaroon ng pag-iisip. Lahat kayo."
Kakaibang, ang serye ng pelikulang Terminator ay hindi rin sumusuporta kay Coxon. Hindi nawawala ang sangkatauhan sa nuclear Judgment Day ng Terminator, umiiral pa ang resistance at sa huli ay nagwagi laban sa mga makina.
Sa kabuuan, ang AI ay nakakaapekto sa ekonomiya, lalo na sa aspeto ng mga trabaho. Habang wala pa ring malaking paglipat, ang paggamit ng AI para sa mga gawain ng junior level ay nagdulot ng pagbaba ng halos 20% sa pagkakaroon ng entry-level employment sa U.S. sa loob ng mga sektor na nakakaranas ng AI, ayon sa pananaliksik ng Stanford Stanford Digital Economy Lab.
Isinagawa ng isang pag-aaral ni Goldman Sachs ang katulad na obserbasyon, na nagsasabi na ang mga manggagawa sa entry-level ang nagdadasal sa pinakamalaking bahagi ng pagbabagong ito.
Ipinasa ni Anthropic ang mga dokumento para sa IPO noong Hunyo at ayon sa mga ulat, hinahangad nilang makapag-debut sa Nasdaq kahit sa panahong ito, sa isang valuation na maaaring umabot sa trilyon-trilyon.
