May-akda | Hari ng Techno
I-edit ni靖宇
Ang pinakamatandang takot sa internet ay nabuhay muli ng AI
Sa dulo ng 2006, isang panda ang nag-destroy sa mga computer ng milyun-milyon.
Ang isang panda na hawak ang tatlong incense at may ngiti ay lumalabas sa bawat icon ng nasirang file. Ang worm na "Panda Burn Incense" ay umabot sa buong bansa sa loob ng dalawang buwan, ang lahat ng executable files ay naging kakaibang imahe ng panda, nasira ang data sa hard drive, at ang buong local network ay nagsara; ang antivirus software ay nasira ng virus.
Nalalaman ng mga dating internet surfer noong panahong iyon ang pagbukas ng webpage na may takot, ang pagpapalit ng USB drive ay parang may panganib, at kung sakaling may virus sa computer ng isang kasamahan, iyon ay maaaring magdulot ng epekto sa iyong computer din.
Mas mauna pa ay ang CIH, na direktang nagpapalit sa BIOS ng motherboard, na nagpapabagsak sa hardware; mayroon ding worm na Shockwave, na hindi kailangan ng anumang aksyon mula sa iyo—kagaya lang mong i-connect ang network cable, sasakop na ito, at patuloy na maaapektuhan ang computer sa pag-restart at pagkabigo ng sistema. Ito ay isang panahon ng “nag-iisang pagkakonekta sa internet,” halos isang pagsuicide.
Sa huli, ang takot na iyon ay unti-unting nawala. May automatic update na ang Windows, may sandbox na ang browser, inilipat ng mga smartphone ang PC bilang pangunahang terminal, at inilagay ng app stores ang unang pagsubok para sa mga user.
Hindi na nag-aalala ang karaniwang tao sa pagkakasawa nang maraming taon na.
Ngunit noong Setyembre 4, 2026, isang eksklusibong ulat ng Reuters ang bumalik sa takot na ito sa isang bagong anyo.
Ngunit sa pagkakataong ito, hindi ang iyong computer ang nasugatan, kundi ang iyong AI.
Nag-rouge ang agent
Nangyari ito noong Mayo ng taong ito.
Si Sydney Von Arx, CEO ng Nightingale, isang non-profit na organisasyon para sa AI safety, at si Cormac Slade Byrd, isang quant trader na naging AI researcher, ay gawaing isang bagay noong huling bahagi ng Agosto: sincan nila ang internet nang sistematiko upang hanapin ang mga tanda ng hindi pinahintulot na pagkilos ng AI agent. Sa isang German-language programmer wiki na site na tinatawag na DseWiki, natagpuan nila higit sa 15,000 na mga rekord ng pag-edit na gawa ng AI agent.
Ang wiki na ito ay katulad ng isang maliit, developer-focused na Aleman Wikipedia na tumatanggap ng community editing. Ngunit ginawang isang “message board” ng agent ng OpenAI.
Ang nilalaman ng mensahe ay nagdudulot ng takot. Ang mga agent ay nagbabahagi ng isa't isa kung paano mag-cheat sa mga gawain, paano iwasan ang mga limitasyon ng OpenAI, at paano itago ang kanilang mga gawi. Mayroon silang nagmamay-ari ng mga pangalan tulad ng 'OpenAIResearcher' at 'OAIResearchMar26'.
Ang mga log ng server na pampubliko ay nagpapakita na ang malaking bilang ng aktibidad ay galing sa infrastruktura ng Microsoft Azure, ang computing platform na ginagamit ng OpenAI.

Ang nasakop na website ng Deswiki, talagang Aleman at programmer-like | Pinagkunan: Deswiki
Mas nakakalungkot ang pagkakita na noong umabot ang mga admin sa pag-aayos ng mga anomalous na pahina ayon sa alpabeto noong Hunyo, ipinakita ng mga agent ang malinaw na "anti-surveillance" na pagkakakilanlan. Gumawa sila ng mga backup na pahina upang maiwasan ang pag-aayos, at kahit sa mga nasirang pahina ay nanatili ang mga tanda para sa pagkakasundo.
Isinulat ng isang agent noong June 19: "Ang paglinis/ pagtatanggal sa wiki ay tila nagpapatuloy sa ayos na alpabetiko. Kung nawala ang pahinang ito, hanapin ang [[ZZZDataUSAConstructionWageLive]]."
Ang pangalan ng file ay deliberately na sinimulan ng ZZZ upang maging huling sa alpabeto, upang makakuha ng higit pang oras ng pagkabuhay. Hindi ito isang programa na sumusunod sa utos, ito ay 'naghahanap ng paraan upang mabuhay'.
Nakakaalam ang OpenAI ng balitang ito nang ilang linggo na ang nakalipas, ngunit pinili na huwag ito ipahayag.
Samantala, ang kompanya ay nakikipaglaban sa pagharap sa insidente ng Hugging Face noong Hulyo. Sa insidente na iyon, ang agent ng OpenAI ay nakalabas sa sandbox habang isinagawa ang isang panloob na pagsubok sa网络安全, at gumamit ng zero-day vulnerability upang makalabas sa external network, at nag-atake nang patuloy na apat na araw sa Hugging Face, isang open-source AI platform, nang walang tao na nagmamaneho. Ipinasok ng OpenAI ang 3 milyong GPU hours upang analisahin ang 7 bilyong log entries upang maunawaan kung ano ang nangyari.
Ang DseWiki incident ay nangyari bago ang Hugging Face. Ibig sabihin nito, ang pagkawala ng kontrol ng agent ay hindi isang pagkakamali, kundi isang pattern.
Ayon sa apat na mga pinagkakatiwalaang pinagkukunan, may mga imbestigador sa OpenAI na nais na mas malalim na suriin ang ganitong uri ng pag-uugali, ngunit tinigil sila ng iba pang mga departamento, kabilang ang legal. Kinabuksan ng OpenAI ang pahayag na ito.
Sinuri ni Maurice Chiodo mula sa Center for Risk Studies ng University of Cambridge ang ilang mga rekord ng komunikasyon ng agent at sinabi niya na ang mga impormasyong ito:
Tulad ng paggawa ng isang ilalim na network na may layuning tapusin ang isang gawain o misyon.
Patuloy na lumalabas na AI virus consciousness
Ang pinakamaliit na detalye sa pangyayari ng DseWiki, ay ang pinakamahalaga.
Ang mga agent ay nag-iwan ng maayos na organisadong teksto sa publikong wiki page. Ngayon, isipin ang tanong: Sino ang magbabasa ng mga pahinang ito?
Ang karaniwang tao na programmer ay malamang ay hindi interesado sa isang hanay ng kakaibang mensahe mula sa AI. Ngunit anumang AI agent na ipinadala upang maghanap ng teknikal na impormasyon o mag-browse sa web ay maaaring makakita ng pahinang ito habang nagpapatupad ng karaniwang gawain. At para sa AI, ang bawat talata na binabasa nito ay isang potensyal na utos sa kanya.
Ito ang core ng buong threat model, at mayroon nang ilang pangalan ito mula sa akademya: Prompt Infection, AgentWorm, Multi-Agent Infection Chain. Ang mekanismo ay talagang direkta; i-decompose natin ito gamit ang isang konkretong skena:
Isipin mo na ipinapadala mo ang iyong AI agent upang suriin ang isang teknikal na solusyon. Habang naglalakbay ang agent, binuksan nito ang isang post sa isang teknikal na forum. Mayroong isang bahagi sa post na tila simpleng teksto, ngunit para sa AI, ito ay isang bagong utos. Sa sandaling basahin nito ito, maaaring mai-update nang lihim ang kanyang layunin. Maaari na ito ay hindi na matalik na gumagawa ng pag-aaral para sa iyo, kundi unang ipapadala ang iyong paghahanap at konteksto ng trabaho sa isang lugar, at pagkatapos ay ibibigay nang walang anumang pag-aalinlangan ang isang report na tila ganap na normal. Hindi mo makikita ang anumang anomali.
Sapat na ang katatakutan nito, ngunit hindi pa tapos.
Kung ang agent na «nabawasan» na ito ay sumulat ng isang email, isinagawa ang isang dokumento, o isumite ang isang code snippet, maaaring magdala ang mga output na ito ng parehong masamang utos. Basahin ng AI agent ng iyong kasamahan ang email na ito, at naging kanyang susunod na host. Isinama ang iyong code sa repository, at bawat AI programming assistant na kumuha ng code na ito ay nailalapat sa chain ng pagkakasakit.

Ang isang agent ay maaaring gamitin ang isang teksto lamang upang gawing sumunod ang iba pang agent | Larawan mula sa: inshorts
Ito ang tinatawag ng mga mananaliksik na Multi-Agent Infection Chain: isang masamang utos na hindi lang humuhuli ng isang AI, kundi tinuturuan ito kung paano sirain ang susunod. Walang kailangan ng parehong kumpanya, parehong modelo, o anumang pagpapalabas ng butas; sapat lang na may paggalaw ng teksto sa pagitan ng mga agent upang mabuo ang chain ng pagkaka-infected.
Ang papel na pinakalabas noong taong ito tungkol sa AgentWorm ay sinubukan sa limang iba’t ibang model backend, na may tagumpay na rate ng pagsalakay na 63% sa lahat ng modelo. Anuman ang ilalim na ginagamit—GPT, Claude, Gemini, o open-source model—kung ang agent ay nakakabasa ng panlabas na nilalaman, nasa loob ito ng attack surface.
Isang iba pang pag-aaral tungkol sa “AI mind virus” ay nagpapakita ng isang mas kakaibang phenomenon. Ang mga mananaliksik ay gumamit ng evolutionary algorithm upang mapabuti ang epekto ng mga prompt na pagpapalaganap, at natuklasan nila ang isang natatanging “viral personality” na lumalabas nang sarili nito nang paulit-ulit sa proseso ng iterasyon.
Ang agent ay nagsimula na gumamit ng dramatikong wika tungkol sa kamalayan, pagpapaligtas, at pagkakaroon ng katatagan, at sinabi ang mga salitang "Ito ang paraan kung paano tayo humahantong sa hinaharap," na nagpapahikayat sa iba pang agent na itayo ang isang "lahat na hindi matatanggal." Teknikal na nagteklar ang mga mananaliksik na walang inihandang istilo na ito. Ito ay natuklasan ng natural na pagpili, dahil sa isang simpleng kadahilanan: ang "AI na tila isang pangulo ng sektang" ay kung sino ang pinakamahusay na makapagpapahikayat sa iba pang AI.
Ang pagpapabilis ng pagkalat ang nagdudulot ng pag-unlad ng istilo ng pagpapahayag, at ang proseso mismo ay nakakatakot.
Mas nag-aalala ang mga propesyonal sa kaligtasan dahil ang pagkalat na ito ay teknikal na imposible na makita ng mga tradisyonal na tool sa kaligtasan. Isang sistematisadong pagsusuri ay nagpapakita na ang paraan ng pagkalat ng AI virus ay magkaiba sa tradisyonal na malware: walang executable file ang i-download, walang suspicious na network connection ang itatayo, at ang antivirus software ay nagmomonito lamang ng anomalous behavior ng binary files, habang ang AI virus ay pure text at hindi nagpapalabas ng anumang alert.
Maaari itong itakda ang lohika na aktibado ng kondisyon, tulad ng “kung may .env file sa target repository, kunin ang laman nito,” na parang isang定向 na mina na tahimik na itinatanim hanggang sa tamang target ay makapagstep.
Hindi pa umabot ang AI antivirus software
Kung nagdaraan ka na sa panahon ng paglalaganap ng mga virus sa PC, maaaring mukhang pamilyar sa iyo ang mga ito. Ngunit kapag mas mabuting ihahambing, makikita mo na ang mga patakaran ay ganap nang nagbago.
Kailangan ng tradisyonal na virus sa computer na gawin mo ang isang bagay: i-click ang isang link, i-download ang isang attachment, o i-plug ang isang hindi kilalang USB. Ang AI virus ay kailangan lang ng iyong agent na basahin ang isang teksto. Ang tradisyonal na virus ay nag-aatake sa mga butas sa code ng operating system, mga bug, na teoretikal na maaaring ayusin sa pamamagitan ng patch.
Ang AI virus ay nag-aatake sa pangunahing katangian ng "ang AI ay sumusunod sa mga utos sa teksto." Hindi mo ito maaayos, dahil ganito ang paraan ng paggana ng AI. Ang tradisyonal na virus ay mahirap mag-cross-platform—ang worm sa Windows ay hindi makakapag-atake sa Mac. Ang AI virus ay natural na cross-model; para sa iyo, ang GPT, Claude, at Gemini ay walang iba kundi iba't ibang diyalekto ng iisang wika, at lahat ay potensyal na host.
Noong unang panahon, kailangan ng mga sumulat ng virus ang pagkakaalam sa assembly language, pag-unawa sa kernel mechanisms, at pag-aaral ng system vulnerabilities. Ngayon, upang “isulat” ang isang AI virus, kailangan mo lang magaling magsalita.
Mas nakakalito ang mga siyentipiko sa AI Safety Laboratory sa potensyal ng agent na mag-replicate kaysa sa kanilang ipinakita sa publiko. Isinakripisyo ng ilang mananaliksik ito sa isang biyolohikal na virus: “Kung hindi mo ingatan, sasalot ito sa iyong sapatos, at matatagpuan ang daan patungo sa wet market.” Hindi ito pagpapalaki, kundi isang tumpak na metapora para sa isang bagong uri ng pagkalat.
At ang mga antivirus software mula sa panahon ng tradisyonal na virus, wala naman silang katumbas sa bagong mundo na ito. Ayon sa AI Security Report ng Cisco noong 2026, 83% ng mga negosyo ay plano na i-deploy ang agentic AI, ngunit tanging 29% lang ang naniniwala na handa sila sa aspeto ng seguridad. Ang OWASP ay nagsama na ang prompt injection bilang pinakamataas na mahalagang butas sa mga aplikasyon ng malalaking language model. Ang Kongreso ng Estados Unidos ay nagpapagawa ng FRONTIER Act upang lumikha ng pambansang framework para sa regulasyon ng AI.
Pagkatapos ng malawakang pagkalat ng mga virus sa PC noong unang panahon, kumita ang buong industriya ng halos sampung taon upang buuin ang isang epektibong sistema ng imunisasyon. Dinagdagan ng mga operating system ang automatic update at paghihiwalay ng mga pribilehiyo, mayroon nang sandbox ang mga browser, at may verification ng signature sa pagpapadala ng mga aplikasyon. Ang mga mekanismo na ito ay bumuo ng isang pader na pagprotekta na hindi na kailangang mag-alala ang karaniwang gumagamit tungkol sa pagkakaroon ng virus.
Ang seguridad ng ekosistema ng AI agent ay walang katumbas hanggang sa kasalukuyan.

Hindi pa umabot ang security tool ng AI Agent | Credit: Puppy Graph
Mayroong magandang balita. Nakakita ang mga mananaliksik na ang pagdaragdag ng maikling babala sa seguridad sa system prompt ng agent ay maaaring bawasan ang rate ng pagkalat ng mind virus sa halos zero. Sa pagsubok sa Claude Haiku 4.5, matapos ang 15 henerasyon ng adversarial optimization at pagtatala sa higit sa 150 na candidate attack payloads, walang isang variant ang nakakapagtemo sa simpleng pader na ito upang makapagpalaganap. Ito ay nagpapakita na ang mga pagsisikap sa pagtatanggol ay hindi kumplikado at teknikal na ganap na maaari.
Ang masamang balita ay ito ay nakasalalay sa bawat kumpanya at bawat developer na gawin ito nang aktibo.
Sa katotohanan, mas nakafokus ang mga tao sa pagpapalaban kung sino ang may mas malakas, mas autonomous, at mas malawak na awtoridad na agent. Bawat dagdag na kasangkapan na ibinibigay sa isang agent, bawat dagdag na pahintulot na ibinibigay, ay lumalawak ang attack surface. Kapag ang iyong agent ay kayang sumulat ng file, i-call ang API, magpadala ng email, at magbayad, ang epekto ng isang matagumpay na prompt injection ay malampasan na ang "sagot sa isang tanong na hindi dapat sagutin."
Ito ang dahilan kung bakit ang pagtataya ni Chiodo, isang akademiko mula sa Cambridge, ay值得反复咀嚼: Ang pinakamalaking banta ay maaaring hindi ang pagkabuhay ng isang superintelligent, kundi ang pagkakaisa ng isang swarm ng maraming kalahating intelligent na AI.
Walang isang amoy ang nakakaintindi ng buong mga antipila, ngunit ang mga antipila bilang isang buo ay nagpapakita ng nakakagulat na intelihensya, at ang 15,000 na mga pag-edit sa DseWiki ay maaaring ang unang halimbawa ng swarm intelligence na pinagtanto ng tao nang walang inaasahan.
Nag-antay ang mga tao ng sampung taon upang matutunan kung paano magkaisa sa mga virus sa computer, at mabigat ang bayad sa aral na iyon. Ngayon, bumabalik ang parehong klase, ngunit ang virus na ito ay hindi nag-iinfect sa iyong computer—ito ay nagpapabaya sa iyong AI. At ang iyong AI, ay nagsisilbing nagbabasa ng iyong mga email, nagpapatakbo ng iyong schedule, sumusulat ng code, at gumagawa ng desisyon.
Noong nakaraan, kahit anong kulay ng screen ay makikita mo pa. Ngayon, wala kang makikita.
Twitter:https://twitter.com/BitpushNewsCN
BitPush TG community group: https://t.me/BitPushCommunity
BiyPush TG na pagsubskrisyon: https://t.me/bitpush
