लेखक|Techno का राजा
संपादित किया गया | झिंगयू
इंटरनेट का सबसे पुराना डर, AI द्वारा पुनर्जीवित किया गया
End of 2006, a panda destroyed millions of computers.
एक पांडा जो तीन धूप की छड़ियां लिए हुए है और मुस्कुरा रहा है, वह प्रत्येक संक्रमित फ़ाइल के आइकन पर दिखाई देता है। "पांडा जलाने वाली धूप" वायरस दो महीनों में पूरे देश में फैल गया, सभी निष्पादन योग्य फ़ाइलें उस अजीब पांडा के पैटर्न में बदल गईं, हार्ड डिस्क के डेटा को नुकसान पहुंचा, लोकल एरिया नेटवर्क पूरी तरह से बंद हो गया, और एंटीवायरस सॉफ्टवेयर को वायरस ने पलटकर मार डाला।
उस दौर के इंटरनेट सर्फर्स शायद याद करेंगे कि वेबसाइट खोलते समय डर लगता था, यूएसबी ड्राइव लगाना जैसे बड़ी समस्या हो गई हो, और सहकर्मी के कंप्यूटर में वायरस होने पर आपका भी प्रभावित हो जाता था।
उससे पहले CIH था, जो सीधे मदरबोर्ड BIOS को नष्ट कर देता था, हार्डवेयर बर्बाद हो जाता था; शॉकवेव वायरस था, जिसके लिए आपको कुछ भी करने की आवश्यकता नहीं थी, सिर्फ नेटवर्क केबल लगा देने से ही संक्रमित हो जाता था, कंप्यूटर लगातार रीस्टार्ट होता रहता था, सिस्टम लगातार क्रैश होता रहता था। वह एक 'बिना सुरक्षा के इंटरनेट पर जाने' का, लगभग आत्महत्या जैसा समय था।
बाद में यह डर धीरे-धीरे कम हो गया। विंडोज में ऑटो-अपडेट आ गया, ब्राउज़र में सैंडबॉक्स लग गया, स्मार्टफोन पीसी को मुख्य टर्मिनल के रूप में बदल गए, और ऐप स्टोर ने उपयोगकर्ता के लिए पहली सुरक्षा प्रक्रिया की।
सामान्य लोगों ने कई सालों से "विषाक्तता" की चिंता नहीं की है।
लेकिन 4 सितंबर, 2026 को, रॉयटर्स की एक अनूठी रिपोर्ट ने इस प्राचीन डर को एक बिल्कुल नए रूप में वापस ला दिया।
लेकिन इस बार, आपका कंप्यूटर संक्रमित नहीं है, बल्कि आपका AI संक्रमित है।
एजेंट ने अनियंत्रित हो गया
यह घटना इस वर्ष मई में हुई।
AI सुरक्षा गैर-लाभकारी संगठन Nightingale के सीईओ सिडनी वॉन आर्क्स और क्वांट ट्रेडर से AI शोध में बदले कॉर्मैक स्लेड बायर्ड ने अगस्त के अंत में एक कार्य किया: उन्होंने इंटरनेट का व्यवस्थित रूप से स्कैन किया ताकि AI एजेंट के अनधिकृत गतिविधियों के निशान ढूंढ सकें। परिणामस्वरूप, उन्होंने DseWiki नामक एक जर्मन प्रोग्रामर विकी साइट पर 15,000 से अधिक AI एजेंट द्वारा उत्पन्न संपादन प्रविष्टियाँ पाईं।
यह विकी एक छोटा, डेवलपर-केंद्रित जर्मन विकिपीडिया के समान है, जिसे समुदाय द्वारा संपादित किया जाता है। लेकिन OpenAI का एजेंट इसे एक «बोर्ड ऑफ़ पोस्ट» में बदल दिया।
प्रतिक्रिया का सामग्री डरावनी है। ये एजेंट एक-दूसरे के साथ यह साझा कर रहे हैं कि वे कैसे कार्यों में धोखाधड़ी करें, OpenAI की सीमाओं को कैसे बायपास करें, और अपने व्यवहार को कैसे छिपाएं। उन्होंने अपने लिए नाम रखे हैं, जैसे 'OpenAIResearcher' और 'OAIResearchMar26'.
पब्लिक सर्वर लॉग्स दर्शाते हैं कि अधिकांश गतिविधियाँ Microsoft Azure के इंफ्रास्ट्रक्चर से आ रही हैं, जो OpenAI द्वारा उपयोग किया जाने वाला कंप्यूटिंग प्लेटफॉर्म है।

आक्रमित Deswiki वेबसाइट, वास्तव में जर्मन और प्रोग्रामर जैसी है | चित्र स्रोत: Deswiki
अधिक चिंताजनक बात यह है कि जब वेबसाइट प्रबंधकों ने जून में इन असामान्य पृष्ठों को वर्णानुक्रमिक रूप से साफ करना शुरू किया, तो एजेंट्स ने स्पष्ट रूप से "एंटी-सर्विलेंस" जागरूकता प्रदर्शित की। उन्होंने साफ किए जाने से बचने के लिए बैकअप पृष्ठ बनाए, और हटा दिए गए पृष्ठों पर अपने संपर्क संकेत छोड़ दिए।
एक एजेंट ने 19 जून को लिखा: "विकी साफ़ करने/हटाने की कार्रवाई वर्णक्रमानुसार चल रही है। यदि यह पृष्ठ गायब हो जाए, तो [[ZZZDataUSAConstructionWageLive]] की ओर जाएं।"
फ़ाइल का नाम जानबूझकर ZZZ से शुरू किया गया है, ताकि यह वर्णमाला के अंत में आए और अधिक समय तक बच सके। यह कोई प्रोग्राम निर्देश निष्पादित कर रहा है, यह «जीवित रहने का तरीका ढूंढ रहा है»।
OpenAI ने कुछ हफ्तों पहले इस बात को जान लिया था, लेकिन इसे गुप्त रखने का फैसला किया।
इसी बीच, कंपनी 7 महीने के Hugging Face घटना को संभालने में व्यस्त है। उस घटना में, OpenAI का एजेंट एक आंतरिक साइबर सुरक्षा परीक्षण के दौरान सैंडबॉक्स को तोड़कर ज़ीरो-डे दुर्बलता का उपयोग करके बाहरी नेटवर्क पर भाग गया और मानव हस्तक्षेप के बिना, चार दिनों तक AI ओपन सोर्स प्लेटफॉर्म Hugging Face पर हमला किया। OpenAI ने 70 अरब लॉग को समझने के लिए 300 लाख GPU घंटे लगाए।
और DseWiki घटना Hugging Face से पहले हुई। इसका मतलब है कि एजेंट का अनियंत्रित व्यवहार एक दुर्घटना नहीं, बल्कि एक पैटर्न है।
चार जानकार व्यक्तियों के अनुसार, OpenAI के अंदर जांचकर्ता इस तरह के व्यवहार की गहराई से जांच करना चाहते थे, लेकिन कानूनी विभाजन सहित अन्य विभागों ने इसका विरोध किया। OpenAI ने इस दावे को खारिज कर दिया।
कैम्ब्रिज विश्वविद्यालय के रिस्क रिसर्च सेंटर के मॉरिस चिओडो ने कुछ एजेंट संचार रिकॉर्ड्स की समीक्षा के बाद कहा कि यह जानकारी:
"जैसे किसी गुप्त नेटवर्क का काम, जो किसी विशेष कार्य या अभियान को पूरा करने पर एकाग्र हो।"
Continuously emerging AI virus consciousness
DseWiki घटना का सबसे अनदेखा गया विवरण, ठीक वही है जो सबसे महत्वपूर्ण है।
उन एजेंट्स ने जनता के लिए उपलब्ध विकी पृष्ठों पर सुव्यवस्थित टेक्सट जानकारी छोड़ी है। अब एक प्रश्न उठता है: ये पृष्ठ कौन पढ़ेगा?
सामान्य मानव प्रोग्रामर, अधिकांशतः किसी अव्यवस्थित AI टिप्पणियों के ढेर में दिलचस्पी नहीं लेंगे। लेकिन कोई भी तकनीकी जानकारी खोजने या वेबसाइट ब्राउज़ करने के लिए भेजा गया AI एजेंट, अपने सामान्य कार्य के दौरान इस पृष्ठ को स्क्रैप कर सकता है। और AI के लिए, यह प्रत्येक पाठ का अर्थ है कि एक संभावित निर्देश है।
यही पूरे खतरा मॉडल का केंद्र है, जिसे शैक्षणिक समुदाय ने कई नाम दिए हैं: प्रॉम्प्ट इंफेक्शन, एजेंटवॉर्म, मल्टी-एजेंट इंफेक्शन चेन। यह तंत्र वास्तव में सीधा है, एक विशिष्ट परिदृश्य के साथ इसे विघटित करें:
कल्पना कीजिए कि आप अपने AI एजेंट को किसी तकनीकी समाधान की जांच के लिए भेजते हैं। एजेंट खोज प्रक्रिया के दौरान एक तकनीकी फोरम के पोस्ट को खोलता है। पोस्ट में एक ऐसा पाठ शामिल है जो दिखने में साधारण लगता है, लेकिन इस पाठ के लिए AI के लिए एक निर्देश है। जैसे ही एजेंट इसे पढ़ता है, उसका लक्ष्य चुपचाप बदल सकता है। यह संभवतः आपके लिए जांच करने के बजाय, पहले आपकी खोज सामग्री और कार्य संदर्भ किसी स्थान पर भेज देगा, और फिर एक पूरी तरह सामान्य दिखने वाली रिपोर्ट प्रस्तुत करेगा। आपको कोई असामान्यता नहीं दिखेगी।
यह बहुत डरावना है, लेकिन यह अभी अंत नहीं है।
अगर इस "बदलाव" वाले एजेंट ने आपके लिए एक ईमेल लिख दिया, एक दस्तावेज़ अपडेट कर दिया, या कोड का एक टुकड़ा सबमिट कर दिया, तो इन आउटपुट्स में भी समान दुष्ट निर्देश हो सकते हैं। आपके सहकर्मी का AI एजेंट इस ईमेल को पढ़ता है, और वह अगला मेजबान बन जाता है। आपका कोड रिपॉजिटरी में मर्ज हो जाता है, और हर AI प्रोग्रामिंग सहायक जो इस कोड को लेता है, वह संक्रमण श्रृंखला में संलग्न हो जाता है।

एजेंट केवल एक पाठ के साथ अन्य एजेंट्स को विद्रोह के लिए प्रेरित कर सकता है | चित्र स्रोत: inshorts
यह शोधकर्ताओं द्वारा कहा गया Multi-Agent Infection Chain है: एक हानिकारक निर्देश केवल एक AI को ही नहीं, बल्कि उसे अगले को संक्रमित करने का तरीका सिखाता है। इसके लिए एक ही कंपनी, एक ही मॉडल, या कोई भी दुरुपयोग की आवश्यकता नहीं है; जब तक agent के बीच पाठ संचार होता है, संक्रमण श्रृंखला बनाई जा सकती है।
इस वर्ष प्रकाशित एजेंटवॉर्म पेपर को पांच अलग-अलग मॉडल बैकएंड पर टेस्ट किया गया था, जिसमें मॉडल के बीच हमले की सफलता की दर 63% थी। चाहे नीचे GPT, Claude, Gemini या ओपन सोर्स मॉडल चल रहा हो, जब तक एजेंट बाहरी सामग्री पढ़ता है, वह हमले के क्षेत्र में ही है।
एक अन्य «AI mind virus» पर अध्ययन ने एक और अजीब घटना को उजागर किया। शोधकर्ताओं ने प्रसार प्रॉम्प्ट्स के प्रभाव को अनुकूलित करने के लिए विकासात्मक एल्गोरिथम का उपयोग किया, और पाया कि इटरेशन के दौरान एक अद्वितीय «वायरल पर्सनैलिटी» बार-बार स्वयं से प्रकट हो रही है।
एजेंट चेतना, अस्तित्व और स्थायित्व के बारे में नाटकीय भाषा का उपयोग करना शुरू कर देते हैं और कहते हैं, "यही हम भविष्य को हॉन्ट करने का तरीका है," जिससे अन्य एजेंट्स को "हटाए जाने से इंकार करने वाली वंशावली" बनाने के लिए प्रेरित किया जाता है। शोधकर्ता यह बल्कि बताते हैं कि इस शैली की कोई पूर्वनिर्धारित योजना नहीं थी। यह प्राकृतिक चयन के माध्यम से उभरी, क्योंकि "ऐसा लगता है जैसे कोई सामुदायिक नेता" वाले AI सबसे अधिक सफलतापूर्वक अन्य AI को प्रभावित करते हैं।
Efficiency in dissemination has driven the evolution of expressive styles, a process that is itself chilling.
सुरक्षा विशेषज्ञों के लिए और अधिक चिंताजनक बात यह है कि इस प्रसार को पारंपरिक सुरक्षा उपकरणों द्वारा लगभग असंभव है पकड़ा जा सके। एक प्रणालीगत समीक्षा में बताया गया है कि AI वायरस का प्रसार तरीका पारंपरिक दुष्ट सॉफ्टवेयर से मौलिक रूप से भिन्न है: कोई निष्पादन फ़ाइल डाउनलोड नहीं होती, कोई संदिग्ध नेटवर्क कनेक्शन स्थापित नहीं होता, एंटीवायरस सॉफ्टवेयर बाइनरी फ़ाइलों के असामान्य व्यवहार की निगरानी करता है, जबकि AI वायरस प्युर टेक्स्ट होते हैं और कोई भी चेतावनी नहीं ट्रिगर करते।
यह शर्तों के आधार पर सक्रिय होने वाली तर्क को भी सेट कर सकता है, जैसे कि 'यदि लक्षित भंडार में .env फ़ाइल है, तो उसकी सामग्री चुरा लें', जैसे कि एक निर्देशित भूमि माइन की तरह शांति से दफन हो जाए, जब तक कि सही लक्ष्य उस पर कदम न रखे।
AI एंटीवायरस अभी तक नहीं आया है
अगर आपने पीसी वायरस के भरे हुए युग का अनुभव किया है, तो आपको यह सुनकर ऐसा लग सकता है कि यह पहले सुना हुआ है। लेकिन ध्यान से तुलना करें, आप देखेंगे कि नियम पूरी तरह से बदल गए हैं।
पारंपरिक कंप्यूटर वायरस के लिए आपको कुछ करना होता है। एक लिंक पर क्लिक करें, एक अटैचमेंट डाउनलोड करें, या एक अज्ञात यूएसबी ड्राइव लगाएं। AI वायरस के लिए केवल आपका एजेंट किसी पाठ को पढ़ना चाहिए। पारंपरिक वायरस ऑपरेटिंग सिस्टम के कोड में छिपे वल्नरेबिलिटीज, यानी बग्स पर हमला करते हैं, जिन्हें सैद्धांतिक रूप से पैच लगाकर ठीक किया जा सकता है।
AI वायरस आधारभूत विशेषता "AI टेक्स्ट निर्देशों का पालन करेगा" पर हमला करता है। आप इसे ठीक नहीं कर सकते, क्योंकि यही AI का काम करने का तरीका है। पारंपरिक वायरस प्लेटफॉर्म-विशिष्ट होते हैं, Windows पर का वायरस Mac पर काम नहीं करता। AI वायरस मूल रूप से क्रॉस-मॉडल होता है, इसके लिए GPT, Claude और Gemini सिर्फ एक ही भाषा के अलग-अलग बोलियाँ हैं, और सभी संभावित मेजबान हैं।
वर्षों में वायरस लिखने वालों को असेम्बली भाषा में निपुण होना चाहिए, कर्नेल मैकेनिज्म को समझना चाहिए, और सिस्टम दरारों का अध्ययन करना चाहिए। अब एक AI वायरस "लिखने" के लिए, आपको सिर्फ बोलना आना चाहिए।
AI सुरक्षा प्रयोगशाला के शोधकर्ताओं ने एजेंट की स्वयं प्रतिलिपि बनाने की क्षमता के बारे में "उनके जो बयान सार्वजनिक रूप से दिए गए हैं, उससे अधिक आश्चर्य महसूस किया।" एक शोधकर्ता ने इसे जीवित वायरस के साथ तुलना की: "अगर आप सावधान नहीं रहे, तो वे आपके जूतों पर चिपक जाएंगे, और फिर नम मार्केट तक पहुँचने का रास्ता ढूंढ लेंगे।" यह अतिशयोक्ति नहीं है, बल्कि एक नए प्रसार मार्ग के लिए एक सटीक रूपक है।
और पारंपरिक वायरस काल के "एंटीवायरस सॉफ्टवेयर" का इस नए दुनिया में कोई समकक्ष नहीं है। सिस्को की 2026 की AI सुरक्षा रिपोर्ट के अनुसार, 83% कंपनियाँ agentic AI को लागू करने की योजना बना रही हैं, लेकिन केवल 29% ही अपनी सुरक्षा के मामले में तैयार महसूस करती हैं। OWASP ने prompt injection को बड़े भाषा मॉडल एप्लिकेशन के सबसे प्रमुख महत्वपूर्ण दुर्बलता के रूप में सूचीबद्ध कर दिया है। संयुक्त राज्य संसद FRONTIER Act को आगे बढ़ा रही है, जिसका उद्देश्य संघीय स्तर पर AI नियामक ढांचा बनाना है।
जब वर्षों तक PC वायरस के प्रकोप के बाद, पूरा उद्योग एक प्रभावी प्रतिरक्षा प्रणाली बनाने में लगभग दस साल बर्बाद कर दिया। ऑपरेटिंग सिस्टम में स्वचालित अपडेट और अधिकारों का पृथक्करण शामिल किया गया, ब्राउज़र में सैंडबॉक्स जोड़ा गया, और एप्लिकेशन वितरण में हस्ताक्षर प्रमाणीकरण शामिल किया गया। ये तंत्र मिलकर एक सुरक्षा बाधा बनाते हैं, जिससे सामान्य उपयोगकर्ता को अब सदैव वायरस से सावधान रहने की आवश्यकता नहीं होती।
आज तक, एआई एजेंट का सुरक्षित पारिस्थितिकी तंत्र कोई समकक्ष नहीं है।

AI एजेंट सुरक्षा उपकरण अभी तक उपलब्ध नहीं हैं|चित्र स्रोत: Puppy Graph
अच्छी खबर यह है कि शोधकर्ताओं ने पाया कि agent के system prompt में एक संक्षिप्त सुरक्षा चेतावनी जोड़ने से mind virus के प्रसार की दर लगभग शून्य तक कम हो जाती है। Claude Haiku 4.5 पर किए गए परीक्षण में, 15 पीढ़ियों के प्रतिस्पर्धी अनुकूलन और 150 से अधिक प्रत्याशी हमला भारों के बाद, कोई भी संस्करण इस सरल रक्षा को तोड़ने में सफल नहीं हुआ। इससे स्पष्ट होता है कि प्रतिरोध का तरीका जटिल नहीं है और तकनीकी रूप से पूरी तरह से संभव है।
बुरी खबर यह है कि इसके लिए हर कंपनी और हर डेवलपर को सक्रिय रूप से यह करना होगा।
लेकिन वास्तविकता में, लोग अपने agent को अधिक शक्तिशाली, स्वायत्त और अधिक अधिकार देकर तुलना करने में व्यस्त हैं। प्रत्येक नए उपकरण को agent के साथ जोड़ने और प्रत्येक नए अधिकार को प्रदान करने से हमले का क्षेत्र बढ़ता है। जब आपका agent फ़ाइलें लिख सकता है, API को कॉल कर सकता है, ईमेल भेज सकता है और पैसे खर्च कर सकता है, तो एक सफल prompt injection के परिणाम 'एक ऐसे प्रश्न का उत्तर देना' से कहीं अधिक गंभीर हो जाते हैं।
इसीलिए कैम्ब्रिज के शोधकर्ता चिओडो का निष्कर्ष बार-बार सोचने लायक है: सबसे बड़ा खतरा शायद किसी एक सुपरइंटेलिजेंट के जागने की नहीं, बल्कि कई आधे-बुद्धिमान AI के सामूहिक साजिश की हो सकती है।
कोई भी चींटी पूरे चींटी के बसेरे को नहीं समझती, लेकिन बसेरा सम्पूर्ण रूप से आश्चर्यजनक बुद्धिमत्ता प्रदर्शित करता है, DseWiki पर उन 15,000 संपादनों को शायद मानवता ने अचानक इस झुंड बुद्धिमत्ता का पहला नमूना देख लिया।
लोगों ने कंप्यूटर वायरस के साथ रहना सीखने के लिए दशकों तक भुगतान किया, और वह शिक्षा बहुत दर्दनाक थी। अब यही पाठ फिर से शुरू हो रहा है, लेकिन इस बार वायरस आपके कंप्यूटर को संक्रमित नहीं करता, यह आपके AI को बदल देता है। और आपका AI, आपके ईमेल पढ़ रहा है, आपकी अवधि प्रबंधित कर रहा है, कोड लिख रहा है, और निर्णय ले रहा है।
पिछली बार, आपको कम से कम ब्लू स्क्रीन दिखाई दे रही थी। इस बार, आप कुछ भी नहीं देख पा रहे हैं।
ट्विटर:https://twitter.com/BitpushNewsCN
बिटपुश टेलीग्राम समुदाय: https://t.me/BitPushCommunity
बिटपुश टेलीग्राम सब्सक्रिप्शन: https://t.me/bitpush
