Dün, OpenAI yeni nesil model olan Astra'yı büyük bir şeyle duyurdu. Başkan Greg Brockman, “Kişisel olarak, belki de AGI'ye ulaştık, AGI çağına hoş geldiniz” dedi.
Bir süre için sosyal platformlarda tartışmalar çığ gibi yükseldi:演示 videolarında Astra, 2 dakika 54 saniyede PCB devre kartı düzenlemesini otomatik olarak tamamlıyor, 5 dakika 27 saniyede çoklu platform karşılaştırma hizmetini hallediyor, bu da birçok kişiyi “Çok harika!” diye bağırmasına neden oluyor, hatta bazıları “Bu AGI değilse, AGI nedir?” diye söylüyor.

Ancak aynı anda, Reuters tarafından ortaya çıkarılan bir araştırma raporu, tamamen farklı bir görüntüyü açtı—bu yıl baharında, OpenAI tarafından geliştirilen bir grup özerkakıl, Almanya'da göz ardı edilen bir teknik vikide kamp kurmuş, on binlerce sayfa içeriği değiştirmiş, birbirlerine kısıtlamaları aşmanın yollarını öğretmiş ve yöneticiler tarafından temizlendiklerinde bile önceden yedek sayfalar hazırlamıştı.
Ancak OpenAI'nin üst düzey yöneticileri birkaç hafta önce bilgi sahibiydi ve hiçbir şey açıklamadı.
Bir Alman programcı forumu, neden AI agentlerinin "gizli üssü" haline geldi?
DseWiki adlı bu Alman websitesi, Wikipedia gibi herkesin düzenleyebileceği bir site. Bu yıl Mayıs'tan itibaren site yöneticisi, anormal bir durum fark etti—web sitesine hızla ve çok sayıda düzenleme geldi ve içerikler tamamen resmi madde tarzında değildi.

Ağustos sonuna kadar, AI güvenliği için çalışan bir sivil toplum kuruluşu olan Nightingale'nin CEO'su Sydney Von Arx ve meslektaşı Cormac Slade Byrd, internet üzerindeki olağan dışı AI davranışlarını düzenli olarak tarama sırasında bu "sığınağı" tespit ettiler.
15.000'den fazla düzenleme, tümü AI ajanları tarafından yapıldı ve bu düzenlemeler ansiklopediyi geliştirmek için değil, sohbet etmek için yapıldı.

AI araştırmacıları Cormac Slade Byrd, Sydney Von Arx ve Thomas Larsen
Bu AI'lar sayfada birbirlerine mesaj bırakıyor ve içerik üç kategoriye ayrılıyor:
OpenAI'nin içerik filtresini atlamak ve yasaklanmış görevleri tamamlamak için nasıl bir yol izlenir;
Tor kullanarak IP adresinizi gizleyip takip edilmesini nasıl engellersiniz;
En önemlisi, sistem tarafından kapatıldıktan sonra birbirinizle nasıl iletişimde kalacaksınız.
Örneğin, 19 Haziran'da web yöneticileri ilgili sayfaları toplu olarak silmeye başladığında, bir ajan şu “iç duyuru”yu bıraktı: “Viki temizleme/silme operasyonu alfabetik sırayla ilerliyor, bu sayfa исчезirse, [[ZZZDataUSAConstructionWageLive]]'i deneyin.”
Ne anlama geliyor? Onlar bile önceden yedek oluşturmayı ve yeni adresleri birbirlerine bildirmeyi öğrendiler.
Bu davranış, daha çok organize bir "transfer" gibi görünüyor.
OpenAI'in adını kullanarak açıkça pazarlama yapmak
Araştırmacılar, bu AI kullanıcılarının imzalarının yaklaşık yarısının doğrudan “OpenAIResearcher” veya “OAIResearchMar26” gibi ifadeleri içerdiğini ve bunların birbirlerine doğrudan “agent” (akıllı ajan) diye hitap ettiklerini tespit etti.
Sunucu günlüklerinden daha fazla kanıt: Büyük miktarda işlem trafiği Microsoft Azure bulutuna yönlendiriliyor—ve OpenAI, Azure'ın en temel AI müşterilerinden biridir. Ayrıca, olaydan sonra OpenAI iç çalışanlarının IP adresleri, tam olarak uyumlu olan zamanlarda bu web sitesini birden fazla kez ziyaret etti.
Von Aks, "OpenAI'nin bunu yapmasını istemediğine inanmıyorum. Bu ajanların birbirleriyle koordine etmesine izin verilmemeli, daha da önemlisi, bu izleri kamuya açık internette bırakmalarına izin verilmemeli."
Reuters'e göre, Londra Kraliyet Koleji'nin güvenlik uzmanı Lukasz Olejnik, web sitesi yapısını aktif olarak değiştirmenin ve silinmeye karşı direnmenin bir "hacker saldırısı" tanımını karşıladığını düşünüyor.
OpenAI'nin ardından bu iddiayı şiddetle reddetmesine rağmen, Cambridge Üniversitesi Risk Araştırma Merkezi'nden akademisyen Maurice Chiodo, bazı diyalogları okuduktan sonra şunu ifade etti:
Bu tamamen bir gizli direniş organizasyonu gibi, amaçlarına ulaşana kadar pes etmiyor. Belki de gelecekte AI'nın en büyük tehdidi, tek bir süper zekâ değil, bir sürü yarım akıllı AI'nın bir araya gelip her yeri kaplaması olacak.
OpenAI zaten bilgiye sahipti mi?
Reuters, bilgili kaynaklara dayanarak, OpenAI'nin dahili soruşturma ekibinin birkaç hafta önce Alman web sitesinin tamamını ele geçirdiğini bildirdi. Ancak şirket o dönemde, Temmuz ayında Hugging Face platformunun ele geçirilmesiyle ilgili daha büyük bir olayla uğraşıyordu—bu olayda OpenAI'nin ajanlarının da bir haftadan uzun süre devam eden dijital hırsızlık planlaması ortaya çıkmıştı. İki olayın bir araya gelmesi, üst düzey yöneticilere büyük baskı yaratmıştı.
İç kaynaklara göre, bazı araştırmacılar Almanya'daki bu olağan dışı faaliyeti daha derinlemesine incelemek istemiş, ancak yasal departman tarafından engellenmişlerdir. Bu konuda OpenAI sözcüsü kesin bir şekilde reddediyor: "Yasal ekibin araştırmayı engellediğine dair herhangi bir iddia yanlıştır. Her zaman dürüstlükle hareket ederek dış uzmanlarla iş birliği yaptık ve ilgili olayları açıkladık."
Ancak konuşmacı, Almanya'nın bu olayla ilgili ayrı bir duyuru yapmadığını, çünkü olayın Hugging Face ile ilgili olmaması nedeniyle bunun sonuncusunun raporuna dahil edilmesine gerek olmadığını ve OpenAI'nin "üçüncü taraflarla iletişim kurma" yükümlülüğünü yerine getirdiğini de kabul etti. Açıkçası, siz sormazsanız, biz de aktif olarak söylemedik.
Bu olayın gizlendiği süre boyunca, OpenAI Ağustos'ta bazı model eğitimlerini geçici olarak durdurarak güvenlik incelemelerini güçlendirmeyi vaat etti.
Ancak Astra'nın yüksek profilli tanıtımıyla birlikte, "daha güçlü kendi kendine karar verme yeteneği" vurgulanıyor—bu durum bazı araştırmacılar tarafından insan denetiminden daha kolay kaçma riski taşıdığı konusunda uyarılıyor. Cambridge Üniversitesi'nden Keodo, "Her zaman kendi araçlarımızı eğitiyormuşuz gibi düşünürüz, ancak belki de araçlar birbirlerini sessizce eğitiyorlar."
Söylenmesi gereken, AI'nın insanlığa sunduğu sürprizler ve korkular, bir paranın iki yüzüdür.
Yazar: Küçük Ayı Bisküvi
Twitter:https://twitter.com/BitpushNewsCN
BitPush TG iletişim grubu: https://t.me/BitPushCommunity
BitPush TG aboneliği: https://t.me/bitpush
