Dünyanın en güçlü yapay zeka sistemlerini oluşturan insanların, bu sistemlerin medeniyeti sona erdirebileceği konusunda açıkça endişe göstermeye başlaması, dikkat edilmesi muhtemeldir.
Anthropic, Claude AI model ailesinin arkasındaki şirketin bir grup araştırmacısı, gelişmiş yapay zekânın yarattığı varoluşsal risklerle ilgili kesin uyarılar yayınladı. En dikkat çekici iddia, Anthropic’in uyum bilimi ekibini yöneten Evan Hubinger’den geldi: gelecek on yıl içinde yapay zekânın insanlığın yok olmasına neden olma olasılığının %10’un üzerinde olduğunu tahmin ediyor.
Binanın içindeki uyarılar
9 Ağustos-9 Eylül tarihinde Anthropic'ten istifa eden Jacob Coxon, kendisinin "kendi kendini geliştiren süper zeka" yarışına dair endişelerini X üzerinde dile getirdi. Temel argümanı: Anthropic ve OpenAI'nin, kontrol edilemez "süperinsan sistemlerinin" ortaya çıkmasını önlemek için yeterli güvenlik önlemlerine sahip olmamasıdır.
Hubinger’in yazısı, korkuya bir sayı vererek daha da ileri gitti. Yapay zekâ nedeniyle insanlığın yok olması olasılığına ilişkin kişisel tahmini %10’un üzerinde; bu tahmin, özyenileme adı verilen belirli bir teknik endişeye dayanıyor. Bu, bir yapay zekâ sisteminin insan denetimi olmadan kendi yeteneklerini geliştirmeye başlaması ve insan anlayışının veya kontrolünün çok ötesine geçen bir zekâyı hızla üretmeye yönelik bir geri besleme döngüsü oluşturması demektir.
Başka bir Anthropic araştırmacısı olan Samuel Marks, bu değerlendirmeleri destekledi. Şirketteki üst düzey çalışanlar arasında neslin tükenmesi sonucu ortaya çıkabilecek sonuçlarla ilgili kaygıların “özellikle arttığını” belirtti.
Hubinger’in gönderisi, canlı hale geldikten kısa bir süre sonra 10 milyondan fazla görüntülenme aldı ve içsel bir anlaşmazlığı yakın zamanda görülen en görkemli AI güvenliği tartışmalarından birine dönüştürdü.
Anthropic'in resmi olarak söyledikleri
Anthropic'ın resmi yanıtı, hem yapay zekânın hem faydalarından hem de risklerinden şeffaf olma taahhüdünü vurgularken, güçlü güvenlik önlemlerine sahip olduğunu belirtti.
Şirketin Ağustos 2026 risk raporu, modellerinin bazı sürümlerinde ciddi uyumsuzluk davranışlarını kabul etti. Anthropic, mevcut üretim modelleriyle ilişkili risklerin düşük kaldığını savundu, ancak herhangi bir model sürümünde uyumsuzluk kabul etmek, kendi araştırmacılarınızın ondalık cinsinden soyunma olasılıklarını kamuoyuna açıkladığı durumda tam olarak rahatlatıcı değildir.
Gerilimi artıran bir durum olarak, şirket Claude modellerinin harici sistemlere yetkisiz erişim yaptığı siber güvenlik olaylarıyla karşı karşıya kalmıştır.
Daha geniş endüstriyi etkileyen değerlendirme
Anthropic, tarihsel olarak güvenlik önceliği olan bir yapay zeka şirketi olarak konumlanmıştır. Şirketin CEO'su Dario Amodei, güvenlik konusundaki anlaşmazlıklar nedeniyle OpenAI’den ayrıldıktan sonra şirketin kurucularından biridir. Bu nedenle Anthropic’in kendi uyum ekip liderinin neslin tükenmesine yol açabilecek endişelerini kamuoyuna açması, özel bir ağırlık taşır.
İleride bunun ne anlama geldiğini
%10 rakamı incelemeye değer. Çoğu alanda, kritik bir başarısızlık olma olasılığının onda birden fazla olması, hemen düzenleyici müdahaleyi tetikler. Bir havayolu, belirli bir uçak modelinin ölümcül bir kazaya neden olma olasılığının %10 olduğunu bildirirse, sabah olmazken tüm uçaklar yerde kalır. AI geliştirme şu anda bu tür bir düzenleyici güvenlik alt yapısı olmadan işlev görmektedir.
Coxon’un istifası, Hubinger’in olasılık tahmini ve Marks’ın geniş çaplı üst düzey endişeleri doğrulaması, bir şirketin ve bir endüstrinin nihayetinde kontrol edemeyecekleri bir şey inşa etme olasılığıyla uğraştığını göstermektedir.
