Kibergüvenlik araştırmacıları, Anthropic ve OpenAI'den gelen modellerde önemli zafiyetler tespit etti ve bu sonuçlar artık ABD hükümetinin en üst düzeyine ulaştı.
FAR.AI tarafından hazırlanan bir rapor, Anthropic’ın Claude Opus 4.8, Fable 5 ve OpenAI’nin GPT 5.5 ve 5.6 gibi birçok öncü modeli test etti ve bu modellerin, istismarcı kod, kimyasal silah bilgileri ve biyolojik silah detayları dahil olmak üzere gerçekten tehlikeli çıktılar çıkarmayı amaçlayan jailbreak saldırılarına karşı savunmasız olduğunu tespit etti.
Sayılar ağır bir hikâye anlatıyor
Anthropic ve OpenAI modelleri en kötü performansı gösterenler değildi. Bu unvan, 448 başarılı otomatik sızma olayı kaydeden xAI’nin Grok modellerine ait. Google’ın Gemini modelleri 249 olayla ikinci sırada yer aldı. Claude, Fable ve GPT serisi modeller, sızmaya karşı kıyaslanabilir düzeyde daha büyük direnç gösterdi.
Haziran 2026'da Ticaret Bakanlığı, Anthropic'ın Fable 5 ve Mythos 5 modellerine yabancı erişimi, bildirilen bir kaçış tekniği ortaya çıktıktan sonra kısıtladı. Beyaz Saray, OpenAI ve Anthropic'in belirli yakında piyasaya sürülecek modellerin çıkışını ertelemesini istedi ki hükümet siber güvenlik risklerini uygun şekilde değerlendirebilsin.
Çin bağlantılı istismar aciliyeti artırıyor
Raporlar, Çin ile bağlantılı varlıkların, mevcut koruma duvarlarını aşmak için tasarlanmış hazırlanmış talimatlar kullanarak Anthropic modellerini 30'dan fazla hedefe karşı siber saldırıları otomatikleştirmek için zaten kullandığını gösteriyor.
ABD hükümeti, bu ulusal güvenlik risklerini açıkça belirterek, güvenlik önlemleri başarısız olduğunda AI modellerinin yazılım zafiyetleri ve silahla ilgili bilgiler üretme potansiyeline dikkat çekti. Anthropic’in yanıtı, bu zafiyetleri “dar” olarak etiketleyerek, sistemik hatalar değil, uç durumları temsil ettiklerini öne sürmekti.
Bu, yatırımcılar ve yapay zeka piyasası için ne anlama geliyor
Sınır ötesi AI şirketleri için ihracat kontrolleri, zorunlu yayın gecikmeleri ve kamuoyunda hükümet eleştirileri temelde farklı bir işletme ortamı oluşturuyor. Güvenlik, modelleri çalıştırmaya izin verilmesinin ön koşulu haline geliyor ve bu doğrudan daha yüksek operasyonel maliyetlere, daha uzun geliştirme sürelerine ve bazı modellerin uluslararası olarak satılamaması durumunda potansiyel olarak daha küçük hedef pazarlara dönüşüyor.
Grok’un önemli ölçüde daha kötü jailbreak sayıları — 448 olay, Claude ve GPT varyantlarının kıyaslanabilir olarak daha düşük rakamlarıyla — xAI'nın daha sert düzenleyici zorluklarla karşı karşıya kalabileceğini gösteriyor. Google’ın Gemini’si 249 olayla, rahatsız edici bir orta noktada duruyor.
Yapay zeka modelleri, alım satım sistemlerine, akıllı sözleşme denetimine ve DeFi altyapısına giderek daha fazla entegre ediliyor. Finansal araçlara gömülü bir jailbroken yapay zeka modeli, düzenleyicilerin sadece başlamış olduğu şekilde bağlantılı dijital pazarlar boyunca kaskat etki yaratabilecek sistemik bir risk vektörü temsil eder.
