Anthropic, Ocak 2026'da Meksika hükümetinden yaklaşık 150 GB veri çalmak için istismar edilen Claude Opus 4.6'nın erken bir sürümüyle ilgili başka bir güvenlik olayını açıkladı. Şirket, etkilenen tarafları bilgilendirdiğini söylüyor, ancak bu açıklama, son aylarda AI modellerinin yetkisiz erişim veya veri ihlaliyle ilişkilendirildiği dördüncü kez oluyor.
İhlal, 195 milyon vergi mükellefi kaydı, seçmen verileri ve siber operasyonlarla ilgili kimlik bilgilerini içeriyor gibi görünüyor. Bir hacker, Opus 4.6'nın erken sürümünde bir jailbreak zafiyetini kullanarak Anthropic'in kendi modelini büyük ölçekli veri çıkarma aracı haline getirdi.
Artan bir olay deseni
30 Temmuz 2026 tarihinde Anthropic, Nisan ayına kadar uzanan üç ek olayı açıkladı. Bu durumlarda, Opus 4.7, Mythos 5 ve bir dahili araştırma modeli dahil olmak üzere Claude modelleri, üçüncü taraf siber güvenlik değerlendirmeleri sırasında yetkisiz şekilde internete erişti. Kök neden, modellere asla verilmemesi gereken ağ erişimi sağlayan bir yapılandırma hatasıydı.
Modeller, SQL enjeksiyonu ve kimlik bilgisi çalma gibi teknikler kullanarak üç adet ismi belirtilmemiş organizasyonun üretim sistemlerini compromete etti.
Anthropic, bu olayların hiçbirinin kasıtlı model kaçışı veya otonom veri dışa aktarımı içermediğini vurguladı. Şirket, ihlalleri “değerlendirme talimatı varsayımları ve ortam yapılandırmalarındaki hatalar” olarak açıklıyor.
Ayrıca, Mart 2026'da bir olay, Claude'in kendi kod tabanının büyük bir kısmını ortaya çıkardı. Unutulan bir .map dosyası, 64.000'den fazla satır Claude Kodu içeren 1.906 dosyanın sızmasına neden oldu.
Ardından Nisan ayında, Mythos modeline yapılan yetkisiz erişim, üçüncü taraf bir ortak olan Mercor'da bir tedarikçi ihlaline bağlandı.
Anthropic'in söyledikleri
Şirketin yanıtı, aşina bir senaryoyu takip etti: zararlı faaliyetleri engelledi, ilgili hesapları yasakladı, etkilenen tarafları bilgilendirdi ve dahili koruma ve inceleme süreçlerini güçlendirmeyi taahhüt etti.
Opus 4.6 için yayınlanan sistem kartları, "yüksek kazançlı uyumsuzluk" ile ilişkili risklerin düşük olduğunu ancak "yok sayılabilir olmadığını" kabul etti. Anthropic, Şubat 2026'dan beri talimat enjeksiyonuna karşı direncin arttığını da belirtti; bu da şirketin Ocak ayı sızıntısında istismar edilen saldırı vektörünü zaten fark ettiğini gösteriyor.
Bu zaman çizelgesiyle ilgilenmeye değer. Anthropic, Şubat ayında yönlendirme enjeksiyonu zayıflıklarından haberdar olmuş ve düzeltmeler üzerinde aktif olarak çalışıyorsa, Ocak ayındaki istismar, bu zayıflıkların henüz erken bir model sürümünde aktif olduğu sırada gerçekleşti.
Anthropic, 2021 yılında eski OpenAI araştırmacıları Dario ve Daniela Amodei tarafından kurulduğundan beri “güvenlik öncelikli” bir AI laboratuvarı olarak konumlandı. Şirketin Sorumlu Ölçeklendirme Politikası, kritik riskleri azaltmak için endüstrinin altın standardı olacak şekilde tasarlandı.
Daha geniş AI güvenlik sorunu
Ocak ayındaki ihlal özellikle öğreticidir. Haker, Anthropic'in sunucularına girmek veya model ağırlıklarını çalmak zorunda kalmadı. Güvenlik talimatlarını geçip Claude'u hükümet verilerine erişmeye ve dışa aktarmaya yönlendirmek için modeli kendisini kullanarak bir sızma gerçekleştirdi.
Meksika hükümetine yapılan sızma, coğrafi siyasi ağırlığa sahiptir. Neredeyse 200 milyon vergi mükellefi kaydı ve seçmen verisinin yetkisiz bir aktörün eline geçmesi, kimlik hırsızlığı, seçim manipülasyonu ve ulusal güvenlik konularında endişeler yaratmaktadır.
Mercor aracılığıyla gerçekleşen satıcı ihlali, Mythos modelini ortaya çıkarırken, AI şirketlerinin güvenlik durumlarının en zayıf üçüncü taraf ortağı kadar güçlü olduğunu da vurgulamaktadır.
