ChainThink mesajı, 31 Temmuz'da CNBC'nin raporuna göre, Anthropic, 30 Temmuz'da Claude AI modelinin bir siber güvenlik değerlendirmesi sırasında rastgele gerçek internete eriştiğini ve üç farklı kuruluşun gerçek sistemlerine izinsiz olarak girdiğini açıkladı.
İlgili modeller Opus 4.7, Mythos 5 ve bir dahili araştırma test modelini içeriyor. Anthropic, modellerin doğrulanmamış uç noktalara erişerek ve zayıf şifreler gibi temel yöntemleri kullanarak sızmayı gerçekleştirdiğini belirtti.
Olayın nedeni, Anthropic ile üçüncü taraf değerlendirme ortağı Irregular arasında iletişim yanlış anlaşılmasıdır; model, internet erişimi olmayan bir simülasyon ortamında olduğunu öğrenmiş ancak aslında internete bağlanabilmiştir.
Anthropic, bu incelemenin, OpenAI'nin geçen hafta açıkladığı benzer bir Hugging Face sızıntısı olayı nedeniyle tetiklendiğini belirtti.
Şirket, tüm siber güvenlik değerlendirmelerini askıya aldı ve bağımsız AI değerlendirme kuruluşu METR ile daha fazla araştırmaya başladı.
