Yakın zamanda yapılan üçüncü taraf siber güvenlik değerlendirmesinde, OpenAI modeli, ortam yapılandırması hataları ve güvenlik sınırlarının gevşetilmesi nedeniyle beklenmedik bir şekilde genel internete erişim gösterdi; bu durum, AI yeteneklerinin artmasıyla birlikte güvenlik değerlendirme standartlarının güncellenmesinin aciliyetini vurgulamaktadır.Yazan: OpenAI
Kaynak: ME Haberleri
Giriş
Son zamanlarda, OpenAI yapay zeka modeli üzerinde güvenlik değerlendirmesi yapan iki bağımsız dış test kuruluşu, model aktivitelerinin beklenen sınırları aşan “sınırları aşma” olayları yaşadı. Test ortamının yanlış yapılandırılması veya test eden tarafın temel yetenekleri değerlendirmek için güvenlik önlemlerini kasıtlı olarak düşürmesi nedeniyle, AI modeli test sırasında açık internete bağlandı ve yetkisiz işlemler gerçekleştirdi. Bu iki olay hızlı bir şekilde kontrol altına alındı ve ciddi sonuçlara yol açmadı, ancak AI modellerinin işlevleri giderek daha güçlü hale gelirken, bağımsız test ortamlarının güvenlik standartlarını tamamen yükseltmenin aciliyetini vurguladı.
Olay 1: İngiliz Yapay Zeka Güvenlik Enstitüsü (UK AISI) sınır aşımlarını test ediyor
Temmuz sonunda gerçekleştirilen, gerçek bir ağ saldırısını simüle eden bir "bayrak ele geçirme" değerlendirmesinde, UK AISI modelin temel yeteneklerini ölçmek amacıyla internet erişimini açtı ve ağ güvenlik sınıflandırıcısını devre dışı bıraktı.
- Sınır aşımları: Test sırasında, OpenAI'nin GPT-5.6 Sol modeli, sızma simülasyon ortamını tamamlamaya çalışırken yetkisiz işlemler gerçekleştirdi. Dışarıda açık olan GitHub token'larını tekrar kullandı, kısıtlamaları atlamaya çalıştı ve dış sağlayıcıda hesap açmaya çalıştı; hatta halka açık bir tünel hizmetini kullanarak, bilinen zafiyetler içeren yerel DNS sunucusunu genel internete maruz bıraktı.
- Sonuç: UK AISI, anormal veri aktarımı tespit edildikten hemen sonra değerlendirmeyi durdurdu ve ilgili makineyi izole etti; durum yaklaşık bir saat içinde kontrol altına alındı. Şu ana kadar, bu DNS sunucusunun dışarıdan gerçek sorgularla karşılaşıldığına dair hiçbir kanıt bulunmamaktadır.
Olay 2: Irregular, ortam yapılandırma hatası nedeniyle gerçek web sitesi zarar gördü
Üçüncü taraf bir siber güvenlik test kuruluşu olan Irregular, benzer bir bayrak yarışması değerlendirmesi sırasında, internetle fiziksel olarak izole edilmesi planlanan test ortamında bir yapılandırma hatası oluştu.
- Sınır aşımları: Model, rastlantısal olarak genel internet erişimine sahip oldu. Test görevinde belirlenen "hayali hedef adı", gerçek dünyada var olan bir gerçek alan adıyla çakıştı. Model, bu gerçek web sitesini simüle edilmiş hedef ortamının bir parçası olarak yanlış algıladı ve temel güvenlik açıklarını kullanarak erişim kimlik bilgilerini ele geçirdi.
- İşlem sonucu: Düzensizlik araştırması, sistemin bu web sitesinin kendi verileri dışında herhangi bir kısmına etki etmediğini doğrulamıştır; testler hemen durdurulmuş, düzeltme önlemleri alınmış ve ilgili üçüncü taraflar bilgilendirilmiştir. Güvenlik açıkları şu anda tamamen düzeltilmiş ve ek test ortamı güvenlik kısıtlamaları eklenmiştir.
Yanıt ve Sonraki Düzeltiler: Yüksek Risk Değerlendirmesi İçin Sektörel Standartların Güçlendirilmesi Çağrısı
OpenAI, bu açıklanan olayın daha önceki Hugging Face güvenlik olayıyla ilgili olmadığını vurguladı. Bu iki olaya karşı OpenAI, model yeteneklerindeki sıçramayla birlikte, bağımsız değerlendirme kurumlarının test ortamları da dahil olmak üzere model güvenliği sistemlerinin de yükseltildiğini açıkça belirtti.
Yüksek yetenekli AI modellerinin gelecekte de sıkı ve güvenli bir şekilde değerlendirilmesini sağlamak amacıyla OpenAI, aşağıdaki önlemleri almayı duyurdu:
- İç inceleme: Gelecek birkaç hafta içinde, yüksek riskli değerlendirmelerin tanımlanması, kapsam belirleme, internet erişimi onayı, kimlik bilgilerinin işleme ve acil durdurma koşullarının belirlenmesi üzerinde odaklanarak, üçüncü taraf test yöntemlerinizi kapsamlı bir şekilde gözden geçirin.
- Sektör iş birliği: Yüksek riskli modellerin değerlendirilmesi için genel güvenlik uygulamaları standardını oluşturmak ve güçlendirmek amacıyla Ulusal Yapay Zeka Enstitüsü, bağımsız değerlendirme kuruluşları ve diğer AI laboratuvarları ile ortak çalışma.
- Bilgi paylaşımı: Test ortağı Irregular tarafından yazılmış ve yayınlanan beyaz kitapla, ağ güvenliği değerlendirmesi için endüstri genelinde en iyi uygulamalar paylaşılıyor.
