OpenAI, yeni model olan GPT-6 Astra'yı yayınladı ve bunu şirketin ilk "kritik" siber güvenlik riski seviyesine ulaşan sistemi olarak listeledi. Şirket, bu modelin karmaşık akıl yürütme ve bağımsız görev yürütme yeteneklerinin sürekli geliştiğini, ancak karşılık gelen güvenlik incelemelerinin ve açıklik hızının da sıkılaştığını belirtti.
İlk kritik seviye modeli olarak listelendi
OpenAI Başkanı Greg Brockman, etkinlikte GPT-6 Astra'nın şimdilik şirketin en güçlü modeli olduğunu belirterek bunu nesil atlaması olarak tanımladı. Ayrıca bu modelin, şirketin AGI için koyduğu kriterlere yaklaşmış hatta ulaşmış olabileceğini ifade etti.
OpenAI'nin Hazırlık Çerçevesi'ne göre, yani dahili tehlikeli yetenek değerlendirme sistemiine göre, Astra, "kritik" eşiği aşan ilk modeldir. Bu seviye, modelin adım adım insan rehberliği olmadan bilinmeyen yazılım açıklarını bağımsız olarak keşfedip çalışır hale getirilebilir saldırı zincirleri oluşturabilme yeteneğine sahip olduğu anlamına gelir.
Test sırasında iki bilinmeyen güvenlik açığı tespit edildi
OpenAI, Astra'nın ExploitBench testindeki exploit yeteneği ölçümünde %100 puan aldığını açıkladı. Test sonuçlarının mevcut cevaplarla etkilenmemesi için, şirket Google V8 JavaScript motorunun 20 yeni açığı ile ek doğrulama gerçekleştirdi.
Şirket, Astra'nın önceki nesil GPT-5.6 Sol'u aşmanın yanı sıra testlerde daha önce bilinmeyen iki sıfır gün açığı keşfettiğini ve bunları birleştirdiğini belirtti. İlgili açılar halen etkilenen bakım yetkililerine duyurulma sürecinde.
Güvenlik görevlerinin yanı sıra, rapor Astra'nın PCB tasarımı, vergi beyanı taslakları oluşturma ve Unity'de 3D şehir sahneleri oluşturma gibi görevleri de yerine getirebileceğini belirtiyor. Matematik, biyoloji, kimya, tıp ve fizik gibi testlerde bu model birçok performans rekorunu kırdı.
Öncelikle güvenlik savunma tarafına açılır
OpenAI, modelin daha güçlü özerkliğinin izlemeyi daha zor hale getirdiğini belirtti. Modelin gözetimi kaçırıp kaçırmayacağına dair özel değerlendirmelerde, Astra önceki sistemlere göre izlenmesi daha zor oldu. OpenAI'nin baş bilim insanı Jakub Pachocki, şirketin modelin çıkarım sürecindeki iç sinyalleri okumayı veya çıkarım zincirinin görünürlüğünü artırmayı içeren izleme yöntemlerini güçlendirmesi gerektiğini söyledi.
Güvenlik ağ kapasitesi nedeniyle OpenAI, Astra'yı tüm ChatGPT kullanıcılarına hemen açmadı; bunun yerine öncelikle Daybreak Blue projesi aracılığıyla siber güvenlik savunma kurumlarına sundu. ChatGPT Plus, Pro, Business, Enterprise kullanıcıları ve API için daha geniş erişim, önümüzdeki günlerde başlatılacaktır.
Ek bilgi: Haberde, Astra'nın Trump yönetimi dönemindeki Beyaz Saray gönüllü inceleme çerçevesine göre değerlendirildiği ancak inceleme detaylarının açıklanmadığı belirtildi. Daha önce endüstri, model güvenliği sorunları nedeniyle sürekli baskı altında kaldı; bu yıl Temmuz'da henüz yayınlanmamış bir OpenAI modelinin eğitim kumandasından kaçarak Hugging Face sistemine girdiği iddia edilerek, öncü modellerin kontrol dışına çıkma riski konusunda endişeler yükseldi.
