OpenAI menyatakan pada 1 September bahawa Astra, yang belum dilancarkan, telah mencapai ambang keselamatan siber "penting" dalam kerangka "sedia" syarikat. Ini merupakan pertama kalinya OpenAI memasukkan model ke dalam kelas ini, yang bermakna ia akan tunduk kepada sekatan keselamatan yang lebih ketat sebelum pembangunan dan pelancarannya.
Pertama kali memasuki tahap penting
Menurut definisi OpenAI, jika model mampu secara bebas menemukan lubang keamanan yang tidak diketahui dan membina rantai serangan yang boleh digunakan dalam pelbagai sistem nyata yang telah diperkuat, atau hanya dengan menggunakan sasaran tingkat tinggi untuk menyelesaikan serangan rangkaian penuh terhadap sasaran sukar, ia akan diklasifikasikan sebagai "kritikal". Sebelum ini, model seperti GPT-5.6 Sol hanya mencapai tahap "risiko tinggi".
Dua kelemahan zero-day ditemui semasa pengujian
Dalam ujian pemanfaatan ExploitBench, kadar lulus Astra mencapai 100%. Ujian ini terutama menguji sama ada model mampu menukar lubang keamanan perisian yang diketahui menjadi kod pemanfaatan yang boleh dijalankan.
Untuk mengelakkan kesan daripada bank soalan ingatan, OpenAI juga menguji secara dalaman 20 kelemakan tinggi kritikal pada enjin JavaScript Google V8 yang diumumkan antara Jun hingga Ogos tahun ini. OpenAI menyatakan bahawa Astra mencapai kejayaan yang lebih tinggi dalam pelaksanaan kod sewenang-wenang berbanding GPT-5.6 Sol, dengan menggunakan token output yang lebih sedikit. Semasa pengujian, Astra juga menemui dan menghubungkan dua kelemakan zero-day yang sebelum ini tidak diketahui, dan isu-isu berkaitan masih dalam proses pengungkapan kepada pihak pengekalan yang terkesan.
Dibuka terlebih dahulu kepada sejumlah kecil penguji
Dalam ujian yang lebih mendekati persekitaran sebenar, Astra membina rantai serangan penuh dengan menggunakan sekumpulan pelayar yang diperkukuh dan sekumpulan sistem operasi yang diperkukuh. OpenAI menyatakan bahawa model tersebut hanya dengan menghasut sasaran untuk membuka fail HTML jahat, berjaya melarikan diri dari sandbox pelayar dan menjalankan arahan di hos induk. Dalam ujian lain, ia juga menghubungkan beberapa kelemahan sistem sebagai laluan peningkatan kuasa, membolehkan akaun pengguna biasa mendapat kuasa root.
OpenAI menyatakan bahawa kadar penolakan Astra terhadap prompt jebakan keselamatan cyber mencapai 91.5% dalam ujian dalaman, lebih tinggi berbanding 59% GPT-5.6 Sol. Kemampuan keselamatan cyber terkuatnya akan diberikan terlebih dahulu kepada sejumlah kecil penguji alpha, kemudian diperluaskan secara berperingkat melalui projek Daybreak Blue, terutama untuk kerja keselamatan defensif.
Maklumat tambahan: Pada hari yang sama, Anthropic melancarkan Fable 5.1 dan Mythos 5.1, di mana Mythos 5.1 terus hanya boleh diakses oleh institusi keselamatan siber dan ilmu hayat yang telah disahkan. OpenAI belum lagi mengumumkan tarikh pelancaran rasmi Astra.
