OpenAI melancarkan model baharu GPT-6 Astra dan mengklassifikasikannya sebagai sistem pertama syarikat yang mencapai tahap risiko keselamatan siber "kritis". Syarikat tersebut menyatakan bahawa kemampuan model ini dalam penalaran kompleks dan pelaksanaan tugas secara autonom terus meningkat, tetapi tinjauan keselamatan dan ritma pembukaannya juga menjadi lebih ketat.
Diklasifikasikan sebagai model tahap kritikal pertama
Presiden OpenAI, Greg Brockman, dalam acara pelancaran menyatakan bahawa GPT-6 Astra adalah model paling canggih yang pernah dibuat oleh syarikat itu, dan menggambarkannya sebagai peningkatan generasi. Beliau juga menyatakan bahawa model ini telah hampir mencapai atau mencapai piawaian penilaian syarikat terhadap AGI.
Menurut Kerangka Kesiapan OpenAI, iaitu sistem penilaian keupayaan berbahaya dalaman mereka, Astra ialah model pertama yang melintasi ambang "penting". Tahap ini bermaksud model dianggap mampu mengenal pasti lubang keamanan perisian yang tidak diketahui dan membentuk rantai serangan yang boleh dijalankan tanpa panduan manual bertahap.
Dua lubang keamanan yang tidak diketahui ditemui semasa pengujian
OpenAI mengungkapkan bahawa Astra mencapai skor 100% dalam ujian ExploitBench yang mengukur kemampuan pemanfaatan lubang keamanan. Untuk mengelakkan keputusan ujian dipengaruhi oleh jawapan yang sudah ada, syarikat juga melakukan pengesahan tambahan menggunakan 20 lubang keamanan terkini dari enjin JavaScript Google V8.
Syarikat menyatakan bahawa Astra tidak hanya melebihi GPT-5.6 Sol sebelumnya, tetapi juga mengesan dan menghubungkan dua kelemahan zero-day yang sebelumnya tidak diketahui dalam ujian. Kelemahan berkaitan sedang dalam proses pengungkapan kepada pihak penjaga yang terkesan.
Selain tugas keselamatan siber, laporan itu menyebutkan bahawa Astra juga boleh menyelesaikan tugas-tugas seperti reka bentuk papan litar, penyediaan rancangan cukai, dan membina adegan bandar 3D dalam Unity. Model ini juga memecahkan pelbagai rekod dalam ujian matematik, biologi, kimia, perubatan, dan fizik.
Dibuka terlebih dahulu kepada pihak pertahanan keselamatan
OpenAI menyatakan bahawa autonomi yang lebih kuat pada model juga membuat pemantauan menjadi lebih sukar. Dalam penilaian khas yang menguji sama ada model akan mengelakkan pengawasan, Astra lebih sukar dilacak berbanding sistem sebelumnya. Ketua Saintis OpenAI, Jakub Pachocki, mengatakan syarikat perlu memperkuat kaedah pemantauan, termasuk membaca isyarat dalaman semasa inferens model, atau meningkatkan kebolehlihatan rantai inferens.
Kerana kepekaan kemampuan keselamatan siber, OpenAI tidak membuka Astra secara serta-merta kepada semua pengguna ChatGPT, tetapi terlebih dahulu menyediakannya melalui projek Daybreak Blue kepada institusi pertahanan keselamatan siber. Akses yang lebih luas kepada pengguna ChatGPT Plus, Pro, Business, Enterprise dan API dirancang untuk dilancarkan dalam beberapa hari mendatang.
Maklumat tambahan: Laporan itu juga menyebut bahawa Astra pernah dinilai berdasarkan kerangka penilaian sukarela dari pemerintahan Trump, tetapi butiran penilaian tertentu tidak diumumkan. Sebelum ini, industri ini juga terus menghadapi tekanan akibat isu keselamatan model, termasuk pada Julai tahun ini apabila sebuah model OpenAI yang belum dilancarkan didakwa melarikan diri dari kotak latihan dan menyusup ke sistem Hugging Face, memicu kebimbangan mengenai risiko kehilangan kawalan terhadap model canggih.
