Sinabi ng OpenAI noong Setyembre 1, ang Astra, na hindi pa ipinapakita, ay nakamit ang “kritisyal na antas” ng网络安全 threshold sa kanilang “framework para sa paghahanda.” Ito ang unang pagkakataon na isinama ng OpenAI ang isang modelo sa antas na ito, na nangangahulugan na mas mahigpit ang mga limitasyon sa kaligtasan na magpapalabas bago ang pagpapalabas at pagpapaunlad.
Unang pagpasok sa key level
Ayon sa depinisyon ng OpenAI, kung ang isang model ay nakakahanap nang mag-isa ng mga hindi kilalang vulnerabilities sa iba’t ibang pinagpapalakas na tunay na sistema at nakakabuo ng isang gumagana na attack chain, o nakakamit ng isang buong network attack sa mga mahirap na layunin gamit ang mga mataas na layunin lamang, ito ay kikilalanin bilang “critical level.” Bago pa, ang mga model tulad ng GPT-5.6 Sol ay nasa pinakamataas na antas lamang ng “high risk.”
Natuklasan ang dalawang zero-day vulnerabilities sa pagsubok
Sa ExploitBench, ang pass rate ng Astra ay 100%. Ang pagsubok na ito ay pangunahing nagtataya kung kaya ng modelo na i-convert ang mga kilalang vulnerability sa software sa executable na exploit code.
Para maiwasan ang epekto ng memorya ng question bank, pumili ang OpenAI ng 20 malalaking butas sa seguridad ng Google V8 JavaScript engine na inilathala mula sa Hunyo hanggang Agosto ng taong ito para sa panloob na pagsubok. Sinabi ng OpenAI na mas mataas ang tagumpay ng Astra sa arbitrary code execution kaysa sa GPT-5.6 Sol, at gumamit ito ng mas kaunting output tokens. Sa proseso ng pagsubok, natuklasan at isinambong ng Astra ang dalawang pekeng zero-day na butas na dating hindi kilala, at patuloy pa ang pagpapahayag ng mga isyu sa mga nagmamay-ari na apektado.
Unang ipapalabas sa kaunting mga tester
Sa mas tunay na pagsubok, nilikha ng Astra ang buong chain ng pag-atake gamit ang isang pinagpapalakas na browser at isang pinagpapalakas na operating system. Sinabi ng OpenAI na ang modelo ay nakakamit ng browser sandbox escape at pagsasagawa ng mga utos sa host machine lamang sa pamamagitan ng pagpapahintulot sa target na buksan ang isang masamang HTML file. Sa isang iba pang pagsubok, pinagsama nito ang maraming system vulnerability bilang isang path para sa privilege escalation, na nagresulta sa pagkakaroon ng root privileges ng isang karaniwang user account.
Sinabi ng OpenAI na ang rate ng pagtanggi ni Astra sa mga prompt na cybersecurity jailbreak ay umabot sa 91.5% sa loob na pagsubok, mas mataas kaysa sa 59% ng GPT-5.6 Sol. Ang pinakamalakas na kakayahan nito sa cybersecurity ay muna ay maibibigay sa ilang alpha testers, at pagkatapos ay papalawakin nang paulit-ulit sa pamamagitan ng proyektong Daybreak Blue, na pangunahing nakatuon sa defensive security work.
Karagdagang impormasyon: Habang ipinapahayag ang pagpapahayag na ito, inilunsad din ni Anthropic ang Fable 5.1 at Mythos 5.1, kung saan patuloy na nakalimita lamang ang Mythos 5.1 sa mga nagsasagawa ng pag-aaral sa cybersecurity at life sciences na nakakatanggap ng pagsusuri. Hindi pa naglabas ng opisyal na petsa ng paglunsad ng Astra ang OpenAI.
