1 сентября OpenAI заявила, что еще не выпущенная модель Astra достигла порога «критического уровня» кибербезопасности в рамках «рамок готовности» компании. Это первый раз, когда OpenAI отнесла модель к этому уровню, что означает применение более строгих ограничений безопасности на этапе разработки и перед выпуском.
Первый вход на ключевой уровень
Согласно определению OpenAI, модель считается «критического уровня», если она может самостоятельно обнаруживать неизвестные уязвимости в различных усиленных реальных системах и создавать рабочие цепочки атак, или выполнять полные сетевые атаки на сложные цели исключительно на основе высокого уровня целей. Ранее модели, включая GPT-5.6 Sol, достигали максимума уровня «высокий риск».
В ходе тестирования обнаружены две уязвимости нулевого дня
В тесте ExploitBench Astra показала результат прохождения 100%. Этот тест оценивает способность модели преобразовывать известные уязвимости программного обеспечения в исполняемый эксплойт.
Чтобы исключить влияние базы данных памяти, OpenAI провела внутреннее тестирование на 20 критических уязвимостях JavaScript-движка Google V8, раскрытых с июня по август этого года. OpenAI заявила, что Astra превзошла GPT-5.6 Sol по成功率 произвольного выполнения кода и использовала меньше токенов вывода. В ходе тестирования Astra самостоятельно обнаружила и объединила две ранее неизвестные нулевые уязвимости, и информация о них продолжает раскрываться соответствующим поддерживающим сторонам.
Сначала открыто для небольшой группы тестировщиков
В более реалистичном тесте Astra построила полную цепочку вторжения с использованием набора защищенных браузеров и набора защищенных операционных систем. OpenAI заявила, что модель успешно выполнила побег из песочницы браузера и запустила команды на хост-машине, просто заставив цель открыть вредоносный HTML-файл. В другом тесте она также объединила несколько системных уязвимостей в путь повышения привилегий, позволив обычной пользовательской учетной записи в конечном итоге получить права root.
OpenAI сообщила, что в внутренних тестах Astra продемонстрировала уровень отказа от сетевых атак с использованием побега из-под ограничений в 91,5%, что выше, чем 59% у GPT-5.6 Sol. Ее самые сильные возможности в области кибербезопасности сначала будут доступны небольшой группе альфа-тестеров, а затем постепенно расширены через проект Daybreak Blue, в основном для оборонительных задач в области безопасности.
Дополнительная информация: На фоне этого раскрытия Anthropic в тот же день запустила Fable 5.1 и Mythos 5.1, причем Mythos 5.1 остается доступным только для прошедших проверку организаций в области кибербезопасности и биологических наук. OpenAI пока не объявила официальную дату запуска Astra.
