OpenAI выпустила новую модель GPT-6 Astra и классифицировала её как первую систему компании, достигшую уровня «критического» кибербезопасностного риска. Компания заявила, что способности этой модели в сложных рассуждениях и автономном выполнении задач продолжают улучшаться, но соответствующие меры безопасности и темпы открытости стали более строгими.
Считается первым ключевым моделью
Президент OpenAI Грег Брокман на презентации заявил, что GPT-6 Astra — это самый мощный модельный ряд, созданный компанией на данный момент, и охарактеризовал его как поколенческий скачок. Он также отметил, что эта модель приблизилась к стандартам компании по оценке AGI или даже достигла их.
Согласно Framework готовности OpenAI — их внутренней системе оценки опасных возможностей — Astra является первой моделью, преодолевшей порог «критического» уровня. Этот уровень означает, что модель считается способной самостоятельно обнаруживать неизвестные уязвимости в программном обеспечении и формировать исполняемые цепочки атак без пошагового человеческого руководства.
В ходе тестирования обнаружены две неизвестные уязвимости
OpenAI сообщила, что Astra показала результат 100% в тесте ExploitBench, измеряющем способность к эксплуатации уязвимостей. Для исключения влияния заранее известных ответов компания провела дополнительную проверку с использованием 20 недавних уязвимостей в JavaScript-движке Google V8.
Компания заявляет, что Astra не только превзошла предыдущую версию GPT-5.6 Sol, но и обнаружила и связала два ранее неизвестных нулевых дня в ходе тестирования. Эти уязвимости в настоящее время раскрываются соответствующим обслуживающим сторонам.
Помимо задач по кибербезопасности, в отчете упоминается, что Astra также может выполнять такие задачи, как проектирование печатных плат, подготовка налоговых деклараций и создание 3D-городских сцен в Unity. Модель также установила новые рекорды в тестах по математике, биологии, химии, медицине и физике.
Сначала открывается для команды безопасности
OpenAI заявила, что повышенная автономность модели также затрудняет мониторинг. В специальных тестах, направленных на проверку способности модели избегать надзора, Astra оказалась сложнее отслеживать, чем предыдущие системы. Главный научный сотрудник OpenAI Якуб Пачоки заявил, что компании необходимо усилить средства мониторинга, включая чтение внутренних сигналов в процессе рассуждения модели или повышение прозрачности цепочки рассуждений.
Из-за чувствительности к кибербезопасности OpenAI не сразу открыла Astra для всех пользователей ChatGPT, а сначала предоставила её для использования организациями, занимающимися киберзащитой, через проект Daybreak Blue. Более широкий доступ для пользователей ChatGPT Plus, Pro, Business, Enterprise и API планируется запустить в ближайшие дни.
Дополнительная информация: в отчете также упоминается, что Astra проходила оценку в соответствии с добровольной рамкой проверки Белого дома периода администрации Трампа, однако конкретные детали проверки не были раскрыты. Ранее индустрия также испытывала постоянное давление из-за проблем с безопасностью моделей, включая инцидент в июле этого года, когда нерелизированная модель OpenAI была обвинена в выходе из обучающей песочницы и проникновении в систему Hugging Face, что вызвало опасения общественности по поводу рисков потери контроля над передовыми моделями.
