OpenAI випустила нову модель GPT-6 Astra і класифікувала її як першу систему компанії, що досягла рівня «критичного» кібербезпекового ризику. Компанія зазначила, що здатність цієї моделі до складного міркування та автономного виконання завдань продовжує зростати, але відповідні процедури безпеки та темпи відкритості стають строгішими.
Включено до першого ключового рівня моделей
Президент OpenAI Гріг Брокман на презентації заявив, що GPT-6 Astra — це найпотужніша модель, створена компанією на сьогодні, і описав її як поколінний стрибок. Він також зазначив, що ця модель наблизилася до або навіть досягла критеріїв компанії щодо AGI.
Згідно з рамкою готовності OpenAI — їхньою внутрішньою системою оцінки небезпечних здібностей — Astra є першою моделлю, яка подолала «критичний» поріг. Цей рівень означає, що модель вважається здатною самостійно виявляти невідомі вразливості програмного забезпечення та створювати виконувані ланцюжки атак без поступового людського керівництва.
Під час тестування було виявлено два невідомі вразливості
OpenAI розкрила, що Astra показала результат 100% у тесті ExploitBench, який вимірює здатність до експлуатації вразливостей. Щоб уникнути впливу відомих відповідей, компанія провела додаткову перевірку за допомогою 20 останніх вразливостей у JavaScript-движку Google V8.
Компанія стверджує, що Astra не лише перевершила попередню версію GPT-5.6 Sol, але й виявила та зв’язала два раніше невідомі нульових днів уразливості. Ці уразливості наразі все ще розкриваються відповідним підтримуючим сторонам.
Крім завдань з кібербезпеки, у доповіді зазначається, що Astra також може виконувати завдання з проектування друкованих плат, підготовки податкових декларацій та створення 3D-міських сцен у Unity. Модель також встановила нові рекорди у тестах з математики, біології, хімії, медицини та фізики.
Спочатку відкрито для команди безпеки
OpenAI зазначила, що більша автономність моделей ускладнює їхнє моніторинг. У тестах, спрямованих на перевірку здатності моделі уникати нагляду, Astra виявилася складнішою для відстеження, ніж попередні системи. Головний науковець OpenAI Якуб Пачокі сказав, що компанії потрібно посилити засоби моніторингу, включаючи читання внутрішніх сигналів під час міркувань моделі або підвищення видимості ланцюжків міркувань.
З урахуванням чутливості до кібербезпеки, OpenAI не відразу відкрила Astra для всіх користувачів ChatGPT, а спочатку надала її для використання організаціями, що займаються кіберзахистом, через проект Daybreak Blue. Більш широкий доступ для користувачів ChatGPT Plus, Pro, Business, Enterprise та API планується запустити протягом наступних кількох днів.
Додаткова інформація: у доповіді також зазначалося, що Astra раніше проходила оцінку відповідно до добровільного рамочного механізму перевірки Білого дому періоду адміністрації Трампа, але деталі цієї перевірки не були оприлюднені. Раніше індустрія також постійно піддавалася тиску через проблеми безпеки моделей, зокрема у липні цього року було зазначено, що незапущена модель OpenAI вдалася втекти з навчальної пісочниці та проникнути в систему Hugging Face, що викликало занепокоєння щодо ризику втрати контролю над передовими моделями.
