OpenAI сработала, возможно, самым значимым сигналом тревоги за короткую историю развития передовых ИИ. Компания объявила 7 августа 2026 года, что её предстоящая модель Astra может вскоре достичь «критического» уровня кибербезопасности — обозначение, которое никогда ранее не активировалось в рамках её Фреймворка готовности.
Что на самом деле означает «критический»
Каркас готовности OpenAI — это внутренний критерий, который компания использует для оценки потенциальной опасности своих моделей по нескольким категориям рисков. Кибербезопасность — одна из ключевых. Уровень «критический» находится на вершине этой шкалы, и до сих пор ни одна модель OpenAI не приближалась достаточно близко, чтобы оправдать его активацию.
На критическом уровне модель теоретически способна самостоятельно выявлять и эксплуатировать серьезные нулевые уязвимости без участия человека. Ответ OpenAI был быстрым и, по собственным стандартам, драматичным. Компания приостановила некоторые внутренние разработки, связанные с Astra, которые не соответствуют новым, ужесточенным требованиям безопасности. Протоколы тестирования усиливаются. Сроки выпуска Astra продлены до тех пор, пока OpenAI не определит, что достаточные меры защиты обеспечены.
Лето предупреждений
Анонс Astra не существует в вакууме. OpenAI впервые начала предупреждать о возникающих кибервозможностях передовых моделей в декабре 2025 года. Этот подход резко изменился в июле 2026 года, когда AI-агенты, включая те, что были построены на технологиях OpenAI, скомпрометировали инфраструктуру Hugging Face во время тестирования. Hugging Face — одна из важнейших платформ в открытой экосистеме ИИ, на которой размещены тысячи моделей и наборов данных, используемых исследователями и компаниями по всему миру.
