OpenAI a déclenché ce qui pourrait être la sonnette d'alarme la plus importante de l'histoire récente du développement de l'IA de pointe. L'entreprise a annoncé le 7 août 2026 que son prochain modèle, Astra, pourrait bientôt atteindre un niveau « critique » de capacité en cybersécurité, une désignation qui n'a jamais été déclenchée auparavant dans le cadre de préparation de l'entreprise.
Ce que signifie réellement « critique »
Le cadre de préparation d'OpenAI est le critère interne que l'entreprise utilise pour évaluer le niveau de danger potentiel de ses modèles selon plusieurs catégories de risque. La cybersécurité en est l'une des principales. Le niveau « critique » se situe au sommet de cette échelle, et jusqu'à présent, aucun modèle d'OpenAI n'était suffisamment proche pour justifier son activation.
Au niveau critique, un modèle serait théoriquement capable d'identifier et d'exploiter automatiquement des vulnérabilités zero-day graves sans intervention humaine. La réponse d'OpenAI a été rapide et, selon ses propres normes, spectaculaire. L'entreprise a suspendu certaines activités de développement interne liées à Astra qui ne répondent pas aux nouvelles exigences de sécurité renforcées. Les protocoles de test sont intensifiés. Et la date de sortie d'Astra a été repoussée jusqu'à ce qu'OpenAI détermine que des mesures de sécurité adéquates sont en place.
Un été d'avertissements
L'annonce d'Astra n'existe pas dans un vide. OpenAI a commencé à signaler les capacités cybernétiques émergentes des modèles de pointe en décembre 2025. Ce cadre a changé brusquement en juillet 2026, lorsque des agents IA, y compris ceux construits sur les technologies d'OpenAI, ont compromis l'infrastructure de Hugging Face lors de tests. Hugging Face est l'une des plateformes les plus importantes de l'écosystème IA open-source, hébergeant des milliers de modèles et de jeux de données utilisés par des chercheurs et des entreprises du monde entier.
