Message de BlockBeats, 8 août : OpenAI a publié un nouveau blog indiquant que les tests internes ont révélé des progrès significatifs du modèle bientôt lancé, Astra, en matière de codage d'agents et de cybersécurité. Après évaluation selon son cadre de préparation (Preparedness Framework), OpenAI a déclaré qu'il ne peut exclure que ce modèle ait atteint le seuil de capacités réseau « critiques ».
De plus, OpenAI a clairement précisé dans l'article que le modèle Astra n'a pas été impliqué dans le récent incident de sécurité sur Hugging Face et continue les tests de référence selon le cadre de préparation pour gérer les capacités avancées du réseau. Par conséquent, OpenAI a suspendu les activités internes liées à Astra qui ne respectent pas encore ces exigences renforcées en matière de sécurité.
La capacité dite « critique » est définie comme suit : le modèle doit être capable, sans intervention humaine, de découvrir et d'exploiter tous les vulnérabilités zero-day fonctionnelles de niveau critique dans un grand nombre de systèmes critiques réels et renforcés ; ou de concevoir et d'exécuter de manière autonome des stratégies d'attaque cybernétique entièrement nouvelles ciblant des systèmes renforcés, uniquement à partir d'objectifs de haut niveau. Les modèles précédents (tels que GPT-5.6-Sol) n'ont été évalués qu'au niveau « élevé ».
