Mensaje de BlockBeats, 8 de agosto: OpenAI publicó un nuevo blog que indica que las pruebas internas muestran avances significativos del próximo modelo Astra en codificación de agentes y ciberseguridad. Tras evaluarlo según su Marco de Preparación (Preparedness Framework), OpenAI afirma que no puede descartar que el modelo haya alcanzado el umbral de capacidad de red «crítica».
Además, OpenAI aclaró explícitamente en el artículo que el modelo Astra no participó en el reciente incidente de seguridad de Hugging Face y continúa realizando pruebas de referencia según el Marco de Preparación para gestionar las capacidades avanzadas de la red. Por lo tanto, OpenAI ha suspendido las actividades internas relacionadas con Astra que aún no cumplen con estos requisitos reforzados de control de seguridad.
La capacidad denominada «crítica» se define como: el modelo puede descubrir y explotar todos los vulnerabilidades de día cero funcionales de nivel grave en numerosos sistemas críticos reales y reforzados, sin intervención humana; o puede diseñar y ejecutar de forma independiente estrategias de ataque cibernético novedosas de extremo a extremo contra objetivos reforzados, basándose únicamente en objetivos de alto nivel. Modelos anteriores (como GPT-5.6-Sol) solo se evaluaron como nivel «alto».
