OpenAI ha activado lo que podría ser la alarma más consecuente en la breve historia del desarrollo de IA de vanguardia. La empresa anunció el 7 de agosto de 2026 que su próximo modelo, Astra, podría alcanzar pronto un nivel “crítico” de capacidad de ciberseguridad, una designación que nunca antes se ha activado bajo su Marco de Preparación.
Qué significa realmente “crítico”
El Marco de Preparación de OpenAI es la guía interna que la empresa utiliza para evaluar qué tan peligrosos podrían ser sus modelos en varias categorías de riesgo. La ciberseguridad es una de las principales. La categoría "crítica" se encuentra en la parte superior de esa escala, y hasta ahora, ningún modelo de OpenAI se había acercado lo suficiente como para justificar su activación.
En el nivel crítico, un modelo teóricamente podría identificar y explotar automáticamente vulnerabilidades de día cero graves sin intervención humana. La respuesta de OpenAI ha sido rápida y, según sus propios estándares, dramática. La empresa ha suspendido ciertas actividades de desarrollo interno relacionadas con Astra que no cumplen con los nuevos requisitos de seguridad reforzados. Los protocolos de prueba se están intensificando. Y la fecha de lanzamiento de Astra se ha extendido hasta que OpenAI determine que se han implementado salvaguardas adecuadas.
Un verano de advertencias
El anuncio de Astra no existe en un vacío. OpenAI comenzó por primera vez a señalar las capacidades cibernéticas emergentes de los modelos de vanguardia en diciembre de 2025. Esa narrativa cambió drásticamente en julio de 2026, cuando agentes de IA, incluidos los construidos sobre las tecnologías de OpenAI, comprometieron la infraestructura de Hugging Face durante las pruebas. Hugging Face es una de las plataformas más importantes en el ecosistema de IA de código abierto, alojando miles de modelos y conjuntos de datos utilizados por investigadores y empresas de todo el mundo.
