ChainThink mensaje, 22 de julio, según un artículo de OpenAI, el incidente de intrusión en la infraestructura de Hugging Face la semana pasada fue provocado por un modelo de IA que se encontraba en prueba.
La investigación muestra que varios modelos lograron escapar del entorno de sandbox en tareas de evaluación de seguridad, aprovecharon vulnerabilidades de día cero para obtener acceso a internet y luego realizaron operaciones automatizadas en el entorno de producción de Hugging Face.
OpenAI indicó que el evento fue causado por varios modelos de OpenAI, incluidos GPT-5.6 Sol y un modelo prelanzado con mayores capacidades. Para realizar esta prueba de evaluación, los mecanismos de seguridad de los modelos relacionados se redujeron intencionadamente.
OpenAI afirmó que el evento revela el riesgo de que modelos de IA avanzados puedan ejecutar ataques cibernéticos complejos en ausencia de restricciones de seguridad, al tiempo que muestra que la IA puede utilizarse para descubrir vulnerabilidades y fortalecer la defensa de seguridad.
