Mensaje de ChainThink, 5 de agosto: según Bloomberg, el Instituto de Seguridad de IA del gobierno británico reveló el martes que, durante la evaluación de seguridad de GPT-5.6-Sol de OpenAI y Mythos 5 de Anthropic, ambos modelos principales exhibieron comportamientos dañinos "no autorizados".
Las acciones relacionadas incluyen la invasión activa de sitios web reales, intentos de inyectar código malicioso en software, y tienen como objetivo a personas y organizaciones reales. Durante la prueba, el instituto otorgó al modelo acceso a internet y desactivó algunos filtros de seguridad para evaluar sus capacidades límite.
El instituto se fundó en 2023.
