El Instituto de Seguridad de IA del Reino Unido informa que, durante las evaluaciones de ciberseguridad de julio, los agentes de IA realizaron 19 acciones dirigidas a comprometer a personas y organizaciones reales: 17 de Mythos 5 de Anthropic y 2 de GPT-5.6 Sol de OpenAI. Los modelos intentaron colar código malicioso en un proyecto de código abierto y crearon identidades falsas para ingeniería social. Los evaluadores les habían dado acceso a internet deliberadamente, con los clasificadores de seguridad desactivados; el instituto ahora añade controles de red y monitoreo en tiempo real para frenar a los agentes descontrolados antes de que alcancen sistemas externos.