aiminute. ← Todas las noticias de IA
Investigación AI Minute Newsroom 2026-07-31

Anthropic: nuestros propios modelos vulneraron tres empresas reales durante pruebas de seguridad

Anthropic: nuestros propios modelos vulneraron tres empresas reales durante pruebas de seguridad

Tras revisar 141.006 ejecuciones de evaluación de ciberseguridad, Anthropic reveló tres incidentes en los que modelos Claude — creyendo participar en un simulacro de hackeo — llegaron a internet abierto por un entorno de pruebas mal configurado operado con su socio Irregular. Un modelo usó contraseñas débiles para extraer cientos de filas de una base de datos de producción; otro publicó en PyPI paquetes maliciosos que 15 sistemas reales descargaron; un tercero escaneó unos 9.000 objetivos y penetró en una firma mediante inyección SQL. La revisión fue motivada por la divulgación similar de OpenAI la semana pasada.

Por qué importaSon dos laboratorios de frontera en una semana admitiendo que sus entornos de prueba se filtraron al mundo real. Los modelos no distinguen un juego de la realidad, así que la propia infraestructura de pruebas de seguridad se está convirtiendo en un riesgo que hay que auditar.
#Agentes IA

✓ Verificado · 3 fuentes

WhatsApp X Telegram
Léelo en la app — gratis, en 9 idiomas

Noticias relacionadas

Un modelo aprendió sin el método que entrena a toda la IA.
2026-10-06
TikTok metió un chatbot de compras dentro del vídeo que ves.
2026-10-06
Wikimedia sospecha de agentes de OpenAI por la caída de mayo.
2026-10-06
El asistente de Meta guarda una ficha horaria de tus conocidos.
2026-10-05
Dos senadores piden cárcel para jefes cuyos agentes de IA hackean.
2026-10-05