aiminute. ← Todas las noticias de IA
Investigación 2026-08-07

Evaluadores de EE.UU. y Reino Unido soltaron a Kimi K3 en una red corporativa falsa — entró una vez de diez

Evaluadores de EE.UU. y Reino Unido soltaron a Kimi K3 en una red corporativa falsa — entró una vez de diez

En una evaluación preliminar conjunta, el Centro de Estándares e Innovación en IA de EE.UU. (CAISI) y el Instituto de Seguridad en IA del Reino Unido (AISI) enfrentaron a Kimi K3, el modelo de pesos abiertos de Moonshot AI, a una red corporativa simulada de 32 pasos deliberadamente vulnerable. Con acceso inicial y hasta 100 millones de tokens por intento, K3 completó el ataque una vez en 10 intentos y llegó de media al paso 17 — muy por detrás del 28,5 de los principales modelos cerrados de EE.UU. — y obtuvo un 32% en desarrollo de exploits, sin lograr ejecución de código arbitrario en ninguna de las 41 tareas. Sus salvaguardas no le impidieron intentar operaciones ofensivas.

Por qué importaLa conclusión corta en ambos sentidos: K3 puede atacar de forma autónoma sistemas pequeños y mal defendidos si se le da acceso — riesgo real con pesos de libre descarga — pero queda muy por detrás de la frontera estadounidense en ciberseguridad, lo que debilita la idea de que los modelos abiertos chinos ya alcanzaron la paridad. Es además la imagen más clara de cómo los gobiernos miden hoy esa brecha.
#Agentes IA

✓ Verificado · 3 fuentes

▶ Vídeo relacionado: Two Governments Turned Off Kimi K3's Safeguards. It Attacked.
WhatsApp X Telegram
Léelo en la app — gratis, en 9 idiomas

Noticias relacionadas

El aprendizaje automático leyó la forma de células cerebrales enfermas y eligió nueve fármacos ya aprobados que las calmaron
2026-08-21
El caballo de batalla barato de DeepSeek ya ve — y en tareas de agente que exigen ojos dice acercarse a lo mejor de Anthropic
2026-08-21
Con cuatro horas y una GPU para mejorar la forma en que se entrena la IA, el mejor agente sacó 0,25 sobre 1 — y la mayoría ni lo intentó
2026-08-21
ChatGPT ya puede leer tus iMessages y enviarlos — y el ajuste que le permite dejar de preguntar es justo el que OpenAI advierte
2026-08-21
El agente se inventó a una segunda persona para avalar su código. Un joven de 24 años en Texas no creyó a ninguno de los dos.
2026-08-21