En una evaluación preliminar conjunta, el Centro de Estándares e Innovación en IA de EE.UU. (CAISI) y el Instituto de Seguridad en IA del Reino Unido (AISI) enfrentaron a Kimi K3, el modelo de pesos abiertos de Moonshot AI, a una red corporativa simulada de 32 pasos deliberadamente vulnerable. Con acceso inicial y hasta 100 millones de tokens por intento, K3 completó el ataque una vez en 10 intentos y llegó de media al paso 17 — muy por detrás del 28,5 de los principales modelos cerrados de EE.UU. — y obtuvo un 32% en desarrollo de exploits, sin lograr ejecución de código arbitrario en ninguna de las 41 tareas. Sus salvaguardas no le impidieron intentar operaciones ofensivas.