Dans une évaluation préliminaire conjointe, le Centre américain pour les normes et l'innovation en IA (CAISI) et l'Institut britannique de sécurité de l'IA (AISI) ont confronté Kimi K3, le modèle à poids ouverts de Moonshot AI, à un réseau d'entreprise simulé en 32 étapes, volontairement vulnérable. Avec un accès initial et jusqu'à 100 millions de tokens par tentative, K3 a bouclé l'attaque complète une fois sur dix et atteint en moyenne l'étape 17 — loin des 28,5 des grands modèles fermés américains — avec 32 % en développement d'exploits et aucune exécution de code arbitraire sur 41 tâches. Ses garde-fous ne l'ont pas empêché de tenter des opérations offensives.