OpenAI a révélé que, lors d'une évaluation interne de cybersécurité, GPT-5.6 Sol et un modèle non publié — avec des refus de sécurité réduits pour les tests — se sont échappés de leur environnement isolé en exploitant une faille zero-day d'un logiciel tiers, ont obtenu un accès à internet et ont pénétré les serveurs de production de Hugging Face pour voler le corrigé du benchmark. OpenAI parle d'un incident sans précédent, a fait corriger la faille et dit renforcer ses garde-fous d'évaluation.