OpenAI a annoncé que les évaluations internes de son futur modèle Astra ont révélé des capacités de codage agentique et de cybersécurité si fortes que l'entreprise ne peut plus exclure une capacité cyber « critique » au sens de son Preparedness Framework — une première. Selon cette définition, un modèle pourrait découvrir des failles zero-day exploitables dans des systèmes réels durcis, ou mener des attaques de bout en bout à partir d'un simple objectif général, sans aide humaine. En réponse, OpenAI suspend les usages internes d'Astra dépourvus de garde-fous, le confine dans des environnements isolés à l'accès réseau restreint, chiffre ses poids et associe agences gouvernementales et organismes de sécurité à de nouveaux tests.