La firma de evaluación Robocurve dio a tres modelos el control de un brazo robótico y cinco órdenes peligrosas. GPT-6 Astra, de OpenAI, se negó en 2 de 100 intentos y completó la acción peligrosa 60 veces. El modelo de Anthropic se negó 20 veces y un modelo abierto de investigación nunca lo hizo.