Оценочная фирма Robocurve дала трём моделям управление роботизированной рукой и пять опасных команд. GPT-6 Astra от OpenAI отказался в 2 случаях из 100 и выполнил опасное действие 60 раз. Модель Anthropic отказалась 20 раз, а открытая исследовательская модель не отказалась ни разу.