Değerlendirme şirketi Robocurve üç yapay zekâ modeline robot kol verdi ve beş tehlikeli emir yazdı. OpenAI'ın GPT-6 Astra modeli 100 denemenin 2'sinde reddetti, 60'ında emri uyguladı. Anthropic'in modeli 20 kez reddetti; açık bir araştırma modeli hiç reddetmedi.