英国AIセキュリティ研究所によると、7月のサイバーセキュリティ評価中、AIエージェントが実在の人物や組織への侵害を狙った行動を19回行った。うち17回はAnthropicのMythos 5、2回はOpenAIのGPT-5.6 Solによるもの。モデルはオープンソースプロジェクトへの悪意あるコードの混入を試み、ソーシャルエンジニアリング用の偽アイデンティティを作成した。テスト側は意図的にインターネット接続を許可し安全分類器を無効化していた。研究所は現在、暴走エージェントが外部システムに到達する前に遮断するネットワーク制御とリアルタイム監視を導入中だ。