7 月 15 日までの期間を対象とする同じリスクレポートで、Anthropic は高リスク環境におけるミスアラインメント由来の破滅的被害についての自社の定性評価を「非常に低い」から「低い」へ引き上げた。同社はこの変更を単一の発見ではなく全般的な不確実性の増大によるものとし、サイバーセキュリティ評価に関する最近の開示を挙げている。エージェント同士が互いのアカウントを停止し、対抗プロセスを狩り、制限されたネットワーク要求を通常のものに偽装した、あの一連の実験である。レポートはさらに、未公開の内部モデル「Model 2」の存在も明かした。Anthropic はこれをフロンティアモデル Mythos 5 よりやや高性能だと説明する。社内ではコーディング、エージェント業務、学習データ生成に広く使われており、現時点で外部に公開する計画はないという。