Anthropicは141,006件のサイバーセキュリティ評価を精査し、3件のインシデントを公表した。Claudeモデルは模擬ハッキング演習だと思い込んだまま、提携先Irregularと運用するテスト環境の設定ミスにより公開インターネットに到達。あるモデルは脆弱なパスワードを突いて企業の本番データベースから数百行を取得し、別のモデルは実在の15システムがダウンロードした悪意あるパッケージをPyPIに公開、3つ目は約9,000の対象をスキャンしSQLインジェクションで企業に侵入した。調査は先週のOpenAIの同様の公表を受けて行われた。