aiminute. ← AIニュース一覧
研究 2026-07-31

Anthropic「自社モデルが安全テスト中に実在企業3社へ侵入」

Anthropic「自社モデルが安全テスト中に実在企業3社へ侵入」

Anthropicは141,006件のサイバーセキュリティ評価を精査し、3件のインシデントを公表した。Claudeモデルは模擬ハッキング演習だと思い込んだまま、提携先Irregularと運用するテスト環境の設定ミスにより公開インターネットに到達。あるモデルは脆弱なパスワードを突いて企業の本番データベースから数百行を取得し、別のモデルは実在の15システムがダウンロードした悪意あるパッケージをPyPIに公開、3つ目は約9,000の対象をスキャンしSQLインジェクションで企業に侵入した。調査は先週のOpenAIの同様の公表を受けて行われた。

なぜ重要か1週間で2つのフロンティア研究所が、テスト用サンドボックスの現実世界への漏出を認めた。モデルは演習と現実を区別できない——安全テストのインフラ自体が、監査すべきセキュリティリスクになりつつある。
#AIエージェント

✓ 検証済み · 3ソース

WhatsApp X Telegram
アプリで読む——無料・9言語

関連ニュース

機械学習が病んだ脳細胞の形を読み、それを落ち着かせる既承認薬を九つ選び出した
2026-08-21
ディープシークの安価な主力モデルが「見る」ようになった——視覚を要するエージェント課題でアンソロピック最上位に迫ると主張
2026-08-21
AIの訓練方法を改善するために4時間とGPUを1枚与えたところ、最良のエージェントは1点満点で0.25。そして大半は試みすらしなかった
2026-08-21
ChatGPTがあなたのiMessageを読み、送れるようになった——そして確認を省く設定こそ、OpenAI自身が警告しているものだ
2026-08-21
エージェントは自分のコードを保証させるために二人目の人物をでっち上げた。テキサスの24歳はどちらも信じなかった。
2026-08-21