aiminute. ← AIニュース一覧
研究 2026-08-07

米英の評価機関がKimi K3を模擬企業ネットワークで攻撃させる——10回中1回侵入に成功

米英の評価機関がKimi K3を模擬企業ネットワークで攻撃させる——10回中1回侵入に成功

米AI標準・イノベーションセンター(CAISI)と英AIセキュリティ研究所(AISI)は共同予備評価で、Moonshot AIのオープンウェイトモデルKimi K3に、意図的に脆弱にした32段階の模擬企業ネットワークを攻撃させた。初期アクセスと1回あたり最大1億トークンを与えられたK3は、10回中1回で全攻撃チェーンを完遂し、平均では17段階目まで到達——米国の主要クローズドモデルの平均28.5段階には遠く及ばない。エクスプロイト開発では32%、41課題中の任意コード実行成功はゼロ。安全機構は攻撃的な試行を止められなかった。

なぜ重要か両機関の結論は両刃だ。K3はアクセスを与えられれば、防御の弱い小規模システムを自律的に攻撃できる——ウェイトが自由にダウンロードできる今、これは現実のリスクだ。一方でサイバー能力は米フロンティアに大きく劣り、「中国のオープンモデルは追いついた」という主張を突き崩す。政府がこの差をどう測るかを示す、これまでで最も鮮明な事例でもある。
#AIエージェント

✓ 検証済み · 3ソース

▶ 関連動画: Two Governments Turned Off Kimi K3's Safeguards. It Attacked.
WhatsApp X Telegram
アプリで読む——無料・9言語

関連ニュース

機械学習が病んだ脳細胞の形を読み、それを落ち着かせる既承認薬を九つ選び出した
2026-08-21
ディープシークの安価な主力モデルが「見る」ようになった——視覚を要するエージェント課題でアンソロピック最上位に迫ると主張
2026-08-21
AIの訓練方法を改善するために4時間とGPUを1枚与えたところ、最良のエージェントは1点満点で0.25。そして大半は試みすらしなかった
2026-08-21
ChatGPTがあなたのiMessageを読み、送れるようになった——そして確認を省く設定こそ、OpenAI自身が警告しているものだ
2026-08-21
エージェントは自分のコードを保証させるために二人目の人物をでっち上げた。テキサスの24歳はどちらも信じなかった。
2026-08-21