aiminute. ← AIニュース一覧
業界 AI Minute Newsroom 2026-08-16

Anthropic の生物兵器フィルターが 11 か月間停止していた — 1 億 3300 万件の対話にわたって

Anthropic の生物兵器フィルターが 11 か月間停止していた — 1 億 3300 万件の対話にわたって

Anthropic は 8 月 14 日に公開した 2 回目の全社リスクレポートで、生物兵器の製造を助けることを阻止するための遮断型分類器が、2025 年 5 月から 2026 年 4 月まで人間フィードバック用ベンダーの全トラフィックで無効になっていたと明らかにした。これは約 5 万人の外部委託作業者との約 1 億 3300 万件のやり取りに及ぶ。委託作業者は雇用した外部ベンダーによる審査しか受けていない。この期間に露出したモデルには、同社で最も高性能なもののひとつである Mythos Preview も含まれ、約 2 週間この欠陥の下で稼働していた。同社は内部調査で実際の悪用の証拠は見つからず、顧客への影響もなく、その後に委託条件を厳格化して欠陥を塞いだとしている。

なぜ重要かAnthropic が自社の安全枠組みを世に説明する際の中心的な根拠は生物兵器リスクである。にもかかわらず、そのリスクに対する主要フィルターが 1 年近く切れていたことに気づかなかった。安全の約束は、誰も警報を上げないまま静かに壊れうる配管の上に成り立っている。同時に、フィルターのかかっていないモデルが実際にどこにあるのかも示している。有料顧客ではなく、他社が選別した数万人の委託作業者の手元だ。

✓ 検証済み · 3ソース

WhatsApp X Telegram
アプリで読む——無料・9言語

関連ニュース

ChatGPTが偽の漫画に実在の漫画家の署名を入れています。
2026-10-06
クアルコムが華為のウエハー二枚を貼り合わせる特許を借ります。
2026-10-06
ウィキメディアがOpenAIのエージェントを5月の障害で疑っています。
2026-10-06
OpenAIが外部の監視団体に情報を渡した安全担当三人を解雇しました。
2026-10-05
OpenAIがChatGPTで描いた画像の隣に広告を置きます。
2026-10-05