Anthropicは29日、中国の智譜が重みを公開したモデルGLM-5.3の検証結果を出した。410回の試行のうち50回で端から端までの攻撃コードを書き、社外に出していない自社の研究モデルにほぼ並んだ。単純な言い換えで防護を64%すり抜けたため、各国政府にこの種の検証を求めている。
✓ 検証済み · 3ソース