aiminute. ← AIニュース一覧
新モデル 2026-08-14

セキュリティ上の穴を見つける能力で最強のオープンモデルは中国製——2週間後に重みが公開される

セキュリティ上の穴を見つける能力で最強のオープンモデルは中国製——2週間後に重みが公開される

旧称 Zhipu の北京の研究所 Z.ai が本日 GLM-5.3 を公開した。コーディングのスコアは大きく動いた。Terminal-Bench 3.0 は 4.6 から 28.3 へ、DeepSWE v1.1 は 46.2 から 66.9 へ。だが注目を集めているのは CyberGym の 84.5 で、Claude Mythos 5 の 83.8、GPT-5.6 Sol の 83.6 をわずかに上回った。ExploitBench では前世代の 24.4 から 54.4 へと倍以上になった。Z.ai によれば、このモデル群はカーネル、ブラウザエンジン、ネットワークプロトコルを含む 269 のオープンソースプロジェクトで 2,436 件の脆弱性を発見し、うち 53 件が公表済み、残りは公開台帳上で開示留保となっている。重みは安全性評価の完了後、公開から約 2 週間後に配布される予定だ。

なぜ重要か脆弱性発見でこれほどの性能を持つモデルを抱える西側の研究所は、いずれもそれを API の内側に置いてきた。誰が何を尋ねているかが見え、遮断できるからだ。オープンな重みはそのスイッチを恒久的に取り去る。公開されたファイルは回収できない。能力そのものはピッキングツールと同じ意味で中立だ。カーネルのバグを保守担当者に渡すのと同じ実行が、モデルをダウンロードした誰にでも同じものを渡す。各国政府が AI エージェントにコンピュータへの何を法的に許すのかをまだ議論している最中に、これは現場の既成事実になる。
#コーディング

✓ 検証済み · 4ソース

WhatsApp X Telegram
アプリで読む——無料・9言語

関連ニュース

噂:コーディングのベンチマークを無料で制した匿名モデルは、智譜(Zhipu)の未発表フラッグシップだとされる
2026-08-21
ディープシークの安価な主力モデルが「見る」ようになった——視覚を要するエージェント課題でアンソロピック最上位に迫ると主張
2026-08-21
エヌビディアが競合の「モデル製造装置」に60億ドル、動かしていた109人も採用
2026-08-21
AIの訓練方法を改善するために4時間とGPUを1枚与えたところ、最良のエージェントは1点満点で0.25。そして大半は試みすらしなかった
2026-08-21
ロボットに一度見せるだけ——3秒から12秒——訓練なしで100回中59回、仕事をこなす
2026-08-21