旧称 Zhipu の北京の研究所 Z.ai が本日 GLM-5.3 を公開した。コーディングのスコアは大きく動いた。Terminal-Bench 3.0 は 4.6 から 28.3 へ、DeepSWE v1.1 は 46.2 から 66.9 へ。だが注目を集めているのは CyberGym の 84.5 で、Claude Mythos 5 の 83.8、GPT-5.6 Sol の 83.6 をわずかに上回った。ExploitBench では前世代の 24.4 から 54.4 へと倍以上になった。Z.ai によれば、このモデル群はカーネル、ブラウザエンジン、ネットワークプロトコルを含む 269 のオープンソースプロジェクトで 2,436 件の脆弱性を発見し、うち 53 件が公表済み、残りは公開台帳上で開示留保となっている。重みは安全性評価の完了後、公開から約 2 週間後に配布される予定だ。