AIニュース

中国Z.ai、新モデル「GLM-5.3」を発表 脆弱性発見能力がAnthropic・OpenAI水準に迫り公開を延期

公開日: ・出典: Axios

中国のAI企業Z.ai(智譜)は2026年8月14日、コーディングモデル「GLM-5.3」を発表しました。ベースモデル自体はGLM-5.2から変更せず、実行可能な演習環境や長時間タスクのデータを増やして事後学習(ポストトレーニング)を1カ月分積み増したことで性能を伸ばしたとしており、同社は現時点で最も高性能なオープンウェイトのコーディングモデルだとしています。

特に注目されたのが、ソースコードから脆弱性を発見・検証する能力を測るベンチマーク「CyberGym」のスコアです。GLM-5.3はGLM-5.2の77.2%から84.5%に上昇し、Anthropicが制限公開している「Mythos 5」の83.8%、OpenAIの「GPT-5.6 Sol」の83.6%をわずかに上回りました。Z.aiは、脆弱性発見データを学習に取り込んだ結果、個々のバグを見つける能力にとどまらず、複数の攻撃段階を横断して一貫した攻略計画を組み立てる能力まで、想定を超えて伸びたと説明しています。一方、発見した欠陥を実際に動く攻撃コードへ変換する能力を測る「ExploitBench」では54.4%にとどまり、Mythos 5の78.0%には及んでいません。

Z.aiは、この能力の伸びを踏まえ、モデルの重み自体の一般公開は安全性評価と対策強化が終わる約2週間後まで見合わせるとしています。危険なリクエストを検知する仕組みやモデル挙動の監視など複数の安全対策を導入し、一部のリスクが高い機能は本人確認を済ませた「トラステッドアクセス」利用者に限定する方針です。その間もGLM-5.3自体はZ.aiのAPIおよびGLM Coding Planを通じて既に利用可能で、既存のコーディングプラン契約者には既に展開されています。

出典: Axios

Xでシェア

GLM-5.2とGLM-5.3の主な違い

Z.aiの発表内容に基づき、GLM-5.2とGLM-5.3の違いを比較します。

項目 GLM-5.2 GLM-5.3
CyberGym(脆弱性発見・検証スコア) 77.2% 84.5%(Mythos 5・GPT-5.6 Solをわずかに上回る)
コーディング性能(Z.ai Code Bench) 比較基準 GLM-5.2比で約50%向上
提供状況 オープンウェイト公開済み API・GLM Coding Planで先行提供、オープンウェイトは安全性評価完了後(約2週間後)に公開予定

※出典: Axios / BigGo Finance