新しいベースモデルを作らず、ポストトレーニングだけでDeepSWEを46.2から66.9まで引き上げた。GLM-5.3のポイントはここにある。GLM-5.2と同じ753Bパラメータのベースを使いながら、長期的なコーディング作業では最先端級に迫る性能をうたうモデルだ。ただし、公開から3日後の時点ではトークン課金APIはなく、「オープンウェイト」とされる重みも2週間の安全性レビューを理由に公開待ちとなっている。
GLM-5.3は何が変わったモデルなのか
GLM-5.3は、長い工程を伴うソフトウェアエンジニアリングやエージェントタスク向けにZ.aiが投入した最新フラッグシップモデルで、リリース日は2026年8月14日。公式のモデルドキュメントによると、最大の特徴はGLM-5.2とベースモデルが同一であることだ。改善分はすべて、課題の発見から実装、検証、納品までを含む実践的なエンジニアリングワークフローでのポストトレーニングによるものとされている。
つまり、GLM-5.3は新アーキテクチャの後継ではなく、同じ基盤から派生した兄弟モデルと見るのが適切だ。GLM-5.2は2026年6月中旬に登場した753BパラメータのMixture-of-Expertsモデルで、MITライセンスの下、6月17日からHugging Faceで重みが公開されている。リリース時にはTechTimesも報じていた。
| 項目 | GLM-5.3 | GLM-5.2 |
|---|---|---|
| ベースモデル | 同一の753B MoE(Z.aiによる) | 753B MoE、MITライセンス |
| コンテキストウィンドウ | 100万トークン | 100万トークン |
| 最大出力 | 128Kトークン | 128Kトークン |
| 入力 / 出力 | テキスト / テキスト | テキスト / テキスト |
| ツール対応 | Function calling、MCP、JSON出力、コンテキストキャッシュ、思考モード | 同じ機能群(GLM-5.2 docs) |
| 重み | 未公開。安全性レビューのため延期中 | 6月17日からHugging Faceで公開 |
| 現時点の利用手段 | GLM Coding Planのみ。APIは「coming soon」 | Coding Plan + トークン課金API |
ベンチマークは好調。ただし独立検証はまだない
以下の数値はすべてZ.aiのリリースドキュメントに掲載されたものだ。GLM-5.2を基準に、前後のスコアをまとめるとこうなる。
| ベンチマーク | GLM-5.2 | GLM-5.3 | 変化 |
|---|---|---|---|
| Terminal-Bench 3.0 | 4.6 | 28.3 | +23.7 |
| DeepSWE v1.1 | 46.2 | 66.9 | +20.7 |
| Agents' Last Exam | 23.8 | 28.5 | +4.7 |
| ExploitBench | 24.4% | 54.4% | +30.0ポイント |
なかでも注目を集めたのは、ポストトレーニングだけでDeepSWEが20.7ポイント伸びた点だ。ローンチ当日には広く共有されたRedditの分析が、「現在の最大級ベースモデルの内部には、まだどれだけの能力が眠っているのか」を示す例だと表現している。同じリリースページでは、44の職業カテゴリにまたがるGDPval-AA v2で1,769ポイントを記録したことも報告されており、純粋なコーディング用途を超えた位置付けも打ち出している。プログラミング能力については「Claude Fable 5に匹敵する」との主張だ。
伸びた方向性は受け止めつつ、スコアの精密さについては保留すべきだろう。ローンチページの数字はベンダー自己申告で、ハーネスの詳細や信頼区間は公開されていない。これらを追っているコミュニティのベンチマークスレッドでも、独立した再現結果はまだないと指摘されている。現時点で参考になる外部比較としては、r/ZaiGLMのユーザー作成の比較がある。DeepSWE v1.1ではGPT-5.6 Luna Maxが67.2、GLM-5.3が66.9で、差は0.3ポイント。エージェント型コーディングでGLM-5.3が最前線の端に競り合っていることは示唆するが、他を大きく引き離しているわけではない。この組み合わせを今ベンチするなら、GPT-5.6 Lunaはすでに呼び出せる。一方、5.3のAPIが来るまで、APIで使えるGLMファミリーのフラッグシップはGLM-5.2のままだ。GLM-5.3のポストトレーニング後の振る舞いを代替するものではないが、ベースモデルは同じである。
オープンウェイトの公開が遅れている理由
Axiosのローンチ当日報道によれば、Z.aiは安全対策を強化するため、GLM-5.3の重み公開を約2週間見送っている。その背景にあるのはサイバーセキュリティ性能だ。長期タスク環境を拡張するなかで、この性能はZ.ai自身の表現でも「期待を上回った」とされている。
既知のセキュリティ脆弱性を発見する能力を測るCyberGymでは、GLM-5.3は84.5%を記録。Z.aiの比較表ではMythos 5の83.8%、GPT-5.6 Solの83.6%を上回った。実際のエクスプロイト開発を通じた推論を評価するExploitBenchでは、GLM-5.3の54.4%はGLM-5.2の24.4%から2倍以上に伸びている。ただしAxiosによる結果の読み解きでは、Claude Fable 5とGPT-5.6 Solには届いていない。Z.aiのドキュメントも限界を明確にしており、優位性はエクスプロイトチェーンの前半に集中していると説明する。より深い侵害と、攻撃・防御を完結させるワークフローには「改善が必要」だという。
公開延期の背景を補う材料は2つある。
- 脆弱性発見の実績:Axiosによると、Z.aiは同日、GLMモデルがLinuxカーネル、VMwareプロジェクト、Apacheプロジェクトなどを対象に2,400件超のセキュリティ上の欠陥を発見したとする開示サイトを立ち上げた。このうち1,000件超はcriticalまたはhigh severityに分類されている。オープンソースのメンテナーは、GLMによるバグスキャン用にリポジトリを提出できる。
- 審査期間中の限定提供:Axiosによれば、公開重みの代わりにZ.aiは選定したセキュリティパートナーへ管理されたアクセスを与える段階的プログラムを準備している。これはCoding Planとは別の経路だ。
重みを公開すれば、その後の改変をZ.aiが制御することはできない。同社自身も発表の中で、問題の重さをこう表現している。「An open world cannot have only open attack surfaces.」
GLM-5.3を今使うには
一般ユーザーがGLM-5.3へアクセスする手段は、現時点ではGLM Coding Planのサブスクリプションだけだ。公式ドキュメントではAPIを「coming soon」としており、2026年8月17日時点でZ.aiのトークン料金表にGLM-5.3の項目はない。GLM-5.2、GLM-5.1、GLM-5には料金が載っているため、5.3の行だけがまだ有効化されていないと考えられる。
公式のsubscribeページに掲載されているサブスクリプションは次の通り。
| プラン | 通常価格 | 表示価格 | 利用枠 | 想定ワークロード |
|---|---|---|---|---|
| Lite | $18/月 | $12.60/月 | 10,000 credits/週 | 小規模リポジトリ、軽い反復作業 |
| Pro | $80/月 | $56/月 | Liteの6倍の利用量 | 日常的な開発、中規模リポジトリ |
| Max | $168/月 | $117.60/月 | Liteの14倍の利用量 | 中〜大規模リポジトリ、高頻度なエージェント利用 |
ページには高い参照価格と低い表示価格が並んでいるが、請求条件のラベルは付いていない。月額の基準は$18/$80/$168と見て、低い価格は現行の割引価格として扱うのが無難だ。セットアップはnpx @z_ai/coding-helperを1回実行するだけでよく、選んだツールにプランを接続できる。Z.aiはClaude Code、OpenClaw、自社のZCodeを含む20以上の対応エージェントツールを挙げており、MCPツールへのアクセスはPro以上で提供される。Maxは新フラッグシップへの優先アクセスをうたい、すべてのCoding Planには現行フラッグシップへのローリングアクセスが含まれる。
ローンチに隠れたCoding Planの値上げ
GLM-5.3のローンチ前後でCoding Planの価格体系は見直され、ヘビーユーザーはすぐに変化へ気付いた。r/ZaiGLMで数値を追っていた購読者が、旧V2プランとの比較を投稿している。これはZ.aiの公式表ではなくコミュニティ由来のデータなので、実際に判断する前には自分のダッシュボードを確認してほしい。
| プラン | 旧価格 | 旧トークン数/週 | 新価格 | 新トークン数/週 |
|---|---|---|---|---|
| Pro | $65 | 約500M | $80 | 約526M |
| Max | $144 | 約2B | $168 | 約1.22B |
「new Max gives you ~39% fewer tokens while costing ~17% more.」 - u/x-primez-x、r/ZaiGLM
投稿者の計算では、Maxのトークン当たりコストは約1.9倍悪化している。週あたり・1ドルあたりのトークン数は約13.89Mから約7.26Mへ低下した。Proへの影響は小さいものの、利用枠は約5%増にとどまる一方で価格は約23%上昇しており、同じ計算では1ドル当たりのトークン数が約14%減る。この投稿はモデル自体を高く評価しながら、次のように警告している。
「GLM-5.3 looks awesome… but this new coding plan probably pushes me away from Z.AI for good.」 - u/x-primez-x、r/ZaiGLM
API側の参考値として、GLM-5.3にトークン料金が設定される際のファミリー内の基準は、公式pricingページにあるGLM-5.2だ。入力100万トークンあたり$1.40、キャッシュ済み入力は$0.26、出力は$4.40で、キャッシュ入力の保存は現時点で無料となっている。同じスレッドのあるコメントでは、サブスクリプションとAPIのトレードオフについて従量課金のほうが有利だとも主張されている。「新モデルが毎週、あるいは2週間ごとに出てくるなら、その柔軟性には価値がある」という見方だ。
GLM-5.3へ乗り換えるべきか
結論は、今どの使い方をしているかで変わる。
| 現在の利用者 | 今すぐ移行? | 理由 |
|---|---|---|
| Coding Plan Proの契約者 | はい | 同じ$80プランでGLM-5.3にすぐアクセスできる。DeepSWEの伸びはベンダー公表値なので、まず自分のリポジトリで検証したい |
| Coding Plan Maxのヘビーユーザー | 先に計算 | 旧Maxより週次トークン数が約39%少ないうえに価格は上昇。1ドル当たりのスループットが損益分岐点を下回る可能性がある |
| 従量課金APIユーザー | 待つ | トークン料金がまだない。計測可能なGLMフラッグシップは、100万トークンあたり$1.40/$4.40のGLM-5.2だけ |
| セルフホスター | 重みを待つ | 約2週間のレビューが終わるまで実行できるものがない。同じ753B MoEベースなのでマルチGPUサーバー級のハードウェアが必要で、vLLM/SGLang対応は共有ベースからの期待でありZ.aiの確認ではない |
| Vision必須のユーザー | いいえ | GLM-5.3はGLM-5.2と同様、テキスト入力・テキスト出力のみ。Visionは別系統のクローズドなGLM-5Vラインに残っている |
最後の行は特に重要だ。これはコミュニティがローンチ前に最も強く求めていた機能だった。Jie Tangが6月29日に実施した「GLM-5.3に何を含めるべきか」という投票は、466,000ビューを集め、Visionが圧倒的な回答だった。しかし、出荷されたモデルには視覚エンコーダーがない。スクリーンショット、PDF、UIモックアップを入力するワークフローなら、代替策はGLM-5.3ではなく、Z.aiのAPIで提供されるGLM-5V-Turbo(100万トークンあたり$1.20/$4.00)となる。
なお、未解決のトレードオフもある。今すぐ契約すればGLM-5.3を使える反面、改定後の利用枠に縛られる。待つ場合のコストはアクセスできないことだけだ。重みについてはZ.aiがレビュー期間を示している一方、APIは価格も日付もない「coming soon」にとどまる。現時点でエージェント型コーディングの処理量がボトルネックでなければ、2週間の重み公開待ちは十分に待てる長さだろう。
FAQ
GLM-5.3の重みはいつ公開される?
Z.aiは安全性レビューのため、8月14日のローンチから約2週間、重みの公開を延期した。予定通りなら8月下旬となる。GLM-5.2の重みは6月のリリースから数日以内に公開されたため、Hugging Faceのzai-org組織を追うとよい。
GLM-5.3はオープンソース?
GLM-5.3はオープンウェイトモデルとして位置付けられているが、重みはまだ公開されておらず、ローンチドキュメントにもライセンスは明記されていない。GLM-5.2はMITライセンスで提供されたため、コミュニティではGLM-5.3も同様ではないかと見られている。ただし、これはZ.aiの確約ではなく推測にすぎない。
GLM-5.3は画像やVisionに対応している?
いいえ。公式ドキュメントに記載されているのはテキスト入力とテキスト出力のみで、コンテキストは100万トークン、最大出力は128Kトークンだ。ネイティブVisionは別系統のGLM-5Vファミリー(GLM-5V-Turbo、GLM-4.6V)で提供されており、Z.aiはオープンウェイトではなくAPI経由でこれらを提供している。
GLM-5.3のトークン単価はいくら?
トークン単価はまだ公開されていない。APIは「coming soon」とされ、GLM-5.3はZ.aiの料金表にも載っていない。現在の利用手段は、通常価格で月額$18/$80/$168のGLM Coding Planのみで、表示価格は現在$12.60/$56/$117.60となっている。
GLM-5.3はローカルで動かせる?
重みが公開されるまでは動かせない。GLM-5.2ではvLLM、SGLang、KTransformersのサポートがモデルカードに記載されていた(TechTimesによる)。ただし、ローンチドキュメントにはGLM-5.3のデプロイスタックがまだ書かれていない。コンシューマー向けPCではなく、マルチGPUサーバー級のハードウェアを想定しておくべきだ。