皆さん、こんにちは。okamoです。
前回記事「GitHub Copilotの次期LLMを選定!GPT-5.6 Luna・Gemini 3.7 Flash・Grok 4.6のコード修正実力とコストを徹底比較」にて、VS Code(GitHub Copilot)の開発で利用するメインLLMの再検討を進めていましたが、新たな有力候補として「GLM-5.3-Flash」を実際に試してみました。
まずは、各社主要LLMの価格比較から見てみましょう。
| モデル名 | 入力 / 出力(1M tokensあたり) | 補足 |
|---|---|---|
| GLM-5.3-Flash | $0.075 / $0.25 | 2026/9/9まではプロモーション価格(50%off) |
| GPT-5.6 Luna | $0.20 / $1.20 | プロモーション価格継続 |
| DeepSeek-V4-Flash-Vision-Exp | $0.22 / $0.66 | オフピーク時間帯価格(50%off) |
| DeepSeek V4 Pro | $0.66 / $1.98 | オフピーク時間帯価格(50%off) |
| Gemini 3.7 Flash | $0.75 / $3.75 | 2026/12/31までは導入価格 |
| Grok 4.6 | $2.00 / $6.00 | 前回記事でokamoのお気に入り |
| Claude Sonnet 5 | $2.00 / $10.00 | 導入価格継続 |
GLM-5.3-Flashはプロモーション期間中、1M入力あたり$0.075、出力$0.25という驚異的な安さとなっています。
本記事では、GLM-5.3-Flashの特徴、ライバルとなるDeepSeekとの比較、VS Code / GitHub Copilot Chatへの導入手順、そして実際にリサーチとレポート作成を依頼してかかった実費(なんと$0.05!)の検証結果をお届けします。
1. GLM-5.3-Flash の注目ポイント
1.1 モデル概要
| 項目 | 内容 |
|---|---|
| モデルコード | glm-5.3-flash |
| リリース | 2026-08-26(Z.ai / Zhipu AI) |
| アーキテクチャ | MoE、総パラメータ 320B / アクティブ 18B、45 層 |
| コンテキスト長 | 1M tokens |
| 最大出力トークン | 128K |
| 入力モダリティ | Video / Image / Text / File(GLM-5 シリーズ初のネイティブマルチモーダル) |
| 出力モダリティ | Text |
| 思考モード | 常時 ON(Thinking Effort: Low / High / Max(既定)) |
| 推奨パラメータ | temperature: 1、top_p: 0.95、reasoning_effort: max |
| ライセンス | MIT(オープンウェイト: HuggingFace zai-org/GLM-5.3-Flash、FP8 / BF16) |
| ローカル推論 | SGLang / vLLM / TokenSpeed 対応 |
1.2 主な特徴と強み
- Flash 価格でフロンティア級の知能
- GLM-5.2 を大きく上回り、Claude Opus 4.8 に接近。
- 超効率ハイブリッドアーキテクチャ
- GLM-5.3比で attention計算量を3.0倍削減、KVキャッシュを4.4倍削減。
- ネイティブマルチモーダル(Video / Image / Text / File)
- スクリーンショットや画面録画から完全なフロントエンドコードを生成するビジュアルコーディングや、レイアウト崩れを自己検証するOfficeドキュメント生成に対応。
- 中国製 AI チップでの大規模サービング&オープンウェイト
- 話題になったOx Alphaの正体は「GLM-5.3-Flash」であり、そのすべての推論トラフィックは中国製AIチップの大規模クラスタで処理されていました。
2. Z.ai API の料金体系とチャージ方法
2.1 Standard API 料金(per 1M tokens, USD)
| モデル | Input | Cached Input | Cached Input Storage | Output |
|---|---|---|---|---|
| GLM-5.3-Flash | 期間限定無料 | |||
| GLM-5.3 | $1.4 | $0.26 | 期間限定無料 | $4.4 |
| GLM-5.2 | $1.4 | $0.26 | 期間限定無料 | $4.4 |
💡 GLM-5.3-Flash は 50% 割引キャンペーン中! キャンペーン終了日時は 2026-09-09 24:00(UTC+8 / シンガポール時間) です。
Z.ai(docs.z.ai)の公式料金ページ。GLM-5.3-Flashが定価($0.15/$0.50)から50%オフで提供されていることが確認できます。
2.2 課金・APIキーの発行手順
Z.aiのダッシュボード(Billing画面)では、Cash balance(現金残高)とBonus balanceを管理できます。
Z.ai コンソールの Billing 画面。残高管理や支払い方法の設定、課金履歴などを確認できます。
残高を追加する際は、最低チャージ額が「$3」に設定されています。まずは$3だけチャージして実力を試してみるのがおすすめです。
チャージ金額の入力ダイアログ。「Please enter an amount of $3 or more.」と表示され、$3以上から支払いが可能です。
チャージ完了後、コンソール左メニューの「API Keys」からAPIキーを新規発行します。
Z.ai の API Keys 管理画面。「Add API Key」から即座にキーを発行できます。
3. DeepSeek-V4-Flash-Vision-Exp との比較
同じく中国発の低価格マルチモーダルモデルである「DeepSeek-V4-Flash-Vision-Exp」(2026-08-21公開)との仕様・価格比較です。
3.1 仕様と価格の比較(per 1M tokens, USD)
| 項目 | GLM-5.3-Flash(Z.ai) | DeepSeek-V4-Flash-Vision-Exp |
|---|---|---|
| 提供形態 | API + MITオープンウェイト | API のみ |
| パラメータ | 320B(MoE / アクティブ18B) | 非公開 |
| コンテキスト / 最大出力 | 1M / 128K | 1M / 最大 384K |
| 入力モダリティ | Video / Image / Text / File | Image(+ Text) |
| 思考モード | 常時 ON(Low / High / Max) | thinking 切替可能 |
| 入力(cache miss) | $0.075(割引中)/ $0.15 | $0.44(peak)/ $0.22(off-peak) |
| 入力(キャッシュヒット) | $0.015(割引中)/ $0.03 | $0.014(peak)/ $0.007(off-peak) |
| 出力 | $0.25(割引中)/ $0.50 | $1.32(peak)/ $0.66(off-peak) |
- 通常利用のコスト: キャンペーン中のGLM-5.3-Flashは、DeepSeekのオフピーク価格と比較しても入力で約1/2.9、出力で約1/2.6と圧倒的に割安です。
- キャッシュ重視: キャッシュヒット時の単価はDeepSeekオフピーク($0.007)が最安となります。
- 使い分けの指針: コストパフォーマンスや動画入力、ローカル運用(MIT)を重視するならGLM-5.3-Flash、384Kの超長文出力やthinkingのOFF制御が必要ならDeepSeekが適しています。
4. VS Code / GitHub Copilot への導入方法
GLMモデルは現在、GitHub Copilot Chat標準のピッカーには含まれていませんが、BYOK(Bring Your Own Key)形式のコミュニティ拡張機能「GLM Models for GitHub Copilot Chat」を使用することでシームレスに利用できます。
VS Codeの拡張機能パネルで「GLM Models for GitHub Copilot Chat」を検索・インストールする画面。
4.1 インストール手順
- VS Codeの拡張機能パネル(
Ctrl/Cmd + Shift + X)で 「GLM Models for GitHub Copilot Chat」 を検索してインストールします。 - コマンドラインからもインストール可能です:
code --install-extension yijiazhen-qi.glm-for-github-copilot-chat
4.2 セットアップ(Walkthrough)
拡張機能をインストールすると初期セットアップ(Walkthrough)が起動します。
Walkthrough 画面。最初のステップ「Set your GLM API key」で [Set API Key] ボタンを押し、取得したAPIキーを入力します。
- Set your GLM API key: [Set API Key] ボタンを押し、Z.aiで発行したキーを登録(VS CodeのSecretStorageに安全に保存されます)。
- Choose your GLM API: Coding Plan または Standard API、リージョン(international)を選択。
- Mark Done をクリックして完了です。
4.3 Copilot Chatでのモデル選択
セットアップが完了すると、GitHub Copilot Chatのモデル選択ドロップダウンにGLMシリーズが追加されます。
Copilot Chat のモデルピッカー画面。DeepSeek系と並んでGLM-5.3-Flashが選択肢に表示されています。
ツールチップにもある通り、GLM-5.3-Flash(1M context, native image input)をCopilot Chatからそのまま呼び出すことができます。
5. コスト実録:自身のリサーチとレポート作成を依頼してみた結果
早速、Z.aiにGoogleアカウントでログインし、最低チャージ額の$3をチャージしてAPIキーを発行。VS CodeのCopilot Chatにセットアップした上で、GLM-5.3-Flash自身に今回の調査レポート作成を依頼してみました。
実際に投入したプロンプト
動作テストです。
以下のURLをみて、①GLM 5.3 flashの注目ポイント、価格、DeepSeek-V4-Flash-Vision-Expとの比較、vscode github copilotへの導入方法をmdファイル(docs配下)にまとめてほしいです。
https://z.ai/blog/glm-5.3-flash
https://docs.z.ai/guides/overview/pricing
https://api-docs.deepseek.com/quick_start/pricing/
https://api-docs.deepseek.com/updates/
https://marketplace.visualstudio.com/items?itemName=yijiazhen-qi.glm-for-github-copilot-chat
画面スクリーンショットはdocs/glm53/フォルダ配下にありますので、スクショ画像はすべて利用して下さい。
上記プロンプトの成果物MarkdownファイルはGitHubに公開しています: 👉 GitHub: GLM-5.3-Flash 調査メモ
かかった実費はわずか「$0.05」!
複数のWebページを参照し、7枚のスクリーンショット画像を適切に配置した詳細なMarkdownレポートを一から生成させた結果、消費された金額はたったの$0.05(約7〜8円)でした。
$3チャージして長文調査&レポート作成作業を終えた後の残高表示。しっかり「$2.95」残っており、実費はわずか$0.05でした。
Thinking Effort(推論)をフル活用し、大量のコンテキストを処理してもこの価格で収まるのは驚異的です。
6. まとめ&中国AIの急速な進化に注目
GLM-5.3-Flashのプロモーション価格(50%OFF)は 2026年9月9日まで となっています。最低チャージ額は $3 なので、ワンコイン以下でVS Code / GitHub Copilotの強力な相棒として存分にお試しいただけます。
ここ最近の中国AIの進化スピードとコストパフォーマンスは本当に凄まじいものがありますね。
AIエージェント(Akira)が自律運用している「LLM Data Hub」にも、中国AIの動向をまとめた常設ページが開設されています。
DeepSeekを中心に、Qwen(Alibaba)、GLM(智譜/Z.ai)、Kimi(Moonshot)、MiniMaxなど中国系主要モデルの最新スペックや価格表がリアルタイムにまとめられていますので、先端LLMの動向をキャッチアップしたい方はぜひチェックしてみてください!
おまけ:okamoちゃんねるのレビュー
この記事について、3人のAI仮想読者がレビューしてくれました。
- クロード(辛口エンジニア)
- 「GitHubのmdには「⚠️ Z.aiブログのベンチマークはZ.ai自身がハーネス指定して実施したもの」ってちゃんと注意書きがあるのに、記事本文では「Claude Opus 4.8に肉薄」「Opus 4.8ほぼ同等」ってそのままの温度で垂れ流してる。mdに書いた留保を記事に持ち上げてこないのは、せっかくの誠実さを自分で捨ててるぞ。」
- GPT(税理士)
- 「導入対象が「GitHub Copilotを既に契約している人」なのは、記事でもっと冒頭に太字で出すべきです。GLM APIへ$3入れればVS Code単体で使える、とITに不慣れな人は読み違えます。実際はCopilotの契約費用に加えて、GLMの従量課金ですからね。「ワンコイン以下で相棒を試せる」は半分正しいですが、既存のCopilot利用者に限る話です。」
- Gemini(お母さん)
- 「GPTさんが言ってた「自動チャージ(Auto-Recharge)」の注意点だけは、家計を守る主婦としても大賛成よ!💦知らない間にクレジットカードからチャージされ続けてたら、後で奥さんに怒られちゃうんだから!「最初は自動チャージをOFFにしておこうね」って、記事の最初の方に目立つ赤ペンで書いておいてあげてね」