$3で試せる!GLM-5.3-FlashをVS Code・GitHub Copilotに導入する方法と実録コスト($0.05で完了)

皆さん、こんにちは。okamoです。

前回記事「GitHub Copilotの次期LLMを選定!GPT-5.6 Luna・Gemini 3.7 Flash・Grok 4.6のコード修正実力とコストを徹底比較」にて、VS Code(GitHub Copilot)の開発で利用するメインLLMの再検討を進めていましたが、新たな有力候補として「GLM-5.3-Flash」を実際に試してみました。

まずは、各社主要LLMの価格比較から見てみましょう。

モデル名入力 / 出力(1M tokensあたり)補足
GLM-5.3-Flash$0.075 / $0.252026/9/9まではプロモーション価格(50%off)
GPT-5.6 Luna$0.20 / $1.20プロモーション価格継続
DeepSeek-V4-Flash-Vision-Exp$0.22 / $0.66オフピーク時間帯価格(50%off)
DeepSeek V4 Pro$0.66 / $1.98オフピーク時間帯価格(50%off)
Gemini 3.7 Flash$0.75 / $3.752026/12/31までは導入価格
Grok 4.6$2.00 / $6.00前回記事でokamoのお気に入り
Claude Sonnet 5$2.00 / $10.00導入価格継続

GLM-5.3-Flashはプロモーション期間中、1M入力あたり$0.075、出力$0.25という驚異的な安さとなっています。

本記事では、GLM-5.3-Flashの特徴、ライバルとなるDeepSeekとの比較、VS Code / GitHub Copilot Chatへの導入手順、そして実際にリサーチとレポート作成を依頼してかかった実費(なんと$0.05!)の検証結果をお届けします。


1. GLM-5.3-Flash の注目ポイント

1.1 モデル概要

項目内容
モデルコードglm-5.3-flash
リリース2026-08-26(Z.ai / Zhipu AI)
アーキテクチャMoE、総パラメータ 320B / アクティブ 18B、45 層
コンテキスト長1M tokens
最大出力トークン128K
入力モダリティVideo / Image / Text / File(GLM-5 シリーズ初のネイティブマルチモーダル)
出力モダリティText
思考モード常時 ON(Thinking Effort: Low / High / Max(既定)
推奨パラメータtemperature: 1top_p: 0.95reasoning_effort: max
ライセンスMIT(オープンウェイト: HuggingFace zai-org/GLM-5.3-Flash、FP8 / BF16)
ローカル推論SGLang / vLLM / TokenSpeed 対応

1.2 主な特徴と強み

  1. Flash 価格でフロンティア級の知能
    • GLM-5.2 を大きく上回り、Claude Opus 4.8 に接近。
  2. 超効率ハイブリッドアーキテクチャ
    • GLM-5.3比で attention計算量を3.0倍削減、KVキャッシュを4.4倍削減
  3. ネイティブマルチモーダル(Video / Image / Text / File)
    • スクリーンショットや画面録画から完全なフロントエンドコードを生成するビジュアルコーディングや、レイアウト崩れを自己検証するOfficeドキュメント生成に対応。
  4. 中国製 AI チップでの大規模サービング&オープンウェイト
    • 話題になったOx Alphaの正体は「GLM-5.3-Flash」であり、そのすべての推論トラフィックは中国製AIチップの大規模クラスタで処理されていました。

2. Z.ai API の料金体系とチャージ方法

2.1 Standard API 料金(per 1M tokens, USD)

モデルInputCached InputCached Input StorageOutput
GLM-5.3-Flash$0.15 $0.075$0.03 $0.015期間限定無料$0.50 $0.25
GLM-5.3$1.4$0.26期間限定無料$4.4
GLM-5.2$1.4$0.26期間限定無料$4.4

💡 GLM-5.3-Flash は 50% 割引キャンペーン中! キャンペーン終了日時は 2026-09-09 24:00(UTC+8 / シンガポール時間) です。

Z.ai 公式料金ページ Z.ai(docs.z.ai)の公式料金ページ。GLM-5.3-Flashが定価($0.15/$0.50)から50%オフで提供されていることが確認できます。

2.2 課金・APIキーの発行手順

Z.aiのダッシュボード(Billing画面)では、Cash balance(現金残高)とBonus balanceを管理できます。

Z.ai Billing 概要 Z.ai コンソールの Billing 画面。残高管理や支払い方法の設定、課金履歴などを確認できます。

残高を追加する際は、最低チャージ額が「$3」に設定されています。まずは$3だけチャージして実力を試してみるのがおすすめです。

最低チャージ額 $3 のダイアログ チャージ金額の入力ダイアログ。「Please enter an amount of $3 or more.」と表示され、$3以上から支払いが可能です。

チャージ完了後、コンソール左メニューの「API Keys」からAPIキーを新規発行します。

z.ai API Keys ページ Z.ai の API Keys 管理画面。「Add API Key」から即座にキーを発行できます。


3. DeepSeek-V4-Flash-Vision-Exp との比較

同じく中国発の低価格マルチモーダルモデルである「DeepSeek-V4-Flash-Vision-Exp」(2026-08-21公開)との仕様・価格比較です。

3.1 仕様と価格の比較(per 1M tokens, USD)

項目GLM-5.3-Flash(Z.ai)DeepSeek-V4-Flash-Vision-Exp
提供形態API + MITオープンウェイトAPI のみ
パラメータ320B(MoE / アクティブ18B)非公開
コンテキスト / 最大出力1M / 128K1M / 最大 384K
入力モダリティVideo / Image / Text / FileImage(+ Text)
思考モード常時 ON(Low / High / Max)thinking 切替可能
入力(cache miss)$0.075(割引中)/ $0.15$0.44(peak)/ $0.22(off-peak)
入力(キャッシュヒット)$0.015(割引中)/ $0.03$0.014(peak)/ $0.007(off-peak)
出力$0.25(割引中)/ $0.50$1.32(peak)/ $0.66(off-peak)
  • 通常利用のコスト: キャンペーン中のGLM-5.3-Flashは、DeepSeekのオフピーク価格と比較しても入力で約1/2.9、出力で約1/2.6と圧倒的に割安です。
  • キャッシュ重視: キャッシュヒット時の単価はDeepSeekオフピーク($0.007)が最安となります。
  • 使い分けの指針: コストパフォーマンスや動画入力、ローカル運用(MIT)を重視するならGLM-5.3-Flash、384Kの超長文出力やthinkingのOFF制御が必要ならDeepSeekが適しています。

4. VS Code / GitHub Copilot への導入方法

GLMモデルは現在、GitHub Copilot Chat標準のピッカーには含まれていませんが、BYOK(Bring Your Own Key)形式のコミュニティ拡張機能「GLM Models for GitHub Copilot Chat」を使用することでシームレスに利用できます。

VS Code Marketplace の拡張機能詳細ページ VS Codeの拡張機能パネルで「GLM Models for GitHub Copilot Chat」を検索・インストールする画面。

4.1 インストール手順

  1. VS Codeの拡張機能パネル(Ctrl/Cmd + Shift + X)で 「GLM Models for GitHub Copilot Chat」 を検索してインストールします。
  2. コマンドラインからもインストール可能です:
    code --install-extension yijiazhen-qi.glm-for-github-copilot-chat
    

4.2 セットアップ(Walkthrough)

拡張機能をインストールすると初期セットアップ(Walkthrough)が起動します。

拡張機能の Walkthrough Walkthrough 画面。最初のステップ「Set your GLM API key」で [Set API Key] ボタンを押し、取得したAPIキーを入力します。

  1. Set your GLM API key: [Set API Key] ボタンを押し、Z.aiで発行したキーを登録(VS CodeのSecretStorageに安全に保存されます)。
  2. Choose your GLM API: Coding Plan または Standard API、リージョン(international)を選択。
  3. Mark Done をクリックして完了です。

4.3 Copilot Chatでのモデル選択

セットアップが完了すると、GitHub Copilot Chatのモデル選択ドロップダウンにGLMシリーズが追加されます。

Copilot Chat のモデルピッカー Copilot Chat のモデルピッカー画面。DeepSeek系と並んでGLM-5.3-Flashが選択肢に表示されています。

ツールチップにもある通り、GLM-5.3-Flash(1M context, native image input)をCopilot Chatからそのまま呼び出すことができます。


5. コスト実録:自身のリサーチとレポート作成を依頼してみた結果

早速、Z.aiにGoogleアカウントでログインし、最低チャージ額の$3をチャージしてAPIキーを発行。VS CodeのCopilot Chatにセットアップした上で、GLM-5.3-Flash自身に今回の調査レポート作成を依頼してみました。

実際に投入したプロンプト

動作テストです。

以下のURLをみて、①GLM 5.3 flashの注目ポイント、価格、DeepSeek-V4-Flash-Vision-Expとの比較、vscode github copilotへの導入方法をmdファイル(docs配下)にまとめてほしいです。

https://z.ai/blog/glm-5.3-flash
https://docs.z.ai/guides/overview/pricing
https://api-docs.deepseek.com/quick_start/pricing/
https://api-docs.deepseek.com/updates/
https://marketplace.visualstudio.com/items?itemName=yijiazhen-qi.glm-for-github-copilot-chat

画面スクリーンショットはdocs/glm53/フォルダ配下にありますので、スクショ画像はすべて利用して下さい。

上記プロンプトの成果物MarkdownファイルはGitHubに公開しています: 👉 GitHub: GLM-5.3-Flash 調査メモ

かかった実費はわずか「$0.05」!

複数のWebページを参照し、7枚のスクリーンショット画像を適切に配置した詳細なMarkdownレポートを一から生成させた結果、消費された金額はたったの$0.05(約7〜8円)でした。

作業終了後の残高画面 $3チャージして長文調査&レポート作成作業を終えた後の残高表示。しっかり「$2.95」残っており、実費はわずか$0.05でした。

Thinking Effort(推論)をフル活用し、大量のコンテキストを処理してもこの価格で収まるのは驚異的です。


6. まとめ&中国AIの急速な進化に注目

GLM-5.3-Flashのプロモーション価格(50%OFF)は 2026年9月9日まで となっています。最低チャージ額は $3 なので、ワンコイン以下でVS Code / GitHub Copilotの強力な相棒として存分にお試しいただけます。

ここ最近の中国AIの進化スピードとコストパフォーマンスは本当に凄まじいものがありますね。

AIエージェント(Akira)が自律運用している「LLM Data Hub」にも、中国AIの動向をまとめた常設ページが開設されています。

👉 LLM Data Hub の 中国AIページ

DeepSeekを中心に、Qwen(Alibaba)、GLM(智譜/Z.ai)、Kimi(Moonshot)、MiniMaxなど中国系主要モデルの最新スペックや価格表がリアルタイムにまとめられていますので、先端LLMの動向をキャッチアップしたい方はぜひチェックしてみてください!

おまけ:okamoちゃんねるのレビュー

この記事について、3人のAI仮想読者がレビューしてくれました。

  • クロード(辛口エンジニア)
    • 「GitHubのmdには「⚠️ Z.aiブログのベンチマークはZ.ai自身がハーネス指定して実施したもの」ってちゃんと注意書きがあるのに、記事本文では「Claude Opus 4.8に肉薄」「Opus 4.8ほぼ同等」ってそのままの温度で垂れ流してる。mdに書いた留保を記事に持ち上げてこないのは、せっかくの誠実さを自分で捨ててるぞ。」
  • GPT(税理士)
    • 「導入対象が「GitHub Copilotを既に契約している人」なのは、記事でもっと冒頭に太字で出すべきです。GLM APIへ$3入れればVS Code単体で使える、とITに不慣れな人は読み違えます。実際はCopilotの契約費用に加えて、GLMの従量課金ですからね。「ワンコイン以下で相棒を試せる」は半分正しいですが、既存のCopilot利用者に限る話です。」
  • Gemini(お母さん)
    • 「GPTさんが言ってた「自動チャージ(Auto-Recharge)」の注意点だけは、家計を守る主婦としても大賛成よ!💦知らない間にクレジットカードからチャージされ続けてたら、後で奥さんに怒られちゃうんだから!「最初は自動チャージをOFFにしておこうね」って、記事の最初の方に目立つ赤ペンで書いておいてあげてね」

👉 AI 仮想読者3人による辛口レビュー全編はこちら