GLM をローカルで動かすには?バージョン別の必要VRAM
GLM には現在ローカルで動かせるバージョンが 5 個あります。最小の GLM 4.7 Flash は Q4 量子化で 4GB、最大の GLM 5.3 は 41GB が必要です。最も安く動かせるデバイスは Tesla V100 16GB(で約 ¥20,097)です。
GLM 各バージョンの必要VRAM
Xianyu
| バージョン | 公開日 | コンテキスト | |||
|---|---|---|---|---|---|
| GLM 4.7 FlashMoE | 30B(有効 3B) | 2026年1月19日 | 198K | 4別途 RAM 17 GB | Tesla V100 16GB¥20,097 · 16 GB · エキスパートオフロード |
| GLM 4.5 AirMoE | 106B(有効 12B) | 2025年7月20日 | 128K | 7別途 RAM 56 GB | Tesla V100 16GB¥20,097 · 16 GB · エキスパートオフロード |
| GLM 5.3 FlashMoE | 320B(有効 18B) | 2026年8月25日 | 1M | 30別途 RAM 174 GB | Instinct MI50 32GB¥62,232 · 32 GB · エキスパートオフロード |
| GLM 5.2MoE | 744B(有効 40B) | 2026年6月16日 | 1M | 41別途 RAM 406 GB | CMP 170HX 64GB¥320,867 · 64 GB · エキスパートオフロード |
| GLM 5.3MoE | 744B(有効 40B) | 2026年8月25日 | 1M | 41別途 RAM 406 GB | CMP 170HX 64GB¥320,867 · 64 GB · エキスパートオフロード |
最小VRAM = Q4_K_M の重み + 8K コンテキストの KV キャッシュ + 実行時オーバーヘッド 1GB(切り上げ)。最安デバイスは現在の価格基準の中央値が安い順で最初に収まるものです。
GLM について
GLM は Z.ai / Zhipu AI が MIT / GLM-5.3 License で公開しています。本ページは 30B から 744B までの 5 バージョンを収録。構造パラメータと量子化サイズは Hugging Face などの出典を確認して更新します。
提供元Z.ai / Zhipu AI
ライセンスMIT / GLM-5.3 License
公式サイトhttps://z.ai/
Hugging Face の組織zai-org