GLM をローカルで動かすには?バージョン別の必要VRAM
GLM には現在ローカルで動かせるバージョンが 5 個あります。最小の GLM 4.7 Flash は Q4 量子化で 4GB、最大の GLM 5.3 は 41GB が必要です。動かせる最も安いデバイスは Radeon RX 7900 XT ですが、中古価格のデータはまだありません。
GLM 各バージョンの必要VRAM
5 バージョン| バージョン | 公開日 | コンテキスト | ||||
|---|---|---|---|---|---|---|
| GLM 4.7 FlashMoE | 30B(有効 3B) | 2026年1月19日 | 198K | 4別途 RAM 17 GB | Radeon RX 7900 XT— · 20 GB | 1,935,018 |
| GLM 4.5 AirMoE | 106B(有効 12B) | 2025年7月20日 | 128K | 7別途 RAM 56 GB | CMP 170HX 64GB (改造)— · 64 GB | 114,264 |
| GLM 5.3 FlashMoE | 320B(有効 18B) | 2026年8月25日 | 1M | 30別途 RAM 174 GB | Mac Studio M3 Ultra 512GB— · 512 GB | 654,957 |
| GLM 5.2MoE | 744B(有効 40B) | 2026年6月16日 | 1M | 41別途 RAM 406 GB | Mac Studio M3 Ultra 512GB— · 512 GB | 1,134,389 |
| GLM 5.3MoE | 744B(有効 40B) | 2026年8月25日 | 1M | 41別途 RAM 406 GB | Mac Studio M3 Ultra 512GB— · 512 GB | 303,534 |
最小VRAM = Q4_K_M の重み + 8K コンテキストの KV キャッシュ + 実行時オーバーヘッド 1GB(切り上げ)。最安デバイスは現在の価格基準の中古中央値が安い順で最初に収まるものです。
GLM について
GLM は Z.ai / Zhipu AI が MIT / GLM-5.3 License で公開しています。このページでは 30B から 744B までの 5 バージョンを収録し、構造パラメータと量子化サイズは毎週 Hugging Face から同期しています。
提供元Z.ai / Zhipu AI
ライセンスMIT / GLM-5.3 License
公式サイトhttps://z.ai/
Hugging Face の組織zai-org