収録 GPU41価格追跡3 日2026年9月3日 から直近 24h の価格データ11,753 件24h 最大の値下げ24h 最大の値上げデータ更新 2026年9月5日

GLM をローカルで動かすには?バージョン別の必要VRAM

GLM には現在ローカルで動かせるバージョンが 5 個あります。最小の GLM 4.7 Flash は Q4 量子化で 4GB、最大の GLM 5.3 は 41GB が必要です。動かせる最も安いデバイスは Radeon RX 7900 XT ですが、中古価格のデータはまだありません。

GLM 各バージョンの必要VRAM

5 バージョン
バージョン公開日コンテキスト
GLM 4.7 FlashMoE30B(有効 3B)2026年1月19日198K4別途 RAM 17 GBRadeon RX 7900 XT · 20 GB1,935,018
GLM 4.5 AirMoE106B(有効 12B)2025年7月20日128K7別途 RAM 56 GBCMP 170HX 64GB (改造) · 64 GB114,264
GLM 5.3 FlashMoE320B(有効 18B)2026年8月25日1M30別途 RAM 174 GBMac Studio M3 Ultra 512GB · 512 GB654,957
GLM 5.2MoE744B(有効 40B)2026年6月16日1M41別途 RAM 406 GBMac Studio M3 Ultra 512GB · 512 GB1,134,389
GLM 5.3MoE744B(有効 40B)2026年8月25日1M41別途 RAM 406 GBMac Studio M3 Ultra 512GB · 512 GB303,534

最小VRAM = Q4_K_M の重み + 8K コンテキストの KV キャッシュ + 実行時オーバーヘッド 1GB(切り上げ)。最安デバイスは現在の価格基準の中古中央値が安い順で最初に収まるものです。

GLM について

GLM は Z.ai / Zhipu AI が MIT / GLM-5.3 License で公開しています。このページでは 30B から 744B までの 5 バージョンを収録し、構造パラメータと量子化サイズは毎週 Hugging Face から同期しています。

提供元Z.ai / Zhipu AI
ライセンスMIT / GLM-5.3 License
公式サイトhttps://z.ai/
Hugging Face の組織zai-org