収録 GPU45価格追跡8 日2026年9月3日 から直近 24h の価格データ6,955 件24h 最大の値下げGeForce RTX 5070 Ti-6.3%24h 最大の値上げRTX PRO 4000 Blackwell+7.7%データ更新

GLM をローカルで動かすには?バージョン別の必要VRAM

GLM には現在ローカルで動かせるバージョンが 5 個あります。最小の GLM 4.7 Flash は Q4 量子化で 4GB、最大の GLM 5.3 は 41GB が必要です。最も安く動かせるデバイスは Tesla V100 16GB(で約 ¥46,846)です。

GLM 各バージョンの必要VRAM

eBay
5 バージョン
バージョン公開日コンテキスト
GLM 4.7 FlashMoE30B(有効 3B)2026年1月19日198K4別途 RAM 17 GBTesla V100 16GB¥46,846 · 16 GB · エキスパートオフロード
GLM 4.5 AirMoE106B(有効 12B)2025年7月20日128K7別途 RAM 56 GBTesla V100 16GB¥46,846 · 16 GB · エキスパートオフロード
GLM 5.3 FlashMoE320B(有効 18B)2026年8月25日1M30別途 RAM 174 GBTesla V100 32GB¥110,588 · 32 GB · エキスパートオフロード
GLM 5.2MoE744B(有効 40B)2026年6月16日1M41別途 RAM 406 GBRadeon PRO W7900¥536,811 · 48 GB · エキスパートオフロード
GLM 5.3MoE744B(有効 40B)2026年8月25日1M41別途 RAM 406 GBRadeon PRO W7900¥536,811 · 48 GB · エキスパートオフロード

最小VRAM = Q4_K_M の重み + 8K コンテキストの KV キャッシュ + 実行時オーバーヘッド 1GB(切り上げ)。最安デバイスは現在の価格基準の中央値が安い順で最初に収まるものです。

GLM について

GLM は Z.ai / Zhipu AI が MIT / GLM-5.3 License で公開しています。本ページは 30B から 744B までの 5 バージョンを収録。構造パラメータと量子化サイズは Hugging Face などの出典を確認して更新します。

提供元Z.ai / Zhipu AI
ライセンスMIT / GLM-5.3 License
公式サイトhttps://z.ai/
Hugging Face の組織zai-org