本地部署 GLM 需要什麼顯示卡?各版本記憶體需求一覽
GLM 目前有 5 個能本地部署的版本,最小的 GLM 4.7 Flash 在 Q4 量化下需要 4GB 記憶體,最大的 GLM 5.3 需要 41GB。最便宜能跑起來的裝置是 GeForce RTX 2080 Ti,二手約 NT$7,897。
GLM 各版本的記憶體需求
共 5 個版本| 版本 | 發布日期 | 上下文 | ||||
|---|---|---|---|---|---|---|
| GLM 4.7 FlashMoE | 30B(啟用 3B) | 2026年1月19日 | 198K | 4另需 17 GB 記憶體 | GeForce RTX 2080 TiNT$7,897 · 11 GB · 專家卸載 | 1,935,018 |
| GLM 4.5 AirMoE | 106B(啟用 12B) | 2025年7月20日 | 128K | 7另需 56 GB 記憶體 | GeForce RTX 2080 TiNT$7,897 · 11 GB · 專家卸載 | 114,264 |
| GLM 5.3 FlashMoE | 320B(啟用 18B) | 2026年8月25日 | 1M | 30另需 174 GB 記憶體 | Arc Pro B70NT$47,002 · 32 GB · 專家卸載 | 654,957 |
| GLM 5.2MoE | 744B(啟用 40B) | 2026年6月16日 | 1M | 41另需 406 GB 記憶體 | CMP 170HX 64GB (改裝)NT$60,403 · 64 GB · 專家卸載 | 1,134,389 |
| GLM 5.3MoE | 744B(啟用 40B) | 2026年8月25日 | 1M | 41另需 406 GB 記憶體 | CMP 170HX 64GB (改裝)NT$60,403 · 64 GB · 專家卸載 | 303,534 |
最低記憶體 = Q4_K_M 權重 + 8K 上下文 KV cache + 1GB 執行開銷,向上取整;最便宜能跑的裝置依目前價格基準的二手中位價升序,取第一台裝得下的。
關於 GLM
GLM 由 Z.ai / Zhipu AI 發布,授權為 MIT / GLM-5.3 License。本頁收錄 5 個版本,參數量從 30B 到 744B,結構參數與量化體積每週從 Hugging Face 同步。
廠商Z.ai / Zhipu AI
授權MIT / GLM-5.3 License
官方首頁https://z.ai/
Hugging Face 組織zai-org