本地部署 Gemma 需要什麼顯示卡?各版本記憶體需求一覽
Gemma 目前有 4 個能本地部署的版本,最小的 Gemma 4 E4B 在 Q4 量化下需要 7GB 記憶體,最大的 Gemma 4 31B 需要 26GB。最便宜能跑起來的裝置是 Tesla V100 16GB,約 NT$4,118。
Gemma 各版本的記憶體需求
閒魚
| 版本 | 發布日期 | 上下文 | |||
|---|---|---|---|---|---|
| Gemma 4 E4B稠密 | 8B | 2026年3月2日 | 128K | 7 | Tesla V100 16GBNT$4,118 · 16 GB |
| Gemma 4 12B稠密 | 12B | 2026年5月23日 | 256K | 11 | Tesla V100 16GBNT$4,118 · 16 GB |
| Gemma 4 26B A4BMoE | 25.8B(啟用 4B) | 2026年3月11日 | 256K | 6另需 13 GB 記憶體 | Tesla V100 16GBNT$4,118 · 16 GB · 專家卸載 |
| Gemma 4 31B稠密 | 31.3B | 2026年3月11日 | 256K | 26 | Instinct MI50 32GBNT$12,751 · 32 GB |
最低記憶體 = Q4_K_M 權重 + 8K 上下文 KV cache + 1GB 執行開銷,向上取整;最便宜能跑的裝置依目前價格基準的中位價升序,取第一台裝得下的。
關於 Gemma
Gemma 由 Google DeepMind 發布,授權為 Apache-2.0。本頁收錄 4 個版本,參數量介於 8B 與 31.3B,結構參數與量化大小依據 Hugging Face 等來源核驗後更新。
廠商Google DeepMind
授權Apache-2.0
Hugging Face 組織google