本地部署 Qwen 需要什麼顯示卡?各版本記憶體需求一覽
Qwen 目前有 8 個能本地部署的版本,最小的 Qwen3 8B 在 Q4 量化下需要 7GB 記憶體,最大的 Qwen3.8 2.4T A95B 需要 30GB。最便宜能跑起來的裝置是 Tesla V100 16GB,約 NT$4,118。
Qwen 各版本的記憶體需求
閒魚
| 版本 | 發布日期 | 上下文 | |||
|---|---|---|---|---|---|
| Qwen3 8B稠密 | 8.2B | 2025年4月27日 | 40K | 7 | Tesla V100 16GBNT$4,118 · 16 GB |
| Qwen3.5 9B稠密 | 9.7B | 2026年2月27日 | 256K | 8 | Tesla V100 16GBNT$4,118 · 16 GB |
| Qwen3.6 27B稠密 | 27.8B | 2026年4月21日 | 256K | 19 | GeForce RTX 2080 Ti 22GBNT$12,166 · 22 GB |
| Qwen3.8 27B稠密 | 27.8B | 2026年8月5日 | 256K | 19 | GeForce RTX 2080 Ti 22GBNT$12,166 · 22 GB |
| Qwen3 32B稠密 | 32.8B | 2025年4月27日 | 40K | 22 | GeForce RTX 2080 Ti 22GBNT$12,166 · 22 GB |
| Qwen3.6 35B A3BMoE | 36B(啟用 3B) | 2026年4月15日 | 256K | 4另需 19 GB 記憶體 | Tesla V100 16GBNT$4,118 · 16 GB · 專家卸載 |
| Qwen3.8 Flash NextMoE | 176B(啟用 6B) | 2026年8月24日 | 256K | 4另需 97 GB 記憶體 | Tesla V100 16GBNT$4,118 · 16 GB · 專家卸載 |
| Qwen3.8 2.4T A95BMoE | 2,446B(啟用 95B) | 2026年8月8日 | 256K | 30另需 1,337 GB 記憶體 | Instinct MI50 32GBNT$12,751 · 32 GB · 專家卸載 |
最低記憶體 = Q4_K_M 權重 + 8K 上下文 KV cache + 1GB 執行開銷,向上取整;最便宜能跑的裝置依目前價格基準的中位價升序,取第一台裝得下的。
關於 Qwen
Qwen 由 Alibaba 發布,授權為 Apache-2.0 / Qwen Community License 1.0 / Qwen3.8-Max License。本頁收錄 8 個版本,參數量介於 8.2B 與 2,446B,結構參數與量化大小依據 Hugging Face 等來源核驗後更新。
廠商Alibaba
授權Apache-2.0 / Qwen Community License 1.0 / Qwen3.8-Max License
官方首頁https://qwen.ai/
Hugging Face 組織Qwen