本地部署 Qwen 需要什么显卡?各版本显存需求一览
Qwen 目前有 8 个能本地部署的版本,最小的 Qwen3 8B 在 Q4 量化下需要 7GB 显存,最大的 Qwen3.8 2.4T A95B 需要 30GB。最便宜能跑起来的设备是 Tesla V100 16GB,约 ¥880。
Qwen 各版本的显存需求
闲鱼
| 版本 | 发布日期 | 上下文 | |||
|---|---|---|---|---|---|
| Qwen3 8B稠密 | 8.2B | 2025年4月27日 | 40K | 7 | Tesla V100 16GB¥880 · 16 GB |
| Qwen3.5 9B稠密 | 9.7B | 2026年2月27日 | 256K | 8 | Tesla V100 16GB¥880 · 16 GB |
| Qwen3.6 27B稠密 | 27.8B | 2026年4月21日 | 256K | 19 | GeForce RTX 2080 Ti 22GB¥2,600 · 22 GB |
| Qwen3.8 27B稠密 | 27.8B | 2026年8月5日 | 256K | 19 | GeForce RTX 2080 Ti 22GB¥2,600 · 22 GB |
| Qwen3 32B稠密 | 32.8B | 2025年4月27日 | 40K | 22 | GeForce RTX 2080 Ti 22GB¥2,600 · 22 GB |
| Qwen3.6 35B A3BMoE | 36B(激活 3B) | 2026年4月15日 | 256K | 4另需 19 GB 内存 | Tesla V100 16GB¥880 · 16 GB · 专家卸载 |
| Qwen3.8 Flash NextMoE | 176B(激活 6B) | 2026年8月24日 | 256K | 4另需 97 GB 内存 | Tesla V100 16GB¥880 · 16 GB · 专家卸载 |
| Qwen3.8 2.4T A95BMoE | 2,446B(激活 95B) | 2026年8月8日 | 256K | 30另需 1,337 GB 内存 | Instinct MI50 32GB¥2,725 · 32 GB · 专家卸载 |
最低显存 = Q4_K_M 权重 + 8K 上下文 KV cache + 1GB 运行开销,向上取整;最便宜能跑的设备按当前价格基准的中位价升序,取第一台装得下的。
关于 Qwen
Qwen 由 Alibaba 发布,许可证为 Apache-2.0 / Qwen Community License 1.0 / Qwen3.8-Max License。本页收录 8 个版本,参数量从 8.2B 到 2,446B,结构参数与量化体积依据 Hugging Face 等来源核验后更新。
厂商Alibaba
许可证Apache-2.0 / Qwen Community License 1.0 / Qwen3.8-Max License
官方主页https://qwen.ai/
Hugging Face 组织Qwen