Qwen をローカルで動かすには?バージョン別の必要VRAM
Qwen には現在ローカルで動かせるバージョンが 8 個あります。最小の Qwen3 8B は Q4 量子化で 7GB、最大の Qwen3.8 2.4T A95B は 30GB が必要です。最も安く動かせるデバイスは Tesla V100 16GB(で約 ¥20,097)です。
Qwen 各バージョンの必要VRAM
Xianyu
| バージョン | 公開日 | コンテキスト | |||
|---|---|---|---|---|---|
| Qwen3 8BDense | 8.2B | 2025年4月27日 | 40K | 7 | Tesla V100 16GB¥20,097 · 16 GB |
| Qwen3.5 9BDense | 9.7B | 2026年2月27日 | 256K | 8 | Tesla V100 16GB¥20,097 · 16 GB |
| Qwen3.6 27BDense | 27.8B | 2026年4月21日 | 256K | 19 | GeForce RTX 2080 Ti 22GB¥59,378 · 22 GB |
| Qwen3.8 27BDense | 27.8B | 2026年8月5日 | 256K | 19 | GeForce RTX 2080 Ti 22GB¥59,378 · 22 GB |
| Qwen3 32BDense | 32.8B | 2025年4月27日 | 40K | 22 | GeForce RTX 2080 Ti 22GB¥59,378 · 22 GB |
| Qwen3.6 35B A3BMoE | 36B(有効 3B) | 2026年4月15日 | 256K | 4別途 RAM 19 GB | Tesla V100 16GB¥20,097 · 16 GB · エキスパートオフロード |
| Qwen3.8 Flash NextMoE | 176B(有効 6B) | 2026年8月24日 | 256K | 4別途 RAM 97 GB | Tesla V100 16GB¥20,097 · 16 GB · エキスパートオフロード |
| Qwen3.8 2.4T A95BMoE | 2,446B(有効 95B) | 2026年8月8日 | 256K | 30別途 RAM 1,337 GB | Instinct MI50 32GB¥62,232 · 32 GB · エキスパートオフロード |
最小VRAM = Q4_K_M の重み + 8K コンテキストの KV キャッシュ + 実行時オーバーヘッド 1GB(切り上げ)。最安デバイスは現在の価格基準の中央値が安い順で最初に収まるものです。
Qwen について
Qwen は Alibaba が Apache-2.0 / Qwen Community License 1.0 / Qwen3.8-Max License で公開しています。本ページは 8.2B から 2,446B までの 8 バージョンを収録。構造パラメータと量子化サイズは Hugging Face などの出典を確認して更新します。
提供元Alibaba
ライセンスApache-2.0 / Qwen Community License 1.0 / Qwen3.8-Max License
公式サイトhttps://qwen.ai/
Hugging Face の組織Qwen