収録 GPU41価格追跡3 日2026年9月3日 から直近 24h の価格データ11,753 件24h 最大の値下げ24h 最大の値上げデータ更新 2026年9月5日

Qwen をローカルで動かすには?バージョン別の必要VRAM

Qwen には現在ローカルで動かせるバージョンが 6 個あります。最小の Qwen3 8B は Q4 量子化で 7GB、最大の Qwen3.6 35B A3B は 4GB が必要です。動かせる最も安いデバイスは GeForce RTX 2080 Ti ですが、中古価格のデータはまだありません。

Qwen 各バージョンの必要VRAM

6 バージョン
バージョン公開日コンテキスト
Qwen3 8BDense8.2B2025年4月27日40K7GeForce RTX 2080 Ti · 11 GB13,232,997
Qwen3.5 9BDense9.7B2026年2月27日256K8GeForce RTX 2080 Ti · 11 GB12,375,273
Qwen3.6 27BDense27.8B2026年4月21日256K19Radeon RX 7900 XT · 20 GB5,366,737
Qwen3.8 27BDense27.8B2026年8月5日256K19Radeon RX 7900 XT · 20 GB5,739,341
Qwen3 32BDense32.8B2025年4月27日40K22Arc Pro B60 · 24 GB5,024,271
Qwen3.6 35B A3BMoE36B(有効 3B)2026年4月15日256K4別途 RAM 19 GBArc Pro B60 · 24 GB4,546,612

最小VRAM = Q4_K_M の重み + 8K コンテキストの KV キャッシュ + 実行時オーバーヘッド 1GB(切り上げ)。最安デバイスは現在の価格基準の中古中央値が安い順で最初に収まるものです。

Qwen について

Qwen は Alibaba が Apache-2.0 で公開しています。このページでは 8.2B から 36B までの 6 バージョンを収録し、構造パラメータと量子化サイズは毎週 Hugging Face から同期しています。

提供元Alibaba
ライセンスApache-2.0
公式サイトhttps://qwen.ai/
Hugging Face の組織Qwen