収録 GPU45価格追跡8 日2026年9月3日 から直近 24h の価格データ6,955 件24h 最大の値下げMac Studio M4 Max 128GB-6.7%24h 最大の値上げGeForce RTX 5070 Ti+21.0%データ更新

Qwen をローカルで動かすには?バージョン別の必要VRAM

Qwen には現在ローカルで動かせるバージョンが 8 個あります。最小の Qwen3 8B は Q4 量子化で 7GB、最大の Qwen3.8 2.4T A95B は 30GB が必要です。最も安く動かせるデバイスは Tesla V100 16GB(で約 ¥20,097)です。

Qwen 各バージョンの必要VRAM

Xianyu
8 バージョン
バージョン公開日コンテキスト
Qwen3 8BDense8.2B2025年4月27日40K7Tesla V100 16GB¥20,097 · 16 GB
Qwen3.5 9BDense9.7B2026年2月27日256K8Tesla V100 16GB¥20,097 · 16 GB
Qwen3.6 27BDense27.8B2026年4月21日256K19GeForce RTX 2080 Ti 22GB¥59,378 · 22 GB
Qwen3.8 27BDense27.8B2026年8月5日256K19GeForce RTX 2080 Ti 22GB¥59,378 · 22 GB
Qwen3 32BDense32.8B2025年4月27日40K22GeForce RTX 2080 Ti 22GB¥59,378 · 22 GB
Qwen3.6 35B A3BMoE36B(有効 3B)2026年4月15日256K4別途 RAM 19 GBTesla V100 16GB¥20,097 · 16 GB · エキスパートオフロード
Qwen3.8 Flash NextMoE176B(有効 6B)2026年8月24日256K4別途 RAM 97 GBTesla V100 16GB¥20,097 · 16 GB · エキスパートオフロード
Qwen3.8 2.4T A95BMoE2,446B(有効 95B)2026年8月8日256K30別途 RAM 1,337 GBInstinct MI50 32GB¥62,232 · 32 GB · エキスパートオフロード

最小VRAM = Q4_K_M の重み + 8K コンテキストの KV キャッシュ + 実行時オーバーヘッド 1GB(切り上げ)。最安デバイスは現在の価格基準の中央値が安い順で最初に収まるものです。

Qwen について

Qwen は Alibaba が Apache-2.0 / Qwen Community License 1.0 / Qwen3.8-Max License で公開しています。本ページは 8.2B から 2,446B までの 8 バージョンを収録。構造パラメータと量子化サイズは Hugging Face などの出典を確認して更新します。

提供元Alibaba
ライセンスApache-2.0 / Qwen Community License 1.0 / Qwen3.8-Max License
公式サイトhttps://qwen.ai/
Hugging Face の組織Qwen