DeepSeek をローカルで動かすには?バージョン別の必要VRAM
DeepSeek には現在ローカルで動かせるバージョンが 6 個あります。最小の DeepSeek R1 Qwen3 8B は Q4 量子化で 7GB、最大の DeepSeek V4 Pro は 17GB が必要です。最も安く動かせるデバイスは Tesla V100 16GB(で約 ¥20,097)です。
DeepSeek 各バージョンの必要VRAM
Xianyu
| バージョン | 公開日 | コンテキスト | |||
|---|---|---|---|---|---|
| DeepSeek R1 Qwen3 8BDense | 8.2B | 2025年5月29日 | 128K | 7 | Tesla V100 16GB¥20,097 · 16 GB |
| DeepSeek R1 Distill Qwen 14BDense | 14.8B | 2025年1月20日 | 128K | 11 | Tesla V100 16GB¥20,097 · 16 GB |
| DeepSeek R1 Distill Qwen 32BDense | 32.8B | 2025年1月20日 | 128K | 22 | GeForce RTX 2080 Ti 22GB¥59,378 · 22 GB |
| DeepSeek V4 FlashMoE | 284B(有効 13B) | 2026年7月31日 | 1M | 7別途 RAM 155 GB | Tesla V100 16GB¥20,097 · 16 GB · エキスパートオフロード |
| DeepSeek V3.2MoE | 671B(有効 37B) | 2025年12月1日 | 160K | 12別途 RAM 365 GB | Tesla V100 16GB¥20,097 · 16 GB · エキスパートオフロード |
| DeepSeek V4 ProMoE | 1,600B(有効 49B) | 2026年8月13日 | 1M | 17別途 RAM 879 GB | GeForce RTX 2080 Ti 22GB¥59,378 · 22 GB · エキスパートオフロード |
最小VRAM = Q4_K_M の重み + 8K コンテキストの KV キャッシュ + 実行時オーバーヘッド 1GB(切り上げ)。最安デバイスは現在の価格基準の中央値が安い順で最初に収まるものです。
DeepSeek について
DeepSeek は DeepSeek が MIT で公開しています。本ページは 8.2B から 1,600B までの 6 バージョンを収録。構造パラメータと量子化サイズは Hugging Face などの出典を確認して更新します。
提供元DeepSeek
ライセンスMIT
Hugging Face の組織deepseek-ai