Mistral をローカルで動かすには?バージョン別の必要VRAM
Mistral には現在ローカルで動かせるバージョンが 5 個あります。最小の Mistral 7B v0.3 は Q4 量子化で 7GB、最大の Mistral Small 3.2 24B は 16GB が必要です。動かせる最も安いデバイスは GeForce RTX 2080 Ti ですが、中古価格のデータはまだありません。
Mistral 各バージョンの必要VRAM
5 バージョン| バージョン | 公開日 | コンテキスト | ||||
|---|---|---|---|---|---|---|
| Mistral 7B v0.3Dense | 7.3B | 2024年5月22日 | 32K | 7 | GeForce RTX 2080 Ti— · 11 GB | 2,648,636 |
| Ministral 3 8BDense | 8.9B | 2025年10月31日 | 256K | 8 | GeForce RTX 2080 Ti— · 11 GB | 142,610 |
| Mistral NemoDense | 12.3B | 2024年7月17日 | 128K | 10 | GeForce RTX 2080 Ti— · 11 GB | 358,821 |
| Ministral 3 14BDense | 14B | 2025年10月31日 | 256K | 11 | GeForce RTX 2080 Ti— · 11 GB | 266,145 |
| Mistral Small 3.2 24BDense | 24B | 2025年6月19日 | 128K | 16 | GeForce RTX 4080— · 16 GB | 126,611 |
最小VRAM = Q4_K_M の重み + 8K コンテキストの KV キャッシュ + 実行時オーバーヘッド 1GB(切り上げ)。最安デバイスは現在の価格基準の中古中央値が安い順で最初に収まるものです。
Mistral について
Mistral は Mistral AI が Apache-2.0 で公開しています。このページでは 7.3B から 24B までの 5 バージョンを収録し、構造パラメータと量子化サイズは毎週 Hugging Face から同期しています。
提供元Mistral AI
ライセンスApache-2.0
公式サイトhttps://mistral.ai/
Hugging Face の組織mistralai