Gemma をローカルで動かすには?バージョン別の必要VRAM
Gemma には現在ローカルで動かせるバージョンが 4 個あります。最小の Gemma 4 E4B は Q4 量子化で 7GB、最大の Gemma 4 31B は 26GB が必要です。動かせる最も安いデバイスは GeForce RTX 2080 Ti ですが、中古価格のデータはまだありません。
Gemma 各バージョンの必要VRAM
4 バージョン| バージョン | 公開日 | コンテキスト | ||||
|---|---|---|---|---|---|---|
| Gemma 4 E4BDense | 8B | 2026年3月2日 | 128K | 7 | GeForce RTX 2080 Ti— · 11 GB | 4,850,749 |
| Gemma 4 12BDense | 12B | 2026年5月23日 | 256K | 11 | GeForce RTX 2080 Ti— · 11 GB | 3,195,490 |
| Gemma 4 26B A4BMoE | 25.8B(有効 4B) | 2026年3月11日 | 256K | 6別途 RAM 13 GB | Radeon RX 7900 XT— · 20 GB | 8,211,474 |
| Gemma 4 31BDense | 31.3B | 2026年3月11日 | 256K | 26 | Arc Pro B65— · 32 GB | 8,332,852 |
最小VRAM = Q4_K_M の重み + 8K コンテキストの KV キャッシュ + 実行時オーバーヘッド 1GB(切り上げ)。最安デバイスは現在の価格基準の中古中央値が安い順で最初に収まるものです。
Gemma について
Gemma は Google DeepMind が Apache-2.0 で公開しています。このページでは 8B から 31.3B までの 4 バージョンを収録し、構造パラメータと量子化サイズは毎週 Hugging Face から同期しています。
提供元Google DeepMind
ライセンスApache-2.0
Hugging Face の組織google