収録 GPU41価格追跡3 日2026年9月3日 から直近 24h の価格データ11,753 件24h 最大の値下げ24h 最大の値上げデータ更新 2026年9月5日

Gemma をローカルで動かすには?バージョン別の必要VRAM

Gemma には現在ローカルで動かせるバージョンが 4 個あります。最小の Gemma 4 E4B は Q4 量子化で 7GB、最大の Gemma 4 31B は 26GB が必要です。動かせる最も安いデバイスは GeForce RTX 2080 Ti ですが、中古価格のデータはまだありません。

Gemma 各バージョンの必要VRAM

4 バージョン
バージョン公開日コンテキスト
Gemma 4 E4BDense8B2026年3月2日128K7GeForce RTX 2080 Ti · 11 GB4,850,749
Gemma 4 12BDense12B2026年5月23日256K11GeForce RTX 2080 Ti · 11 GB3,195,490
Gemma 4 26B A4BMoE25.8B(有効 4B)2026年3月11日256K6別途 RAM 13 GBRadeon RX 7900 XT · 20 GB8,211,474
Gemma 4 31BDense31.3B2026年3月11日256K26Arc Pro B65 · 32 GB8,332,852

最小VRAM = Q4_K_M の重み + 8K コンテキストの KV キャッシュ + 実行時オーバーヘッド 1GB(切り上げ)。最安デバイスは現在の価格基準の中古中央値が安い順で最初に収まるものです。

Gemma について

Gemma は Google DeepMind が Apache-2.0 で公開しています。このページでは 8B から 31.3B までの 4 バージョンを収録し、構造パラメータと量子化サイズは毎週 Hugging Face から同期しています。

提供元Google DeepMind
ライセンスApache-2.0
Hugging Face の組織google