H100 PCIe の価格・中古相場:実行できるローカルLLMは?
H100 PCIe は 80GB の HBM2e メモリと 2,000 GB/s の帯域幅を備えます。価格のデータはまだありません。4-bit 量子化・8K コンテキストなら最大で約 136B パラメータの Dense モデルが収まり、推定 18 tokens/s です。
Xianyu
H100 PCIe の価格推移
Xianyu
購入リンクにはアフィリエイトタグが含まれる場合がありますが、支払額は変わりません。
H100 PCIe の詳細スペック
- メモリ80 GB · HBM2e
- 帯域幅2,000 GB/s
- FP16 / BF16756 TFLOPS
- FP8 / INT81,513 / 1,513 TOPS
- バス幅
- 5,120-bit
- アーキテクチャ
- Hopper (GH100)
- コア
- 14,592
- Tensor コア
- 456
- エコシステム
- CUDA
- インターフェース
- PCIe 5.0 x16
- NVLink
- 600 GB/s
- 消費電力
- 350 W
- 補助電源
- 16-pin
- スロット
- 2
- 長さ
- 268 mm
- 種別
- データセンター
- 発売日
- 2022年3月22日
H100 PCIe で動かせるモデルは?
H100 PCIe 1 枚で動かせる 50B 以下のモデル、2026 年以降にリリースされたバージョンのみ
| モデル | サイズ | 動作 | 速度 t/s | 最大コンテキスト |
|---|---|---|---|---|
| 3.8 GB | 動く | 291 | 128K | |
| 4.1 GB | 動く | 271.9 | 256K | |
| 4.7 GB | 動く | 240.8 | 256K | |
| 10.5 GB | 動く | 192.2 | 256K | |
| 11.8 GB | 動く | 111 | 256K | |
| 9.8 GB | 動く | 130.8 | 256K | |
| 11.9 GB | 動く | 201.7 | 198K | |
| 11.8 GB | 動く | 107.2 | 256K | |
| 12.3 GB | 動く | 210.3 | 256K |
| モデル | サイズ | 動作 | 速度 t/s | 最大コンテキスト |
|---|---|---|---|---|
| 5 GB | 動く | 235.1 | 128K | |
| 5.7 GB | 動く | 209.8 | 256K | |
| 7.1 GB | 動く | 172.8 | 256K | |
| 16.9 GB | 動く | 170.7 | 256K | |
| 16.8 GB | 動く | 80.6 | 256K | |
| 16.5 GB | 動く | 81.9 | 256K | |
| 18.3 GB | 動く | 185.4 | 198K | |
| 18.3 GB | 動く | 72.7 | 256K | |
| 22.1 GB | 動く | 188.3 | 256K |
| モデル | サイズ | 動作 | 速度 t/s | 最大コンテキスト |
|---|---|---|---|---|
| 8.2 GB | 動く | 155.5 | 128K | |
| 9.5 GB | 動く | 136 | 256K | |
| 12.7 GB | 動く | 104.2 | 256K | |
| 26.9 GB | 動く | 145.2 | 256K | |
| 28.6 GB | 動く | 48.9 | 256K | |
| 29 GB | 動く | 48.3 | 256K | |
| 31.8 GB | 動く | 158.5 | 198K | |
| 32.6 GB | 動く | 42.6 | 256K | |
| 36.9 GB | 動く | 162.6 | 256K |
動く重みも KV キャッシュも VRAM に収まり、速度は VRAM 帯域幅から推定します。
RAM オフロードが必要MoE モデルのみ。エキスパート重みをシステム RAM に置くため、速度は RAM 帯域幅 70 GB/s から推定します。
入らないこの量子化では 1 枚に収まらず、RAM へのオフロードでも動きません。
H100 PCIe 2枚・4枚・8枚差しで動かせる LLM は?
2026 年以降リリースの 50B 以上のモデルに必要な枚数(vLLM のテンソル並列、32K コンテキスト)
| モデル | サイズ | 必要枚数 | 合計価格 | 合計 VRAM | 速度 t/s | 合計消費電力 |
|---|---|---|---|---|---|---|
| 78.9 GB | 2 枚 | 価格なし | 160 GB | 164 | 700 W | |
| 96.8 GB | 2 枚 | 価格なし | 160 GB | 141.4 | 700 W | |
| 107.2 GB | 2 枚 | 価格なし | 160 GB | 78.4 | 700 W | |
| 108.7 GB | 2 枚 | 価格なし | 160 GB | 120.7 | 700 W | |
| 253.9 GB | 4 枚 | 価格なし | 320 GB | 70.1 | 1,400 W | |
| 286.1 GB推定 | 8 枚 | 価格なし | 640 GB | 54.7 | 2,800 W | |
| 339.5 GB | 8 枚 | 価格なし | 640 GB | 82.3 | 2,800 W |
| モデル | サイズ | 必要枚数 | 合計価格 | 合計 VRAM | 速度 t/s | 合計消費電力 |
|---|---|---|---|---|---|---|
| 111.3 GB | 2 枚 | 価格なし | 160 GB | 146 | 700 W | |
| 155.1 GB | 4 枚 | 価格なし | 320 GB | 112.5 | 1,400 W | |
| 182.2 GB | 4 枚 | 価格なし | 320 GB | 61 | 1,400 W | |
| 199.7 GB | 4 枚 | 価格なし | 320 GB | 85 | 1,400 W | |
| 467.3 GB | 8 枚 | 価格なし | 640 GB | 45.3 | 2,800 W | |
| 467.3 GB | 8 枚 | 価格なし | 640 GB | 39.7 | 2,800 W | |
| 510.3 GB | 8 枚Engram は RAM | 価格なし | 640 GB | 75.1 | 2,800 W | |
| 583.7 GB | 8 枚 | 価格なし | 640 GB | 57.2 | 2,800 W |
| モデル | サイズ | 必要枚数 | 合計価格 | 合計 VRAM | 速度 t/s | 合計消費電力 |
|---|---|---|---|---|---|---|
| 161.9 GB | 4 枚 | 価格なし | 320 GB | 109.9 | 1,400 W | |
| 188.2 GB | 4 枚 | 価格なし | 320 GB | 115.8 | 1,400 W | |
| 317.7 GB | 8 枚 | 価格なし | 640 GB | 43.6 | 2,800 W | |
| 341 GB | 8 枚 | 価格なし | 640 GB | 58.2 | 2,800 W | |
| 594.5 GB | 8 枚 | 価格なし | 640 GB | 56.5 | 2,800 W |
枚数は 1 / 2 / 4 / 8 枚、各カード VRAM の 90% を使用。速度は 1 枚分の帯域幅から推定し、合計価格は GPU のみです。「Engram は RAM」の行は、別途約 203 GB のシステムメモリが必要です。NVLink(600 GB/s)に対応しています。実際に動くかは vLLM の対応次第です。
H100 PCIe のレンタル料金
H100 PCIe のレンタルは 1 時間 ¥313 から(RunPod)、1 日 8 時間なら月約 ¥76,177 です。
他市場の価格
購入リンクにはアフィリエイトタグが含まれる場合がありますが、支払額は変わりません。
よくある質問
H100 PCIe で動かせるモデルの最大サイズは?
H100 PCIe 1 枚の VRAM は 80GB の HBM2e です。4-bit 量子化・8K コンテキストなら最大で約 136B パラメータの Dense モデルが収まり、8-bit では約 73B です。
H100 PCIe で 70B モデルは動きますか?
はい。4-bit・8K コンテキストでは 70B Dense モデルに約 43GB が必要で、H100 PCIe の 80GB に収まります。
H100 PCIe に向いている LLM は?
2026 年リリースのモデルのうち、4-bit で VRAM に丸ごと収まる最大の Dense モデルは Gemma 4 31B で、推定 72.7 tokens/s です。MoE モデルでは Qwen3.6 35B A3B が最速で、約 188.3 tokens/s です。全リストは上の「動かせるモデル」の表にあります。
H100 PCIe で LLM は毎秒何トークン出ますか?
VRAM 帯域から推定すると、4-bit・8K コンテキストで 8B の Dense モデルで約 226.5 tokens/s、14B の Dense モデルで約 142.8 tokens/s、32B の Dense モデルで約 68.8 tokens/s、70B の Dense モデルで約 33.1 tokens/s です。MoE モデルは 1 トークンごとにアクティブパラメータだけを読むため、ずっと速くなります。実測は推定値の 70%〜100% になることが多いです。
H100 PCIe 2枚差しで動かせる LLM は?
H100 PCIe 2 枚(合計 160GB)なら、vLLM のテンソル並列・4-bit・32K コンテキストで Qwen3.8 Flash Next が収まります。Kimi K2.7 Code を 4-bit・32K コンテキストで動かすには 8 枚必要です。
H100 PCIe の価格は?
価格のデータはまだありません。取得が始まり次第ここに表示します。
H100 PCIe のレンタル料金は 1 時間いくら?
2026年9月29日時点の料金:RunPod は 1 時間 ¥313、Vast.ai は 1 時間 ¥407。いずれも 1 GPU のオンデマンド料金で、ストレージと通信量は含みません。
LLM 用なら H100 PCIe と A100 80GB PCIe のどちらを選ぶべきですか?
A100 80GB PCIe は VRAM 80GB・帯域 1,935 GB/s、H100 PCIe は 80GB・2,000 GB/s です。70B の Dense モデル(4-bit)では、推定で H100 PCIe が約 33.1 tokens/s、A100 80GB PCIe が約 32 tokens/s です。