収録 GPU56価格追跡27 日直近 24h の価格データ34,228 件24h 最大の値下げGeForce RTX 4060 Ti 16GB-16.4%24h 最大の値上げRadeon RX 7800 XT+19.1%更新
¥ JPY
日本語

H100 PCIe の価格・中古相場:実行できるローカルLLMは?

H100 PCIe は 80GB の HBM2e メモリと 2,000 GB/s の帯域幅を備えます。価格のデータはまだありません。4-bit 量子化・8K コンテキストなら最大で約 136B パラメータの Dense モデルが収まり、推定 18 tokens/s です。

H100 PCIe の価格推移

現在見積もりなし
価格更新日時 —

データ不足のため、推移を表示できません

有効な価格データが十分に集まると、中央値の推移を表示します。

購入リンクにはアフィリエイトタグが含まれる場合がありますが、支払額は変わりません。

H100 PCIe の詳細スペック

  • メモリ80 GB · HBM2e
  • 帯域幅2,000 GB/s
  • FP16 / BF16756 TFLOPS
  • FP8 / INT81,513 / 1,513 TOPS
バス幅
5,120-bit
アーキテクチャ
Hopper (GH100)
コア
14,592
Tensor コア
456
エコシステム
CUDA
インターフェース
PCIe 5.0 x16
NVLink
600 GB/s
消費電力
350 W
補助電源
16-pin
スロット
2
長さ
268 mm
種別
データセンター
発売日
2022年3月22日

H100 PCIe で動かせるモデルは?

H100 PCIe 1 枚で動かせる 50B 以下のモデル、2026 年以降にリリースされたバージョンのみ

モデルサイズ動作速度 t/s最大コンテキスト
Gemma 4 E4B8B5 GB動く235.1128K
Qwen3.5 9B9.7B5.7 GB動く209.8256K
Gemma 4 12B12B7.1 GB動く172.8256K
Gemma 4 26B A4B25.2B(有効 3.8B)16.9 GB動く170.7256K
Qwen3.6 27B27.8B16.8 GB動く80.6256K
Qwen3.8 27B27.8B16.5 GB動く81.9256K
GLM 4.7 Flash30B(有効 3B)18.3 GB動く185.4198K
Gemma 4 31B30.7B18.3 GB動く72.7256K
Qwen3.6 35B A3B36B(有効 3B)22.1 GB動く188.3256K

動く重みも KV キャッシュも VRAM に収まり、速度は VRAM 帯域幅から推定します。

RAM オフロードが必要MoE モデルのみ。エキスパート重みをシステム RAM に置くため、速度は RAM 帯域幅 70 GB/s から推定します。

入らないこの量子化では 1 枚に収まらず、RAM へのオフロードでも動きません。

H100 PCIe 2枚・4枚・8枚差しで動かせる LLM は?

2026 年以降リリースの 50B 以上のモデルに必要な枚数(vLLM のテンソル並列、32K コンテキスト)

モデルサイズ必要枚数合計価格合計 VRAM速度 t/s合計消費電力
Qwen3.8 Flash Next176B(有効 6B)111.3 GB2 枚価格なし160 GB146700 W
DeepSeek V4 Flash284B(有効 13B)155.1 GB4 枚価格なし320 GB112.51,400 W
Hy3295B(有効 21B)182.2 GB4 枚価格なし320 GB611,400 W
GLM 5.3 Flash320B(有効 18B)199.7 GB4 枚価格なし320 GB851,400 W
GLM 5.3744B(有効 40B)467.3 GB8 枚価格なし640 GB45.32,800 W
Hy4 preview770B(有効 49B)467.3 GB8 枚価格なし640 GB39.72,800 W
DeepSeek V4.1 Flash763B(有効 8 / 16B)510.3 GB8 枚Engram は RAM価格なし640 GB75.12,800 W
Kimi K2.7 Code1,000B(有効 32B)583.7 GB8 枚価格なし640 GB57.22,800 W

枚数は 1 / 2 / 4 / 8 枚、各カード VRAM の 90% を使用。速度は 1 枚分の帯域幅から推定し、合計価格は GPU のみです。「Engram は RAM」の行は、別途約 203 GB のシステムメモリが必要です。NVLink(600 GB/s)に対応しています。実際に動くかは vLLM の対応次第です。

H100 PCIe のレンタル料金

H100 PCIe のレンタルは 1 時間 ¥313 から(RunPod)、1 日 8 時間なら月約 ¥76,177 です。

方法価格1 日 4 時間1 日 8 時間1 日 24 時間見る
RunPodレンタル38 分前に更新¥313/時間¥38,089/月¥76,177/月¥228,532/月借りる
Vast.aiレンタル38 分前に更新¥407/時間¥49,547/月¥99,095/月¥297,284/月借りる

他市場の価格

eBay · 米国
なし
出品なし
見る
Xianyu · 中国本土
なし
出品なし
見る

購入リンクにはアフィリエイトタグが含まれる場合がありますが、支払額は変わりません。

よくある質問

H100 PCIe で動かせるモデルの最大サイズは?

H100 PCIe 1 枚の VRAM は 80GB の HBM2e です。4-bit 量子化・8K コンテキストなら最大で約 136B パラメータの Dense モデルが収まり、8-bit では約 73B です。

H100 PCIe で 70B モデルは動きますか?

はい。4-bit・8K コンテキストでは 70B Dense モデルに約 43GB が必要で、H100 PCIe の 80GB に収まります。

H100 PCIe に向いている LLM は?

2026 年リリースのモデルのうち、4-bit で VRAM に丸ごと収まる最大の Dense モデルは Gemma 4 31B で、推定 72.7 tokens/s です。MoE モデルでは Qwen3.6 35B A3B が最速で、約 188.3 tokens/s です。全リストは上の「動かせるモデル」の表にあります。

H100 PCIe で LLM は毎秒何トークン出ますか?

VRAM 帯域から推定すると、4-bit・8K コンテキストで 8B の Dense モデルで約 226.5 tokens/s、14B の Dense モデルで約 142.8 tokens/s、32B の Dense モデルで約 68.8 tokens/s、70B の Dense モデルで約 33.1 tokens/s です。MoE モデルは 1 トークンごとにアクティブパラメータだけを読むため、ずっと速くなります。実測は推定値の 70%〜100% になることが多いです。

H100 PCIe 2枚差しで動かせる LLM は?

H100 PCIe 2 枚(合計 160GB)なら、vLLM のテンソル並列・4-bit・32K コンテキストで Qwen3.8 Flash Next が収まります。Kimi K2.7 Code を 4-bit・32K コンテキストで動かすには 8 枚必要です。

H100 PCIe の価格は?

価格のデータはまだありません。取得が始まり次第ここに表示します。

H100 PCIe のレンタル料金は 1 時間いくら?

2026年9月29日時点の料金:RunPod は 1 時間 ¥313、Vast.ai は 1 時間 ¥407。いずれも 1 GPU のオンデマンド料金で、ストレージと通信量は含みません。

LLM 用なら H100 PCIe と A100 80GB PCIe のどちらを選ぶべきですか?

A100 80GB PCIe は VRAM 80GB・帯域 1,935 GB/s、H100 PCIe は 80GB・2,000 GB/s です。70B の Dense モデル(4-bit)では、推定で H100 PCIe が約 33.1 tokens/s、A100 80GB PCIe が約 32 tokens/s です。