RTX PRO 5500 の価格・中古相場:実行できるローカルLLMは?
RTX PRO 5500 は 84GB の GDDR7 ECC メモリと 1,398 GB/s の帯域幅を備えます。価格のデータはまだありません。4-bit 量子化・8K コンテキストなら最大で約 143B パラメータの Dense モデルが収まり、推定 12 tokens/s です。
Xianyu
RTX PRO 5500 の価格推移
Xianyu
購入リンクにはアフィリエイトタグが含まれる場合がありますが、支払額は変わりません。
RTX PRO 5500 の詳細スペック
- メモリ84 GB · GDDR7 ECC
- 帯域幅1,398 GB/s
- バス幅
- 448-bit
- アーキテクチャ
- Blackwell (GB202)
- コア
- 21,760
- Tensor コア
- 680
- エコシステム
- CUDA
- インターフェース
- PCIe 5.0 x16
- NVLink
- 非対応
- 消費電力
- 600 W
- スロット
- 2
- 長さ
- 282 mm
- 種別
- ワークステーション
- 発売日
- 2026年9月14日
RTX PRO 5500 で動かせるモデルは?
RTX PRO 5500 1 枚で動かせる 50B 以下のモデル、2026 年以降にリリースされたバージョンのみ
| モデル | サイズ | 動作 | 速度 t/s | 最大コンテキスト |
|---|---|---|---|---|
| 3.8 GB | 動く | 218.7 | 128K | |
| 4.1 GB | 動く | 203.3 | 256K | |
| 4.7 GB | 動く | 178.6 | 256K | |
| 10.5 GB | 動く | 174.8 | 256K | |
| 11.8 GB | 動く | 79.7 | 256K | |
| 9.8 GB | 動く | 94.4 | 256K | |
| 11.9 GB | 動く | 186.2 | 198K | |
| 11.8 GB | 動く | 76.9 | 256K | |
| 12.3 GB | 動く | 196.9 | 256K |
| モデル | サイズ | 動作 | 速度 t/s | 最大コンテキスト |
|---|---|---|---|---|
| 5 GB | 動く | 174.2 | 128K | |
| 5.7 GB | 動く | 154.4 | 256K | |
| 7.1 GB | 動く | 126.1 | 256K | |
| 16.9 GB | 動く | 150.2 | 256K | |
| 16.8 GB | 動く | 57.5 | 256K | |
| 16.5 GB | 動く | 58.4 | 256K | |
| 18.3 GB | 動く | 166.9 | 198K | |
| 18.3 GB | 動く | 51.7 | 256K | |
| 22.1 GB | 動く | 170.2 | 256K |
| モデル | サイズ | 動作 | 速度 t/s | 最大コンテキスト |
|---|---|---|---|---|
| 8.2 GB | 動く | 112.9 | 128K | |
| 9.5 GB | 動く | 98.3 | 256K | |
| 12.7 GB | 動く | 74.7 | 256K | |
| 26.9 GB | 動く | 123 | 256K | |
| 28.6 GB | 動く | 34.6 | 256K | |
| 29 GB | 動く | 34.2 | 256K | |
| 31.8 GB | 動く | 136.9 | 198K | |
| 32.6 GB | 動く | 30.1 | 256K | |
| 36.9 GB | 動く | 141.3 | 256K |
動く重みも KV キャッシュも VRAM に収まり、速度は VRAM 帯域幅から推定します。
RAM オフロードが必要MoE モデルのみ。エキスパート重みをシステム RAM に置くため、速度は RAM 帯域幅 70 GB/s から推定します。
入らないこの量子化では 1 枚に収まらず、RAM へのオフロードでも動きません。
RTX PRO 5500 2枚・4枚・8枚差しで動かせる LLM は?
2026 年以降リリースの 50B 以上のモデルに必要な枚数(vLLM のテンソル並列、32K コンテキスト)
| モデル | サイズ | 必要枚数 | 合計価格 | 合計 VRAM | 速度 t/s | 合計消費電力 |
|---|---|---|---|---|---|---|
| 78.9 GB | 1 枚 | 価格なし | 84 GB | 142.8 | 600 W | |
| 96.8 GB | 2 枚 | 価格なし | 168 GB | 119.1 | 1,200 W | |
| 107.2 GB | 2 枚 | 価格なし | 168 GB | 60.5 | 1,200 W | |
| 108.7 GB | 2 枚 | 価格なし | 168 GB | 98.8 | 1,200 W | |
| 253.9 GB | 4 枚 | 価格なし | 336 GB | 53.5 | 2,400 W | |
| 286.1 GB推定 | 4 枚 | 価格なし | 336 GB | 40.9 | 2,400 W | |
| 339.5 GB | 8 枚 | 価格なし | 672 GB | 63.8 | 4,800 W | |
| 594.6 GB推定 | 8 枚 | 価格なし | 672 GB | 43.2 | 4,800 W |
| モデル | サイズ | 必要枚数 | 合計価格 | 合計 VRAM | 速度 t/s | 合計消費電力 |
|---|---|---|---|---|---|---|
| 111.3 GB | 2 枚 | 価格なし | 168 GB | 123.8 | 1,200 W | |
| 155.1 GB | 2 枚 | 価格なし | 168 GB | 90.9 | 1,200 W | |
| 182.2 GB | 4 枚 | 価格なし | 336 GB | 46 | 2,400 W | |
| 199.7 GB | 4 枚 | 価格なし | 336 GB | 66.2 | 2,400 W | |
| 467.3 GB | 8 枚 | 価格なし | 672 GB | 33.5 | 4,800 W | |
| 467.3 GB | 8 枚 | 価格なし | 672 GB | 29.1 | 4,800 W | |
| 510.3 GB | 8 枚 | 価格なし | 672 GB | 57.7 | 4,800 W | |
| 583.7 GB | 8 枚 | 価格なし | 672 GB | 43 | 4,800 W |
| モデル | サイズ | 必要枚数 | 合計価格 | 合計 VRAM | 速度 t/s | 合計消費電力 |
|---|---|---|---|---|---|---|
| 161.9 GB | 4 枚 | 価格なし | 336 GB | 88.5 | 2,400 W | |
| 188.2 GB | 4 枚 | 価格なし | 336 GB | 94.1 | 2,400 W | |
| 317.7 GB | 8 枚 | 価格なし | 672 GB | 32.1 | 4,800 W | |
| 341 GB | 8 枚 | 価格なし | 672 GB | 43.8 | 4,800 W | |
| 594.5 GB | 8 枚 | 価格なし | 672 GB | 42.4 | 4,800 W |
枚数は 1 / 2 / 4 / 8 枚、各カード VRAM の 90% を使用。速度は 1 枚分の帯域幅から推定し、合計価格は GPU のみです。「Engram は RAM」の行は、別途約 203 GB のシステムメモリが必要です。NVLink 非対応のため、カード間は PCIe 経由です。実際に動くかは vLLM の対応次第です。
他市場の価格
購入リンクにはアフィリエイトタグが含まれる場合がありますが、支払額は変わりません。
よくある質問
RTX PRO 5500 で動かせるモデルの最大サイズは?
RTX PRO 5500 1 枚の VRAM は 84GB の GDDR7 ECC です。4-bit 量子化・8K コンテキストなら最大で約 143B パラメータの Dense モデルが収まり、8-bit では約 77B です。
RTX PRO 5500 で 70B モデルは動きますか?
はい。4-bit・8K コンテキストでは 70B Dense モデルに約 43GB が必要で、RTX PRO 5500 の 84GB に収まります。
RTX PRO 5500 に向いている LLM は?
2026 年リリースのモデルのうち、4-bit で VRAM に丸ごと収まる最大の Dense モデルは Gemma 4 31B で、推定 51.7 tokens/s です。MoE モデルでは Qwen3.6 35B A3B が最速で、約 170.2 tokens/s です。全リストは上の「動かせるモデル」の表にあります。
RTX PRO 5500 で LLM は毎秒何トークン出ますか?
VRAM 帯域から推定すると、4-bit・8K コンテキストで 8B の Dense モデルで約 167.5 tokens/s、14B の Dense モデルで約 103.4 tokens/s、32B の Dense モデルで約 48.9 tokens/s、70B の Dense モデルで約 23.3 tokens/s です。MoE モデルは 1 トークンごとにアクティブパラメータだけを読むため、ずっと速くなります。実測は推定値の 70%〜100% になることが多いです。
RTX PRO 5500 2枚差しで動かせる LLM は?
RTX PRO 5500 2 枚(合計 168GB)なら、vLLM のテンソル並列・4-bit・32K コンテキストで Qwen3.8 Flash Next、DeepSeek V4 Flash が収まります。Kimi K2.7 Code を 4-bit・32K コンテキストで動かすには 8 枚必要です。
RTX PRO 5500 の価格は?
価格のデータはまだありません。取得が始まり次第ここに表示します。