RTX PRO 5500 價格與中古行情:能部署哪些大型語言模型?
RTX PRO 5500 有 84GB GDDR7 ECC 顯存,頻寬 1,398 GB/s。暫無價資料。4-bit 量化、8K 上下文下最大能裝約 143B 參數的稠密模型,預估 12 tokens/s。
eBay
RTX PRO 5500 價格走勢
eBay
購買連結可能含聯盟標記,不影響你支付的價格。
RTX PRO 5500 完整規格
- 顯存84 GB · GDDR7 ECC
- 頻寬1,398 GB/s
- 位寬
- 448-bit
- 架構
- Blackwell (GB202)
- 核心
- 21,760
- 張量核心
- 680
- 生態
- CUDA
- 介面
- PCIe 5.0 x16
- NVLink
- 不支援
- 功耗
- 600 W
- 槽位
- 2
- 長度
- 282 mm
- 類型
- 工作站
- 發布日期
- 2026年9月14日
RTX PRO 5500 能跑哪些模型?
單張 RTX PRO 5500 能跑哪些 50B 參數以內的模型,只列 2026 年起發布的版本
| 模型 | 大小 | 能否執行 | 速度 t/s | 最大上下文 |
|---|---|---|---|---|
| 3.8 GB | 能跑 | 218.7 | 128K | |
| 4.1 GB | 能跑 | 203.3 | 256K | |
| 4.7 GB | 能跑 | 178.6 | 256K | |
| 10.5 GB | 能跑 | 174.8 | 256K | |
| 11.8 GB | 能跑 | 79.7 | 256K | |
| 9.8 GB | 能跑 | 94.4 | 256K | |
| 11.9 GB | 能跑 | 186.2 | 198K | |
| 11.8 GB | 能跑 | 76.9 | 256K | |
| 12.3 GB | 能跑 | 196.9 | 256K |
| 模型 | 大小 | 能否執行 | 速度 t/s | 最大上下文 |
|---|---|---|---|---|
| 5 GB | 能跑 | 174.2 | 128K | |
| 5.7 GB | 能跑 | 154.4 | 256K | |
| 7.1 GB | 能跑 | 126.1 | 256K | |
| 16.9 GB | 能跑 | 150.2 | 256K | |
| 16.8 GB | 能跑 | 57.5 | 256K | |
| 16.5 GB | 能跑 | 58.4 | 256K | |
| 18.3 GB | 能跑 | 166.9 | 198K | |
| 18.3 GB | 能跑 | 51.7 | 256K | |
| 22.1 GB | 能跑 | 170.2 | 256K |
| 模型 | 大小 | 能否執行 | 速度 t/s | 最大上下文 |
|---|---|---|---|---|
| 8.2 GB | 能跑 | 112.9 | 128K | |
| 9.5 GB | 能跑 | 98.3 | 256K | |
| 12.7 GB | 能跑 | 74.7 | 256K | |
| 26.9 GB | 能跑 | 123 | 256K | |
| 28.6 GB | 能跑 | 34.6 | 256K | |
| 29 GB | 能跑 | 34.2 | 256K | |
| 31.8 GB | 能跑 | 136.9 | 198K | |
| 32.6 GB | 能跑 | 30.1 | 256K | |
| 36.9 GB | 能跑 | 141.3 | 256K |
能跑權重、KV 快取和執行開銷都裝得進顯存,速度按顯存頻寬估算。
需卸載到記憶體僅 MoE 模型:專家權重放進記憶體,速度按記憶體頻寬 70 GB/s 估算。
跑不了這一檔量化下單卡放不下,借記憶體也不行。
雙卡、四卡、八卡 RTX PRO 5500 能跑哪些大型語言模型?
2026 年起發布的 50B 以上模型,按 vLLM 張量並行、32K 上下文要幾張卡才裝得下
| 模型 | 大小 | 需要幾張 | 總價 | 總顯示記憶體 | 速度 t/s | 總功耗 |
|---|---|---|---|---|---|---|
| 78.9 GB | 1 張 | 暫無 | 84 GB | 142.8 | 600 W | |
| 96.8 GB | 2 張 | 暫無 | 168 GB | 119.1 | 1,200 W | |
| 107.2 GB | 2 張 | 暫無 | 168 GB | 60.5 | 1,200 W | |
| 108.7 GB | 2 張 | 暫無 | 168 GB | 98.8 | 1,200 W | |
| 253.9 GB | 4 張 | 暫無 | 336 GB | 53.5 | 2,400 W | |
| 286.1 GB估 | 4 張 | 暫無 | 336 GB | 40.9 | 2,400 W | |
| 339.5 GB | 8 張 | 暫無 | 672 GB | 63.8 | 4,800 W | |
| 594.6 GB估 | 8 張 | 暫無 | 672 GB | 43.2 | 4,800 W |
| 模型 | 大小 | 需要幾張 | 總價 | 總顯示記憶體 | 速度 t/s | 總功耗 |
|---|---|---|---|---|---|---|
| 111.3 GB | 2 張 | 暫無 | 168 GB | 123.8 | 1,200 W | |
| 155.1 GB | 2 張 | 暫無 | 168 GB | 90.9 | 1,200 W | |
| 182.2 GB | 4 張 | 暫無 | 336 GB | 46 | 2,400 W | |
| 199.7 GB | 4 張 | 暫無 | 336 GB | 66.2 | 2,400 W | |
| 467.3 GB | 8 張 | 暫無 | 672 GB | 33.5 | 4,800 W | |
| 467.3 GB | 8 張 | 暫無 | 672 GB | 29.1 | 4,800 W | |
| 510.3 GB | 8 張 | 暫無 | 672 GB | 57.7 | 4,800 W | |
| 583.7 GB | 8 張 | 暫無 | 672 GB | 43 | 4,800 W |
| 模型 | 大小 | 需要幾張 | 總價 | 總顯示記憶體 | 速度 t/s | 總功耗 |
|---|---|---|---|---|---|---|
| 161.9 GB | 4 張 | 暫無 | 336 GB | 88.5 | 2,400 W | |
| 188.2 GB | 4 張 | 暫無 | 336 GB | 94.1 | 2,400 W | |
| 317.7 GB | 8 張 | 暫無 | 672 GB | 32.1 | 4,800 W | |
| 341 GB | 8 張 | 暫無 | 672 GB | 43.8 | 4,800 W | |
| 594.5 GB | 8 張 | 暫無 | 672 GB | 42.4 | 4,800 W |
張數取 1 / 2 / 4 / 8 張,每張按 90% 顯存計;速度按單卡頻寬估算,總價只算顯示卡。標「Engram 放記憶體」的另需約 203 GB 系統記憶體。不支援 NVLink,卡間走 PCIe。能否實際執行還要看 vLLM 是否支援。
其他市場價格
購買連結可能含聯盟標記,不影響你支付的價格。
常見問題
RTX PRO 5500 能跑多大的模型?
單張 RTX PRO 5500 有 84GB GDDR7 ECC 顯示記憶體,在 4-bit 量化、8K 上下文下最大能裝約 143B 參數的稠密模型,8-bit 下約 77B。
RTX PRO 5500 能跑 70B 模型嗎?
能。在 4-bit 量化、8K 上下文下,70B 稠密模型約需 43GB,RTX PRO 5500 的 84GB 裝得下。
RTX PRO 5500 適合跑哪些大型語言模型?
2026 年發布的模型中,4-bit 下能完整放進顯示記憶體的最大稠密模型是 Gemma 4 31B,預估 51.7 tokens/s。MoE 模型中 Qwen3.6 35B A3B 最快,約 170.2 tokens/s。完整列表見上方「能跑哪些模型」表格。
RTX PRO 5500 跑大型語言模型每秒多少 token?
按顯示記憶體頻寬估算,4-bit、8K 上下文下:8B 稠密模型約 167.5 tokens/s、14B 稠密模型約 103.4 tokens/s、32B 稠密模型約 48.9 tokens/s、70B 稠密模型約 23.3 tokens/s。MoE 模型每個 token 只讀取啟用參數,會快很多。實測通常在估算值的 70%–100%。
雙卡 RTX PRO 5500 能跑哪些大型語言模型?
兩張 RTX PRO 5500(共 168GB)按 vLLM 張量並行、4-bit、32K 上下文,能裝下 Qwen3.8 Flash Next、DeepSeek V4 Flash。要在 4-bit、32K 上下文下跑 Kimi K2.7 Code,需要 8 張。
RTX PRO 5500 多少錢?
暫無價資料,價格接入後會顯示在這裡。