收录显卡56价格追踪27 天近 24h 价格数据34,228 条24h 降价最多GeForce RTX 4060 Ti 16GB-16.4%24h 涨价最多Radeon RX 7800 XT+19.1%更新于
¥ CNY
简体中文

H100 PCIe 价格与二手行情:能部署哪些大模型?

H100 PCIe 有 80GB HBM2e 显存,带宽 2,000 GB/s。暂无价数据。4-bit 量化、8K 上下文下最大能装约 136B 参数的稠密模型,预估 18 tokens/s。

H100 PCIe 价格走势

价格更新于 —

数据不足,暂无法生成走势

积累足够的有效报价后,将展示中位价走势。

购买链接可能含联盟标记,不影响你支付的价格。

H100 PCIe 完整规格

  • 显存80 GB · HBM2e
  • 带宽2,000 GB/s
  • FP16 / BF16756 TFLOPS
  • FP8 / INT81,513 / 1,513 TOPS
位宽
5,120-bit
架构
Hopper (GH100)
核心
14,592
张量核心
456
生态
CUDA
接口
PCIe 5.0 x16
NVLink
600 GB/s
功耗
350 W
供电接口
16-pin
槽位
2
长度
268 mm
类型
数据中心
发布日期
2022年3月22日

H100 PCIe 能跑哪些模型?

单张 H100 PCIe 能跑哪些 50B 参数以内的模型,只列 2026 年起发布的版本

模型大小能否运行速度 t/s最大上下文
Gemma 4 E4B8B5 GB能跑235.1128K
Qwen3.5 9B9.7B5.7 GB能跑209.8256K
Gemma 4 12B12B7.1 GB能跑172.8256K
Gemma 4 26B A4B25.2B(激活 3.8B)16.9 GB能跑170.7256K
Qwen3.6 27B27.8B16.8 GB能跑80.6256K
Qwen3.8 27B27.8B16.5 GB能跑81.9256K
GLM 4.7 Flash30B(激活 3B)18.3 GB能跑185.4198K
Gemma 4 31B30.7B18.3 GB能跑72.7256K
Qwen3.6 35B A3B36B(激活 3B)22.1 GB能跑188.3256K

能跑权重、KV 缓存和运行开销都装得进显存,速度按显存带宽估算。

需卸载到内存仅 MoE 模型:专家权重放进内存,速度按内存带宽 70 GB/s 估算。

跑不了这一档量化下单卡装不下,借内存也不行。

双卡、四卡、八卡 H100 PCIe 能跑哪些大模型?

2026 年起发布的 50B 以上模型,按 vLLM 张量并行、32K 上下文要几张卡才装得下

模型大小需要几张总价总显存速度 t/s总功耗
Qwen3.8 Flash Next176B(激活 6B)111.3 GB2 张暂无160 GB146700 W
DeepSeek V4 Flash284B(激活 13B)155.1 GB4 张暂无320 GB112.51,400 W
Hy3295B(激活 21B)182.2 GB4 张暂无320 GB611,400 W
GLM 5.3 Flash320B(激活 18B)199.7 GB4 张暂无320 GB851,400 W
GLM 5.3744B(激活 40B)467.3 GB8 张暂无640 GB45.32,800 W
Hy4 preview770B(激活 49B)467.3 GB8 张暂无640 GB39.72,800 W
DeepSeek V4.1 Flash763B(激活 8 / 16B)510.3 GB8 张Engram 放内存暂无640 GB75.12,800 W
Kimi K2.7 Code1,000B(激活 32B)583.7 GB8 张暂无640 GB57.22,800 W

张数取 1 / 2 / 4 / 8 张,每张按 90% 显存计;速度按单卡带宽估算,总价只算显卡。标「Engram 放内存」的另需约 203 GB 系统内存。支持 NVLink(600 GB/s)。能否实际运行还要看 vLLM 是否支持。

H100 PCIe 租用价格

H100 PCIe 按需租用每小时 ¥13.4 起(RunPod),每天用 8 小时约 ¥3,255/月。

方案价格每天 4 小时每天 8 小时每天 24 小时去查看
RunPod租用37分钟前更新¥13.4/小时¥1,627/月¥3,255/月¥9,764/月去租
Vast.ai租用37分钟前更新¥17.4/小时¥2,117/月¥4,234/月¥12,702/月去租

其他市场价格

eBay · 美国
暂无
暂无挂单
去查看
闲鱼 · 中国大陆
暂无
暂无挂单
去查看

购买链接可能含联盟标记,不影响你支付的价格。

常见问题

H100 PCIe 能跑多大的模型?

单张 H100 PCIe 有 80GB HBM2e 显存,在 4-bit 量化、8K 上下文下最大能装约 136B 参数的稠密模型,8-bit 下约 73B。

H100 PCIe 能跑 70B 模型吗?

能。在 4-bit 量化、8K 上下文下,70B 稠密模型约需 43GB,H100 PCIe 的 80GB 装得下。

H100 PCIe 适合跑哪些大模型?

2026 年发布的模型里,4-bit 下能整个放进显存的最大稠密模型是 Gemma 4 31B,预估 72.7 tokens/s。MoE 模型里 Qwen3.6 35B A3B 最快,约 188.3 tokens/s。完整列表见上方「能跑哪些模型」表。

H100 PCIe 跑大模型每秒多少 token?

按显存带宽估算,4-bit、8K 上下文下:8B 稠密模型约 226.5 tokens/s、14B 稠密模型约 142.8 tokens/s、32B 稠密模型约 68.8 tokens/s、70B 稠密模型约 33.1 tokens/s。MoE 模型每个 token 只读激活参数,会快很多。实测通常在估算值的 70%–100%。

双卡 H100 PCIe 能跑哪些大模型?

两张 H100 PCIe(共 160GB)按 vLLM 张量并行、4-bit、32K 上下文,能装下 Qwen3.8 Flash Next。要在 4-bit、32K 上下文下跑 Kimi K2.7 Code,需要 8 张。

H100 PCIe 多少钱?

暂无价数据,价格接入后会显示在这里。

H100 PCIe 租一小时多少钱?

截至 2026年9月29日,RunPod 每小时 ¥13.4、Vast.ai 每小时 ¥17.4。都是单卡按需价,不含存储和流量。

H100 PCIe 和 A100 80GB PCIe 跑大模型怎么选?

A100 80GB PCIe 有 80GB 显存、1,935 GB/s 带宽,H100 PCIe 是 80GB、2,000 GB/s。跑 70B 稠密模型(4-bit)预估 H100 PCIe 约 33.1 tokens/s,A100 80GB PCIe 约 32 tokens/s。