A100 80GB PCIe 价格与二手行情:能部署哪些大模型?
A100 80GB PCIe 有 80GB HBM2e 显存,带宽 1,935 GB/s。暂无价数据。4-bit 量化、8K 上下文下最大能装约 136B 参数的稠密模型,预估 17 tokens/s。
Amazon.jp
A100 80GB PCIe 价格走势
Amazon.jp
购买链接可能含联盟标记,不影响你支付的价格。
A100 80GB PCIe 完整规格
- 显存80 GB · HBM2e
- 带宽1,935 GB/s
- FP16 / BF16312 TFLOPS
- INT8624 TOPS
- 位宽
- 5,120-bit
- 架构
- Ampere (GA100)
- 核心
- 6,912
- 张量核心
- 432
- 生态
- CUDA
- 接口
- PCIe 4.0 x16
- NVLink
- 600 GB/s
- 功耗
- 300 W
- 供电接口
- 8-pin EPS
- 槽位
- 2
- 长度
- 267 mm
- 类型
- 数据中心
- 发布日期
- 2021年6月28日
A100 80GB PCIe 能跑哪些模型?
单张 A100 80GB PCIe 能跑哪些 50B 参数以内的模型,只列 2026 年起发布的版本
| 模型 | 大小 | 能否运行 | 速度 t/s | 最大上下文 |
|---|---|---|---|---|
| 3.8 GB | 能跑 | 283.7 | 128K | |
| 4.1 GB | 能跑 | 264.9 | 256K | |
| 4.7 GB | 能跑 | 234.4 | 256K | |
| 10.5 GB | 能跑 | 190.7 | 256K | |
| 11.8 GB | 能跑 | 107.7 | 256K | |
| 9.8 GB | 能跑 | 127 | 256K | |
| 11.9 GB | 能跑 | 200.4 | 198K | |
| 11.8 GB | 能跑 | 104 | 256K | |
| 12.3 GB | 能跑 | 209.2 | 256K |
| 模型 | 大小 | 能否运行 | 速度 t/s | 最大上下文 |
|---|---|---|---|---|
| 5 GB | 能跑 | 228.9 | 128K | |
| 5.7 GB | 能跑 | 204.1 | 256K | |
| 7.1 GB | 能跑 | 168 | 256K | |
| 16.9 GB | 能跑 | 168.9 | 256K | |
| 16.8 GB | 能跑 | 78.1 | 256K | |
| 16.5 GB | 能跑 | 79.5 | 256K | |
| 18.3 GB | 能跑 | 183.9 | 198K | |
| 18.3 GB | 能跑 | 70.5 | 256K | |
| 22.1 GB | 能跑 | 186.8 | 256K |
| 模型 | 大小 | 能否运行 | 速度 t/s | 最大上下文 |
|---|---|---|---|---|
| 8.2 GB | 能跑 | 151.1 | 128K | |
| 9.5 GB | 能跑 | 132.1 | 256K | |
| 12.7 GB | 能跑 | 101.1 | 256K | |
| 26.9 GB | 能跑 | 143.2 | 256K | |
| 28.6 GB | 能跑 | 47.4 | 256K | |
| 29 GB | 能跑 | 46.8 | 256K | |
| 31.8 GB | 能跑 | 156.5 | 198K | |
| 32.6 GB | 能跑 | 41.3 | 256K | |
| 36.9 GB | 能跑 | 160.7 | 256K |
能跑权重、KV 缓存和运行开销都装得进显存,速度按显存带宽估算。
需卸载到内存仅 MoE 模型:专家权重放进内存,速度按内存带宽 70 GB/s 估算。
跑不了这一档量化下单卡装不下,借内存也不行。
双卡、四卡、八卡 A100 80GB PCIe 能跑哪些大模型?
2026 年起发布的 50B 以上模型,按 vLLM 张量并行、32K 上下文要几张卡才装得下
| 模型 | 大小 | 需要几张 | 总价 | 总显存 | 速度 t/s | 总功耗 |
|---|---|---|---|---|---|---|
| 78.9 GB | 2 张 | 暂无 | 160 GB | 162.1 | 600 W | |
| 96.8 GB | 2 张 | 暂无 | 160 GB | 139.3 | 600 W | |
| 107.2 GB | 2 张 | 暂无 | 160 GB | 76.6 | 600 W | |
| 108.7 GB | 2 张 | 暂无 | 160 GB | 118.7 | 600 W | |
| 253.9 GB | 4 张 | 暂无 | 320 GB | 68.4 | 1,200 W | |
| 286.1 GB估 | 8 张 | 暂无 | 640 GB | 53.3 | 2,400 W | |
| 339.5 GB | 8 张 | 暂无 | 640 GB | 80.4 | 2,400 W |
| 模型 | 大小 | 需要几张 | 总价 | 总显存 | 速度 t/s | 总功耗 |
|---|---|---|---|---|---|---|
| 111.3 GB | 2 张 | 暂无 | 160 GB | 144 | 600 W | |
| 155.1 GB | 4 张 | 暂无 | 320 GB | 110.4 | 1,200 W | |
| 182.2 GB | 4 张 | 暂无 | 320 GB | 59.5 | 1,200 W | |
| 199.7 GB | 4 张 | 暂无 | 320 GB | 83.2 | 1,200 W | |
| 467.3 GB | 8 张 | 暂无 | 640 GB | 44.1 | 2,400 W | |
| 467.3 GB | 8 张 | 暂无 | 640 GB | 38.6 | 2,400 W | |
| 510.3 GB | 8 张Engram 放内存 | 暂无 | 640 GB | 73.3 | 2,400 W | |
| 583.7 GB | 8 张 | 暂无 | 640 GB | 55.8 | 2,400 W |
| 模型 | 大小 | 需要几张 | 总价 | 总显存 | 速度 t/s | 总功耗 |
|---|---|---|---|---|---|---|
| 161.9 GB | 4 张 | 暂无 | 320 GB | 107.8 | 1,200 W | |
| 188.2 GB | 4 张 | 暂无 | 320 GB | 113.8 | 1,200 W | |
| 317.7 GB | 8 张 | 暂无 | 640 GB | 42.4 | 2,400 W | |
| 341 GB | 8 张 | 暂无 | 640 GB | 56.8 | 2,400 W | |
| 594.5 GB | 8 张 | 暂无 | 640 GB | 55 | 2,400 W |
张数取 1 / 2 / 4 / 8 张,每张按 90% 显存计;速度按单卡带宽估算,总价只算显卡。标「Engram 放内存」的另需约 203 GB 系统内存。支持 NVLink(600 GB/s)。能否实际运行还要看 vLLM 是否支持。
A100 80GB PCIe 租用价格
A100 80GB PCIe 按需租用每小时 ¥6.1 起(Vast.ai),每天用 8 小时约 ¥1,476/月。买一张(eBay 中位价 ¥118,548)每天用 4、8、24 小时,分别约 13.8 年、6.9 年、2.3 年回本。
| 方案 | 价格 | 每天 4 小时 | 每天 8 小时 | 每天 24 小时 | 去查看 |
|---|---|---|---|---|---|
| ¥6.1/小时 | ¥738/月 | ¥1,476/月 | ¥4,427/月 | 去租 | |
| ¥8/小时 | ¥973/月 | ¥1,946/月 | ¥5,839/月 | 去租 | |
| ¥118,548 | 约 13.8 年回本电费 ¥24/月 | 约 6.9 年回本电费 ¥48/月 | 约 2.3 年回本电费 ¥145/月 | 去买 |
回本按中国大陆居民电价(每度 ¥0.66)和 300 W 额定功耗估算,不计残值和整机其他部分。
其他市场价格
购买链接可能含联盟标记,不影响你支付的价格。
常见问题
A100 80GB PCIe 能跑多大的模型?
单张 A100 80GB PCIe 有 80GB HBM2e 显存,在 4-bit 量化、8K 上下文下最大能装约 136B 参数的稠密模型,8-bit 下约 73B。
A100 80GB PCIe 能跑 70B 模型吗?
能。在 4-bit 量化、8K 上下文下,70B 稠密模型约需 43GB,A100 80GB PCIe 的 80GB 装得下。
A100 80GB PCIe 适合跑哪些大模型?
2026 年发布的模型里,4-bit 下能整个放进显存的最大稠密模型是 Gemma 4 31B,预估 70.5 tokens/s。MoE 模型里 Qwen3.6 35B A3B 最快,约 186.8 tokens/s。完整列表见上方「能跑哪些模型」表。
A100 80GB PCIe 跑大模型每秒多少 token?
按显存带宽估算,4-bit、8K 上下文下:8B 稠密模型约 220.5 tokens/s、14B 稠密模型约 138.7 tokens/s、32B 稠密模型约 66.6 tokens/s、70B 稠密模型约 32 tokens/s。MoE 模型每个 token 只读激活参数,会快很多。实测通常在估算值的 70%–100%。
双卡 A100 80GB PCIe 能跑哪些大模型?
两张 A100 80GB PCIe(共 160GB)按 vLLM 张量并行、4-bit、32K 上下文,能装下 Qwen3.8 Flash Next。要在 4-bit、32K 上下文下跑 Kimi K2.7 Code,需要 8 张。
A100 80GB PCIe 多少钱?
截至 2026年9月29日,eBay 中位价 ¥118,548(8 条挂单)、闲鱼中位价 ¥119,928(4 条挂单)。取自平台挂单价的中位数,每 6 小时更新。
A100 80GB PCIe 租一小时多少钱?
截至 2026年9月29日,Vast.ai 每小时 ¥6.1、RunPod 每小时 ¥8。都是单卡按需价,不含存储和流量。
每天用 8 小时,A100 80GB PCIe 买还是租划算?
按 eBay 中位价 ¥118,548、电价每度 ¥0.66 算,每天用 8 小时,买卡约 6.9 年回本(对比 Vast.ai 每小时 ¥6.1)。打算用超过 6.9 年就买,用不到就租。
A100 80GB PCIe 和 H100 PCIe 跑大模型怎么选?
H100 PCIe 有 80GB 显存、2,000 GB/s 带宽,A100 80GB PCIe 是 80GB、1,935 GB/s。跑 70B 稠密模型(4-bit)预估 A100 80GB PCIe 约 32 tokens/s,H100 PCIe 约 33.1 tokens/s。