Tesla P40 价格与二手行情:能部署哪些大模型?
到价提醒
闲鱼价格到了你设的价,就发邮件提醒你。
Tesla P40 有 24GB GDDR5 显存,带宽 347 GB/s。当前闲鱼中位价 ¥1,200。4-bit 量化、8K 上下文下最大能装约 37B 参数的稠密模型,预估 11 tokens/s。
闲鱼
Tesla P40 价格走势
闲鱼
购买链接可能含联盟标记,不影响你支付的价格。
Tesla P40 完整规格
- 显存24 GB · GDDR5
- 带宽347 GB/s
- INT847 TOPS
- 位宽
- 384-bit
- 架构
- Pascal (GP102)
- 核心
- 3,840
- 生态
- CUDA
- 接口
- PCIe 3.0 x16
- NVLink
- 不支持
- 功耗
- 250 W
- 供电接口
- 8-pin CPU (EPS-12V)
- 槽位
- 2
- 长度
- 267 mm
- 类型
- 数据中心
- 发布日期
- 2016年9月13日
Tesla P40 能跑哪些模型?
单张 Tesla P40 能跑哪些 50B 参数以内的模型,只列 2026 年起发布的版本
| 模型 | 大小 | 能否运行 | 速度 t/s | 最大上下文 |
|---|---|---|---|---|
| 3.8 GB | 能跑 | 62.5 | 128K | |
| 4.1 GB | 能跑 | 57.5 | 256K | |
| 4.7 GB | 能跑 | 49.7 | 256K | |
| 10.5 GB | 能跑 | 91.5 | 256K | |
| 11.8 GB | 能跑 | 20.8 | 192K | |
| 9.8 GB | 能跑 | 24.8 | 221K | |
| 11.9 GB | 能跑 | 105.1 | 198K | |
| 11.8 GB | 能跑 | 20 | 143K | |
| 12.3 GB | 能跑 | 119.8 | 256K |
| 模型 | 大小 | 能否运行 | 速度 t/s | 最大上下文 |
|---|---|---|---|---|
| 5 GB | 能跑 | 48.3 | 128K | |
| 5.7 GB | 能跑 | 42.3 | 256K | |
| 7.1 GB | 能跑 | 33.9 | 256K | |
| 16.9 GB | 能跑 | 68 | 256K | |
| 16.8 GB | 能跑 | 14.8 | 117K | |
| 16.5 GB | 能跑 | 15 | 122K | |
| 18.3 GB | 能跑 | 83.2 | 115K | |
| 18.3 GB | 能跑 | 13.3 | 66K | |
| 22.1 GB | 能跑 | 86.6 | 123K |
| 模型 | 大小 | 能否运行 | 速度 t/s | 最大上下文 |
|---|---|---|---|---|
| 8.2 GB | 能跑 | 30.1 | 128K | |
| 9.5 GB | 能跑 | 25.9 | 256K | |
| 12.7 GB | 能跑 | 19.4 | 256K | |
| 26.9 GB | 需卸载到内存 | 22.6 | 256K | |
| 28.6 GB | 跑不了 | — | — | |
| 29 GB | 跑不了 | — | — | |
| 31.8 GB | 需卸载到内存 | 21.3 | 198K | |
| 32.6 GB | 跑不了 | — | — | |
| 36.9 GB | 需卸载到内存 | 30 | 256K |
能跑权重、KV 缓存和运行开销都装得进显存,速度按显存带宽估算。
需卸载到内存仅 MoE 模型:专家权重放进内存,速度按内存带宽 70 GB/s 估算。
跑不了这一档量化下单卡装不下,借内存也不行。
双卡、四卡、八卡 Tesla P40 能跑哪些大模型?
2026 年起发布的 50B 以上模型,按 vLLM 张量并行、32K 上下文要几张卡才装得下
| 模型 | 大小 | 需要几张 | 总价 | 总显存 | 速度 t/s | 总功耗 |
|---|---|---|---|---|---|---|
| 78.9 GB | 4 张 | ¥4,800 | 96 GB | 62.1 | 1,000 W | |
| 96.8 GB | 8 张 | ¥9,600 | 192 GB | 46 | 2,000 W | |
| 107.2 GB | 8 张 | ¥9,600 | 192 GB | 18.3 | 2,000 W | |
| 108.7 GB | 8 张 | ¥9,600 | 192 GB | 34.9 | 2,000 W |
| 模型 | 大小 | 需要几张 | 总价 | 总显存 | 速度 t/s | 总功耗 |
|---|---|---|---|---|---|---|
| 111.3 GB | 8 张 | ¥9,600 | 192 GB | 49 | 2,000 W | |
| 155.1 GB | 8 张 | ¥9,600 | 192 GB | 31.1 | 2,000 W |
| 模型 | 大小 | 需要几张 | 总价 | 总显存 | 速度 t/s | 总功耗 |
|---|---|---|---|---|---|---|
| 161.9 GB | 8 张 | ¥9,600 | 192 GB | 29.9 | 2,000 W |
张数取 1 / 2 / 4 / 8 张,每张按 90% 显存计;速度按单卡带宽估算,总价只算显卡。不支持 NVLink,卡间走 PCIe。能否实际运行还要看 vLLM 是否支持。
Tesla P40 租用价格
Tesla P40 在优云智算按需租用每小时 ¥0.38,每天用 8 小时约 ¥92/月。买一张(闲鱼中位价 ¥1,200)每天用 4、8、24 小时,分别约 3.8 年、1.9 年、8 个月回本。
| 方案 | 价格 | 每天 4 小时 | 每天 8 小时 | 每天 24 小时 | 去查看 |
|---|---|---|---|---|---|
| ¥0.38/小时 | ¥46/月 | ¥92/月 | ¥277/月 | 去租 | |
| ¥1,200 | 约 3.8 年回本电费 ¥20/月 | 约 1.9 年回本电费 ¥40/月 | 约 8 个月回本电费 ¥120/月 | 去买 |
回本按中国大陆居民电价(每度 ¥0.66)和 250 W 额定功耗估算,不计残值和整机其他部分。
其他市场价格
购买链接可能含联盟标记,不影响你支付的价格。
常见问题
Tesla P40 能跑多大的模型?
单张 Tesla P40 有 24GB GDDR5 显存,在 4-bit 量化、8K 上下文下最大能装约 37B 参数的稠密模型,8-bit 下约 20B。
Tesla P40 能跑 70B 模型吗?
单卡跑不了。在 4-bit 量化、8K 上下文下,70B 稠密模型约需 43GB,超过 Tesla P40 的 24GB。用 llama.cpp 按层拆到 2 张卡上(合计 48GB)就能跑。
Tesla P40 适合跑哪些大模型?
2026 年发布的模型里,4-bit 下能整个放进显存的最大稠密模型是 Gemma 4 31B,预估 13.3 tokens/s。MoE 模型里 Qwen3.6 35B A3B 最快,约 86.6 tokens/s。完整列表见上方「能跑哪些模型」表。
Tesla P40 跑大模型每秒多少 token?
按显存带宽估算,4-bit、8K 上下文下:8B 稠密模型约 46.2 tokens/s、14B 稠密模型约 27.4 tokens/s、32B 稠密模型约 12.5 tokens/s。MoE 模型每个 token 只读激活参数,会快很多。实测通常在估算值的 70%–100%。
双卡 Tesla P40 能跑哪些大模型?
按 vLLM 张量并行、4-bit、32K 上下文,两张 Tesla P40 装不下 2026 年发布的 50B 以上模型。4-bit、32K 上下文下最少要 8 张,能跑 Qwen3.8 Flash Next、DeepSeek V4 Flash。
Tesla P40 多少钱?
截至 2026年9月29日,eBay 中位价 ¥2,668(16 条挂单)、闲鱼中位价 ¥1,200(13 条挂单)。取自平台挂单价的中位数,每 6 小时更新。
Tesla P40 价格在涨还是在跌?
截至 2026年9月29日,闲鱼中位价近 7 天下跌 4.4%,近 30 天下跌 4.4%。
Tesla P40 租一小时多少钱?
截至 2026年9月29日,优云智算每小时 ¥0.38。都是单卡按需价,不含存储和流量。
每天用 8 小时,Tesla P40 买还是租划算?
按闲鱼中位价 ¥1,200、电价每度 ¥0.66 算,每天用 8 小时,买卡约 1.9 年回本(对比优云智算每小时 ¥0.38)。打算用超过 1.9 年就买,用不到就租。
Tesla P40 和 Tesla T10 跑大模型怎么选?
Tesla T10 有 16GB 显存、403 GB/s 带宽,Tesla P40 是 24GB、347 GB/s。按闲鱼中位价,Tesla T10 约 ¥1,335,比 Tesla P40(¥1,200)贵 11.2%。跑 14B 稠密模型(4-bit)预估 Tesla P40 约 27.4 tokens/s,Tesla T10 约 31.7 tokens/s。