这是 2026 年最常见的选卡问题,答案取决于你买卡干什么:只跑本地大模型,选二手 RTX 3090;要兼顾游戏、怕二手、或者机箱电源有限,选 RTX 5070 Ti。 两张卡的带宽几乎相同(936 对 896 GB/s),所以速度相差不到 5%;差别全在显存:24GB 能跑 32B 稠密模型的 4-bit 版本,16GB 不能。截至 2026 年 9 月 5 日的价格与走势见下表。
两张卡的关键规格对比
3090 赢在 24GB 显存和略高的带宽,5070 Ti 赢在功耗、体积、新架构和质保。 实时数据:
| 项目 | |||
|---|---|---|---|
| 显存 | 24 GB GDDR6X | 16 GB GDDR7 | 16 GB GDDR6X |
| 带宽 | 936 GB/s | 896 GB/s | 717 GB/s |
| BF16 | 142.3 TFLOPS | 175.8 TFLOPS | 195 TFLOPS |
| INT8 | 285 TOPS | 352 TOPS | 390 TOPS |
| 功耗 | 350 W | 300 W | 320 W |
| 接口 | PCIe 4.0 x16 | PCIe 5.0 x16 | PCIe 4.0 x16 |
| 发布日期 | 2020年9月24日 | 2025年2月20日 | 2022年11月16日 |
| 官方定价 | ¥10,095 | ¥5,044 | ¥8,075 |
| 闲鱼二手 | ¥7,999 | ¥13,950 | ¥7,590 |
| 显存单价 | ¥333 | ¥872 | ¥474 |
| 能跑的最大稠密档位(4-bit、8K) | 32B | 14B | 14B |
| DeepSeek R1 Distill Qwen 14B 速度 | 68 t/s | 65 t/s | 52 t/s |
几个规格对推理的实际影响:
- 带宽几乎打平,这是速度相同的原因。GDDR7 的高频率被 5070 Ti 的 256-bit 位宽抵消,3090 是 384-bit。
- FP8 / FP4 算力:5070 Ti 有,3090 没有。这对 vLLM 的批量推理和 FP8 权重有用,对 llama.cpp 跑 GGUF 单流几乎没影响。
- 功耗:350W 对 300W,实际推理时两卡都在标称的 60% 左右,一年电费差几十元。
- 尺寸:3090 公版三槽、313 mm,非公更大;5070 Ti 多数双槽,ITX 机箱只能选后者。
24GB 比 16GB 多跑哪些模型?
多出的 8GB 意味着整整一档:24B 到 32B 的稠密模型 4-bit 版本,以及 70B 模型的 2-bit 版本。 只有 3090 能单卡跑的模型库版本(4-bit、8K 上下文):
| 只有 GeForce RTX 3090 能跑 | 需要显存 GB | GeForce RTX 3090 上的速度 t/s |
|---|---|---|
| Gemma 4 26B A4B | 18 | 112 |
| Qwen3.6 27B | 19 | 38 |
| Qwen3.8 27B | 19 | 38 |
| GLM 4.7 Flash | 19 | 144 |
| DeepSeek R1 Distill Qwen 32B | 22 | 32 |
| Qwen3 32B | 22 | 32 |
| Qwen3.6 35B A3B | 22 | 141 |
口径:4-bit、8K 上下文,单卡。模型库里两张卡都能跑的有 11 个,都跑不了的有 2 个;上表这些模型 GeForce RTX 5070 Ti 一个都装不下。
这张表就是买 3090 的全部理由。DeepSeek R1 Distill Qwen 32B、Qwen3.8 27B、Qwen3 32B 都是 2026 年家用最常跑的模型,在 5070 Ti 上只能降到 3-bit 以下或者走 CPU offload,速度掉一半以上。
3090 和 5070 Ti 速度差多少?
两卡都能跑的模型上,速度差在 5% 以内;3090 独有的 32B 模型约 32 tokens/s。 预估解码速度:
| 型号 | Qwen3 8B | Gemma 4 12B | DeepSeek R1 Distill Qwen 14B | DeepSeek R1 Distill Qwen 32B |
|---|---|---|---|---|
| 114 | 74 | 68 | 32 | |
| 109 | 71 | 65 | 装不下 | |
| 89 | 58 | 52 | 装不下 | |
| 117 | 76 | 69 | 装不下 |
4-bit、8K 上下文、单路解码的预估速度。带 * 的是 MoE 模型把专家权重放在系统内存里跑(按 70 GB/s 内存带宽算)。
公开实测与这个估算一致:llama.cpp 跑 Llama 3.1 8B Q4_K_M,3090 社区实测约 120 tokens/s,5070 Ti 约 110 到 115。5070 Ti 在 prefill(读入长提示词)阶段快 30% 左右,因为算力高,长文档场景能感觉到,但决定体感的解码速度不分上下。

二手 3090 的风险
四个风险按发生概率排:显存颗粒故障、矿卡、供电接口烧蚀、风扇轴承,前两个可以在交易时排除。
- 显存故障:GDDR6X 背面 12 颗颗粒靠背板散热,长期 100°C 以上后出现花屏、CUDA 报错。要求卖家跑
memtest_vulkan或 OCCT 显存测试 30 分钟并录屏,收货后自己再跑。 - 矿卡:2021 到 2022 年大量 3090 用于挖矿。看 PCB 有没有清洗痕迹、螺丝有没有拆卸痕迹、风扇是否明显磨损。矿卡不是不能买,要按更低的价格买,并且默认显存已经过热老化。
- 12-pin / 8-pin 接口烧蚀:检查接口有没有发黄发黑。
- 风扇:轴承响可以换,成本低。
交易渠道:闲鱼走「验货宝」,eBay 选带 30 天退货的卖家,两边都不要用「不退不换」的低价单。
价格走势:3090 还会跌吗?
3090 的二手价在 2025 到 2026 年基本横盘,跌幅小于同期任何一张新卡。 最近 30 天:
| 型号 | 当前 | 30 天最低 | 30 天最高 | 30 天变化 | 30d 趋势 |
|---|---|---|---|---|---|
| ¥7,999 | ¥7,650 | ¥8,049 | +4.6% | ||
| ¥13,950 | ¥7,888 | ¥13,950 | +76.9% | ||
| ¥7,590 | ¥7,580 | ¥7,633 | -0.6% |
闲鱼最近 30 天的中位价,每 6 小时一个点;变化是当前中位价相对窗口内最早一点的涨跌。
3090 已经六年,价格由本地推理需求托着,24GB 消费卡的替代品只有更贵的 4090 和 5090 D V2。没有理由等它大跌;5070 Ti 作为新卡,一年后二手价会明显低于现在,反而是等得起的那张。
结论:按用途给答案
只跑模型选 3090,兼顾游戏或空间电源受限选 5070 Ti,两者都不满足就看 4080。
- 本地大模型为主:RTX 3090。多出的 8GB 是能力档位,不是参数。
- 游戏为主、偶尔跑模型:RTX 5070 Ti。4K 游戏性能高一大截,DLSS 4,功耗低,新卡质保三年。
- 只有双槽空间或 650W 电源:RTX 5070 Ti。
- 预算比 5070 Ti 更紧:二手 RTX 4080,16GB 里最便宜的 CUDA 卡,见 16GB 能跑哪些模型。
- 两张 3090:预算到一万六以上、想跑 70B 的,见多卡入门。
