這是 2026 年最常見的選卡問題,答案取決於你買卡幹什麼:只跑本地大模型,選二手 RTX 3090;要兼顧遊戲、怕二手、或者機箱電源有限,選 RTX 5070 Ti。 兩張卡的頻寬幾乎相同(936 對 896 GB/s),所以速度相差不到 5%;差別全在顯示記憶體:24GB 能跑 32B 稠密模型的 4-bit 版本,16GB 不能。截至 2026 年 9 月 5 日的價格與走勢見下表。
二手 RTX 3090 還是新 RTX 5070 Ti?跑本地大模型的 24GB 與 16GB 之爭(2026)
譯自简体中文版 · 閱讀原文
正文與常見問題中的數字截至 2026年9月5日;表格使用最新已發布價格,各裝置採集時間可能不同。

本文提及的固定價格均以中國二手市場人民幣(CNY)為基準;動態表格則依頁面所選幣別顯示。
兩張卡的關鍵規格對比
3090 贏在 24GB 顯示記憶體和略高的頻寬,5070 Ti 贏在功耗、體積、新架構和質保。 即時資料:
| 項目 | |||
|---|---|---|---|
| 顯存 | 24 GB GDDR6X | 16 GB GDDR7 | 16 GB GDDR6X |
| 頻寬 | 936 GB/s | 896 GB/s | 717 GB/s |
| BF16 | 142.3 TFLOPS | 175.8 TFLOPS | 195 TFLOPS |
| INT8 | 285 TOPS | 352 TOPS | 390 TOPS |
| 功耗 | 350 W | 300 W | 320 W |
| 介面 | PCIe 4.0 x16 | PCIe 5.0 x16 | PCIe 4.0 x16 |
| 發布日期 | 2020年9月24日 | 2025年2月20日 | 2022年11月16日 |
| 官方定價 | NT$47,426 | NT$23,697 | NT$37,934 |
| 閒魚二手 | NT$37,579 | NT$65,537 | NT$35,658 |
| 顯存單價 | NT$1,566 | NT$4,096 | NT$2,229 |
| 能跑的最大稠密檔位(4-bit、8K) | 32B | 14B | 14B |
| DeepSeek R1 Distill Qwen 14B 速度 | 68 t/s | 65 t/s | 52 t/s |
幾個規格對推論的實際影響:
- 頻寬幾乎打平,這是速度相同的原因。GDDR7 的高頻率被 5070 Ti 的 256-bit 位寬抵消,3090 是 384-bit。
- FP8 / FP4 算力:5070 Ti 有,3090 沒有。這對 vLLM 的批次推論和 FP8 權重有用,對 llama.cpp 跑 GGUF 單流幾乎沒影響。
- 功耗:350W 對 300W,實際推論時兩卡都在標稱的 60% 左右,一年電費差幾十元。
- 尺寸:3090 公版三槽、313 mm,非公更大;5070 Ti 多數雙槽,ITX 機箱只能選後者。
24GB 比 16GB 多跑哪些模型?
多出的 8GB 意味著整整一檔:24B 到 32B 的稠密模型 4-bit 版本,以及 70B 模型的 2-bit 版本。 只有 3090 能單卡跑的模型庫版本(4-bit、8K 上下文):
| 只有 GeForce RTX 3090 能跑 | 需要顯示記憶體 GB | GeForce RTX 3090 上的速度 t/s |
|---|---|---|
| Gemma 4 26B A4B | 18 | 112 |
| Qwen3.6 27B | 19 | 38 |
| Qwen3.8 27B | 19 | 38 |
| GLM 4.7 Flash | 19 | 144 |
| DeepSeek R1 Distill Qwen 32B | 22 | 32 |
| Qwen3 32B | 22 | 32 |
| Qwen3.6 35B A3B | 22 | 141 |
口徑:4-bit、8K 上下文,單卡。模型庫裡兩張卡都能跑的有 11 個,都跑不了的有 2 個;上表這些模型 GeForce RTX 5070 Ti 一個都裝不下。
這張表就是買 3090 的全部理由。DeepSeek R1 Distill Qwen 32B、Qwen3.8 27B、Qwen3 32B 都是 2026 年家用最常跑的模型,在 5070 Ti 上只能降到 3-bit 以下或者走 CPU offload,速度掉一半以上。
3090 和 5070 Ti 速度差多少?
兩卡都能跑的模型上,速度差在 5% 以內;3090 獨有的 32B 模型約 32 tokens/s。 預估解碼速度:
| 型號 | Qwen3 8B | Gemma 4 12B | DeepSeek R1 Distill Qwen 14B | DeepSeek R1 Distill Qwen 32B |
|---|---|---|---|---|
| 114 | 74 | 68 | 32 | |
| 109 | 71 | 65 | 裝不下 | |
| 89 | 58 | 52 | 裝不下 | |
| 117 | 76 | 69 | 裝不下 |
4-bit、8K 上下文、單路解碼的預估速度。帶 * 的是 MoE 模型把專家權重放在系統記憶體裡跑(按 70 GB/s 記憶體頻寬算)。
公開實測與這個估算一致:llama.cpp 跑 Llama 3.1 8B Q4_K_M,3090 社群實測約 120 tokens/s,5070 Ti 約 110 到 115。5070 Ti 在 prefill(讀入長提示詞)階段快 30% 左右,因為算力高,長文件場景能感覺到,但決定體感的解碼速度不分上下。

二手 3090 的風險
四個風險按發生機率排:顯示記憶體顆粒故障、礦卡、供電介面燒蝕、風扇軸承,前兩個可以在交易時排除。
- 顯示記憶體故障:GDDR6X 背面 12 顆顆粒靠背板散熱,長期 100°C 以上後出現破圖、CUDA 報錯。要求賣家跑
memtest_vulkan或 OCCT 顯示記憶體測試 30 分鐘並錄屏,收貨後自己再跑。 - 礦卡:2021 到 2022 年大量 3090 用於挖礦。看 PCB 有沒有清洗痕跡、螺絲有沒有拆卸痕跡、風扇是否明顯磨損。礦卡不是不能買,要按更低的價格買,並且預設顯示記憶體已經過熱老化。
- 12-pin / 8-pin 介面燒蝕:檢查介面有沒有發黃發黑。
- 風扇:軸承響可以換,成本低。
交易渠道:閒魚走「驗貨寶」,eBay 選帶 30 天退貨的賣家,兩邊都不要用「不退不換」的低價單。
價格走勢:3090 還會跌嗎?
3090 的二手價格在 2025 到 2026 年基本橫盤,跌幅小於同期任何一張新卡。 最近 30 天:
| 型號 | 目前 | 30 天最低 | 30 天最高 | 30 天變化 | 30d 趨勢 |
|---|---|---|---|---|---|
| NT$37,579 | NT$35,940 | NT$37,814 | +4.6% | ||
| NT$65,537 | NT$37,058 | NT$65,537 | +76.9% | ||
| NT$35,658 | NT$35,611 | NT$35,860 | -0.6% |
閒魚最近 30 天的中位價,每 6 小時一個點;變化是目前中位價相對視窗內最早一點的漲跌。
3090 已經六年,價格由本地推論需求託著,24GB 消費卡的替代品只有更貴的 4090 和 5090 D V2。沒有理由等它大跌;5070 Ti 作為新卡,一年後二手價格會明顯低於現在,反而是等得起的那張。
結論:按用途給答案
只跑模型選 3090,兼顧遊戲或空間電源受限選 5070 Ti,兩者都不滿足就看 4080。
- 本地大模型為主:RTX 3090。多出的 8GB 是能力檔位,不是參數。
- 遊戲為主、偶爾跑模型:RTX 5070 Ti。4K 遊戲效能高一大截,DLSS 4,功耗低,新卡質保三年。
- 只有雙槽空間或 650W 電源:RTX 5070 Ti。
- 預算比 5070 Ti 更緊:二手 RTX 4080,16GB 裡最便宜的 CUDA 卡,見 16GB 能跑哪些模型。
- 兩張 3090:預算到一萬六以上、想跑 70B 的,見多卡入門。
常見問題
RTX 3090 和 RTX 5070 Ti 跑大模型哪個快?
幾乎一樣。解碼速度由頻寬決定,3090 是 936 GB/s,5070 Ti 是 896 GB/s,8B 模型 4-bit 預估 114 對 109 tokens/s。5070 Ti 的 Blackwell 架構和 FP4 算力對 llama.cpp 的單流推論幫助很小。
RTX 5070 Ti 的 16GB 少了哪些模型?
所有 24B 到 32B 稠密模型的 4-bit 版本:DeepSeek R1 Distill Qwen 32B、Qwen3.8 27B、Gemma 4 31B 都裝不下,Mistral Small 3.2 24B 只能 8K 上下文。這是能力檔位的差距,不是速度差距。
二手 3090 最大的風險是什麼?
顯示記憶體顆粒故障和礦卡。GDDR6X 背面顆粒長期高溫後會出現破圖和 CUDA 錯誤。買前要求賣家跑 30 分鐘顯示記憶體壓力測試,收貨後自己再跑一次,閒魚走驗貨寶、eBay 用 30 天退貨。
什麼人應該選 5070 Ti?
同時要打 4K 遊戲、機箱只能裝雙槽卡、電源在 650W 以下、或者完全不想承擔二手風險的人。只跑模型不打遊戲,選 3090。