二手 RTX 3090 還是新 RTX 5070 Ti?跑本地大模型的 24GB 與 16GB 之爭(2026)

譯自简体中文版 · 閱讀原文

這是 2026 年最常見的選卡問題,答案取決於你買卡幹什麼:只跑本地大模型,選二手 RTX 3090;要兼顧遊戲、怕二手、或者機箱電源有限,選 RTX 5070 Ti 兩張卡的頻寬幾乎相同(936 對 896 GB/s),所以速度相差不到 5%;差別全在顯示記憶體:24GB 能跑 32B 稠密模型的 4-bit 版本,16GB 不能。截至 2026 年 9 月 5 日的價格與走勢見下表。

示意圖:工作臺上並排放著一張三槽二手顯示卡和一張開箱的新雙槽顯示卡
示意圖 · 工作臺上並排放著一張三槽二手顯示卡和一張開箱的新雙槽顯示卡

本文提及的固定價格均以中國二手市場人民幣(CNY)為基準;動態表格則依頁面所選幣別顯示。

兩張卡的關鍵規格對比

3090 贏在 24GB 顯示記憶體和略高的頻寬,5070 Ti 贏在功耗、體積、新架構和質保。 即時資料:

項目GeForce RTX 3090GeForce RTX 5070 TiGeForce RTX 4080
顯存24 GB GDDR6X16 GB GDDR716 GB GDDR6X
頻寬936 GB/s896 GB/s717 GB/s
BF16142.3 TFLOPS175.8 TFLOPS195 TFLOPS
INT8285 TOPS352 TOPS390 TOPS
功耗350 W300 W320 W
介面PCIe 4.0 x16PCIe 5.0 x16PCIe 4.0 x16
發布日期2020年9月24日2025年2月20日2022年11月16日
官方定價NT$47,426NT$23,697NT$37,934
閒魚二手NT$37,579NT$65,537NT$35,658
顯存單價NT$1,566NT$4,096NT$2,229
能跑的最大稠密檔位(4-bit、8K)32B14B14B
DeepSeek R1 Distill Qwen 14B 速度68 t/s65 t/s52 t/s

幾個規格對推論的實際影響:

  • 頻寬幾乎打平,這是速度相同的原因。GDDR7 的高頻率被 5070 Ti 的 256-bit 位寬抵消,3090 是 384-bit。
  • FP8 / FP4 算力:5070 Ti 有,3090 沒有。這對 vLLM 的批次推論和 FP8 權重有用,對 llama.cpp 跑 GGUF 單流幾乎沒影響。
  • 功耗:350W 對 300W,實際推論時兩卡都在標稱的 60% 左右,一年電費差幾十元。
  • 尺寸:3090 公版三槽、313 mm,非公更大;5070 Ti 多數雙槽,ITX 機箱只能選後者。

24GB 比 16GB 多跑哪些模型?

多出的 8GB 意味著整整一檔:24B 到 32B 的稠密模型 4-bit 版本,以及 70B 模型的 2-bit 版本。 只有 3090 能單卡跑的模型庫版本(4-bit、8K 上下文):

只有 GeForce RTX 3090 能跑需要顯示記憶體 GBGeForce RTX 3090 上的速度 t/s
Gemma 4 26B A4B18112
Qwen3.6 27B1938
Qwen3.8 27B1938
GLM 4.7 Flash19144
DeepSeek R1 Distill Qwen 32B2232
Qwen3 32B2232
Qwen3.6 35B A3B22141

口徑:4-bit、8K 上下文,單卡。模型庫裡兩張卡都能跑的有 11 個,都跑不了的有 2 個;上表這些模型 GeForce RTX 5070 Ti 一個都裝不下。

這張表就是買 3090 的全部理由。DeepSeek R1 Distill Qwen 32BQwen3.8 27BQwen3 32B 都是 2026 年家用最常跑的模型,在 5070 Ti 上只能降到 3-bit 以下或者走 CPU offload,速度掉一半以上。

3090 和 5070 Ti 速度差多少?

兩卡都能跑的模型上,速度差在 5% 以內;3090 獨有的 32B 模型約 32 tokens/s。 預估解碼速度:

型號Qwen3 8BGemma 4 12BDeepSeek R1 Distill Qwen 14BDeepSeek R1 Distill Qwen 32B
GeForce RTX 3090114746832
GeForce RTX 5070 Ti1097165裝不下
GeForce RTX 4080895852裝不下
GeForce RTX 50801177669裝不下

4-bit、8K 上下文、單路解碼的預估速度。帶 * 的是 MoE 模型把專家權重放在系統記憶體裡跑(按 70 GB/s 記憶體頻寬算)。

公開實測與這個估算一致:llama.cpp 跑 Llama 3.1 8B Q4_K_M,3090 社群實測約 120 tokens/s,5070 Ti 約 110 到 115。5070 Ti 在 prefill(讀入長提示詞)階段快 30% 左右,因為算力高,長文件場景能感覺到,但決定體感的解碼速度不分上下。

示意圖:雙手把一張二手顯示卡舉到檯燈下檢查背板和供電介面
示意圖:雙手把一張二手顯示卡舉到檯燈下檢查背板和供電介面

二手 3090 的風險

四個風險按發生機率排:顯示記憶體顆粒故障、礦卡、供電介面燒蝕、風扇軸承,前兩個可以在交易時排除。

  1. 顯示記憶體故障:GDDR6X 背面 12 顆顆粒靠背板散熱,長期 100°C 以上後出現破圖、CUDA 報錯。要求賣家跑 memtest_vulkan 或 OCCT 顯示記憶體測試 30 分鐘並錄屏,收貨後自己再跑。
  2. 礦卡:2021 到 2022 年大量 3090 用於挖礦。看 PCB 有沒有清洗痕跡、螺絲有沒有拆卸痕跡、風扇是否明顯磨損。礦卡不是不能買,要按更低的價格買,並且預設顯示記憶體已經過熱老化。
  3. 12-pin / 8-pin 介面燒蝕:檢查介面有沒有發黃發黑。
  4. 風扇:軸承響可以換,成本低。

交易渠道:閒魚走「驗貨寶」,eBay 選帶 30 天退貨的賣家,兩邊都不要用「不退不換」的低價單。

價格走勢:3090 還會跌嗎?

3090 的二手價格在 2025 到 2026 年基本橫盤,跌幅小於同期任何一張新卡。 最近 30 天:

型號目前30 天最低30 天最高30 天變化30d 趨勢
GeForce RTX 3090NT$37,579NT$35,940NT$37,814+4.6%
GeForce RTX 5070 TiNT$65,537NT$37,058NT$65,537+76.9%
GeForce RTX 4080NT$35,658NT$35,611NT$35,860-0.6%

閒魚最近 30 天的中位價,每 6 小時一個點;變化是目前中位價相對視窗內最早一點的漲跌。

3090 已經六年,價格由本地推論需求託著,24GB 消費卡的替代品只有更貴的 4090 和 5090 D V2。沒有理由等它大跌;5070 Ti 作為新卡,一年後二手價格會明顯低於現在,反而是等得起的那張。

結論:按用途給答案

只跑模型選 3090,兼顧遊戲或空間電源受限選 5070 Ti,兩者都不滿足就看 4080。

  • 本地大模型為主:RTX 3090。多出的 8GB 是能力檔位,不是參數。
  • 遊戲為主、偶爾跑模型:RTX 5070 Ti。4K 遊戲效能高一大截,DLSS 4,功耗低,新卡質保三年。
  • 只有雙槽空間或 650W 電源:RTX 5070 Ti。
  • 預算比 5070 Ti 更緊:二手 RTX 4080,16GB 裡最便宜的 CUDA 卡,見 16GB 能跑哪些模型
  • 兩張 3090:預算到一萬六以上、想跑 70B 的,見多卡入門

常見問題

RTX 3090 和 RTX 5070 Ti 跑大模型哪個快?

幾乎一樣。解碼速度由頻寬決定,3090 是 936 GB/s,5070 Ti 是 896 GB/s,8B 模型 4-bit 預估 114 對 109 tokens/s。5070 Ti 的 Blackwell 架構和 FP4 算力對 llama.cpp 的單流推論幫助很小。

RTX 5070 Ti 的 16GB 少了哪些模型?

所有 24B 到 32B 稠密模型的 4-bit 版本:DeepSeek R1 Distill Qwen 32B、Qwen3.8 27B、Gemma 4 31B 都裝不下,Mistral Small 3.2 24B 只能 8K 上下文。這是能力檔位的差距,不是速度差距。

二手 3090 最大的風險是什麼?

顯示記憶體顆粒故障和礦卡。GDDR6X 背面顆粒長期高溫後會出現破圖和 CUDA 錯誤。買前要求賣家跑 30 分鐘顯示記憶體壓力測試,收貨後自己再跑一次,閒魚走驗貨寶、eBay 用 30 天退貨。

什麼人應該選 5070 Ti?

同時要打 4K 遊戲、機箱只能裝雙槽卡、電源在 650W 以下、或者完全不想承擔二手風險的人。只跑模型不打遊戲,選 3090。

文中提到的顯示卡

型號閒魚

文中提到的模型