GeForce RTX 4060 Ti 16GB 價格與中古行情:能部署哪些大型語言模型?
到價提醒
eBay價格到達你設定的價位時,寄信通知你。
GeForce RTX 4060 Ti 16GB 有 16GB GDDR6 顯存,頻寬 288 GB/s。目前eBay中位價 NT$22,268。4-bit 量化、8K 上下文下最大能裝約 23B 參數的稠密模型,預估 14 tokens/s。
eBay
GeForce RTX 4060 Ti 16GB 價格走勢
eBay
購買連結可能含聯盟標記,不影響你支付的價格。
GeForce RTX 4060 Ti 16GB 完整規格
- 顯存16 GB · GDDR6
- 頻寬288 GB/s
- FP16 / BF1688.3 TFLOPS
- FP8 / INT8176.5 / 176.5 TOPS
- 位寬
- 128-bit
- 架構
- Ada Lovelace (AD106)
- 核心
- 4,352
- 張量核心
- 136
- 生態
- CUDA
- 介面
- PCIe 4.0 x8
- NVLink
- 不支援
- 功耗
- 165 W
- 供電介面
- 1× 8-pin / 16-pin 12VHPWR
- 類型
- 消費卡
- 發布日期
- 2023年7月18日
- 官方定價
- NT$15,874
GeForce RTX 4060 Ti 16GB 能跑哪些模型?
單張 GeForce RTX 4060 Ti 16GB 能跑哪些 50B 參數以內的模型,只列 2026 年起發布的版本
| 模型 | 大小 | 能否執行 | 速度 t/s | 最大上下文 |
|---|---|---|---|---|
| 3.8 GB | 能跑 | 52.3 | 128K | |
| 4.1 GB | 能跑 | 48.1 | 256K | |
| 4.7 GB | 能跑 | 41.5 | 256K | |
| 10.5 GB | 能跑 | 81 | 256K | |
| 11.8 GB | 能跑 | 17.3 | 64K | |
| 9.8 GB | 能跑 | 20.7 | 93K | |
| 11.9 GB | 能跑 | 93.9 | 75K | |
| 11.8 GB | 能跑 | 16.7 | 41K | |
| 12.3 GB | 能跑 | 108.3 | 181K |
| 模型 | 大小 | 能否執行 | 速度 t/s | 最大上下文 |
|---|---|---|---|---|
| 5 GB | 能跑 | 40.4 | 128K | |
| 5.7 GB | 能跑 | 35.3 | 256K | |
| 7.1 GB | 能跑 | 28.2 | 256K | |
| 16.9 GB | 需卸載到記憶體 | 32.3 | 256K | |
| 16.8 GB | 跑不了 | — | — | |
| 16.5 GB | 跑不了 | — | — | |
| 18.3 GB | 需卸載到記憶體 | 33.5 | 198K | |
| 18.3 GB | 跑不了 | — | — | |
| 22.1 GB | 需卸載到記憶體 | 44 | 256K |
| 模型 | 大小 | 能否執行 | 速度 t/s | 最大上下文 |
|---|---|---|---|---|
| 8.2 GB | 能跑 | 25.1 | 128K | |
| 9.5 GB | 能跑 | 21.6 | 196K | |
| 12.7 GB | 能跑 | 16.2 | 183K | |
| 26.9 GB | 需卸載到記憶體 | 21.5 | 256K | |
| 28.6 GB | 跑不了 | — | — | |
| 29 GB | 跑不了 | — | — | |
| 31.8 GB | 需卸載到記憶體 | 20.8 | 198K | |
| 32.6 GB | 跑不了 | — | — | |
| 36.9 GB | 需卸載到記憶體 | 28.6 | 256K |
能跑權重、KV 快取和執行開銷都裝得進顯存,速度按顯存頻寬估算。
需卸載到記憶體僅 MoE 模型:專家權重放進記憶體,速度按記憶體頻寬 70 GB/s 估算。
跑不了這一檔量化下單卡放不下,借記憶體也不行。
雙卡、四卡、八卡 GeForce RTX 4060 Ti 16GB 能跑哪些大型語言模型?
2026 年起發布的 50B 以上模型,按 vLLM 張量並行、32K 上下文要幾張卡才裝得下
| 模型 | 大小 | 需要幾張 | 總價 | 總顯示記憶體 | 速度 t/s | 總功耗 |
|---|---|---|---|---|---|---|
| 78.9 GB | 8 張 | NT$178,145 | 128 GB | 53.9 | 1,320 W | |
| 96.8 GB | 8 張 | NT$178,145 | 128 GB | 39.4 | 1,320 W | |
| 108.7 GB | 8 張 | NT$178,145 | 128 GB | 29.6 | 1,320 W |
| 模型 | 大小 | 需要幾張 | 總價 | 總顯示記憶體 | 速度 t/s | 總功耗 |
|---|---|---|---|---|---|---|
| 111.3 GB | 8 張 | NT$178,145 | 128 GB | 42 | 1,320 W |
這一檔量化下,8 張 GeForce RTX 4060 Ti 16GB 也裝不下任何 50B 以上的模型。
張數取 1 / 2 / 4 / 8 張,每張按 90% 顯存計;速度按單卡頻寬估算,總價只算顯示卡。不支援 NVLink,卡間走 PCIe。能否實際執行還要看 vLLM 是否支援。
其他市場價格
購買連結可能含聯盟標記,不影響你支付的價格。
常見問題
GeForce RTX 4060 Ti 16GB 能跑多大的模型?
單張 GeForce RTX 4060 Ti 16GB 有 16GB GDDR6 顯示記憶體,在 4-bit 量化、8K 上下文下最大能裝約 23B 參數的稠密模型,8-bit 下約 13B。MoE 模型可以把專家卸載到記憶體,跑更大的模型,例如 Qwen3.6 35B A3B(36B)。
GeForce RTX 4060 Ti 16GB 能跑 70B 模型嗎?
單卡跑不了。在 4-bit 量化、8K 上下文下,70B 稠密模型約需 43GB,超過 GeForce RTX 4060 Ti 16GB 的 16GB。用 llama.cpp 按層拆到 3 張卡上(合計 48GB)就能跑。
GeForce RTX 4060 Ti 16GB 適合跑哪些大型語言模型?
2026 年發布的模型中,4-bit 下能完整放進顯示記憶體的最大稠密模型是 Gemma 4 12B,預估 28.2 tokens/s。完整列表見上方「能跑哪些模型」表格。
GeForce RTX 4060 Ti 16GB 跑大型語言模型每秒多少 token?
按顯示記憶體頻寬估算,4-bit、8K 上下文下:8B 稠密模型約 38.6 tokens/s、14B 稠密模型約 22.8 tokens/s。MoE 模型每個 token 只讀取啟用參數,會快很多。實測通常在估算值的 70%–100%。
雙卡 GeForce RTX 4060 Ti 16GB 能跑哪些大型語言模型?
按 vLLM 張量並行、4-bit、32K 上下文,兩張 GeForce RTX 4060 Ti 16GB 裝不下 2026 年發布的 50B 以上模型。4-bit、32K 上下文下最少要 8 張,能跑 Qwen3.8 Flash Next。
GeForce RTX 4060 Ti 16GB 多少錢?
截至 2026年9月29日,eBay 中位價 NT$22,268(5 筆掛單)、Amazon.jp 中位價 NT$42,223(3 筆掛單)、閒魚中位價 NT$17,085(3 筆掛單)。取自平台掛單價的中位數,每 6 小時更新。
GeForce RTX 4060 Ti 16GB 價格在漲還是在跌?
截至 2026年9月29日,eBay 中位價近 7 天上漲 24.6%,近 30 天上漲 24.6%。
GeForce RTX 4060 Ti 16GB 和 Tesla T10 跑大型語言模型怎麼選?
Tesla T10 有 16GB 顯示記憶體、403 GB/s 頻寬,GeForce RTX 4060 Ti 16GB 是 16GB、288 GB/s。按 eBay 中位價,Tesla T10 約 NT$15,747,比 GeForce RTX 4060 Ti 16GB(NT$22,268)便宜 29.3%。跑 14B 稠密模型(4-bit)預估 GeForce RTX 4060 Ti 16GB 約 22.8 tokens/s,Tesla T10 約 31.7 tokens/s。