收錄顯卡56價格追蹤27 天近 24h 價格資料34,228 筆24h 降價最多GeForce RTX 4060 Ti 16GB-16.4%24h 漲價最多Radeon RX 7800 XT+19.1%更新於
NT$ TWD
繁體中文

GeForce RTX 4060 Ti 16GB 價格與中古行情:能部署哪些大型語言模型?

GeForce RTX 4060 Ti 16GB 有 16GB GDDR6 顯存,頻寬 288 GB/s。目前Amazon.jp中位價 NT$42,223。4-bit 量化、8K 上下文下最大能裝約 23B 參數的稠密模型,預估 14 tokens/s。

GeForce RTX 4060 Ti 16GB 價格走勢

目前NT$42,223-16.45%
價格更新於
NT$76,859NT$65,788NT$54,717NT$43,646NT$32,575
最低價 NT$38,901最高價 NT$70,533
9月28日 下午12:009月29日 上午12:009月29日 下午12:00

購買連結可能含聯盟標記,不影響你支付的價格。

GeForce RTX 4060 Ti 16GB 完整規格

  • 顯存16 GB · GDDR6
  • 頻寬288 GB/s
  • FP16 / BF1688.3 TFLOPS
  • FP8 / INT8176.5 / 176.5 TOPS
位寬
128-bit
架構
Ada Lovelace (AD106)
核心
4,352
張量核心
136
生態
CUDA
介面
PCIe 4.0 x8
NVLink
不支援
功耗
165 W
供電介面
1× 8-pin / 16-pin 12VHPWR
類型
消費卡
發布日期
2023年7月18日
官方定價
NT$15,874

GeForce RTX 4060 Ti 16GB 能跑哪些模型?

單張 GeForce RTX 4060 Ti 16GB 能跑哪些 50B 參數以內的模型,只列 2026 年起發布的版本

模型大小能否執行速度 t/s最大上下文
Gemma 4 E4B8B5 GB能跑40.4128K
Qwen3.5 9B9.7B5.7 GB能跑35.3256K
Gemma 4 12B12B7.1 GB能跑28.2256K
Gemma 4 26B A4B25.2B(啟用 3.8B)16.9 GB需卸載到記憶體32.3256K
Qwen3.6 27B27.8B16.8 GB跑不了——
Qwen3.8 27B27.8B16.5 GB跑不了——
GLM 4.7 Flash30B(啟用 3B)18.3 GB需卸載到記憶體33.5198K
Gemma 4 31B30.7B18.3 GB跑不了——
Qwen3.6 35B A3B36B(啟用 3B)22.1 GB需卸載到記憶體44256K

能跑權重、KV 快取和執行開銷都裝得進顯存,速度按顯存頻寬估算。

需卸載到記憶體僅 MoE 模型:專家權重放進記憶體,速度按記憶體頻寬 70 GB/s 估算。

跑不了這一檔量化下單卡放不下,借記憶體也不行。

雙卡、四卡、八卡 GeForce RTX 4060 Ti 16GB 能跑哪些大型語言模型?

2026 年起發布的 50B 以上模型,按 vLLM 張量並行、32K 上下文要幾張卡才裝得下

模型大小需要幾張總價總顯示記憶體速度 t/s總功耗
Qwen3.8 Flash Next176B(啟用 6B)111.3 GB8 張NT$337,781128 GB421,320 W

張數取 1 / 2 / 4 / 8 張,每張按 90% 顯存計;速度按單卡頻寬估算,總價只算顯示卡。不支援 NVLink,卡間走 PCIe。能否實際執行還要看 vLLM 是否支援。

其他市場價格

eBay · 美國
NT$22,268
5 筆掛單
去查看
閒魚 · 中國大陸
NT$17,085
3 筆掛單
去查看

購買連結可能含聯盟標記,不影響你支付的價格。

常見問題

GeForce RTX 4060 Ti 16GB 能跑多大的模型?

單張 GeForce RTX 4060 Ti 16GB 有 16GB GDDR6 顯示記憶體,在 4-bit 量化、8K 上下文下最大能裝約 23B 參數的稠密模型,8-bit 下約 13B。MoE 模型可以把專家卸載到記憶體,跑更大的模型,例如 Qwen3.6 35B A3B(36B)。

GeForce RTX 4060 Ti 16GB 能跑 70B 模型嗎?

單卡跑不了。在 4-bit 量化、8K 上下文下,70B 稠密模型約需 43GB,超過 GeForce RTX 4060 Ti 16GB 的 16GB。用 llama.cpp 按層拆到 3 張卡上(合計 48GB)就能跑。

GeForce RTX 4060 Ti 16GB 適合跑哪些大型語言模型?

2026 年發布的模型中,4-bit 下能完整放進顯示記憶體的最大稠密模型是 Gemma 4 12B,預估 28.2 tokens/s。完整列表見上方「能跑哪些模型」表格。

GeForce RTX 4060 Ti 16GB 跑大型語言模型每秒多少 token?

按顯示記憶體頻寬估算,4-bit、8K 上下文下:8B 稠密模型約 38.6 tokens/s、14B 稠密模型約 22.8 tokens/s。MoE 模型每個 token 只讀取啟用參數,會快很多。實測通常在估算值的 70%–100%。

雙卡 GeForce RTX 4060 Ti 16GB 能跑哪些大型語言模型?

按 vLLM 張量並行、4-bit、32K 上下文,兩張 GeForce RTX 4060 Ti 16GB 裝不下 2026 年發布的 50B 以上模型。4-bit、32K 上下文下最少要 8 張,能跑 Qwen3.8 Flash Next。

GeForce RTX 4060 Ti 16GB 多少錢?

截至 2026年9月29日,eBay 中位價 NT$22,268(5 筆掛單)、Amazon.jp 中位價 NT$42,223(3 筆掛單)、閒魚中位價 NT$17,085(3 筆掛單)。取自平台掛單價的中位數,每 6 小時更新。

GeForce RTX 4060 Ti 16GB 價格在漲還是在跌?

截至 2026年9月29日,Amazon.jp 中位價近 7 天下跌 16.4%,近 30 天下跌 16.4%。

GeForce RTX 4060 Ti 16GB 和 GeForce RTX 5060 Ti 16GB 跑大型語言模型怎麼選?

GeForce RTX 5060 Ti 16GB 有 16GB 顯示記憶體、448 GB/s 頻寬,GeForce RTX 4060 Ti 16GB 是 16GB、288 GB/s。按 Amazon.jp 中位價,GeForce RTX 5060 Ti 16GB 約 NT$30,402,比 GeForce RTX 4060 Ti 16GB(NT$42,223)便宜 28%。跑 14B 稠密模型(4-bit)預估 GeForce RTX 4060 Ti 16GB 約 22.8 tokens/s,GeForce RTX 5060 Ti 16GB 約 35.1 tokens/s。