收錄顯卡56價格追蹤27 天近 24h 價格資料34,229 筆24h 降價最多A100 80GB PCIe-20.0%24h 漲價最多RTX PRO 5000 48GB+17.5%更新於
NT$ TWD
繁體中文

A100 80GB PCIe 價格與中古行情:能部署哪些大型語言模型?

A100 80GB PCIe 有 80GB HBM2e 顯存,頻寬 1,935 GB/s。目前閒魚中位價 NT$567,590。4-bit 量化、8K 上下文下最大能裝約 136B 參數的稠密模型,預估 17 tokens/s。

A100 80GB PCIe 價格走勢

目前NT$567,590-20.05%
價格更新於
NT$792,673NT$685,115NT$577,558NT$470,000NT$362,442
最低價 NT$423,904最高價 NT$731,211
9月22日9月25日9月29日

購買連結可能含聯盟標記,不影響你支付的價格。

A100 80GB PCIe 完整規格

  • 顯存80 GB · HBM2e
  • 頻寬1,935 GB/s
  • FP16 / BF16312 TFLOPS
  • INT8624 TOPS
位寬
5,120-bit
架構
Ampere (GA100)
核心
6,912
張量核心
432
生態
CUDA
介面
PCIe 4.0 x16
NVLink
600 GB/s
功耗
300 W
供電介面
8-pin EPS
槽位
2
長度
267 mm
類型
資料中心
發布日期
2021年6月28日

A100 80GB PCIe 能跑哪些模型?

單張 A100 80GB PCIe 能跑哪些 50B 參數以內的模型,只列 2026 年起發布的版本

模型大小能否執行速度 t/s最大上下文
Gemma 4 E4B8B5 GB能跑228.9128K
Qwen3.5 9B9.7B5.7 GB能跑204.1256K
Gemma 4 12B12B7.1 GB能跑168256K
Gemma 4 26B A4B25.2B(啟用 3.8B)16.9 GB能跑168.9256K
Qwen3.6 27B27.8B16.8 GB能跑78.1256K
Qwen3.8 27B27.8B16.5 GB能跑79.5256K
GLM 4.7 Flash30B(啟用 3B)18.3 GB能跑183.9198K
Gemma 4 31B30.7B18.3 GB能跑70.5256K
Qwen3.6 35B A3B36B(啟用 3B)22.1 GB能跑186.8256K

能跑權重、KV 快取和執行開銷都裝得進顯存,速度按顯存頻寬估算。

需卸載到記憶體僅 MoE 模型:專家權重放進記憶體,速度按記憶體頻寬 70 GB/s 估算。

跑不了這一檔量化下單卡放不下,借記憶體也不行。

雙卡、四卡、八卡 A100 80GB PCIe 能跑哪些大型語言模型?

2026 年起發布的 50B 以上模型,按 vLLM 張量並行、32K 上下文要幾張卡才裝得下

模型大小需要幾張總價總顯示記憶體速度 t/s總功耗
Qwen3.8 Flash Next176B(啟用 6B)111.3 GB2 張NT$1,135,181160 GB144600 W
DeepSeek V4 Flash284B(啟用 13B)155.1 GB4 張NT$2,270,361320 GB110.41,200 W
Hy3295B(啟用 21B)182.2 GB4 張NT$2,270,361320 GB59.51,200 W
GLM 5.3 Flash320B(啟用 18B)199.7 GB4 張NT$2,270,361320 GB83.21,200 W
GLM 5.3744B(啟用 40B)467.3 GB8 張NT$4,540,723640 GB44.12,400 W
Hy4 preview770B(啟用 49B)467.3 GB8 張NT$4,540,723640 GB38.62,400 W
DeepSeek V4.1 Flash763B(啟用 8 / 16B)510.3 GB8 張Engram 放記憶體NT$4,540,723640 GB73.32,400 W
Kimi K2.7 Code1,000B(啟用 32B)583.7 GB8 張NT$4,540,723640 GB55.82,400 W

張數取 1 / 2 / 4 / 8 張,每張按 90% 顯存計;速度按單卡頻寬估算,總價只算顯示卡。標「Engram 放記憶體」的另需約 203 GB 系統記憶體。支援 NVLink(600 GB/s)。能否實際執行還要看 vLLM 是否支援。

A100 80GB PCIe 租用價格

A100 80GB PCIe 在優雲智算隨需租用每小時 NT$48.3,每天用 8 小時約 NT$11,758/月。買一張(閒魚中位價 NT$567,590)每天用 4、8、24 小時,分別約 8.2 年、4.1 年、1.4 年回本。

方案價格每天 4 小時每天 8 小時每天 24 小時去查看
優雲智算租用42 分鐘前更新NT$48.3/小時NT$5,879/月NT$11,758/月NT$35,275/月去租
閒魚46 分鐘前更新NT$567,590約 8.2 年回本電費 NT$105/月約 4.1 年回本電費 NT$210/月約 1.4 年回本電費 NT$629/月去買

回本依台灣住宅平均電價(每度 NT$2.87)和 300 W 額定功耗估算,不計殘值和整機其他部分。

其他市場價格

eBay · 美國
NT$561,061
8 筆掛單
去查看
Amazon.jp · 日本
暫無
暫無掛單
去查看

購買連結可能含聯盟標記,不影響你支付的價格。

常見問題

A100 80GB PCIe 能跑多大的模型?

單張 A100 80GB PCIe 有 80GB HBM2e 顯示記憶體,在 4-bit 量化、8K 上下文下最大能裝約 136B 參數的稠密模型,8-bit 下約 73B。

A100 80GB PCIe 能跑 70B 模型嗎?

能。在 4-bit 量化、8K 上下文下,70B 稠密模型約需 43GB,A100 80GB PCIe 的 80GB 裝得下。

A100 80GB PCIe 適合跑哪些大型語言模型?

2026 年發布的模型中,4-bit 下能完整放進顯示記憶體的最大稠密模型是 Gemma 4 31B,預估 70.5 tokens/s。MoE 模型中 Qwen3.6 35B A3B 最快,約 186.8 tokens/s。完整列表見上方「能跑哪些模型」表格。

A100 80GB PCIe 跑大型語言模型每秒多少 token?

按顯示記憶體頻寬估算,4-bit、8K 上下文下:8B 稠密模型約 220.5 tokens/s、14B 稠密模型約 138.7 tokens/s、32B 稠密模型約 66.6 tokens/s、70B 稠密模型約 32 tokens/s。MoE 模型每個 token 只讀取啟用參數,會快很多。實測通常在估算值的 70%–100%。

雙卡 A100 80GB PCIe 能跑哪些大型語言模型?

兩張 A100 80GB PCIe(共 160GB)按 vLLM 張量並行、4-bit、32K 上下文,能裝下 Qwen3.8 Flash Next。要在 4-bit、32K 上下文下跑 Kimi K2.7 Code,需要 8 張。

A100 80GB PCIe 多少錢?

截至 2026年9月29日,eBay 中位價 NT$561,061(8 筆掛單)、閒魚中位價 NT$567,590(4 筆掛單)。取自平台掛單價的中位數,每 6 小時更新。

A100 80GB PCIe 價格在漲還是在跌?

截至 2026年9月29日,閒魚中位價近 7 天下跌 20%,近 30 天下跌 20%。

A100 80GB PCIe 租一小時多少錢?

截至 2026年9月29日,優雲智算每小時 NT$48.3。皆為單卡隨需價格,不含儲存空間和流量。

每天用 8 小時,A100 80GB PCIe 買還是租划算?

以閒魚中位價 NT$567,590、電價每度 NT$2.87 計算,每天用 8 小時,買卡約 4.1 年回本(對比優雲智算每小時 NT$48.3)。打算用超過 4.1 年就買,用不到就租。

A100 80GB PCIe 和 H100 PCIe 跑大型語言模型怎麼選?

H100 PCIe 有 80GB 顯示記憶體、2,000 GB/s 頻寬,A100 80GB PCIe 是 80GB、1,935 GB/s。跑 70B 稠密模型(4-bit)預估 A100 80GB PCIe 約 32 tokens/s,H100 PCIe 約 33.1 tokens/s。