收录显卡45价格追踪8 天自 2026年9月3日近 24h 价格数据7,968 条24h 降价最多GeForce RTX 5070 Ti-6.3%24h 涨价最多RTX PRO 4000 Blackwell+7.7%更新于

数据方法

本页说明 VRAMGlass 各项数据的来源与计算方式:价格的统计口径、能跑与速度的估算公式、汇率来源,以及纠错与反馈渠道。

价格口径

价格为当前在售报价的中位数,而非成交价。闲鱼与 eBay 统计二手挂单;Amazon 统计日本站面向日本境内配送的新品主报价,采用页面显示的日元商品价,运费另计。各来源独立统计,核对型号与显存、剔除无关商品,记录中位数、四分位数与样本数。价格、卖家或库存不明确的报价不计入。Amazon 样本按商品 ASIN 去重;二手市场样本按卖家去重。

每台设备都有独立的匹配规则,用于排除矿卡、配件、代购等无关挂单,并对异常价格做离群剔除。有效样本少于 3 条时,该轮价格不予发布,页面显示为空。

价格发布前还会做一致性校验:样本较少且与上次发布价偏离较大的结果不计入价格历史,整轮数据异常时沿用上一次的有效价格。价格每 6 小时更新一次,历史走势保留 30 天。

能跑与速度

weights_gb = params_b × bytes_per_param × 1.05

权重显存 = 参数量 × 每参数字节 × 1.05。每参数字节按量化档位取:IQ1_M 0.24、Q2_K_XL 0.38、Q3_K_XL 0.49、Q4_K_M 0.57、Q5_K_M 0.69、Q8_0 1.06、FP16 2;系数 1.05 用于覆盖 GGUF 元数据与未量化的嵌入层等固定开销。

kv_gb = 2 × layers × kv_heads × head_dim × context × 2

KV cache = 2 × 层数 × KV 头数 × 头维度 × 上下文 × 2 字节(K 与 V 两份,FP16)。对 MLA 与线性注意力混合结构,通用公式会明显高估,模型库中有实测的每 token 字节数时优先采用实测值;滑动窗口注意力未单独建模,长上下文下给出的是上界。

fits = weights_gb + kv_gb + 1 ≤ vram_gb

ms_per_token = (active_params_b × bytes_per_param + kv_cache_gb ÷ 2) ÷ (bandwidth_gbs × eff) × 1000 + overhead_ms
tokens_per_sec = 1000 ÷ ms_per_token

装得下 = 权重 + KV cache + 1GB 运行开销 ≤ 可用显存,单卡、不做 CPU offload;统一内存机器按内存总量算,不扣 macOS 的 GPU 占用上限。预估速度按 llama.cpp 单流口径:每 token 耗时 = 读取字节 ÷(带宽 × 生态效率)+ 固定开销,读取字节 = 激活参数 × 量化字节 + 上下文一半的 KV cache。生态效率 CUDA 0.7、ROCm 0.5、Metal 0.55、oneAPI 0.45;固定开销稠密模型 0.8 ms、MoE 4 ms。按公开的 llama.cpp 实测校准,误差通常在 ±20% 内,上下文越长实际越慢。

三个单价

price_per_gb = used_price ÷ vram_gb

显存单价 = 中位价 ÷ 显存容量,单位是「币种 / GB」,是全站主表的默认排序列。

price_per_bandwidth = used_price ÷ (bandwidth_gbs ÷ 100)

带宽单价 = 中位价 ÷(带宽 ÷ 100),单位是「币种 / 100GB/s」。除以 100 只是为了让数字和显存单价落在同一量级,方便横着比。

price_per_tops = used_price ÷ int8_tops_dense

算力单价 = 中位价 ÷ INT8 稠密算力,单位是「币种 / TOPS」;没有公开 INT8 标称值的设备这一列留空。三个单价都按当前价格基准算,先折美元再除,与先除再折算等价。

汇率

价格按原币种记录,展示时按当日汇率换算,基准币种为美元。汇率每日更新;当日汇率暂不可用时沿用最近一次有效汇率,并在页脚标注。本页当前使用的汇率日期为 2026年9月10日,来源:open.er-api.com。

数据来源

显卡规格来自厂商官方规格页,并与 TechPowerUp GPU Database、Wikipedia 显卡列表交叉核对,各项规格均可追溯到来源。目前收录 45 台设备。

模型参数来自 Hugging Face 官方仓库的公开配置,量化权重体积以 GGUF 实际文件大小为准,Ollama 标签取自官方模型库。目前已收录 9 个家族、43 个版本,新模型经核验后定期更新。

更新频率与变更

价格每 6 小时更新,汇率每日更新,新模型经审核后定期发布。页面显示的更新时间为最近一次成功更新的时间。规格与公式如有调整,会在本页记录。

当前系数:每参数字节 IQ1_M 0.24 / Q2_K_XL 0.38 / Q3_K_XL 0.49 / Q4_K_M 0.57 / Q5_K_M 0.69 / Q8_0 1.06 / FP16 2,权重开销 1.05,KV 每元素 2 字节,运行开销 1GB,速度效率 CUDA 0.7 / ROCm 0.5 / Metal 0.55 / oneAPI 0.45。

纠错与反馈

如发现价格、规格或公式有误,欢迎来信告知,并附上对应页面与来源链接。经核实后我们会尽快修正,并在本页记录变更。

写邮件