价格观察

栏目方法:价格是怎么采集和表达的

价格观察栏目只做一件事:把算力租赁的价格按统一口径整理出来,让不同平台、不同卡型之间可以横向比较。采集方法很朴素——以各平台官网公开的价目页为准,按卡型和计费方式归类,记录为区间而不是单一数字。之所以不写精确到分的价格,是因为算力价格变动频繁,促销、新用户折扣、长租折扣会持续改变实际成交价,写死一个数字反而会误导读者。

本站统一使用的口径有三条:第一,价格一律标注计费方式(按小时、按天或包月);第二,价格写区间并注明以各平台官网实时价格为准;第三,企业级报价与零售价分开列示,不混在同一张表里比较。理解了这三条口径,再看下面的表格,就不会把会员价与标准价混为一谈。

2026 年主流卡型价格参考

下表为 2026 年国内市场公开价格的整理,口径为零售按小时计费,除特别注明外均为标准价。

卡型 显存 时租区间 备注
P40 24G 低至 0.3-0.4 元/小时 入门价位,适合轻量推理
3080Ti / 2080Ti 12G / 11G 约 0.88-0.98 元/小时 入门档
RTX 3090 24G 约 1 元/小时起 上一代主力
RTX 4090D 24G 约 1.14 元/小时起 合规版本
RTX 4090 24G 约 1.2-2.5 元/小时 包月可到 0.8-1.5 元/小时
RTX 5090 32G 约 2.68-3.28 元/小时 新一代消费级
A100 40G / 80G 约 2.4-2.9 元/小时 训练与推理通用
H100 / H800 80G 国内约 9.6-12 元/小时 海外约 2.0-3.5 美元/小时
H20 96G 折合约 2.1 万元/月/卡 企业级整卡月租口径

从这张表能读出三层结构:入门卡(P40、3080Ti、2080Ti)时租在 1 元以下;中端主力(3090、4090、4090D、5090、A100)集中在 1-3.3 元/小时;高端卡(H100/H800)国内时租 9.6-12 元,与中端拉开三到十倍的差距。企业级另有整机月租形式,例如 H100 整机月租约 6.3 万元量级,这类报价通常包含整机交付与运维条款,不能直接与零售时租换算比较。

价格之外的成本

行业里反复被提醒的一句话是别只看卡价,要算总账。以下四项是租 GPU 时最容易被忽略的开支:

  • 存储:模型权重、数据集、训练检查点都要占盘。数据量大时,存储费用可能接近甚至超过卡时费用的可观比例,下单前务必确认存储单价与免费额度。
  • 带宽与流量:上传数据集、下载模型权重、对外提供推理服务都会产生流量。部分平台的公网带宽按流量计费,长期跑推理服务时要特别留意。
  • 快照与备份:训练类任务需要定期做检查点。快照是否收费、保留多久、恢复是否额外付费,都是签署前要问清的点。
  • 数据保留与迁移:长期不使用时的数据保留策略、迁出数据的成本与方式,关系到你未来更换平台时的退出成本。

把这几项与卡时费加在一起,才是真正可比的总价。这也是本站建议先小额试用的原因——试用的过程本身就是在测量这些隐性成本。

价格信号怎么读

价格不只是成本,也是供需信号。高端卡价格高企并伴随排队,说明供给紧张、需求集中;中端卡价格平稳且即开即用,说明供给相对充裕。当高端卡价格从峰值大幅回落时,通常对应着供给放量以及需求结构从训练转向推理的变化。

对租户来说,有几条实用的读法:第一,高端卡高峰排队时,能错峰的任务尽量安排在凌晨或周末;第二,中端卡的价格竞争通常对新用户最有利,是试用期入场的窗口;第三,当某个卡型的低价明显偏离区间下沿时,先确认是否存在隐性限制(例如限核数、限带宽、限时段),再决定是否迁移。更系统的成本核算方法,可以结合算力租用栏目中的选型指南一起看。