栏目方法:价格是怎么采集和表达的
价格观察栏目只做一件事:把算力租赁的价格按统一口径整理出来,让不同平台、不同卡型之间可以横向比较。采集方法很朴素——以各平台官网公开的价目页为准,按卡型和计费方式归类,记录为区间而不是单一数字。之所以不写精确到分的价格,是因为算力价格变动频繁,促销、新用户折扣、长租折扣会持续改变实际成交价,写死一个数字反而会误导读者。
本站统一使用的口径有三条:第一,价格一律标注计费方式(按小时、按天或包月);第二,价格写区间并注明以各平台官网实时价格为准;第三,企业级报价与零售价分开列示,不混在同一张表里比较。理解了这三条口径,再看下面的表格,就不会把会员价与标准价混为一谈。
2026 年主流卡型价格参考
下表为 2026 年国内市场公开价格的整理,口径为零售按小时计费,除特别注明外均为标准价。
| 卡型 | 显存 | 时租区间 | 备注 |
|---|---|---|---|
| P40 | 24G | 低至 0.3-0.4 元/小时 | 入门价位,适合轻量推理 |
| 3080Ti / 2080Ti | 12G / 11G | 约 0.88-0.98 元/小时 | 入门档 |
| RTX 3090 | 24G | 约 1 元/小时起 | 上一代主力 |
| RTX 4090D | 24G | 约 1.14 元/小时起 | 合规版本 |
| RTX 4090 | 24G | 约 1.2-2.5 元/小时 | 包月可到 0.8-1.5 元/小时 |
| RTX 5090 | 32G | 约 2.68-3.28 元/小时 | 新一代消费级 |
| A100 | 40G / 80G | 约 2.4-2.9 元/小时 | 训练与推理通用 |
| H100 / H800 | 80G | 国内约 9.6-12 元/小时 | 海外约 2.0-3.5 美元/小时 |
| H20 | 96G | 折合约 2.1 万元/月/卡 | 企业级整卡月租口径 |
从这张表能读出三层结构:入门卡(P40、3080Ti、2080Ti)时租在 1 元以下;中端主力(3090、4090、4090D、5090、A100)集中在 1-3.3 元/小时;高端卡(H100/H800)国内时租 9.6-12 元,与中端拉开三到十倍的差距。企业级另有整机月租形式,例如 H100 整机月租约 6.3 万元量级,这类报价通常包含整机交付与运维条款,不能直接与零售时租换算比较。
价格之外的成本
行业里反复被提醒的一句话是别只看卡价,要算总账。以下四项是租 GPU 时最容易被忽略的开支:
- 存储:模型权重、数据集、训练检查点都要占盘。数据量大时,存储费用可能接近甚至超过卡时费用的可观比例,下单前务必确认存储单价与免费额度。
- 带宽与流量:上传数据集、下载模型权重、对外提供推理服务都会产生流量。部分平台的公网带宽按流量计费,长期跑推理服务时要特别留意。
- 快照与备份:训练类任务需要定期做检查点。快照是否收费、保留多久、恢复是否额外付费,都是签署前要问清的点。
- 数据保留与迁移:长期不使用时的数据保留策略、迁出数据的成本与方式,关系到你未来更换平台时的退出成本。
把这几项与卡时费加在一起,才是真正可比的总价。这也是本站建议先小额试用的原因——试用的过程本身就是在测量这些隐性成本。
价格信号怎么读
价格不只是成本,也是供需信号。高端卡价格高企并伴随排队,说明供给紧张、需求集中;中端卡价格平稳且即开即用,说明供给相对充裕。当高端卡价格从峰值大幅回落时,通常对应着供给放量以及需求结构从训练转向推理的变化。
对租户来说,有几条实用的读法:第一,高端卡高峰排队时,能错峰的任务尽量安排在凌晨或周末;第二,中端卡的价格竞争通常对新用户最有利,是试用期入场的窗口;第三,当某个卡型的低价明显偏离区间下沿时,先确认是否存在隐性限制(例如限核数、限带宽、限时段),再决定是否迁移。更系统的成本核算方法,可以结合算力租用栏目中的选型指南一起看。