H100 租用价格全景:国内时租 9.58 元起是怎么来的

结论先行:9.58 元这个数字是怎么构成的

2026 年问”H100 租一小时多少钱”,答案要分两个市场:国内零售与整机渠道的时租大致在 9.6-12 元区间,部分平台会员价可以低至 9.58 元起;海外主流渠道折算后约 2.0-3.5 美元/小时,较 2024 年市场峰值下跌约 64%。9.58 元并不是某个平台的”促销价”,而是一条价格带的下沿:它由卡源的采购与折旧成本、机房的电力与散热成本、平台的运维与调度成本、以及渠道的会员折扣共同决定。理解了这条价格带的构成,你就能判断自己看到的任何报价是偏高、偏低还是正常。

这篇文章分四步讲清楚 H100 的价格:先看国内与海外的价格全景,再解释这一轮下跌的供需原因,然后讨论按需与包月的分界点,最后给出一张”什么时候值得上 H100″的决策表。所有数字都是 2026 年公开市场报价的区间整理,用于建立量级判断,实际以各平台官网实时价格为准。

价格全景:国内、海外与整机口径

先明确口径。H100 与 H800 都是 80G 显存的高端卡,在国内属于供给受限的高端产品,因此国内价格显著高于海外;而 H800 是面向合规要求的产品版本,NVLink 带宽从 900GB/s 降到 600GB/s,其他规格接近,价格通常与 H100 同一带。整机月租则是企业级采购口径,H100 整机月租在 6.3 万元量级,不适合与按小时零售价直接换算。

口径 价格区间 说明
国内时租(H100/H800) 约 9.6-12 元/小时 会员价可低至 9.58 元起,高峰期需排队或加价
海外时租 约 $2.0-3.5/小时 较 2024 年峰值跌约 64%
整机月租(企业级) H100 约 6.3 万元/月 量级 含整机与配套,非按卡时折算
同级国产/替代口径 H20 约 2.1 万元/月/卡 量级 保显存带宽、砍算力的产品定位

把表读成一个结论:如果你在国内、按小时租、且不追求整机独占,那么 9.6-12 元/小时是当前对你的有效区间;如果你的业务可以放在海外节点或用海外账期,海外的 $2.0-3.5 会便宜一半以上,但要额外考虑网络延迟、数据出境与合规成本,这部分成本经常比价差更大。

用这张表做预算时,建议用三步法。第一步,把你的任务折算成 GPU 小时——这需要先估出训练步数与单步耗时,得到一个量级;第二步,用你实际能拿到的单价乘以小时数,得到金额区间;第三步,为排队等待、试错重跑和数据处理各留出一部分余量。三步做完,你会得到一个”区间”而不是”一个数字”,这才是可以拿去做决策的预算。只用一个单价乘一个理想时长得出的结论,几乎总是偏乐观。

跌 64% 的供需解释

价格从 2024 年的峰值 8 美元量级跌到 2-3.5 美元,不是单一因素造成的,而是供给与需求两端同时变化的结果。

供给侧的关键词是”放量”。新一代加速卡进入规模交付,云厂商与专业算力平台的高端卡池容量持续扩大;同时,早期已经回本的部分卡源进入更低价的市场分层。供给一旦从稀缺转向”结构性充裕”,最敏感的高端时租价格首先松动。

需求侧的关键词是”结构迁移”。2024 年前后,市场对高端卡的需求主要由大模型训练驱动,训练对卡的互联带宽、显存容量要求苛刻,价格弹性极低;到了 2026 年,增量需求明显向推理倾斜。推理对单卡的算力与互联要求更宽容,可以用更多中端卡、甚至消费级卡承担,高端卡的边际需求因此下降。训练转推理,是这一轮价格回落最重要的背景。

第三个小因素是租赁模式本身的成熟。当按需租赁成为标准配置、包月与预留产品线齐全之后,价格发现机制更充分,信息差被压缩,早期那种”加价抢卡”的空间自然收窄。这三个因素叠加,才构成了”腰斩”的结果。

按需还是包月:150 小时是一条经验分界线

H100 的价格对比不能只看时租单价,要把使用时长代入计算。行业里比较通用的经验是:月均使用超过 150 小时,包月通常比按需省 20-30%;低于这个量级,按需更划算,因为包月合同一般不退款,闲置时长就是浪费。

把这条经验落到 H100 上:假设你按需使用,国内 9.6-12 元/小时,月均 150 小时意味着约 1440-1800 元的月度支出量级;如果包月产品给出 20-30% 的折扣,节省的绝对金额对个人开发者并不算大,但对一个持续训练的团队就是可观的固定成本优化。反过来,如果你的负载是”每月集中跑几轮实验”,每次几十小时,那么按需 + 关机不计费的组合更合适。

需要额外考虑的是排队成本。高端卡在高峰期需要排队,包月或预留可以在一定程度上锁定可用性,这部分”确定性”本身就是价值,很难用小时价折算。

海外与国内:三条容易被忽略的额外成本

看到海外 $2.0-3.5/小时的报价,很多人的第一反应是”比国内便宜一半以上”。但在改预算表之前,至少要把三条额外成本算进去。

第一是数据出境与合规成本。训练数据与模型权重的跨境传输需要评估合规要求,部分行业(金融、医疗、政企)存在硬性限制;即便不涉及敏感数据,跨境传输本身也会带来审计与合同层面的额外工作量。

第二是网络延迟与带宽成本。如果数据留在国内、算力放在海外,每次迭代都要付出时延与流量费用,对数据读取频繁的训练任务影响尤其明显;如果数据也一起放到海外,则要考虑长期存储与访问的合规问题。第三是账期与结算成本,海外渠道通常需要外币结算与更长的账期,对现金流管理提出要求,汇率波动也会影响实际支出。

把这三条加进去,”便宜一半”往往会被压缩到两成左右——仍然可观,但判断依据变了。这也解释了为什么数据落在国内的团队,即便看到海外低价,最终仍选择国内 9.6-12 元/小时的区间:省下的价差,不足以覆盖新增的合规与传输风险。

H100 还是 H800:合规与互联的取舍

国内做多卡训练时,经常需要在 H100 与 H800 之间选择。多数场景下两者可以互换,因为它们同为 80G 显存、算力接近,平台报价也常常在同一价格带。真正的差别在两处:一是 NVLink 带宽,H100 为 900GB/s,H800 为 600GB/s;二是合规背景,H800 是为满足特定合规要求而设计的产品版本。这一带宽差异对”卡间通信密集”的负载影响明显:当模型并行策略需要频繁在卡之间同步参数与梯度时,互联带宽会直接影响扩展效率;而当负载是单卡推理、或并行度较低时,差异对最终结果的影响有限。

选型建议非常直接:如果你的并行策略是张量并行(TP)且规模较大,优先 H100;如果是数据并行(DP)为主、或单卡推理,H800 在价格相近时完全可以用;如果有明确的合规约束,则按合规要求选择即可。同一类逻辑也适用于 A800:它的互联带宽从 600GB/s 降到 400GB/s,属于同一系列的合规版本。

什么时候值得上 H100:一张决策表

你的场景 是否值得上 H100/H800 理由
70B 级模型的持续预训练或多机微调 值得,且应优先保障互联 显存与卡间带宽是硬约束,中端卡难以替代
大规模高并发在线推理(长上下文) 值得评估,先算并发账 单卡吞吐高,但需与多张中端卡方案对比总成本
7B-13B 微调、实验性训练 多数情况不必 A100 或 4090 集群通常够用,单价低数倍
AIGC 出图、LoRA 微调、教学 不必 4090/5090 级别即可满足,包月更省
短期突发的高端算力需求 值得,用按需而非包月 避免为闲置付费,接受排队换取灵活性
有严格合规要求的训练任务 按合规版本选择(H800 等) 带宽略有牺牲,换取合规可用

这张表的用法是先找自己所在的场景行,再看”理由”列是否成立。如果理由是”显存与互联是硬约束”,那 H100 就是刚需;如果理由是”吞吐更高”,那就需要真的把并发账算清,再和替代方案比较,因为高端卡的单价是 A100 的两倍以上、是中端卡的四到八倍,量级差异必须用吞吐或时间价值来弥补。

还有一类场景容易被误判:把”模型规模不大但上下文很长”的任务当成不需要高端卡。长上下文推理的显存占用会随上下文长度上升,缓存部分可能占据相当大比例的显存,这时即使模型参数量不大,也可能因为显存不足而无法提供目标并发。遇到这类情况,先在 A100 上做一次显存与并发的实测,再判断是否需要升级;很多时候升级的目标不是算力,而是显存容量与带宽。

避坑与注意事项

  • 不要用海外报价直接对标国内预算。海外 $2.0-3.5 看起来便宜,但数据出境、网络延迟、账期与合规成本要一起算。
  • 不要忽略排队成本。高端卡高峰期排队明显,报价再低,排不上队也没有意义;凌晨与周末相对宽松。
  • 不要只看时租不看整机口径。6.3 万元/月 的整机报价与 9.6-12 元/小时 不是同一个东西,混算会得出错误结论。
  • 不要用消费级跑分推断 H100 性能。高端卡的价值在多卡互联与显存带宽,单卡跑分无法体现。
  • 不要跳过试用直接签长约。先用按需实例完成一次真实负载验证,再决定包月或预留。

常见问题

H100 价格还会继续跌吗?

方向性判断可以看三个信号:高端卡的新增供给节奏、推理需求在总算力需求中的占比、以及新一代产品的发布与交付进度。推理占比继续上升、供给继续放量,价格下行的压力就持续存在;但高端卡的绝对价格也有成本底线,不太可能出现无限制下跌。做预算时建议用区间而非单点,并保留调整空间。

国内 9.58 元起的会员价,和普通用户价差多少?

会员价的本质是渠道折扣,通常对应更长的预付周期或更高的承诺用量。对低频用户来说,为了折扣而预付并不划算;对稳定使用的团队来说,折扣加上可用性锁定,整体价值更明显。判断标准还是那个 150 小时的量级分界。

为什么 H800 价格和 H100 差不多?

因为两者在显存容量、算力量级上接近,主要差异在 NVLink 带宽(900GB/s 对 600GB/s)与合规定位,而不是”性能档次”。市场把它当作同一档次的不同版本定价,价差因此有限。

用 H20 替代 H100 划算吗?

取决于你的负载是”显存敏感”还是”算力敏感”。H20 的设计思路是保留显存带宽、削减算力,量级报价约 2.1 万元/月/卡,适合显存与带宽受限、而算力需求相对温和的场景;如果是计算密集型训练,替代效果会打折扣。先明确瓶颈在哪一侧,再决定。

预算有限时,有哪些降本替代路径?

三条:把可中断的训练搬到中端卡并做断点续训;用 LoRA 等参数高效方法降低对显存与算力的要求;把”必须高端卡”的部分压缩到最短时长,其余环节放在 A100 或 4090 集群上。这三条组合起来,通常能在不明显延长工期的前提下显著降低高端卡的账时。

总结

H100 的价格全景可以用三句话概括:国内时租 9.6-12 元、海外 $2.0-3.5、较峰值跌约 64%;下跌由供给放量与训练转推理共同驱动;是否值得上 H100,取决于你的瓶颈是不是”显存与卡间互联”。9.58 元起这个数字,只是一个坐标——它的意义是让你在拿到任何报价时,能够立刻判断它在价格带里的位置。做决策前,请以各平台官网的实时价格与服务条款为准,并用一次真实负载的试用验证你的判断。

Comments

Leave a Reply

Your email address will not be published. Required fields are marked *