Author: siop-ops

  • H100 租用价格全景:国内时租 9.58 元起是怎么来的

    结论先行:9.58 元这个数字是怎么构成的

    2026 年问”H100 租一小时多少钱”,答案要分两个市场:国内零售与整机渠道的时租大致在 9.6-12 元区间,部分平台会员价可以低至 9.58 元起;海外主流渠道折算后约 2.0-3.5 美元/小时,较 2024 年市场峰值下跌约 64%。9.58 元并不是某个平台的”促销价”,而是一条价格带的下沿:它由卡源的采购与折旧成本、机房的电力与散热成本、平台的运维与调度成本、以及渠道的会员折扣共同决定。理解了这条价格带的构成,你就能判断自己看到的任何报价是偏高、偏低还是正常。

    这篇文章分四步讲清楚 H100 的价格:先看国内与海外的价格全景,再解释这一轮下跌的供需原因,然后讨论按需与包月的分界点,最后给出一张”什么时候值得上 H100″的决策表。所有数字都是 2026 年公开市场报价的区间整理,用于建立量级判断,实际以各平台官网实时价格为准。

    价格全景:国内、海外与整机口径

    先明确口径。H100 与 H800 都是 80G 显存的高端卡,在国内属于供给受限的高端产品,因此国内价格显著高于海外;而 H800 是面向合规要求的产品版本,NVLink 带宽从 900GB/s 降到 600GB/s,其他规格接近,价格通常与 H100 同一带。整机月租则是企业级采购口径,H100 整机月租在 6.3 万元量级,不适合与按小时零售价直接换算。

    口径 价格区间 说明
    国内时租(H100/H800) 约 9.6-12 元/小时 会员价可低至 9.58 元起,高峰期需排队或加价
    海外时租 约 $2.0-3.5/小时 较 2024 年峰值跌约 64%
    整机月租(企业级) H100 约 6.3 万元/月 量级 含整机与配套,非按卡时折算
    同级国产/替代口径 H20 约 2.1 万元/月/卡 量级 保显存带宽、砍算力的产品定位

    把表读成一个结论:如果你在国内、按小时租、且不追求整机独占,那么 9.6-12 元/小时是当前对你的有效区间;如果你的业务可以放在海外节点或用海外账期,海外的 $2.0-3.5 会便宜一半以上,但要额外考虑网络延迟、数据出境与合规成本,这部分成本经常比价差更大。

    用这张表做预算时,建议用三步法。第一步,把你的任务折算成 GPU 小时——这需要先估出训练步数与单步耗时,得到一个量级;第二步,用你实际能拿到的单价乘以小时数,得到金额区间;第三步,为排队等待、试错重跑和数据处理各留出一部分余量。三步做完,你会得到一个”区间”而不是”一个数字”,这才是可以拿去做决策的预算。只用一个单价乘一个理想时长得出的结论,几乎总是偏乐观。

    跌 64% 的供需解释

    价格从 2024 年的峰值 8 美元量级跌到 2-3.5 美元,不是单一因素造成的,而是供给与需求两端同时变化的结果。

    供给侧的关键词是”放量”。新一代加速卡进入规模交付,云厂商与专业算力平台的高端卡池容量持续扩大;同时,早期已经回本的部分卡源进入更低价的市场分层。供给一旦从稀缺转向”结构性充裕”,最敏感的高端时租价格首先松动。

    需求侧的关键词是”结构迁移”。2024 年前后,市场对高端卡的需求主要由大模型训练驱动,训练对卡的互联带宽、显存容量要求苛刻,价格弹性极低;到了 2026 年,增量需求明显向推理倾斜。推理对单卡的算力与互联要求更宽容,可以用更多中端卡、甚至消费级卡承担,高端卡的边际需求因此下降。训练转推理,是这一轮价格回落最重要的背景。

    第三个小因素是租赁模式本身的成熟。当按需租赁成为标准配置、包月与预留产品线齐全之后,价格发现机制更充分,信息差被压缩,早期那种”加价抢卡”的空间自然收窄。这三个因素叠加,才构成了”腰斩”的结果。

    按需还是包月:150 小时是一条经验分界线

    H100 的价格对比不能只看时租单价,要把使用时长代入计算。行业里比较通用的经验是:月均使用超过 150 小时,包月通常比按需省 20-30%;低于这个量级,按需更划算,因为包月合同一般不退款,闲置时长就是浪费。

    把这条经验落到 H100 上:假设你按需使用,国内 9.6-12 元/小时,月均 150 小时意味着约 1440-1800 元的月度支出量级;如果包月产品给出 20-30% 的折扣,节省的绝对金额对个人开发者并不算大,但对一个持续训练的团队就是可观的固定成本优化。反过来,如果你的负载是”每月集中跑几轮实验”,每次几十小时,那么按需 + 关机不计费的组合更合适。

    需要额外考虑的是排队成本。高端卡在高峰期需要排队,包月或预留可以在一定程度上锁定可用性,这部分”确定性”本身就是价值,很难用小时价折算。

    海外与国内:三条容易被忽略的额外成本

    看到海外 $2.0-3.5/小时的报价,很多人的第一反应是”比国内便宜一半以上”。但在改预算表之前,至少要把三条额外成本算进去。

    第一是数据出境与合规成本。训练数据与模型权重的跨境传输需要评估合规要求,部分行业(金融、医疗、政企)存在硬性限制;即便不涉及敏感数据,跨境传输本身也会带来审计与合同层面的额外工作量。

    第二是网络延迟与带宽成本。如果数据留在国内、算力放在海外,每次迭代都要付出时延与流量费用,对数据读取频繁的训练任务影响尤其明显;如果数据也一起放到海外,则要考虑长期存储与访问的合规问题。第三是账期与结算成本,海外渠道通常需要外币结算与更长的账期,对现金流管理提出要求,汇率波动也会影响实际支出。

    把这三条加进去,”便宜一半”往往会被压缩到两成左右——仍然可观,但判断依据变了。这也解释了为什么数据落在国内的团队,即便看到海外低价,最终仍选择国内 9.6-12 元/小时的区间:省下的价差,不足以覆盖新增的合规与传输风险。

    H100 还是 H800:合规与互联的取舍

    国内做多卡训练时,经常需要在 H100 与 H800 之间选择。多数场景下两者可以互换,因为它们同为 80G 显存、算力接近,平台报价也常常在同一价格带。真正的差别在两处:一是 NVLink 带宽,H100 为 900GB/s,H800 为 600GB/s;二是合规背景,H800 是为满足特定合规要求而设计的产品版本。这一带宽差异对”卡间通信密集”的负载影响明显:当模型并行策略需要频繁在卡之间同步参数与梯度时,互联带宽会直接影响扩展效率;而当负载是单卡推理、或并行度较低时,差异对最终结果的影响有限。

    选型建议非常直接:如果你的并行策略是张量并行(TP)且规模较大,优先 H100;如果是数据并行(DP)为主、或单卡推理,H800 在价格相近时完全可以用;如果有明确的合规约束,则按合规要求选择即可。同一类逻辑也适用于 A800:它的互联带宽从 600GB/s 降到 400GB/s,属于同一系列的合规版本。

    什么时候值得上 H100:一张决策表

    你的场景 是否值得上 H100/H800 理由
    70B 级模型的持续预训练或多机微调 值得,且应优先保障互联 显存与卡间带宽是硬约束,中端卡难以替代
    大规模高并发在线推理(长上下文) 值得评估,先算并发账 单卡吞吐高,但需与多张中端卡方案对比总成本
    7B-13B 微调、实验性训练 多数情况不必 A100 或 4090 集群通常够用,单价低数倍
    AIGC 出图、LoRA 微调、教学 不必 4090/5090 级别即可满足,包月更省
    短期突发的高端算力需求 值得,用按需而非包月 避免为闲置付费,接受排队换取灵活性
    有严格合规要求的训练任务 按合规版本选择(H800 等) 带宽略有牺牲,换取合规可用

    这张表的用法是先找自己所在的场景行,再看”理由”列是否成立。如果理由是”显存与互联是硬约束”,那 H100 就是刚需;如果理由是”吞吐更高”,那就需要真的把并发账算清,再和替代方案比较,因为高端卡的单价是 A100 的两倍以上、是中端卡的四到八倍,量级差异必须用吞吐或时间价值来弥补。

    还有一类场景容易被误判:把”模型规模不大但上下文很长”的任务当成不需要高端卡。长上下文推理的显存占用会随上下文长度上升,缓存部分可能占据相当大比例的显存,这时即使模型参数量不大,也可能因为显存不足而无法提供目标并发。遇到这类情况,先在 A100 上做一次显存与并发的实测,再判断是否需要升级;很多时候升级的目标不是算力,而是显存容量与带宽。

    避坑与注意事项

    • 不要用海外报价直接对标国内预算。海外 $2.0-3.5 看起来便宜,但数据出境、网络延迟、账期与合规成本要一起算。
    • 不要忽略排队成本。高端卡高峰期排队明显,报价再低,排不上队也没有意义;凌晨与周末相对宽松。
    • 不要只看时租不看整机口径。6.3 万元/月 的整机报价与 9.6-12 元/小时 不是同一个东西,混算会得出错误结论。
    • 不要用消费级跑分推断 H100 性能。高端卡的价值在多卡互联与显存带宽,单卡跑分无法体现。
    • 不要跳过试用直接签长约。先用按需实例完成一次真实负载验证,再决定包月或预留。

    常见问题

    H100 价格还会继续跌吗?

    方向性判断可以看三个信号:高端卡的新增供给节奏、推理需求在总算力需求中的占比、以及新一代产品的发布与交付进度。推理占比继续上升、供给继续放量,价格下行的压力就持续存在;但高端卡的绝对价格也有成本底线,不太可能出现无限制下跌。做预算时建议用区间而非单点,并保留调整空间。

    国内 9.58 元起的会员价,和普通用户价差多少?

    会员价的本质是渠道折扣,通常对应更长的预付周期或更高的承诺用量。对低频用户来说,为了折扣而预付并不划算;对稳定使用的团队来说,折扣加上可用性锁定,整体价值更明显。判断标准还是那个 150 小时的量级分界。

    为什么 H800 价格和 H100 差不多?

    因为两者在显存容量、算力量级上接近,主要差异在 NVLink 带宽(900GB/s 对 600GB/s)与合规定位,而不是”性能档次”。市场把它当作同一档次的不同版本定价,价差因此有限。

    用 H20 替代 H100 划算吗?

    取决于你的负载是”显存敏感”还是”算力敏感”。H20 的设计思路是保留显存带宽、削减算力,量级报价约 2.1 万元/月/卡,适合显存与带宽受限、而算力需求相对温和的场景;如果是计算密集型训练,替代效果会打折扣。先明确瓶颈在哪一侧,再决定。

    预算有限时,有哪些降本替代路径?

    三条:把可中断的训练搬到中端卡并做断点续训;用 LoRA 等参数高效方法降低对显存与算力的要求;把”必须高端卡”的部分压缩到最短时长,其余环节放在 A100 或 4090 集群上。这三条组合起来,通常能在不明显延长工期的前提下显著降低高端卡的账时。

    总结

    H100 的价格全景可以用三句话概括:国内时租 9.6-12 元、海外 $2.0-3.5、较峰值跌约 64%;下跌由供给放量与训练转推理共同驱动;是否值得上 H100,取决于你的瓶颈是不是”显存与卡间互联”。9.58 元起这个数字,只是一个坐标——它的意义是让你在拿到任何报价时,能够立刻判断它在价格带里的位置。做决策前,请以各平台官网的实时价格与服务条款为准,并用一次真实负载的试用验证你的判断。

  • 2026 年 GPU 算力租用平台怎么选:三类平台对比与避坑清单

    先说结论:三类平台,按你的角色选

    2026 年在国内租 GPU,同样一张 RTX 4090(24G 显存),不同平台的小时价可以从 1.2 元一路差到 2.5 元,差距接近一倍;同样一张 H100,国内时租约 9.6-12 元,而海外市场报价折算后只有 2.0-3.5 美元,较 2024 年峰值回落约六成。价格差只是表象,真正决定使用体验的是平台类型。把市面上叫得出名字的算力平台分成三类——零售开发者向、大厂云、国产信创——再用六个维度逐一对照,选型这件事就能从一个模糊的”哪家便宜”,变成一张可以打勾的表。

    这篇 GPU 算力租用指南不打算做”谁第一谁第二”的排行榜,因为排行榜依赖的维度对不同人完全不同:一个人跑 LoRA 微调,最在意的是开卡速度和小时价;一个企业部署推理服务,最在意的反而是 SLA 条款和数据合规。我们要给的是一套可复用的对比方法:先判断平台类型,再拆价格结构,最后用避坑清单收尾。把方法拿在手里,比记住任何一份榜单都更有用。

    一句话版本:个人开发者与中小团队优先考虑零售向平台,追求低门槛与灵活计费;有合规、发票与 SLA 硬要求的企业,去看大厂云;被信创政策约束、或有长期国产化对冲需求的团队,评估昇腾 910B 一类的国产算力。三类之间不是替代关系,不少团队会同时使用两到三家,用零售平台做开发和试错,用大厂云跑生产,用国产平台满足合规。

    三类平台的分法

    第一类是零售/开发者向平台,代表有 AutoDL、晨涧云、智星云、恒源云、趋动云、算家云、OpenBayes 等。它们的共同点是计费粒度细、开卡快、镜像与社区教程齐全、价格带最密集,适合需要频繁创建和销毁实例的开发和实验场景。它们之间的差异主要体现在长租折扣力度、新用户优惠策略、以及企业合规背景上,比如晨涧云更强调长租折扣,智星云常被提到新用户优惠与企业合规背景。缺点也类似:资源池以中端消费卡为主,高端卡在高峰期需要排队,售后主要依赖工单响应。

    第二类是大厂云,代表是阿里云、腾讯云、华为云。它们的优势在于 SLA 明确、合规与发票体系完善、网络与存储配套成熟,弹性公网、对象存储、专线这些周边能力可以和服务一起打包,适合对稳定性有硬要求的生产环境。代价是单价明显更高,配置体系也更复杂,规格、镜像、存储、网络是分开计费的,小团队容易在”选规格”这一步就迷失,最后账单远超预期。

    第三类是国产/信创方向,核心是昇腾 910B 生态,可以通过华为云等渠道获得现货。它的价值主要不在性价比,而在于合规对冲与供应链安全:在信创要求下,910B 往往是唯一可选项;而在长期战略上,它提供了一条不完全依赖单一生态的路径。代价是软件生态需要适配,迁移成本真实存在,后文会单独讲。

    平台类型 代表平台 定价特征 适合谁 上手难度
    零售/开发者向 AutoDL、晨涧云、智星云、恒源云、趋动云、算家云、OpenBayes 4090 约 1.2-2.5 元/时;包月可到 0.8-1.5 元/时;计费粒度细 个人开发者、中小团队、实验与试错
    大厂云 阿里云、腾讯云、华为云 单价高,配套(存储/带宽/公网)单独计费;SLA 明确 企业生产环境、合规与发票硬要求 中到高
    国产信创 昇腾 910B(华为云现货) 以整机/包月报价为主,企业级口径 信创合规场景、长期国产化对冲 中(需生态适配)

    价格结构对比:4090 是观察窗口

    把 RTX 4090 当作观察窗口,是因为它是国内零售平台上供给最充足的卡型,价格最透明、可比性最强。2026 年的市场价约 1.2-2.5 元/小时,其中算家云约 1.24 元、智星云约 1.31 元、AutoDL 在 1.8-2.5 元区间;如果走包月,折算下来可以到 0.8-1.5 元/小时。这组数字的意义不在于精确记住哪家是 1.24,而在于建立”量级感”:同一张卡,零售平台的价格区间可以拉开一倍,而这个差距通常由三点造成——是否包月、卡池的新旧与地域、以及计费粒度。

    价格结构的关键在于”口径”。同样标注 1.2 元/小时,有的是按秒计费、关机不计费;有的是按小时取整,停机也计费;有的把存储、快照、镜像带宽单独列出。所以对比时不能只看单价那一列,要看计费规则那一行。这也是这份租用指南反复强调平台”价格结构”而非”价格”的原因:结构决定了你实际付多少钱。

    卡型 显存 时租区间 备注
    RTX 4090 24G 1.2-2.5 元/时 包月折算约 0.8-1.5 元/时,供给最充足
    RTX 4090D 24G 约 1.14 元/时起 性价比入门选择,算力略低于 4090
    RTX 3090 24G 约 1 元/时起 老卡,适合显存敏感、算力不敏感的负载
    P40 24G 0.3-0.4 元/时 极低成本场景,如轻量推理、教学演示
    A100 40G/80G 2.4-2.9 元/时 训练与科研常用,企业级稳定性较好
    H100 / H800 80G 国内约 9.6-12 元/时 海外约 $2.0-3.5/时,较 2024 年峰值跌约 64%
    RTX 5090 32G 2.68-3.28 元/时 新一代消费级旗舰,显存与带宽提升
    入门卡(3080Ti 等) 12-24G 0.88-0.98 元/时 试水与轻量任务

    需要提醒的是,上表是 2026 年公开市场报价的区间整理,用于建立量级感,实际以各平台官网实时价格为准。H20 这类卡通常以整机或包月口径报价,量级在约 2.1 万元/月/卡,与按小时零售的卡型不适合直接比较。

    六个选择维度

    选定平台类型之后,同类平台之间还要用统一维度打分,否则很容易被单价牵着走。下面六个维度覆盖了绝大多数踩坑场景。

    维度一:上手成本

    上手成本包括注册与实名流程、镜像丰富度、文档质量、以及第一次成功跑通任务需要多久。对个人开发者而言,这一维权重最高:一个镜像齐全、开卡即用的平台,能省下半天到一天的配环境时间。判断方法很简单,看平台是否提供主流框架的预置镜像、是否支持自定义镜像、是否有公开的常见问题文档。上手成本低的平台通常也意味着社区活跃,遇到问题更容易搜到答案。

    维度二:价格结构

    价格结构要拆成四层看:计费粒度(按秒/按分/按小时)、关机是否计费、存储与快照是否单独收费、以及包月折扣的触发条件。业内经验是月均使用 150 小时以上,包月通常能省 20-30%,但前提是你能吃满时长。把四层拆开算一遍,再决定按需还是包月,比直接看标价靠谱得多。

    维度三:稳定性与可用性

    稳定性包含两层含义:实例会不会中途宕机,以及你想用的卡当时有没有货。高端卡 H100/H800 在高峰期经常需要排队,凌晨和周末相对宽松;中端卡基本即开即用。如果你的任务对启动时间敏感,就要么接受排队,要么把任务设计成可中断、可断点续训,要么选择有预留机制的平台。

    维度四:数据合规

    数据合规容易被个人开发者忽略,却是企业采购的第一道门槛:数据存在哪里、是否落盘到共享存储、能否约定保留期限与删除义务、是否提供合规发票。涉及用户数据、医疗、金融、政企场景时,这一维可以直接一票否决。大厂云与具备合规背景的零售平台在这一维明显占优。

    维度五:售后兜底

    售后兜底看三件事:故障赔付条款是否写在合同或服务协议里、工单响应时长、以及是否有人工渠道。算力是按时计费的资源,一次数小时的实例不可用如果没有赔付条款,损失是实打实的。不要只看”技术支持 7×24″这类宣传语,要看赔付规则的具体文字。

    维度六:隐性费用

    隐性费用是最容易超预算的一项,通常藏在磁盘、带宽、快照和存储上:系统盘与数据盘分开计价、公网流量按 GB 计费、快照长期保留按月收费。规避方式是上线前把所有计费项拉一张清单,按预期用量估算一次总账,而不是只算卡时。这也是行业里反复出现的那句话:别只看卡价,要算总账。

    维度之外:三个快速验证动作

    六个维度是打分框架,落到操作上,建议在实际付款前完成三个小动作。第一,用一个最小实例跑一遍你的真实负载,而不是跑分脚本,因为跑分与实际负载之间经常脱节;观察三件事——数据读取速度、单位时间吞吐、以及内存与显存的实际占用峰值。第二,把预计用量的账单估算出来,特别要确认存储与出网流量怎么算,这一步能挡掉大多数超预算的意外。第三,读一遍服务协议里的故障与赔付条款,确认实例不可用时的处理方式,再决定是否长期使用。三个动作加起来通常不超过半天,却能避免后续数周的返工。

    避坑清单:五条最容易踩的坑

    • 只比较卡价、不算总账。CPU、内存、磁盘、带宽、存储与快照往往才是超预算的主因,务必按预期用量估一次全量成本。
    • 跳过试用直接包月。先用小额按需实例验证性能与网络,再决定是否包月;包月虽然能省 20-30%,但前提是时长吃得满。
    • 忽略隐性限制。并发数上限、单实例磁盘 IO 上限、出网带宽、快照数量限制,这些不会写在单价里,却会直接决定任务能不能按时跑完。
    • 把平台背书当性能保证。合作机构名单、融资新闻、榜单排名都不能替代你自己跑一次基准测试;以公开信息判断,不轻信宣传口径。
    • 不做错峰规划。高端卡高峰期排队明显,把可中断的训练安排在凌晨或周末,能显著降低等待与成本。

    常见问题

    零售平台和大厂云,企业应该怎么选?

    看你的约束条件。如果任务对可用性、数据合规、发票有硬要求,或者要和现有云上架构(对象存储、专线、监控)打通,大厂云更省心;如果只是训练实验、批量推理,对成本敏感且能接受工单式支持,零售平台的性价比优势更明显。很多企业的实际做法是混合:核心生产在大厂云,实验与突发在零售平台。

    包月到底划不划算?

    决定因素是月均使用时长的量级。行业经验是月均 150 小时以上,包月通常比按需省 20-30%;低于这个量级,按需或按秒计费更灵活,也不必为闲置付费。注意包月合同一般不可退,先用按需验证负载特征再签。

    为什么同一张 4090,平台之间能差一倍?

    差异来自三点:是否包月、卡池的老化程度与地域、以及计费粒度。新卡池、一线城市机房、按秒计费的平台价格偏高;老旧卡池、异地节点、按小时取整的平台价格偏低。价差合理,但要用”结构”而不是”单价”去比较。

    高端卡一直排队怎么办?

    三个办法:把任务改成可断点续训并安排在凌晨与周末;选择提供预留实例或包月锁定的平台;或者在任务允许时用中端卡替代,比如显存够用的场景下用多张 24G 卡分担。中端卡基本即开即用,这是它们的隐藏优势。

    要不要现在就评估国产算力?

    如果业务没有信创要求,短期可以先不动;如果有长期国产化对冲需求,或需要为供应链风险做备份,建议提前做小规模验证,把生态适配的时间成本纳入规划,因为迁移与适配通常需要数月量级,而不是几天。

    按画像给建议

    • 个人开发者:从零售向平台起步,选计费粒度细、镜像齐全的一家,先用入门卡或 4090 跑通流程,再按需升级到 A100 或高端卡。
    • 初创团队:用”零售平台 + 包月基线”的组合,把稳定负载包月、突发负载按需,同时保留一家大厂云账号应对合规与客户要求。
    • 企业与研究机构:以 SLA、数据合规、发票为前置条件筛选,再在合格名单里比价格;有信创要求时把昇腾 910B 方案单独立项评估。

    最后回到方法本身:这篇租用指南的所有结论都建立在”先分类型、再拆结构、最后避坑”的顺序上。市场报价随时在变,但只要你手里有这张对比表,换一个时间点重新填一遍,结论依然成立。选择平台时,优先参考官方渠道公布的价格与服务条款,例如 AutoDL阿里云 等平台官网的实时价目页。多方交叉核对之后,你得到的不是一份”最优平台”名单,而是一套随时可以重新执行的决策流程——这才是这份指南真正想交付的东西。