主流云厂商GPU算力价格怎么比:每小时单价之外,还要算存储、流量和起租门槛

2026-10-01 43 0

比较几家云厂商的 GPU 价格,最常见的错误是只看控制台上那一行每小时单价。账单上的实际金额,是一项任务从开机到数据清理完毕的总花费:

  • 算力按运行时长计费;
  • 存储按容量和保留时长计费;
  • 出网流量按传出去的数据量计费。

还有一些门槛不写在单价里,比如要不要整机起租,要不要签合约才能拿到折扣。

所以比价要换个顺序:先确定任务需要什么卡、跑多久、数据留多久、要往外传多少数据,再拿这几个数去套每家的计费规则。

单价之外,账单还有哪几项

AWS、阿里云这类综合型大云,账单是分项计算的:

  • 算力实例:卡型决定这一项的大头。按需实例按小时或按秒结算。
  • 云盘或块存储:系统盘和数据盘按配置容量持续计费。AWS 的 EBS 卷在实例停止后照样计费,直到卷被删除。阿里云停止实例只停 vCPU 和 GPU 的算力费用,没有释放的云盘会继续扣费。
  • 出网流量:从实例往公网传数据要单独结算,比如下载生成结果、对外提供接口。
  • 快照与备份:快照占用的空间另外计费。

这几项里最容易被低估的是存储。假设你的实例挂着一块大盘,里面装了几个模型权重。任务跑完你关机离开,算力确实停了,但这块盘每天都在计费。几十到上百 GB 的模型和数据集放上几周,这部分费用可能超出预期。按容量乘时长的估算方法,可以看云GPU存储费怎么算。

出网流量取决于用法。如果只在实例里训练,最后拷出一个不大的 checkpoint,流量很少。如果把实例当作对外的推理服务,或者经常把生成的视频、模型文件拉回本地,就要单独估算这一项。

GPU 实例运行、关机、删盘三个阶段中算力、存储和流量费用的变化示意

按需价、合约价和起租单位

在综合大云上,同一张卡的按需(On-Demand)价格通常偏高。想拿到较大折扣,一般要绑定包年包月或 Savings Plans 这类长期承诺。负载稳定、能长期用满的团队适合这种方式。只想跑几天实验的人签了合约,等于提前买下可能用不上的时长。选哪种取决于任务能不能中断、利用率有多高,详细判断见竞价实例和预留 GPU 实例哪个更省钱。

CoreWeave 这类专业 GPU 云,主要按裸机节点或 GPU 实例小时定价,部分平台的对象存储免收出网流量费。但 H100、H200、B200 这类高端训练卡,大多按 8 卡整机节点出租,或者优先供应长期预留客户。如果你只想用一张卡做开发测试或轻量推理,在这类平台上的门槛和调度灵活性都会受限。单卡单价看起来合适,但起租单位是 8 卡时,你要为用不上的那几张卡一起付费。

另外,部分平台开 GPU 实例前需要实名认证或申请配额,这会影响你多快能开始跑任务,见租 GPU 要不要实名认证和配额申请。

卡型对价格的影响往往比平台更大

在同一个平台上换一档卡,价差常常比换平台还大。

  • RTX 系列消费级显卡:适合单卡图像视频生成(如 ComfyUI)、小参数模型微调和推理测试,单位算力成本低。
  • A100、H100、H200 等数据中心卡:有大显存、ECC 和 NVLink/NVSwitch 高速互联,单价高得多。它们的价值主要体现在多卡分布式训练,以及长上下文、高吞吐的大模型推理。

如果你的任务一张消费级卡就能装下,拿 H100 的价格去比几家平台意义不大,应该先把卡选对。消费级卡什么时候真的不够用,可以看消费级显卡什么时候不够用。

把几家放到同一个口径里算

建议先按下面的顺序准备好数字,再去各家价格页填数:

  1. 定卡型和卡数:按模型参数量、精度和上下文长度确定显存门槛,确认单卡是否够用。
  2. 估实际运行时长:除了理想的训练时长,还要算上环境调试、下载模型和出错重跑的时间。对短任务来说,按秒计量和按小时取整的差别比较明显。
  3. 估存储容量和保留天数:把系统盘、模型权重、数据集和输出结果加起来。再想清楚任务结束后要不要保留环境,保留多久。
  4. 估出网数据量:结果要拉回本地多少,会不会对外提供服务。
  5. 查门槛:起租单位是单卡还是整机,有没有最低消费或合约,需不需要配额申请。
  6. 算总账:算力单价 × 运行时长 + 存储单价 × 容量 × 保留时长 + 流量单价 × 出网量,用了快照的再加上快照费用。每家都用同一组数字算一遍,再做比较。

有两点要注意:

  • 现货或抢占式实例的折扣和库存会随地域、时段波动,以开机页面的实时信息为准。
  • 合约折扣要按你确定能用满的时长来算,不要按理想情况算。

不同任务,比价的重点不同

  • 第一次租卡生图、跑开源模型试验:重点看能不能单卡按小时起租、有没有最低消费,以及跑完后存储怎么停掉。这类任务时间短,起租门槛和闲置存储的影响通常比单价上的小差别更大。
  • 微调和持续推理:负载稳定以后,再比较按需和预留。做推理服务要特别估算出网流量。
  • 多卡分布式训练:重点是节点间互联、整机供给和合约条款,单卡小时价只能作参考。联系厂商前可以先整理一份需求清单,见企业GPU集群和预留实例怎么咨询。

在 NexGPU 上怎么算这笔账

NexGPU 按小时计费、按秒计量,没有最低消费,也不需要签合约,显卡从消费级到数据中心级都有。账单只有算力、存储、流量三项,直接套用上面第 6 步的公式即可:

  • 停机后,算力停止计费,存储仍然计费;
  • 销毁实例后,三项费用才全部停止;
  • 下单时单价锁定,一直到销毁为止都不变。

具体操作分两步。先在模型选卡指南确认你的模型需要哪一档显卡,再到价格页查看对应卡型的当前单价和可租节点,把自己的运行时长和存储保留时间代入公式。任务跑完、数据导出以后,记得销毁实例,只关机的话存储费还会继续产生。

相关文章

两张L40S能替代一张A100吗?按任务瓶颈分四类判断
L40S 租一小时多少钱?先看实时单价,再按算力、存储、流量算整次任务
48GB显存能跑多大的模型?推理与微调的精度和上下文边界
L40S 与 A100 跑大模型推理,哪张卡的 Token 成本更低?按并发、上下文和精度来选
租 GPU 要不要实名认证和配额申请?按平台类型分三种情况
消费级显卡什么时候不够用:四条越界信号和换卡的判断口径

评论(0)

暂无评论

发布评论