结论先给:账单砍掉一半,开机时间从几天变成几分钟
一台 8 卡 H100 节点,AWS us-east-1 的 p5.48xlarge 挂牌 $55.04/小时,跑满 30 天是 $39,628.80。同样 8 张 H100 SXM 80GB 在 NexGPU 是 $28.656/小时,一个月 $20,632.32——同样的卡,同样的显存,一个月省下 $18,996.48。A100 SXM4 80GB 的差距更夸张:AWS p4de.24xlarge 折合 $3.4309/GPU·小时,我们 $1.088,便宜 68%。而且这只是钱的部分:AWS 新账号的「Running On-Demand P instances」配额默认是 0 个 vCPU,一台 p5.48xlarge 要 192 个 vCPU,你得先向 AWS Support 提工单,等人工审批,可能批、可能部分批、也可能不批;真要拿到 H100/H200,实际路径是 Capacity Blocks——那是另一套默认同样为 0 的配额、全额预付、明文写着不允许取消。在 NexGPU,这一整套流程等于零:选卡、选镜像、开机。
01 —
同规格 GPU,价格逐行对照
每一行的竞品价格都可以点开,直达对方官网的报价页。
| GPU 型号 | NexGPU | AWS | 省 |
|---|---|---|---|
| H100 SXMp5.48xlarge · $55.04/hr ÷ 8 · us-east-1 | $3.582 | $6.880 | −47% |
| H100 SXMp5.48xlarge · $68.80/hr ÷ 8 · ap-northeast-1 | $3.582 | $8.600 | −58% |
| H200p5en.48xlarge · $63.296/hr ÷ 8 · us-east-1 | $6.660 | $7.912 | −15% |
| H200p5en.48xlarge · $79.12/hr ÷ 8 · ap-northeast-1 | $6.660 | $9.890 | −32% |
| A100 SXM4p4de.24xlarge · $27.4471/hr ÷ 8 · us-east-1 | $1.088 | $3.431 | −68% |
| A100 SXM4p4de.24xlarge · $37.6223/hr ÷ 8 · ap-northeast-1 | $1.088 | $4.703 | −76% |
竞品价格为其官网公开的按量/按需价,点击数字可核对来源;整机报价已按 GPU 数折算为单卡每小时。
02 —
四个维度的正面对比
价格、上手速度、全球节点、售后响应。
价格优势
NexGPU · H100 SXM 80GB $3.582、A100 SXM4 80GB $1.088、H200 141GB $6.660,全部是每 GPU 小时的挂牌价,按秒计量、按小时计价,没有最低消费、没有开通费。想跑消费级卡更省:RTX 4090 $0.540、RTX 3090 $0.193,存储中位价 $0.414/GB·月,出网中位价 $0.0081/GB。
AWS · AWS us-east-1 的 p5.48xlarge 挂牌 $55.04/小时,折合 H100 每 GPU 小时 $6.88;同一台机器在东京区是 $68.80/小时,也就是 $8.60/GPU·小时,同样的硅片贵 25%。A100 80GB 的 p4de.24xlarge 是 $27.4471/小时,折合 $3.4309/GPU·小时。而 H100/H200 真正的走货渠道 Capacity Blocks 根本没有挂牌价——AWS 自己写的是价格「取决于购买时 Capacity Blocks 的供需」,你得先登录账号才看得到数字。
上手快捷
NexGPU · 注册、充值、开机,三步。2,000+ 预置镜像随选——PyTorch、vLLM、ComfyUI、Stable Diffusion、AUTOMATIC1111、Whisper ASR、Ubuntu CLI,SSH / Jupyter / 网页终端任选一种进去,REST API 和 CLI 也是开箱即用。不用申请配额,不用等审批,不用预付,不用挑档期,用完随时关,按秒结算。
AWS · AWS 新账号的 GPU 配额默认是 0:「Running On-Demand P instances」默认 0 个 vCPU,「Running On-Demand G and VT instances」也是 0,连一台单卡 g6.xlarge 都开不了;Spot 同样是 0。配额按 vCPU 算,一台 p5.48xlarge 是 192 个 vCPU,等于要 AWS 把你从 0 提到 192,超过自动阈值的申请会转给 AWS Support 人工判断,可批、可部分批、也可拒。想拿 H100/H200 通常要走 Capacity Blocks:配额同样默认 0(P5、P5e、P5en 各是一条),全额预付,付款没在开始前 5 分钟或 12 小时内到账就直接释放,而且 AWS 明文写着不允许取消;档期还按 AWS 的钟走,UTC 11:30 结束,11:00 就开始终止实例。自建 AMI 上 P5 还得对齐 NVIDIA 驱动 530、CUDA 12.1、GDRCopy 2.3、EFA 1.24.1、NCCL 2.18.3 这一整套版本。
全球节点丰富
NexGPU · 51 个国家和地区,1,175 个已验证可租节点,2,498 张 GPU,75 种 GPU 型号,单节点最多 14 张卡、单节点显存最高 2,152GB。一套价格、一个控制台,哪个区域有货就在哪个区域开,不用为每个 region 单独排队要容量。
AWS · AWS 的 region 数量很好看,GPU 容量的分布要窄得多。AWS 自己的 Capacity Blocks 支持表一共只列出 18 个地点:p5(8×H100)11 个 region 加一个本地扩展区,p4d(A100 40GB)只有 us-east-1、us-east-2、us-west-2 三个,而 p4de(A100 80GB)全球只有 us-east-1 和 us-west-2 两个——整个 A100 80GB 机队都在美国,亚洲和欧洲一台都没有。表里也没有任何中国大陆 region。离中国最近、且按需带 H100/H200 的是东京,代价是贵 25%。
售后灵活
NexGPU · 中英文双语、全天候在线,Telegram 直连 t.me/nextipkf,找到的是能动手的人,不是工单队列,也没有 severity 分级。不签支持合同,不按账单比例抽成——技术支持占你花费的 0%。
AWS · AWS 的免费 Basic 档给的是客服、文档和 Trusted Advisor,7×24 电话/在线/邮件技术支持和不限量工单是付费档才有的。Business Support+ 每月最低 $29,之后按当月用量抽成:$10K 以内 9%,$10K–$80K 7%,$80K–$250K 5%,$250K 以上 3%。也就是说,你 GPU 租得越多,支持费自动越贵:一台 p5.48xlarge 跑满一个月是 $39,628.80 的 EC2 消费,光 Business Support+ 就要约 $3,566/月,换来的是 severity 1 的 30 分钟内响应,其余问题回落到 24 小时内的一般性指导。Enterprise 档起步 $5,000/月,Unified Operations 起步 $50,000/月。更关键的是,前面那道配额审批,恰恰由这个付费部门把关。
03 —
常见问题
迁移之前你会想清楚的几件事。
