▮▮Coloprice
← 指南与分析

· ai-data-centers

2026年GPU云服务对比:15家供应商排名

2026年15家GPU云服务排名:CoreWeave、Lambda、Nebius、RunPod、AWS、Azure、GCP、OCI等,基于H100/H200/B200定价、规模和SLA对比。

2026年GPU云服务对比:15家供应商排名

15家GPU云服务供应商的同款NVIDIA H100价格相差6倍:市场化平台和专业新型云服务商约$1.49-2.10/小时,而Azure和Google Cloud约$10.98-12.29/小时,根据GetDeploying和Spheron价格追踪工具。价格本身不决定赢家——规模、互联、SLA和合规性同等重要,甚至对生产级工作负载更为关键。本指南基于这些维度对15家供应商进行排名,并给出每个排名背后的定价、功能和适配数据。

关键要点

  • 新型云服务商在价格上比超大规模云服务商便宜2-4倍(同款GPU),根据TensorWave/Spheron市场对比——CoreWeave、Lambda、Nebius、RunPod和FluidStack在公开按需价格上都低于AWS、Azure、GCP和Oracle。
  • CoreWeave是规模领导者:约45,000块GPU和994亿美元的合同承诺收入(2026年Q1),但仅售8块GPU节点——没有自助单GPU的途径。
  • Vast.ai和FluidStack发布最低的H100价格(约$1.49-2.10/小时),无或最小化平台SLA;RunPod的Secure Cloud(约99.5%正常运行时间)是提供真正可靠性保证的最便宜选项。
  • 超大规模云服务商仍是合规和生态系统的默认选择:最广泛的认证组合(SOC 2、HIPAA、FedRAMP、ISO),但Azure的$12.29/GPU小时的H100价格是主要供应商中最高的。
  • AMD是一个独特的、较薄的市场:AMD专业云TensorWave和Vultr都将MI300X列价低于$2/GPU小时,大约比同等内存的H100低20%,但供应商数量远少得多。
  • GB200/Blackwell一代容量仍大多为预留合同制——CoreWeave和Together AI出售,但大多GB200访问通过报价制协议而非公开按需价格。

关于GPU型号的实时价格,请见我们的GPU价格指数;关于AI基础设施的托管侧,见托管机柜价格指数数据中心目录

排名如何运作

供应商基于四个加权因素进行排名,按照2026年大多数AI买家的重要性顺序:

  1. 价格竞争力——H100/H200/B200公开按需和预留价格与追踪市场范围的对比。
  2. 规模和可靠性——GPU服务器集群规模、正常运行时间SLA(如有),以及容量是否真正可按宣传价格获得。
  3. 训练级网络——InfiniBand/NVLink多节点集群的可用性对比仅单GPU配置。
  4. 开发者和企业适配——自助配置、计费粒度、合规认证和支持模式。

这产生了一个「典型AI买家的最佳总体价值」的顺序,而非纯粹价格排名——有严格合规需求或2,000块GPU训练运行的工作负载应将规模和网络权重置于主要价格之上。末尾的「选择哪家」部分将排名映射到具体买家档案。

排名:15家GPU云服务

排名 供应商 类别 H100按需价格 突出优势
1 CoreWeave 企业级新型云 约$6.16/小时(仅8块GPU节点) 最大的独立规模,994亿美元合同承诺
2 Lambda 托管AI云 $3.99-4.29/小时 99.9% SLA,1-Click Clusters可扩展至2,000+个GPU
3 Nebius 纵向集成新型云 按需$3.85/小时,抢占$2.15/小时 自助单块GPU,最高35%承诺折扣
4 RunPod 混合平台 $1.99(Community) / $2.89(Secure) 价格-可靠性比最优,无出站费用
5 Crusoe 可持续电力新型云 约$3.90/小时单块GPU按需 2024-25收入增长262%,废气能源模式
6 Together AI 推理+训练混合 按需$5.49/小时,预留$3.49/小时 集群可扩展至4,000+块GPU,按token API选项
7 FluidStack 专业新型云 约$2.10/小时 追踪中最低的企业级价格之一
8 TensorWave AMD专业商 N/A(仅AMD) MI355X从$2.85/小时,MI300X按需脱销
9 Vast.ai 市场平台 约$1.53-1.87/小时 最便宜的广泛可用价格;无平台SLA
10 Vultr 预算全球云 $0.118-19.18/小时范围 最便宜的MI300X/MI355X(约$1.85-2.59/小时)
11 DigitalOcean 简化GPU Droplets $3.39/小时($3.26预留) 最简单的计费,无长期承诺必需
12 Oracle Cloud (OCI) 裸机超大规模云 每块GPU $10(8块GPU节点 = $80/小时) 唯一提供真正裸机的超大规模云(无虚拟化开销)
13 Google Cloud 超大规模云 约$10.98-11.06/小时(A3,按需) 与Vertex AI、TPU生态最深度集成
14 AWS 超大规模云 约$5.19-6.87/小时(Capacity Blocks) 最广泛的合规和企业采购生态
15 Azure 超大规模云 约$12.29/小时(ND H100 v5) 主要供应商中最高的按需价格;Microsoft栈和OpenAI相邻工具最深

价格为2026年中期的公开按需数据,来自供应商定价页面和GetDeploying/Spheron/Thunder Compute聚合;多个(CoreWeave、Together AI、Oracle)也按固定多块GPU节点而非按块GPU销售。AWS的Capacity Block价格在2026年7月1日上涨约20%。注意AWS排名超过Azure,尽管价差更小,因为Capacity Blocks列价低于Azure ND H100 v5价格且AWS覆盖更广泛的合规范围。

第一梯队:企业级新型云(排名1-3)

CoreWeave是规模领导者——北美最大的独立GPU供应商,约45,000块GPU,在2026年Q1财报上报告994亿美元合同收入承诺,同比增长近4倍。它仅以8块GPU的HGX节点出售,配备NVLink和InfiniBand,面向需要保证多节点可用性的70B+参数模型训练团队——但没有自助单块GPU的途径,且H100价格(约$6.16/小时)远超RunPod或Nebius。

Lambda是托管AI云的基准:一个精选目录(H100、H200、B200、A100),由99.9%正常运行时间SLA的合同承诺和通过Slack、电子邮件和电话的人工支持支持。1-Click Clusters从16扩展到2,000+个InfiniBand连接GPU——这是对RunPod和Vast.ai的差异化优势,用于认真的分布式训练,但高于预算型新型云40-100%的价格溢价。

Nebius在保持自助的同时更便宜:H100按需$3.85/小时(对比CoreWeave的$6.16/小时),抢占$2.15/小时,加承诺折扣最高35%。与CoreWeave不同,Nebius提供单块GPU预设,使其对不需要8块GPU最小值的团队可行。

第二梯队:开发者友好和专业新型云(排名4-8)

RunPod因其价格-可靠性比排名第4:Community Cloud $1.99/小时H100(无SLA,约97-99%正常运行时间)或Secure Cloud $2.89/小时(约99.5%正常运行时间,SOC 2/HIPAA/GDPR),两者都无出站费用和按秒计费。它是不需要CoreWeave/Lambda规模集群的中小型AI团队的默认推荐。完整对比Lambda和Vast.ai见我们的RunPod vs. Lambda vs. Vast.ai指南

Crusoe配对独特的基础设施故事——废气和烧气电力驱动跨86个站点的Tier III移动数据中心——与真实增长:收入从2024年的2.76亿美元升至2025年近10亿美元,增长262%,云ARR同比增长150%。按需单块GPU价格(约$3.90/小时)有竞争力但不是最便宜;微软、Databricks和Together AI是客户。

Together AI占据混合利基:按token无服务器推理、专属端点和Instant GPU Clusters(8到4,000+块GPU、InfiniBand)按需$5.49/小时或预留$3.49/小时。最适合想在租赁原始GPU和消费托管推理API之间移动而不改变供应商的团队。

FluidStack发布一些追踪中最低的企业级价格——约$2.10/小时H100,约$2.30/小时H200——在价格上将其置于CoreWeave和Lambda之下,同时仍以生产而非市场平台客户为目标。

TensorWave是AMD专业商:MI355X从$2.85/GPU小时,MI325X从$1.95/GPU小时,MI300X因AMD租赁市场较薄而频繁脱销。对于AMD Instinct工作负载的正确选择,而非通用目的选择。

第三梯队:市场平台和预算新型云(排名9-11)

Vast.ai是广泛可用H100容量的价格下限(按需约$1.53-1.87/小时,可抢占实例低50%),通过40+数据中心和数千独立主机的点对点市场。没有平台级SLA——可靠性完全取决于个体主机——使其最适合中断容忍、检查点友好的工作负载。

Vultr跨一个异常宽的$0.118-19.18/小时范围(通过其GPU目录A16到B200),是AMD MI300X(约$1.85/小时)和MI355X(约$2.59/小时) pods的最便宜追踪来源,甚至低于TensorWave对这些SKU的价格。

DigitalOcean以简单性换取价格:GPU Droplets(H100、H200、L40S、MI300X)$3.39/小时,按小时计费,无长期承诺必需,12个月预留仅到$3.26/小时——一个小折扣,表示DigitalOcean为易用性而非最低成本优化。

第四梯队:超大规模云(排名12-15)

四大云商对同硅价格2-6倍高于新型云服务商,但对受监管产业、现有企业协议和已集成到特定云生态的工作负载仍是默认值。

超大规模云 H100按需 著名型号 排名原因
Oracle Cloud (OCI) 每块GPU $10(8块GPU节点 = $80/小时) BM.GPU.H100.8裸机 唯一提供真正裸机的超大规模云(无虚拟化开销);四大中最简单的固定价率
Google Cloud 约$10.98-11.06/小时(A3、H100) A3(H100)、A3 Ultra(H200) 如果已标准化Vertex AI、TPU或BigQuery最佳;A4(B200)定价尚未在公开列表中
AWS 约$5.19-6.87/小时(Capacity Blocks) P5、P5e、P5en 最广泛的合规/采购生态;Capacity Block价格于2026年7月1日上涨约20%
Azure 约$12.29/小时(ND H100 v5) ND H100 v5 主要供应商中最高的追踪按需价格;对Microsoft栈和OpenAI相邻工具最深入

抢占/可抢占价格以短逐出通知(在Azure最低30秒)将超大规模云价格降低70-82%,一年预留条款折扣约35%——对于能容忍中断或提前承诺的团队,大幅缩小与新型云按需价格的差距。

市场中按GPU型号的定价

GPU 追踪按需范围 典型/中值 最便宜层 最贵层
L40S(48GB) $0.48-3.50/小时 约$1.55/小时 Verda(约$0.48) Oracle Cloud(约$3.50)
A100(80GB) $1.09-5.07/小时 约$1.85/小时 Thunder Compute(约$1.09) GCP a2-ultragpu(约$5.07)
H100(80GB) $1.49-11.06/小时 约$3.72/小时 Vast.ai/FluidStack Google Cloud A3
MI300X(192GB、AMD) $1.85-7.86/小时 约$3.00/小时 Vultr Azure
H200(141GB) $2.30-13.78/小时 约$4.15/小时 FluidStack Azure ND H200 v5
MI355X(288GB、AMD) $2.59-8.60/小时 约$4.95/小时 Vultr Oracle裸机
B200(180GB) $3.50-16.11/小时 约$6.20/小时 Vultr Azure/AWS高级SKU
GB200(每块GPU、NVL72) $10.50-27.04/小时 约$17-18/小时 CoreWeave Azure裸机

数据汇编自GetDeploying、AIMultiple、Thunder Compute和供应商定价页面,截至2026-08-05GPU价格指数更新时最新。GB200/B200数字低估实际可用性:大多GB200容量和大量B200交易通过报价制预留合同而非公开按需列表进行。

可靠性和企业就绪性对比

因素 超大规模云(AWS/Azure/GCP/OCI) 企业级新型云(CoreWeave/Lambda/Nebius) 预算新型云(RunPod/Vultr/DigitalOcean) 市场平台(Vast.ai)
正常运行时间SLA 99.9%+合同、平台范围 托管层99.5-99.9% 无到约99.5%取决于层级 无(主机相依)
合规 最广泛:FedRAMP、HIPAA、SOC 2、ISO、PCI DSS 托管层SOC 2、HIPAA 某些SOC 2/HIPAA(RunPod Secure) 按主机变动
多节点训练 是,高级定价 是,核心产品(CoreWeave、Lambda) 有限至中等规模 有限,单节点焦点
自助单块GPU 无(CoreWeave),是(Nebius、Lambda)
计费粒度 按小时,某些按秒 按小时/分钟 按秒常见 按秒
出站费用 是,典型$0.08-0.12/GB 变动;某些豁免 常见豁免(RunPod、Lambda) 主机定价

这对买家意味着什么

正确的供应商取决于工作负载形式而非主要价格:

  • 大规模、有期限的训练(100+块GPU、多周运行):CoreWeave或Lambda。当停滞的训练运行成本超过价格差异时,保证的多节点容量和InfiniBand互连值得对市场平台价格的溢价。
  • 创业或中型团队发布AI产品:RunPod或Nebius。两者发布竞争价格和真正的可靠性层,无出站费用——对没有专著基础设施人员的团队,成本和操作安全的最佳平衡。
  • 受监管产业或现有企业云协议:AWS、Azure、Google Cloud或Oracle。对于金融、医疗和政府买家,合规认证广度和采购关系超越2-4倍价格溢价。
  • AMD特定工作负载:TensorWave保证MI300X/MI355X访问,如果MI300X/MI355X价格是唯一变量则Vultr。
  • 批量、中断容忍或探索性工作:Vast.ai。可抢占价格比其自身按需价格低50%以上,按需实例本身已低于每个托管供应商——经常检查点并将任何单一主机视为可丢弃。
  • 可持续性加权采购:Crusoe的废气能源模式是此排名中唯一围绕该约束特别构建的,竞争(非最低)定价。

在提交预留期限前在两个入选供应商上并行运行相同工作——公开价格是起点,而非添加出站、存储和可抢占开销后的总成本。在GPU价格指数追踪所有这些GPU型号的实时价格,从2023年以来看此市场如何移动见H100租赁价格。关于配对GPU租赁的托管侧基础设施决策——自购硬件而非租赁——对比托管机柜价格指数请求报价

常见问题

2026年租用H100最便宜的GPU云服务是哪家?

交易平台和专业新型云服务商提供最低价格:Vast.ai和FluidStack的H100大约从$1.49-2.10/小时起价,RunPod Community Cloud为$1.99/小时。超大规模云服务商价格高3-6倍——Azure的ND H100 v5列价约$12.29/GPU小时,Google Cloud的A3按需约为$10.98-11.06/GPU小时,根据GetDeploying和Thunder Compute等价格聚合商的数据。

哪家GPU云服务能提供最大规模的大模型训练?

CoreWeave是北美最大的独立GPU供应商,截至2026年Q1财报,部署了约45,000块GPU,合同承诺收入达994亿美元——同比增长近4倍。在超大规模云服务商中,AWS、Azure和Google Cloud分别通过Capacity Blocks、ND系列和A3/A4超级计算机配置提供数千GPU级别的集群。

超大规模云服务商、新型云服务商和市场化GPU供应商有什么区别?

超大规模云服务商(AWS、Azure、Google Cloud、Oracle)在更广泛的云平台内运营GPU,拥有最广泛的合规认证组合,但价格最高——通常是新型云服务商同硅芯片价格的2-4倍。新型云服务商(CoreWeave、Lambda、Nebius、Crusoe、FluidStack、TensorWave)仅运营GPU基础设施,通常价格更低、配置速度更快,SLA从无到99.9%不等。市场化平台(Vast.ai)汇聚第三方主机,没有平台级SLA,提供最低价格但可靠性变化最大。

哪家GPU云服务最适合多节点分布式训练?

CoreWeave和Lambda为此而生:CoreWeave仅销售8块GPU的HGX节点,配备NVLink和InfiniBand,设计用于保证多节点可用性;Lambda的1-Click Clusters可从16块GPU扩展到2,000块以上的InfiniBand连接GPU。Together AI的Instant GPU Clusters也可按需或预留的方式扩展到4,000块以上GPU。市场化平台和单GPU平台(Vast.ai、DigitalOcean、大多数RunPod pods)更适合单节点或中等规模多节点任务。

GPU云服务价格因GPU代数而异吗?

是的,差异很大。2026年中期追踪的按需中值大约为:L40S $0.48-1.55/小时,H100 $1.85-3.72/小时,H200 $4.15/小时,B200 $6.20/小时,GB200 NVL72节点在有货的情况下平均$17-18/小时每块GPU——根据GetDeploying和提供商定价页面追踪的数据,GB200容量中很多是报价制预留合同。

AMD GPU云服务比NVIDIA便宜吗?

对于同等内存容量,通常是的。AMD的MI300X(192GB)中值约$3.00/GPU小时,对比NVIDIA H100(80GB)的$3.72/GPU小时,AMD专业云TensorWave和预算型新型云服务商Vultr都将MI300X/MI355X列价低于$2/GPU小时。AMD租赁市场较薄——只有少数供应商对比H100的48家以上——这限制了价格发现和除少数专业和预算云服务商外的可用性。

我应该购买H100还是从GPU云服务租用?

在满负荷利用的情况下,自购在18-24个月内开始超越租赁:新H100成本为$25,000-40,000,一年的预留租赁约$20,600/年(按约$2.35/小时的合同价)。利用率低于50%,或工作负载周期短于一年的情况下,从新型云服务商或市场化平台租赁在灵活性上更胜一筹,避免了自购的电力、托管和转售风险——详见我们的H100租赁价格指南。

资料来源

本文引用的一手来源。每个数字都链接到其出处。

  1. GetDeploying — H100 cloud price comparison
  2. GetDeploying — H200 cloud price comparison
  3. AIMultiple — Cloud GPU rental price index
  4. Thunder Compute — CoreWeave pricing review (August 2026)
  5. Sacra — CoreWeave revenue, valuation and funding
  6. Spheron — AWS H100 pricing 2026
  7. Spheron — Azure H100 pricing 2026
  8. Spheron — Google Cloud A3 H100 pricing 2026
  9. Spheron — Oracle Cloud (OCI) GPU pricing 2026
  10. Nebius — GPU cloud pricing
  11. Sacra — Crusoe revenue, valuation and funding
  12. RunPod pricing
  13. Vast.ai pricing

获取报价

告诉我们您的需求——我们从目录中为您匹配数据中心并返回真实报价。买方免费。

我们在一个工作日内回复。无垃圾邮件,不转售您的联系方式。