2026年GPU云服务对比:15家供应商排名
2026年15家GPU云服务排名:CoreWeave、Lambda、Nebius、RunPod、AWS、Azure、GCP、OCI等,基于H100/H200/B200定价、规模和SLA对比。

15家GPU云服务供应商的同款NVIDIA H100价格相差6倍:市场化平台和专业新型云服务商约$1.49-2.10/小时,而Azure和Google Cloud约$10.98-12.29/小时,根据GetDeploying和Spheron价格追踪工具。价格本身不决定赢家——规模、互联、SLA和合规性同等重要,甚至对生产级工作负载更为关键。本指南基于这些维度对15家供应商进行排名,并给出每个排名背后的定价、功能和适配数据。
关键要点
- 新型云服务商在价格上比超大规模云服务商便宜2-4倍(同款GPU),根据TensorWave/Spheron市场对比——CoreWeave、Lambda、Nebius、RunPod和FluidStack在公开按需价格上都低于AWS、Azure、GCP和Oracle。
- CoreWeave是规模领导者:约45,000块GPU和994亿美元的合同承诺收入(2026年Q1),但仅售8块GPU节点——没有自助单GPU的途径。
- Vast.ai和FluidStack发布最低的H100价格(约$1.49-2.10/小时),无或最小化平台SLA;RunPod的Secure Cloud(约99.5%正常运行时间)是提供真正可靠性保证的最便宜选项。
- 超大规模云服务商仍是合规和生态系统的默认选择:最广泛的认证组合(SOC 2、HIPAA、FedRAMP、ISO),但Azure的$12.29/GPU小时的H100价格是主要供应商中最高的。
- AMD是一个独特的、较薄的市场:AMD专业云TensorWave和Vultr都将MI300X列价低于$2/GPU小时,大约比同等内存的H100低20%,但供应商数量远少得多。
- GB200/Blackwell一代容量仍大多为预留合同制——CoreWeave和Together AI出售,但大多GB200访问通过报价制协议而非公开按需价格。
关于GPU型号的实时价格,请见我们的GPU价格指数;关于AI基础设施的托管侧,见托管机柜价格指数和数据中心目录。
排名如何运作
供应商基于四个加权因素进行排名,按照2026年大多数AI买家的重要性顺序:
- 价格竞争力——H100/H200/B200公开按需和预留价格与追踪市场范围的对比。
- 规模和可靠性——GPU服务器集群规模、正常运行时间SLA(如有),以及容量是否真正可按宣传价格获得。
- 训练级网络——InfiniBand/NVLink多节点集群的可用性对比仅单GPU配置。
- 开发者和企业适配——自助配置、计费粒度、合规认证和支持模式。
这产生了一个「典型AI买家的最佳总体价值」的顺序,而非纯粹价格排名——有严格合规需求或2,000块GPU训练运行的工作负载应将规模和网络权重置于主要价格之上。末尾的「选择哪家」部分将排名映射到具体买家档案。
排名:15家GPU云服务
| 排名 | 供应商 | 类别 | H100按需价格 | 突出优势 |
|---|---|---|---|---|
| 1 | CoreWeave | 企业级新型云 | 约$6.16/小时(仅8块GPU节点) | 最大的独立规模,994亿美元合同承诺 |
| 2 | Lambda | 托管AI云 | $3.99-4.29/小时 | 99.9% SLA,1-Click Clusters可扩展至2,000+个GPU |
| 3 | Nebius | 纵向集成新型云 | 按需$3.85/小时,抢占$2.15/小时 | 自助单块GPU,最高35%承诺折扣 |
| 4 | RunPod | 混合平台 | $1.99(Community) / $2.89(Secure) | 价格-可靠性比最优,无出站费用 |
| 5 | Crusoe | 可持续电力新型云 | 约$3.90/小时单块GPU按需 | 2024-25收入增长262%,废气能源模式 |
| 6 | Together AI | 推理+训练混合 | 按需$5.49/小时,预留$3.49/小时 | 集群可扩展至4,000+块GPU,按token API选项 |
| 7 | FluidStack | 专业新型云 | 约$2.10/小时 | 追踪中最低的企业级价格之一 |
| 8 | TensorWave | AMD专业商 | N/A(仅AMD) | MI355X从$2.85/小时,MI300X按需脱销 |
| 9 | Vast.ai | 市场平台 | 约$1.53-1.87/小时 | 最便宜的广泛可用价格;无平台SLA |
| 10 | Vultr | 预算全球云 | $0.118-19.18/小时范围 | 最便宜的MI300X/MI355X(约$1.85-2.59/小时) |
| 11 | DigitalOcean | 简化GPU Droplets | $3.39/小时($3.26预留) | 最简单的计费,无长期承诺必需 |
| 12 | Oracle Cloud (OCI) | 裸机超大规模云 | 每块GPU $10(8块GPU节点 = $80/小时) | 唯一提供真正裸机的超大规模云(无虚拟化开销) |
| 13 | Google Cloud | 超大规模云 | 约$10.98-11.06/小时(A3,按需) | 与Vertex AI、TPU生态最深度集成 |
| 14 | AWS | 超大规模云 | 约$5.19-6.87/小时(Capacity Blocks) | 最广泛的合规和企业采购生态 |
| 15 | Azure | 超大规模云 | 约$12.29/小时(ND H100 v5) | 主要供应商中最高的按需价格;Microsoft栈和OpenAI相邻工具最深 |
价格为2026年中期的公开按需数据,来自供应商定价页面和GetDeploying/Spheron/Thunder Compute聚合;多个(CoreWeave、Together AI、Oracle)也按固定多块GPU节点而非按块GPU销售。AWS的Capacity Block价格在2026年7月1日上涨约20%。注意AWS排名超过Azure,尽管价差更小,因为Capacity Blocks列价低于Azure ND H100 v5价格且AWS覆盖更广泛的合规范围。
第一梯队:企业级新型云(排名1-3)
CoreWeave是规模领导者——北美最大的独立GPU供应商,约45,000块GPU,在2026年Q1财报上报告994亿美元合同收入承诺,同比增长近4倍。它仅以8块GPU的HGX节点出售,配备NVLink和InfiniBand,面向需要保证多节点可用性的70B+参数模型训练团队——但没有自助单块GPU的途径,且H100价格(约$6.16/小时)远超RunPod或Nebius。
Lambda是托管AI云的基准:一个精选目录(H100、H200、B200、A100),由99.9%正常运行时间SLA的合同承诺和通过Slack、电子邮件和电话的人工支持支持。1-Click Clusters从16扩展到2,000+个InfiniBand连接GPU——这是对RunPod和Vast.ai的差异化优势,用于认真的分布式训练,但高于预算型新型云40-100%的价格溢价。
Nebius在保持自助的同时更便宜:H100按需$3.85/小时(对比CoreWeave的$6.16/小时),抢占$2.15/小时,加承诺折扣最高35%。与CoreWeave不同,Nebius提供单块GPU预设,使其对不需要8块GPU最小值的团队可行。
第二梯队:开发者友好和专业新型云(排名4-8)
RunPod因其价格-可靠性比排名第4:Community Cloud $1.99/小时H100(无SLA,约97-99%正常运行时间)或Secure Cloud $2.89/小时(约99.5%正常运行时间,SOC 2/HIPAA/GDPR),两者都无出站费用和按秒计费。它是不需要CoreWeave/Lambda规模集群的中小型AI团队的默认推荐。完整对比Lambda和Vast.ai见我们的RunPod vs. Lambda vs. Vast.ai指南。
Crusoe配对独特的基础设施故事——废气和烧气电力驱动跨86个站点的Tier III移动数据中心——与真实增长:收入从2024年的2.76亿美元升至2025年近10亿美元,增长262%,云ARR同比增长150%。按需单块GPU价格(约$3.90/小时)有竞争力但不是最便宜;微软、Databricks和Together AI是客户。
Together AI占据混合利基:按token无服务器推理、专属端点和Instant GPU Clusters(8到4,000+块GPU、InfiniBand)按需$5.49/小时或预留$3.49/小时。最适合想在租赁原始GPU和消费托管推理API之间移动而不改变供应商的团队。
FluidStack发布一些追踪中最低的企业级价格——约$2.10/小时H100,约$2.30/小时H200——在价格上将其置于CoreWeave和Lambda之下,同时仍以生产而非市场平台客户为目标。
TensorWave是AMD专业商:MI355X从$2.85/GPU小时,MI325X从$1.95/GPU小时,MI300X因AMD租赁市场较薄而频繁脱销。对于AMD Instinct工作负载的正确选择,而非通用目的选择。
第三梯队:市场平台和预算新型云(排名9-11)
Vast.ai是广泛可用H100容量的价格下限(按需约$1.53-1.87/小时,可抢占实例低50%),通过40+数据中心和数千独立主机的点对点市场。没有平台级SLA——可靠性完全取决于个体主机——使其最适合中断容忍、检查点友好的工作负载。
Vultr跨一个异常宽的$0.118-19.18/小时范围(通过其GPU目录A16到B200),是AMD MI300X(约$1.85/小时)和MI355X(约$2.59/小时) pods的最便宜追踪来源,甚至低于TensorWave对这些SKU的价格。
DigitalOcean以简单性换取价格:GPU Droplets(H100、H200、L40S、MI300X)$3.39/小时,按小时计费,无长期承诺必需,12个月预留仅到$3.26/小时——一个小折扣,表示DigitalOcean为易用性而非最低成本优化。
第四梯队:超大规模云(排名12-15)
四大云商对同硅价格2-6倍高于新型云服务商,但对受监管产业、现有企业协议和已集成到特定云生态的工作负载仍是默认值。
| 超大规模云 | H100按需 | 著名型号 | 排名原因 |
|---|---|---|---|
| Oracle Cloud (OCI) | 每块GPU $10(8块GPU节点 = $80/小时) | BM.GPU.H100.8裸机 | 唯一提供真正裸机的超大规模云(无虚拟化开销);四大中最简单的固定价率 |
| Google Cloud | 约$10.98-11.06/小时(A3、H100) | A3(H100)、A3 Ultra(H200) | 如果已标准化Vertex AI、TPU或BigQuery最佳;A4(B200)定价尚未在公开列表中 |
| AWS | 约$5.19-6.87/小时(Capacity Blocks) | P5、P5e、P5en | 最广泛的合规/采购生态;Capacity Block价格于2026年7月1日上涨约20% |
| Azure | 约$12.29/小时(ND H100 v5) | ND H100 v5 | 主要供应商中最高的追踪按需价格;对Microsoft栈和OpenAI相邻工具最深入 |
抢占/可抢占价格以短逐出通知(在Azure最低30秒)将超大规模云价格降低70-82%,一年预留条款折扣约35%——对于能容忍中断或提前承诺的团队,大幅缩小与新型云按需价格的差距。
市场中按GPU型号的定价
| GPU | 追踪按需范围 | 典型/中值 | 最便宜层 | 最贵层 |
|---|---|---|---|---|
| L40S(48GB) | $0.48-3.50/小时 | 约$1.55/小时 | Verda(约$0.48) | Oracle Cloud(约$3.50) |
| A100(80GB) | $1.09-5.07/小时 | 约$1.85/小时 | Thunder Compute(约$1.09) | GCP a2-ultragpu(约$5.07) |
| H100(80GB) | $1.49-11.06/小时 | 约$3.72/小时 | Vast.ai/FluidStack | Google Cloud A3 |
| MI300X(192GB、AMD) | $1.85-7.86/小时 | 约$3.00/小时 | Vultr | Azure |
| H200(141GB) | $2.30-13.78/小时 | 约$4.15/小时 | FluidStack | Azure ND H200 v5 |
| MI355X(288GB、AMD) | $2.59-8.60/小时 | 约$4.95/小时 | Vultr | Oracle裸机 |
| B200(180GB) | $3.50-16.11/小时 | 约$6.20/小时 | Vultr | Azure/AWS高级SKU |
| GB200(每块GPU、NVL72) | $10.50-27.04/小时 | 约$17-18/小时 | CoreWeave | Azure裸机 |
数据汇编自GetDeploying、AIMultiple、Thunder Compute和供应商定价页面,截至2026-08-05GPU价格指数更新时最新。GB200/B200数字低估实际可用性:大多GB200容量和大量B200交易通过报价制预留合同而非公开按需列表进行。
可靠性和企业就绪性对比
| 因素 | 超大规模云(AWS/Azure/GCP/OCI) | 企业级新型云(CoreWeave/Lambda/Nebius) | 预算新型云(RunPod/Vultr/DigitalOcean) | 市场平台(Vast.ai) |
|---|---|---|---|---|
| 正常运行时间SLA | 99.9%+合同、平台范围 | 托管层99.5-99.9% | 无到约99.5%取决于层级 | 无(主机相依) |
| 合规 | 最广泛:FedRAMP、HIPAA、SOC 2、ISO、PCI DSS | 托管层SOC 2、HIPAA | 某些SOC 2/HIPAA(RunPod Secure) | 按主机变动 |
| 多节点训练 | 是,高级定价 | 是,核心产品(CoreWeave、Lambda) | 有限至中等规模 | 有限,单节点焦点 |
| 自助单块GPU | 是 | 无(CoreWeave),是(Nebius、Lambda) | 是 | 是 |
| 计费粒度 | 按小时,某些按秒 | 按小时/分钟 | 按秒常见 | 按秒 |
| 出站费用 | 是,典型$0.08-0.12/GB | 变动;某些豁免 | 常见豁免(RunPod、Lambda) | 主机定价 |
这对买家意味着什么
正确的供应商取决于工作负载形式而非主要价格:
- 大规模、有期限的训练(100+块GPU、多周运行):CoreWeave或Lambda。当停滞的训练运行成本超过价格差异时,保证的多节点容量和InfiniBand互连值得对市场平台价格的溢价。
- 创业或中型团队发布AI产品:RunPod或Nebius。两者发布竞争价格和真正的可靠性层,无出站费用——对没有专著基础设施人员的团队,成本和操作安全的最佳平衡。
- 受监管产业或现有企业云协议:AWS、Azure、Google Cloud或Oracle。对于金融、医疗和政府买家,合规认证广度和采购关系超越2-4倍价格溢价。
- AMD特定工作负载:TensorWave保证MI300X/MI355X访问,如果MI300X/MI355X价格是唯一变量则Vultr。
- 批量、中断容忍或探索性工作:Vast.ai。可抢占价格比其自身按需价格低50%以上,按需实例本身已低于每个托管供应商——经常检查点并将任何单一主机视为可丢弃。
- 可持续性加权采购:Crusoe的废气能源模式是此排名中唯一围绕该约束特别构建的,竞争(非最低)定价。
在提交预留期限前在两个入选供应商上并行运行相同工作——公开价格是起点,而非添加出站、存储和可抢占开销后的总成本。在GPU价格指数追踪所有这些GPU型号的实时价格,从2023年以来看此市场如何移动见H100租赁价格。关于配对GPU租赁的托管侧基础设施决策——自购硬件而非租赁——对比托管机柜价格指数或请求报价。
常见问题
2026年租用H100最便宜的GPU云服务是哪家?
交易平台和专业新型云服务商提供最低价格:Vast.ai和FluidStack的H100大约从$1.49-2.10/小时起价,RunPod Community Cloud为$1.99/小时。超大规模云服务商价格高3-6倍——Azure的ND H100 v5列价约$12.29/GPU小时,Google Cloud的A3按需约为$10.98-11.06/GPU小时,根据GetDeploying和Thunder Compute等价格聚合商的数据。
哪家GPU云服务能提供最大规模的大模型训练?
CoreWeave是北美最大的独立GPU供应商,截至2026年Q1财报,部署了约45,000块GPU,合同承诺收入达994亿美元——同比增长近4倍。在超大规模云服务商中,AWS、Azure和Google Cloud分别通过Capacity Blocks、ND系列和A3/A4超级计算机配置提供数千GPU级别的集群。
超大规模云服务商、新型云服务商和市场化GPU供应商有什么区别?
超大规模云服务商(AWS、Azure、Google Cloud、Oracle)在更广泛的云平台内运营GPU,拥有最广泛的合规认证组合,但价格最高——通常是新型云服务商同硅芯片价格的2-4倍。新型云服务商(CoreWeave、Lambda、Nebius、Crusoe、FluidStack、TensorWave)仅运营GPU基础设施,通常价格更低、配置速度更快,SLA从无到99.9%不等。市场化平台(Vast.ai)汇聚第三方主机,没有平台级SLA,提供最低价格但可靠性变化最大。
哪家GPU云服务最适合多节点分布式训练?
CoreWeave和Lambda为此而生:CoreWeave仅销售8块GPU的HGX节点,配备NVLink和InfiniBand,设计用于保证多节点可用性;Lambda的1-Click Clusters可从16块GPU扩展到2,000块以上的InfiniBand连接GPU。Together AI的Instant GPU Clusters也可按需或预留的方式扩展到4,000块以上GPU。市场化平台和单GPU平台(Vast.ai、DigitalOcean、大多数RunPod pods)更适合单节点或中等规模多节点任务。
GPU云服务价格因GPU代数而异吗?
是的,差异很大。2026年中期追踪的按需中值大约为:L40S $0.48-1.55/小时,H100 $1.85-3.72/小时,H200 $4.15/小时,B200 $6.20/小时,GB200 NVL72节点在有货的情况下平均$17-18/小时每块GPU——根据GetDeploying和提供商定价页面追踪的数据,GB200容量中很多是报价制预留合同。
AMD GPU云服务比NVIDIA便宜吗?
对于同等内存容量,通常是的。AMD的MI300X(192GB)中值约$3.00/GPU小时,对比NVIDIA H100(80GB)的$3.72/GPU小时,AMD专业云TensorWave和预算型新型云服务商Vultr都将MI300X/MI355X列价低于$2/GPU小时。AMD租赁市场较薄——只有少数供应商对比H100的48家以上——这限制了价格发现和除少数专业和预算云服务商外的可用性。
我应该购买H100还是从GPU云服务租用?
在满负荷利用的情况下,自购在18-24个月内开始超越租赁:新H100成本为$25,000-40,000,一年的预留租赁约$20,600/年(按约$2.35/小时的合同价)。利用率低于50%,或工作负载周期短于一年的情况下,从新型云服务商或市场化平台租赁在灵活性上更胜一筹,避免了自购的电力、托管和转售风险——详见我们的H100租赁价格指南。
资料来源
本文引用的一手来源。每个数字都链接到其出处。
- GetDeploying — H100 cloud price comparison
- GetDeploying — H200 cloud price comparison
- AIMultiple — Cloud GPU rental price index
- Thunder Compute — CoreWeave pricing review (August 2026)
- Sacra — CoreWeave revenue, valuation and funding
- Spheron — AWS H100 pricing 2026
- Spheron — Azure H100 pricing 2026
- Spheron — Google Cloud A3 H100 pricing 2026
- Spheron — Oracle Cloud (OCI) GPU pricing 2026
- Nebius — GPU cloud pricing
- Sacra — Crusoe revenue, valuation and funding
- RunPod pricing
- Vast.ai pricing
获取报价
告诉我们您的需求——我们从目录中为您匹配数据中心并返回真实报价。买方免费。