🌐 全球公有云厂商 GPU 选型分析市场报告

Hyperscale Public Cloud GPU Selection Analysis Report 2026

报告日期:2026年5月 | 数据来源:IDC, Synergy, Canalys, 公司财报

$8.21B
2025年 GPU云市场规模
26.5%
GPUaaS年复合增长率 (2025-2030)
400万+
全球云端GPU部署量
55%
英伟达中国市场份额 (2025)

第一章:全球公有云 GPU 市场概览

全球公有云厂商市场份额 (2025)

GPU云服务市场规模增长趋势

全球云厂商 GPU 集群规模

💡 市场洞察:全球公有云GPU市场正经历"多元化"转型。AWS、Azure、Google Cloud三大巨头仍主导市场,但专业GPU云服务商(CoreWeave、Lambda Labs等)凭借灵活定价和快速交付正在快速崛起。

第二章:国际云厂商 GPU 选型策略

NVIDIA GPU 依然是绝对主力

云厂商 主要GPU型号 集群规模 自研芯片 替代方案
AWS H100, H200, Blackwell (GB200/B300), Rubin 100万+ GPU Trainium2, Trainium3 NVIDIA为主
Microsoft Azure H100, H200, NDm A100 v5 数万级别 MAIA (预览) AMD MI300X
Google Cloud H100, H200 (少量), TPUv7 数十万级别 TPUv7 (Ironwood) TPU为主
Oracle Cloud H100/H200, MI300X 5万+ AMD AMD推理

NVIDIA GPU 各型号性能对比

主流云厂商 GPU 定价对比 ($/小时)

Anthropic 的 GPU 选型

G
Google TPU — 主力训练芯片
1GW+ TPU 容量

Claude Opus/Sonnet/Haiku 主要在 TPUv7 上训练,4倍价格性能优势

N
NVIDIA GPU — 部分采用
数百亿美元合同

虽与 Google TPU 合作,仍与 NVIDIA 保持大规模采购关系

xAI 的 GPU 选型

N
NVIDIA H100/H200 — 训练主力
20万+ H100/H200

Memphis Colossus 超算,2025年底目标100万GPU

A
AMD MI300X — 推理专用
Oracle Cloud 5万片

Grok 模型推理任务,降低成本的重要选择

💡 关键发现:头部AI实验室正在实施"去Nvidia化"策略。Anthropic选择Google TPU每年可节省数十亿美元" Nvidia税";xAI通过AMD做推理实现成本优化,同时自研芯片以实现完全掌控。

第三章:中国公有云厂商 GPU 选型分析

中国公有云 IaaS 市场份额 (2025)

中国AI芯片厂商出货量排名 (2025)

中国AI芯片市场份额 (2025)

中国公有云厂商 GPU/AI芯片选型详情

云厂商 市场份额 GPU选型 自研芯片 状态
阿里云 26.8% H100/H200(受限), H20, A800/H800 含光800 (推理) 自研芯片年化收入百亿级
百度智能云 22-24.6% 昆仑芯R480/P800 昆仑芯 (IPO中) 2026年初港股IPO
华为云 12.9% 昇腾910B/910C (自供) 昇腾系列 昇腾出货量国内第一
天翼云 12.3% H20, H100 (合规) 运营商云主力
移动云 9.4% 昇腾, 昆仑芯 万卡集群落地
腾讯云 7.9% A800/H800, H100 燧原科技 (参投) AMD合作

国产AI芯片代表产品

华为昇腾 910B
INT8算力优秀,已规模化落地万卡集群
昆仑芯 P800
已点亮万卡集群,2025年预计营收35亿元
阿里含光 800
推理芯片,累计交付47万片,年化收入百亿
寒武纪
2026年多家国产芯片厂商IPO,产能释放

出口管制下的"特供版"GPU性能

型号 FP8算力 FP16算力 INT8算力 显存 带宽 状态
📌 出口管制特供版(中国市场)
H20 296 TFLOPS ~148 TFLOPS 96GB HBM3 4.0 TB/s 在售
H800 ~1513 TFLOPS ~756 TFLOPS 80GB HBM3 3.35 TB/s 已停供
A800 ~624 TFLOPS ~312 TFLOPS 624 TOPS 40/80GB HBM2e 2.0 TB/s 已停供
🔍 国际版参考(美元市场)
H100 1979 TFLOPS 989 TFLOPS 3958 TOPS 80GB HBM3 3.35 TB/s 在售
H200 3958 TFLOPS 1979 TFLOPS 7916 TOPS 141GB HBM3e 4.8 TB/s 在售
B200 ~20 PFLOPS (FP4) 192GB HBM3e 8.0 TB/s 即将量产
💡 国产替代加速:2024年英伟达占中国市场约70%,2025年降至55%。华为昇腾从23%提升至20%(国内第二),百度昆仑芯商业化最成功即将独立IPO。阿里平头哥47万片交付破百亿年收入。

第四章:GPU云服务市场未来展望

GPUaaS市场规模预测 (2025-2034)

全球云厂商 GPU 战略布局时间线

2024年Q3 — AWS推出Trainium2,Google发布TPUv5
2024年Q4 — xAI Colossus首期10万H100上线
2025年Q1 — Anthropic与Google签署数百亿美元TPU合同
2025年Q2 — AMD MI300X大规模部署于Oracle Cloud
2025年Q3 — AWS宣布100万GPU计划,Blackwell全面上市
2025年Q4 — 百度昆仑芯P800万卡集群点亮
2026年Q1 — Google TPUv7 (Ironwood)全面可用
2026年Q2 — xAI目标达到100万GPU规模

未来发展趋势

🚀 训练端

  • NVIDIA Blackwell统治高端训练市场
  • Google TPU在特定场景替代Nvidia
  • 自研芯片成为大厂标配
  • 万卡集群成为入门门槛

⚡ 推理端

  • AMD MI300X性价比优势显现
  • 国产芯片在推理场景快速渗透
  • 边缘推理需求爆发
  • 专用推理芯片崭露头角

第五章:核心结论

🌍 国际市场

  • NVIDIA GPU仍是云端AI训练绝对主力,但份额正被侵蚀
  • Google TPU凭借4倍价格性能优势成为 Anthropic 等首选
  • AMD MI300X在推理场景性价比突出
  • AWS、Azure、Google均已自研芯片实现垂直整合
  • 专业GPU云服务商CoreWeave等快速崛起

🇨🇳 中国市场

  • 英伟达份额从70%降至55%,国产替代加速
  • 华为昇腾出货量第一,阿里平头哥紧随其后
  • 百度昆仑芯商业化最成熟,申请港股IPO
  • H20/H800成为合规主流,性能降级但仍必需
  • 2026年多家国产芯片IPO,产能集中释放
💡 最终结论

全球公有云GPU市场正在经历从"一家独大""多元竞争"的转型。

NVIDIA凭借CUDA生态护城河仍占主导,但Google TPU、AWS Trainium、华为昇腾等自研芯片正在特定场景实现替代。推理市场AMD渐获青睐,国产芯片在中国市场快速崛起。

展望2026年,"自研芯片+多元采购"将成为云厂商的标准策略。