AWS再部署200万块英伟达GPU 合作扩至CPU与内存
2026年8月26日,就在英伟达发布创纪录财报的同一天,AWS与英伟达联合宣布大幅扩大战略合作:AWS计划于2027至2028年在其全球基础设施中额外部署200万块英伟达GPU,覆盖Blackwell Ultra、Rubin与Rubin Ultra三代平台。加上此前承诺,英伟达今年在AWS全球基础设施中引入的GPU总量将超过300万块。
需求跑赢计划:从100万块到300万块
在今年早些时候的GTC 2026大会上,AWS曾宣布自2026年起新增超100万块英伟达GPU。双方表示,客户需求此后持续超出预期,才有了本次追加200万块的决定。新增算力将支撑智能体AI(Agentic AI)、科学计算、企业自动化及物理AI等负载。
不止GPU:CPU、内存、网络全栈打通
本次合作的看点在于"全栈化":
- Vera CPU登陆AWS:英伟达面向AI工厂负载的Vera CPU将进入AWS,承担代码执行、工具调用、数据管道等智能体AI的CPU侧工作;
- Trainium拥抱英伟达生态:AWS自研Trainium下一代芯片将支持NVLink Fusion高速互联,并采用英伟达定制高带宽内存NVHBM。据外媒披露的技术细节,NVHBM将内存控制器移入HBM基底裸片,带宽较标准HBM4E最高提升约30%,功耗更低,还可为计算逻辑腾出更多芯片面积;
- 联邦AI工厂:双方将为美国联邦机构在符合IL-6及以上安全等级的AWS基础设施上建设至少10万块GPU规模的专用AI工厂;
- EC2 G7实例将引入RTX PRO 4500 Blackwell服务器版GPU,机器人领域也将展开Jetson、Isaac平台协作。
行业影响
公有云GPU供给将进一步向头部集中,同时也印证:即便是自研芯片投入最大的云厂商,短期内也无法摆脱对英伟达平台的依赖。多云时代,"哪里有卡去哪里"仍是AI企业的现实选择。
超大规模云商的GPU扩容主要服务于大客户长约,中小企业在公有云上依旧面临排队与高价。SellBGP 的 香港GPU服务器 与 香港云服务器 支持独享资源、按月灵活租用,CN2 GIA回国线路低时延,适合AI应用出海与推理部署。
声明:本文由SellBGP编辑部依据公开渠道信息独立撰写。转载请注明出处。