AWS与英伟达扩大AI合作 新增部署200万颗GPU
2026年8月27日消息,亚马逊云服务(AWS)与英伟达(NVIDIA)宣布扩大长期AI基础设施合作,计划于2027年和2028年在AWS数据中心部署额外200万颗NVIDIA GPU。该协议还拓展了双方在CPU、网络、开放AI模型、数据处理及机器人领域的合作。
此次部署的规模凸显出,随着AI进入生产环节,半导体供应链和数据中心基础设施仍将持续承压。同时,这也反映出云服务提供商正如何组合商用GPU、定制芯片、高带宽内存与先进互连技术,以构建更大规模的AI系统。
200万颗新增GPU
AWS表示,新增算力将包含部署在全球基础设施及AI工厂中的NVIDIA Blackwell Ultra、Rubin和Rubin Ultra GPU。这200万颗GPU是在GTC 2026大会上已公布的从今年开始新增超过100万颗NVIDIA GPU计划之外的追加部分。
此外,AWS还将通过面向Amazon EC2 G7实例的NVIDIA RTX PRO 4500 Blackwell Server Edition GPU,扩展基于Blackwell的算力。据AWS称,G7实例的AI推理性能是上一代G6实例的4.6倍,图形性能则是其2.1倍。
AWS首席执行官Matt Garman表示:“客户希望为自己的AI工作负载自由选择最佳工具,并希望一切都能无缝协同工作。这正是我们与英伟达深度投资的原因,旨在让AWS成为运行英伟达AI技术的最佳场所,从网络、安全到部署,优化我们整个基础设施的性能。此次扩展合作将为前沿实验室、企业和政府提供更多在AWS上构建和部署AI的方式。”
Vera CPU与NVLink Fusion
两家公司还计划将基于NVIDIA Vera CPU的基础设施引入AWS,用于在加速器之外还需要高性能CPU资源的agentic AI(智能体AI)工作负载。
双方围绕NVIDIA NVLink Fusion的合作也在深化。亚马逊旗下Annapurna Labs计划在未来的Trainium芯片上采用NVIDIA新推出的定制高带宽内存(NVHBM)技术。这一方案旨在将Trainium加速器与NVIDIA GPU集成到统一的机架级架构中。
此外,AWS与英伟达还计划为美国政府建设AI工厂,其中包括包含10万颗GPU的基础设施,用于联邦和国家安全工作负载。
数据处理与机器人
除计算硬件外,NVIDIA Nemotron开放模型将继续通过Amazon Bedrock和SageMaker提供。AWS与英伟达还正在将NVIDIA cuDF与Amazon EMR、NVIDIA cuVS与Amazon OpenSearch进行集成,以加速数据处理和向量索引。
Physical AI(物理AI)是另一个重点。Amazon Robotics正在采用NVIDIA Jetson、Omniverse和Isaac机器人平台等技术,用于仿真、合成数据生成、机器人训练与验证。
NVIDIA创始人兼首席执行官黄仁勋(Jensen Huang)表示:“NVIDIA与AWS共同打造了AI时代最强大的增长引擎之一,需求已超出所有预测。16年来,我们携手在云端扩展NVIDIA计算。现在,我们正将合作扩展到全栈——GPU、CPU、网络、开放模型和软件——以空前的速度和规模实现agentic AI和物理AI,而这只有AWS和NVIDIA联合才能做到。此次扩展反映了客户对AWS上NVIDIA平台的需求。”












