关注我们: 微信公众号

扫码关注我们

AWS 狂扩 AI 算力:再上 200 万块英伟达 GPU

AI头条 2026-08-27 19

2026 年 8 月 27 日,AWS 与 NVIDIA 宣布进一步扩大双方 AI 基础设施合作,AWS 计划在 2027 年至 2028 年期间,在全球基础设施中新增部署 200 万块 NVIDIA GPU,覆盖 Blackwell Ultra、Rubin 和 Rubin Ultra 等架构,用于智能体 AI、科学计算、企业自动化及物理 AI 等工作负载。

3.png

此次扩容规模较双方今年 3 月公布的计划进一步大幅提升。

NVIDIA GTC 2026 期间,AWS 曾宣布从 2026 年开始新增部署超过 100 万块 NVIDIA GPU。

AWS 与 NVIDIA 此次表示,客户需求超出此前预期,因此决定在 2027-2028 年继续增加 200 万块 GPU。

除 GPU 外,双方此次合作还进一步延伸至 CPU、网络、内存、模型和机器人等环节。

AWS 将引入 NVIDIA Vera CPU 基础设施,并继续扩大 Blackwell GPU 部署,包括在 Amazon EC2 G7 实例中采用 NVIDIA RTX PRO 4500 Blackwell Server Edition GPU。

AWS 称,G7 实例的 AI 推理性能较上一代 G6 提升至 4.6 倍,图形性能达到 2.1 倍。 

AWS 还将与 NVIDIA 推进 NVLink Fusion 与 NVIDIA 新型定制高带宽内存 NVHBM 的结合。AWS 旗下 Annapurna Labs 此前已经计划在下一代 Trainium 芯片中支持 NVLink Fusion,此次合作进一步允许 Trainium 接入 NVIDIA 的高带宽内存及扩展架构,在同一机架级体系中整合 AWS 自研 AI 芯片与 NVIDIA GPU。

双方同时计划为美国政府建设 AI Factory,其中包括在 AWS 安全基础设施上部署 10 万块 NVIDIA GPU,服务于美国联邦政府和国家安全工作负载,包括 Impact Level 6(IL6)及更高安全级别的应用。 

软件层面,NVIDIA Nemotron 开放模型将继续通过 Amazon Bedrock 和 Amazon SageMaker 提供。AWS 与 NVIDIA 还将在 Amazon EMR 中引入 NVIDIA cuDF,对数据处理进行 GPU 加速。

双方披露,与 CPU 配置相比,该方案最高可将处理速度提升至 3.7 倍,价格性能提高 30%;Amazon OpenSearch 的 GPU 向量索引速度最高提升至 9 倍,成本降至原来的约四分之一。 

物理 AI 也成为此次合作的一部分。

Amazon Robotics 正采用 NVIDIA Jetson、Omniverse 和 Isaac 等平台,用于机器人仿真、合成数据生成、训练、路径优化和验证,进一步推进亚马逊仓储自动化及下一代机器人研发。

AWS CEO Matt Garman 表示,AWS 已经与 NVIDIA 在网络、安全和部署等基础设施环节进行了深度优化,此次扩大合作将让前沿 AI 实验室、企业和政府获得更多在 AWS 上开发及部署 AI 的方式。

NVIDIA CEO 黄仁勋则表示,双方已经合作 16 年,目前 AI 算力需求“超过了每一次预测”。此次扩展将合作范围从 GPU 延伸至 CPU、网络、开放模型和软件整个技术栈。 

云头条声明:如以上内容有误或侵犯到你公司、机构、单位或个人权益,请联系我们说明理由,我们会配合,无条件删除处理。

关键词:

网友留言2

未查询到任何数据!
◎欢迎您留言咨询,请在这里提交您想咨询的内容。