为应对不断增长的人工智能系统需求,Amazon Web Services (AWS) 与 NVIDIA 扩大了战略合作。根据两家公司公布的合作计划,2027年至2028年期间,AWS全球云基础设施将新增2百万个 NVIDIA 图形处理单元(GPU)。此举将延续 AWS 此前作出的承诺,即自2026年起向其数据中心增加超过1百万个芯片。
硬件架构进入新阶段
该协议除 GPU 供应外,还包括全栈技术集成。正如我们在题为《Amazon 与 NVIDIA 扩大合作:将在 AWS 基础设施中部署3百万个 GPU》的报道中所述,相关系统将采用 NVIDIA 的 Blackwell Ultra、Rubin 和 Rubin Ultra 架构。两家公司还计划将 NVIDIA 基于 Vera 的新型处理器(CPU)引入 AWS 云,以支持先进的人工智能应用。
为提升大型计算集群的性能,基础设施还将加入扩展版 NVLink Fusion 网络更新,并配合专用的高带宽内存技术运行。
数据处理性能提升
基础设施方面的创新也将体现在软件和数据分析服务中。通过在 Amazon 的分析服务中使用 NVIDIA 的 cuDF 软件,目标是使处理速度较标准配置提高至多3.7倍。预计与仅依赖标准处理器的系统相比,这一提升将使性价比改善约30%。在搜索服务的向量搜索功能中,基于 GPU 执行的索引创建操作完成速度则快约9倍。
政府与机器人领域的合作
该项目还包括一项专门用于满足美国政府机构和国防部门敏感计算需求的专项容量。为支持全国范围内的关键国家安全工作负载,将在安全的 AWS 基础设施上建设容量达100千个 GPU 的人工智能设施。
Amazon 的机器人部门也正与 NVIDIA 就仿真工具开展合作,以加快新一代仓储机器人的训练。
据称,最新的硬件更新可提供最高达上一代系统4.6倍的推理(inference)速度,以及2.1倍更强的图形输出。相关方面强调,巨额投资表明,行业人工智能支出的增长势头将会持续。