AWS与NVIDIA扩大合作将新增200万颗GPU,Blackwell Ultra和Rubin全面上线
Amazon Web Services(AWS)与NVIDIA于8月26日联合宣布大幅扩展双方战略合作,以应对全球AI基础设施需求的持续加速增长。根据协议,AWS计划在2027至2028年间,于其全球基础设施中新增部署200万颗NVIDIA GPU,涵盖Blackwell Ultra、Rubin与Rubin Ultra三代产品线。
从100万到300万:GPU部署规模再度加码
今年3月的NVIDIA GTC 2026大会上,AWS已宣布从2026年起新增超过100万颗NVIDIA GPU。然而,随后数月的客户需求远超预期。AWS CEO Matt Garman表示,客户希望自由选择最适合其AI工作负载的工具,并确保所有技术之间能无缝协作。NVIDIA创始人兼CEO黄仁勳也指出,NVIDIA与AWS共同打造了AI时代最强劲的增长引擎之一,市场需求已远超所有预测。
此次追加200万颗GPU后,AWS在2026至2028年间新增的NVIDIA GPU总量将达到约300万颗,规模在全球云服务商中处于领先水平。
EC2 G7实例首发RTX PRO 4500:推理性能提升4.6倍
作为合作扩展的一部分,AWS将在Amazon EC2 G7实例中配备NVIDIA RTX PRO 4500 Blackwell服务器版GPU。根据官方数据,G7实例的AI推理性能较上一代G6实例提升4.6倍,图形性能提升2.1倍。AWS也因此成为首家提供RTX PRO 4500加速计算实例的主要云服务商。
这一升级意味着,依赖GPU云实例进行模型推理、图像处理或实时渲染的企业客户,将在相同预算下获得显著更高的计算吞吐量。
合作范围深入全栈:CPU、网络、开放模型、机器人
此次合作不仅限于GPU供应,还延伸至CPU、高速网络、开放模型、数据处理和机器人技术等多个层面:
AWS将引入基于NVIDIA Vera CPU的下一代AI工厂实例,并计划导入NVIDIA Spectrum-X以太网网络技术,以优化跨GPU集群的大规模AI训练工作负载的网络性能。在软件层面,双方将在Amazon Bedrock和SageMaker上深度集成NVIDIA NeMo开放模型框架,并通过Amazon Robotics采用NVIDIA物理AI平台,加速仓储自动化。
此外,Amazon旗下自研芯片部门Annapurna Labs将与NVIDIA合作,使Amazon Trainium芯片支持NVLink Fusion高速互连和NVHBM定制高带宽内存技术,实现Trainium与GPU在统一机架架构中的无缝集成。
对服务器租用市场的影响
大规模GPU部署扩张释放了一个明确信号:AI算力的供需缺口仍在扩大,短期内GPU实例价格不太可能大幅下降。对于需要GPU服务器资源的企业而言,除了关注AWS等超大规模云平台的GPU实例可用性外,也可考虑独立部署或混合部署策略,根据训练与推理等不同场景灵活配置资源。
声明:本文由SellBGP编辑部依据AWS与NVIDIA官方公告及公开渠道信息独立撰写。转载请注明出处。