Meta 押注亚马逊 Graviton5 芯片,赋能具身智能AI时代

新闻摘要
Meta 与亚马逊签署数十亿美元协议,利用 Graviton5 芯片赋能 Agentic AI
2026 年 4 月 24 日(美国东部时间),Meta 宣布与亚马逊网络服务(AWS)达成一项具有里程碑意义的、为期多年、价值数十亿美元的协议,将在 AWS 数据中心部署数千万个亚马逊的 Graviton5 ARM CPU 核心。此次合作使 Meta 成为全球最大的 Graviton 客户之一,标志着驱动下一代人工智能的基础设施演进迈出了重要一步。
构建什么以及为何重要
虽然图形处理单元(GPU)长期以来一直是训练大型 AI 模型的主力,但一种新的 AI 工作负载类别正在迅速兴起:Agentic AI。这些系统能够实时推理、生成代码、执行搜索以及自主协调复杂的、多步骤的任务。这类工作负载高度依赖 CPU 而非 GPU,需要大规模并行处理能力以及计算节点之间低延迟的通信。
AWS Graviton5 正是为满足此类需求而设计的。Graviton5 基于尖端的 3 纳米芯片技术,每个芯片拥有 192 个核心,缓存容量是其前代产品的五倍。这些架构上的进步将核心间通信延迟最多降低 33%,与上一代 Graviton 相比,整体性能最多提升 25%。这些芯片还支持弹性网络适配器(EFA),这是一种网络技术,可实现实例之间低延迟、高带宽的通信——这对于将大规模 Agentic AI 任务分布到数千个紧密协调的处理器至关重要。
Meta 的战略基础设施推进
作为向 AI 优先产品和服务进行更广泛战略转型的一部分,Meta 一直在积极扩展其 AI 基础设施。该公司已披露 2026 年的资本支出计划超过 1350 亿美元,凸显了其雄心壮志。此次与 AWS 的协议是对 Meta 与英伟达和 AMD 现有合作关系的补充,扩大了其计算组合的多样性,以匹配不同的工作负载特征。
Meta 基础设施负责人 Santosh Janardhan 清楚地阐述了其理由:“随着我们扩展 Meta AI 雄心背后的基础设施,多元化我们的计算来源是战略上的必然要求。”通过将 Graviton5 与传统的 GPU 集群一起集成到其技术栈中,Meta 可以将 CPU 密集型的 Agentic 工作负载路由到最有效的可用硬件,从而降低每次推理的成本并提高最终用户的延迟。
大部分 Graviton5 容量将部署在美国境内的 AWS 数据中心。这种国内部署的重点与 Meta 为确保其 AI 基础设施的韧性和合规性所做的努力相一致。
Agentic AI 作为计算驱动因素的崛起
Meta 与 AWS 的交易反映了 AI 计算的购买和部署方式的更广泛行业转变。第一波 AI 基础设施支出主要集中在用于模型训练的 GPU 采购。而目前正在进行的第二波浪潮,则围绕着推理和 Agentic AI——这些应用中的模型不仅仅是训练一次,而是持续运行,处理实时请求,通过多步问题进行推理,并与用户和系统动态交互。
这种转变创造了一个更加异构的计算格局。像 Meta 这样的公司不仅需要 GPU 集群,还需要能够处理 Agentic 系统编排层的高性能 CPU 容量的庞大池。基于 CPU 的云计算,特别是拥有像 Graviton5 这样强大的芯片,正在成为 AI 基础设施规划中的一等公民。
亚马逊在 AI 基础设施中日益增长的作用
对于亚马逊网络服务而言,这项交易是对 Graviton 芯片系列作为 AI 工作负载领域重要竞争者的重大肯定。AWS 在定制芯片方面进行了大量投资——包括用于通用计算的 Graviton 系列以及用于特定 AI 任务的 Trainium/Inferentia 芯片——这是其提供差异化、高性价比云服务战略的一部分。
将全球最大的 AI 支出者之一 Meta 争取为主要的 Graviton 客户,增强了 AWS 在竞争激烈的云市场中的地位。这也向更广泛的行业表明,CPU 优化的定制芯片在现代 AI 部署中扮演着明确且日益增长的角色,不仅仅是作为 GPU 的支持角色,而是作为整个生产工作负载类别的主要计算层。
前瞻
Meta 与 AWS 的 Graviton5 合作伙伴关系预计将影响其他大型 AI 开发商的基础设施规划方式。随着 Agentic AI 功能的进步和生产部署的规模化,对 CPU 密集型、低延迟云计算的需求只会增长。这项交易为超大规模云服务提供商和 AI 平台公司如何大规模协作设定了先例,将定制芯片创新与前沿 AI 系统的运营需求相结合。
两家公司都将此次协议描述为一项长期战略合作伙伴关系——这表明此次合作旨在随着技术的发展而演进,而不是服务于单一固定的部署里程碑。