Meta 押注亞馬遜 Graviton5 晶片,為代理式AI時代提供動力

新聞摘要
Meta 與亞馬遜簽署數十億美元協議,以 Graviton5 晶片為代理式 AI 提供動力
2026 年 4 月 24 日(美國東部時間),Meta 宣布與亞馬遜網路服務 (AWS) 達成一項具有里程碑意義的多年期數十億美元協議,將在 AWS 資料中心部署數千萬個亞馬遜的 Graviton5 ARM CPU 核心。這項合作使 Meta 成為全球最大的 Graviton 客戶之一,並標誌著為下一代人工智慧提供動力的基礎設施演進中的一個重要里程碑。
正在建構什麼以及為何重要
雖然圖形處理單元 (GPU) 長久以來一直是訓練大型 AI 模型的主力,但一種新型的 AI 工作負載正在迅速興起:代理式 AI。這些系統能夠即時推理、生成程式碼、執行搜尋以及自主協調複雜的多步驟任務。這類工作負載高度依賴 CPU 而非 GPU,需要大規模的平行處理能力以及計算節點之間的低延遲通訊。
AWS Graviton5 的設計正是為了滿足這類需求。Graviton5 採用最先進的 3 奈米晶片技術,每個晶片配備 192 個核心,快取容量是前代的五倍。這些架構上的進步將核心間通訊延遲降低高達 33%,與前一代 Graviton 相比,整體效能提升高達 25%。這些晶片還支援 Elastic Fabric Adapter (EFA),這是一種網路技術,能夠實現執行個體之間低延遲、高頻寬的通訊,這對於將大規模代理式 AI 任務分佈到數千個緊密協調的處理器至關重要。
Meta 的策略性基礎設施推動
作為其轉向 AI 優先產品和服務的更廣泛策略性轉變的一部分,Meta 一直在積極擴展其 AI 基礎設施。該公司已披露 2026 年的資本支出計畫將超過 1350 億美元,這凸顯了其雄心壯志的規模。這項 AWS 協議是對 Meta 現有與 Nvidia 和 AMD 合作夥伴關係的補充,擴大了其計算組合的多樣性,以匹配不同的工作負載特性。
Meta 基礎設施負責人 Santosh Janardhan 清楚地闡述了其理由:「隨著我們擴展 Meta AI 雄心的基礎設施,分散我們的計算來源是一項策略性任務。」透過將 Graviton5 與傳統 GPU 集群整合到其堆疊中,Meta 可以將 CPU 密集型的代理式工作負載路由到最有效率的可用硬體,從而降低每次推理的成本並改善終端使用者的延遲。
大部分 Graviton5 容量將部署在美國境內的 AWS 資料中心。這種國內部署的重點與 Meta 為確保其 AI 基礎設施的韌性和法規遵循所做的努力一致。
代理式 AI 作為計算驅動力的崛起
Meta-AWS 交易反映了 AI 計算的購買和部署方式的更廣泛行業轉變。第一波 AI 基礎設施支出主要由用於模型訓練的 GPU 採購所主導。目前正在進行的第二波浪潮,則聚焦於推理和代理式 AI — 這些應用程式的模型不僅僅是訓練一次,而是持續運行,處理即時請求,透過多步驟問題進行推理,並與使用者和系統動態互動。
這種轉變創造了一個更異質化的計算格局。像 Meta 這樣的公司不僅需要 GPU 農場,還需要能夠處理代理式系統協調層的高效能 CPU 容量的龐大池。基於 CPU 的雲端計算,特別是像 Graviton5 這樣強大的晶片,正在成為 AI 基礎設施規劃中的一等公民。
亞馬遜在 AI 基礎設施中日益增長的作用
對於亞馬遜網路服務而言,這項交易是對 Graviton 晶片系列作為 AI 工作負載的嚴肅競爭者的重大驗證。AWS 在客製化晶片方面投入了巨資 — 包括用於通用計算的 Graviton 系列以及用於 AI 特定任務的 Trainium/Inferentia 晶片 — 作為其提供差異化、具成本效益的雲端服務策略的一部分。
將全球最大的 AI 支出者之一 Meta 爭取為主要的 Graviton 客戶,加強了 AWS 在競爭激烈的雲端市場中的地位。這也向更廣泛的行業發出信號,表明 CPU 優化的客製化晶片在現代 AI 部署中具有明確且不斷增長的地位,不僅僅是作為 GPU 的支援角色,而是作為整個生產工作負載類別的主要計算層。
展望未來
Meta-AWS Graviton5 合作夥伴關係預計將影響其他大型 AI 開發者如何進行基礎設施規劃。隨著代理式 AI 功能的進步和生產部署的擴大,對 CPU 密集型、低延遲雲端計算的需求只會增長。這項交易為超大規模雲端服務提供商和 AI 平台公司如何大規模協作設定了先例,將客製化晶片創新與前沿 AI 系統的營運需求相結合。
兩家公司都將此次協議描述為一項長期戰略合作夥伴關係 — 這表明該合作旨在隨著技術的發展而演進,而不是服務於單一固定的部署里程碑。