亞馬遜 AWS 宣佈 2027~2028 年額外部署 200 萬塊 NVIDIA GPU

2026年8月27日 09:36
亞馬遜 AWS 宣佈 2027~2028 年額外部署 200 萬塊 NVIDIA GPU
站內 AI 整理稿

亞馬遜雲端服務(Amazon Web Services,簡稱 AWS)於 8 月 27 日與 NVIDIA 共同發佈聯合新聞稿,正式宣佈一項規模龐大的基礎設施擴建計畫。根據這項最新規劃,AWS 將在 2027 年至 2028 年期間,於其全球資料中心基礎設施中額外部署 200 萬塊 NVIDIA GPU,這項決定也讓 AWS 的 GPU 部署總量達到前所未有的高度。回顧今年 3 月舉行的 GTC 2026 大會,AWS 當時已經公開承諾將部署 100 萬塊 NVIDIA GPU,作為其人工智慧運算基礎建設的重要一環。

如今隨著新公告的釋出,等於是在原本的百萬規模之上再追加兩倍數量,使得總部署規模一舉攀升至 300 萬塊。這項擴張動作不僅反映出雲端服務供應商對 AI 運算需求的強烈信心,也顯示出 AWS 與 NVIDIA 之間的合作關係正持續深化。除了 GPU 數量的巨幅提升之外,這份聯合新聞稿中還揭露了多項技術合作細節。AWS 預計將導入 NVIDIA 的 Groq LPU(Language Processing Unit),這項技術的加入有望為特定類型的人工智慧工作負載提供更多元的運算選擇,進一步強化 AWS 在生成式 AI 與大型語言模型服務上的效能表現。

在運算基礎設施方面,AWS 也計劃在其自有雲端服務中,提供基於 NVIDIA Vera CPU 所打造的基礎設施。這意味著 AWS 的雲端環境將不再僅限於 GPU 加速運算,而是進一步延伸至 CPU 層級的整合,讓客戶在 AWS 上運行高效能運算工作負載時,能夠獲得更完整的硬體支援。此外,雙方也將把 AWS 自行開發的晶片與 NVIDIA 的 NVLink Fusion 及 NVHBM 技術進行整合。

NVLink 作為 NVIDIA 高速互連技術的關鍵環節,向來在高階運算叢集中扮演重要角色,而這項整合計畫也顯示出 AWS 與 NVIDIA 正試圖在系統架構層級打造更緊密的軟硬體協同設計,以應對日益複雜的 AI 模型訓練與推論需求。除了硬體層面的合作,AWS 與 NVIDIA 的合作觸角也延伸至人工智慧的多元應用場景。根據新聞稿內容,雙方在工廠自動化、網路互連技術、模型最佳化以及物理模擬等領域,都存在既有的合作關係。這些合作項目顯示出,兩家公司在 AI 技術的落地應用上,正從單純的雲端運算資源供應,逐步擴展至產業層級的解決方案共創。從產業角度來看,這項部署計畫的規模堪稱罕見。

300 萬塊 NVIDIA GPU 的總量,意味著 AWS 將在未來數年內持續大規模擴建其全球資料中心,以容納這批運算資源。對於依賴雲端 AI 服務的企業客戶而言,這項投資也傳達出一個明確訊號:AWS 正積極確保其基礎設施能夠滿足下一波人工智慧應用的爆發性成長。值得注意的是,這項消息發布的時間點,正值各大雲端服務供應商與 AI 晶片大廠之間競合關係日益緊密的時期。AWS 一方面持續導入 NVIDIA 的頂尖 GPU 產品,另一方面也未曾停止自有晶片的研發與部署,這種雙軌並進的策略,讓 AWS 在維持高效能 AI 運算服務的同時,也能保有硬體供應鏈上的彈性與自主性。

整體而言,這份聯合新聞稿所揭露的內容,不僅僅是一次單純的採購規模擴張,更勾勒出 AWS 與 NVIDIA 在技術架構、晶片整合、產業應用等多個層面的深度合作藍圖。隨著 2027 年至 2028 年的部署時程逐步推進,外界也將密切關注這批 GPU 資源如何實際落地,以及其對全球 AI 雲端服務市場格局所帶來的影響。

Related

相關文章

存力躍遷,AI破局,2026全球閃存峰會閃耀江城

2026全球閃存峰會在武漢登場,以「存力躍遷,AI破局」為主題,匯聚全球存儲產業專家,聚焦AI時代下存儲技術與產業變革。與會者認為,高頻寬、低延遲、大容量的存儲系統是支撐AI應用的關鍵,廠商也展示更高密度、更低功耗的閃存解決方案。峰會選在武漢舉辦,凸顯其作為中國存儲產業重鎮的地位,並釋出AI與存儲深度融合將成為半導體產業重要趨勢的訊號。

剛剛
鈦媒體AI硬體

OpenAI自研芯片將擊穿英偉達CUDA護城河?

Kimi K2.5等主流第三方開源模型,表現同樣不輸GB200。報告還強調,OpenAI並未過度聚焦模型推理的某個特定部分,而是致力於打造一款能在所有場景下提供高性能的通用推理芯片。SemiAnalysis還認為,Jalapeño甚至不該與Blackwell“同臺競技”,而應該直接PK英偉達還未批量交付的Rubin。

剛剛

OpenAI 芯片實測跑分揭曉,「為模型造芯片」時代來了

OpenAI 自研芯片的實測跑分數據正式曝光,外界得以首次窺見這家 AI 巨頭在硬體領域的布局成果。這款備受矚目的晶片並非單純追求通用算力的極限,而是針對大型語言模型的推理與訓練特性進行深度調校,其性能表現也讓「為模型造芯片」的產業趨勢從概念走向現實。 從目前揭露的跑分結果來看,OpenAI 的晶片在特定 AI 工作負載下的表現相當突出,尤其是在處理長序列文本與複雜推理任務時,展現出優於傳統通用 GPU 的效率。

剛剛

AI 開始給自己造芯了,從零到生產 OpenAI 只用了九個月

OpenAI 透露從零設計晶片到實際生產僅花九個月,遠快於業界常見的數年開發週期,顯示 AI 公司開始將硬體主導權收回自己手中。自研晶片能針對自家模型架構深度優化,並降低對少數供應商的依賴。此舉為產業立下新的速度標竿,未來可能帶動更多 AI 公司跟進自研晶片。

剛剛

OpenAI 自研「辣椒芯片」首測超英偉達,會讓 ChatGPT 更便宜嗎?

OpenAI 自研代號「辣椒」的 AI 晶片在首次性能測試中超越英偉達同級產品,被視為硬體自主化的關鍵進展。外界關注這款晶片能否量產並導入自家服務,以降低基礎設施支出、調降 ChatGPT 訂閱費率。不過官方尚未公布具體規格與量產時程,後續發展仍待觀察。

8 小時前

用 Astra+Codex 幹掉 CUDA,奧特曼9個月AI造芯反殺英偉達 GB300

OpenAI 執行長奧特曼(Sam Altman)近來主導的一項內部計畫,正悄悄改寫半導體產業的遊戲規則。據了解,OpenAI 團隊僅花費約九個月的時間,就完成了一款以人工智慧為核心設計邏輯的客製化晶片,並計畫透過自家開發的 Astra 與 Codex 兩套系統,直接挑戰 NVIDIA 長期以來靠 CUDA 軟體生態建立的護城河。這款晶片被外界視為劍指 NVIDIA 下一代旗艦產品 GB300 的戰略武器,也讓「AI 反殺 AI 晶片霸主」的戲碼正式登上檯面。

11 小時前