曝 Meta 定製版 AMD MI450 架構 GPU 僅具備 1/2 計算單元和 1/3 顯存容量

重點摘要
首頁 > 數碼之家>電腦硬件 曝 Meta 定製版 AMD MI450 架構 GPU 僅具備 1/2 計算單元和 1/3 顯存容量 2026/7/22 11:44:04 來源:IT之家 作者:溯波(實習) 責編:溯波 評論: IT之家 7 月 22 日消息,研究機構 SemiAnalysis 北京時間 22 日表示,Meta 獲得的基於 MI450 架構的定。
Meta 在客製化 GPU 領域的最新布局再度引發業界關注。根據研究機構 SemiAnalysis 於 7 月 22 日發布的分析報告,Meta 所取得的基於 AMD MI450 架構的定製版 Instinct 加速器,在設計上與標準產品存在顯著差異,最引人注目的在於計算單元與記憶體容量的大幅縮減。據了解,AMD 標準款的 Instinct MI455 加速器配備了 8 個基於台積電 N2 製程打造的運算晶片,並搭配 12 個 12-Hi 36GB HBM4 記憶體堆疊,總記憶體容量高達 432GB。
然而,Meta 的定製版本則僅採用 4 個運算晶片,記憶體也縮減為 6 個 8-Hi 24GB HBM4 堆疊。這意味著與標準版相比,Meta 定製版的運算單元數量僅為一半,記憶體容量更只有三分之一。SemiAnalysis 在報告中指出,Meta 之所以選擇這樣的設計,並非單純為了降低成本,而是有其特定的應用場景考量。該定製版本的核心目標在於提升機架級系統中 CPU 與 GPU 的算力比例,進而改善記憶體頻寬的性價比。透過降低 GPU 的運算密度與記憶體容量,可以讓整體系統在處理 Meta 慣用的 RecSys 推薦系統時,獲得更好的運算效能與資源配置效率。
RecSys 推薦系統是 Meta 旗下 Facebook、Instagram 等平台內容排序與廣告投放的核心技術,這類工作負載對於大量並行浮點運算的需求相對較低,但對於記憶體頻寬與延遲卻有極高的敏感度。因此,Meta 選擇犧牲部分運算單元與總記憶體容量,換取更平衡的 CPU 與 GPU 協同運作,從而在特定應用場景中達到最佳化。不過,SemiAnalysis 也強調,這樣的設計雖然在推薦系統上表現優異,但對於當前主流的 LLM 大型語言模型訓練與推理工作負載而言,卻可能產生不利影響。
大型語言模型通常需要極高的運算密度與大量記憶體來容納模型參數與中間結果,Meta 定製版 GPU 僅具備一半的運算單元與三分之一的記憶體,將難以滿足 Llama 系列或其他大型模型的訓練需求,甚至可能無法有效執行推理任務。這項發現也反映出大型科技公司在硬體採購與客製化上的策略分化。不同於微軟、Google 等企業積極投入自研晶片或採用高規格 GPU 來應對廣泛的 AI 工作負載,Meta 顯然更傾向於針對其核心業務進行深度優化。透過與 AMD 合作,Meta 能夠獲得符合自身特定需求的客製化加速器,從而在推薦系統等關鍵應用上取得競爭優勢。
值得注意的是,AMD 的 MI450 架構本身是針對資料中心與 AI 運算所設計的高效能架構,而 MI455 標準版更是在記憶體頻寬與運算能力上達到頂尖水準。Meta 的定製版本雖然在規格上看似縮水,但實際上代表了硬體設計與軟體演算法之間的高度協同。未來若 Meta 在 LLM 領域有更進一步的部署需求,也可能會回頭採用標準版或更高階的加速器。目前 Meta 並未對這份報告公開回應,但 SemiAnalysis 的資訊來源通常來自供應鏈與工程團隊的內部消息,具有一定的可信度。
隨著 AI 晶片市場競爭日益激烈,AMD 與 NVIDIA 在客製化領域的角力也將持續升溫,而 Meta 作為全球最大的 GPU 採購方之一,其選擇往往會影響整個產業的發展方向。整體而言,Meta 定製版 AMD MI450 架構 GPU 的出現,不僅展示了硬體設計如何因應特定軟體需求而進行調整,也凸顯了推薦系統與 LLM 在運算資源配置上的根本差異。對於關注資料中心硬體發展的讀者而言,這項消息無疑提供了重要的觀察視角。
Related
相關文章

OpenAI首款AI硬件,為什麼是個沒有屏幕的「甜甜圈」
OpenAI與Jony Ive團隊合作的首款AI硬體,外型類似無螢幕的冰球大小圓環,被形容為金屬甜甜圈。這款設備定位為以AI為第一交互入口的計算設備,而非傳統智能音箱,售價可能落在300至400美元之間。
OpenAI 首款硬件真容浮現:冰球大小無屏設計,售價 300 至 400 美元
OpenAI首款硬件產品細節曝光,為一款無螢幕的智能音箱,外型類似冰球,售價約300至400美元,由OpenAI與前蘋果設計師Jony Ive的LoveFrom公司合作開發。該設備內建電池與攝影鏡頭,可支援手持使用並將視覺資訊傳給ChatGPT,實現多模態感知。此產品推出時正值蘋果對OpenAI提起商業機密訴訟,OpenAI內部評估其設計細節有望反駁侵權指控。

消息稱英偉達急尋中國 AI 基站供應商,與“下一個中際旭創”合作開發 6G 基站
NVIDIA正積極在中國尋找AI基站供應商,並有意與被視為「下一個中際旭創」的業者合作開發6G基站,顯示其從資料中心延伸至通訊基礎設施的布局。此舉凸顯NVIDIA對6G市場的重視,AI基站被視為整合邊緣運算與智慧調度的關鍵節點,但合作細節與技術方案尚未正式公布。
金剛GC3芯片重新定義視頻AI算力規則,國產RISC-V高端算力商業化提速
近日,第三屆中國計算機學會芯片大會(CCF Chip 2026)在太湖之濱無錫成功舉辦。會場中,兩院院士與頂尖工程師們的討論話題直指底層架構的“根技術”創新。一個核心追問被反覆推至臺前:當摩爾定律逼近物理極限,製程紅利日益稀薄,堆核心、拼頻率的老路越走越窄,是否該徹底換一條路走?換言之,與其在通用架構上不斷打補丁,能否從數據流動的本質出發,為特定場景原生設計一顆芯片?
把512 GiB閃存搬到xPU旁邊,HBF能打破推理內存牆?
HBM已經證明,通過堆疊和共封裝把存儲介質遷移至GPU附近,可以緩解AI計算中的數據搬運瓶頸。現在,SK海力士聯合閃迪,將類似的思路正式應用到NAND上,通過HBF將大容量閃存放到包括GPU在內的各類xPU旁,以緩解AI推理內存牆問題。近日,雙方通過OCP發佈《High Bandwidth Flash(HBF)High-Level Base Die Specification, Version 0.7.0》。

AI的錢,被誰賺走了?
AI 浪潮推動雲端服務供應商大舉擴建資料中心,背後龐大的資本支出正沿著供應鏈層層傳導,最終流向光模塊、晶片與伺服器業者。這條資金鏈路的起點是亞馬遜 AWS、微軟 Azure、Google Cloud 等雲端廠商,他們為了滿足訓練與推論大語言模型所需的算力,持續加碼採購 GPU 伺服器與高速網路設備,帶動上游零組件需求爆發。