英偉達正在完成“五層蛋糕”閉環

重點摘要
英偉達正在完成「五層蛋糕」閉環,從GPU巨頭升級為AI工廠的總架構師。黃仁勳在2026年GTC臺北上提出一個關鍵等式:「Compute equals revenue」(算力等於收入),意味著AI公司、雲端廠商和企業客戶購買的不再只是硬體,而是未來能持續產生收益的智慧產能。如今英偉達不再只是一家晶片公司,更像一座大型Token工廠的總包商,而黃仁勳的目標是擔任確保一切順利運轉的工廠總架構師。
英偉達正在完成「五層蛋糕」閉環,從GPU巨頭升級為AI工廠的總架構師。黃仁勳在2026年GTC臺北上提出一個關鍵等式:「Compute equals revenue」(算力等於收入),意味著AI公司、雲端廠商和企業客戶購買的不再只是硬體,而是未來能持續產生收益的智慧產能。如今英偉達不再只是一家晶片公司,更像一座大型Token工廠的總包商,而黃仁勳的目標是擔任確保一切順利運轉的工廠總架構師。他提出的「五層蛋糕」理論,從能源、晶片、基礎設施、模型到應用,每一層都被重新定義為Token生產系統的一環,透過層層相乘的效應,讓競爭對手難以追趕。能源層被視為AI工廠的起點。
黃仁勳認為,未來的AI工廠競爭本質上是「每度電能產出多少智慧」的競爭,並提出「Token工廠經濟學」,以「Token per Watt」(每瓦特Token產出)作為核心衡量指標。英偉達的Vera Rubin高性能運算平臺每瓦性能提升10倍,每Token成本降至十分之一。為了確保能源供應穩定,英偉達旗下的風險投資部門NVentures首次涉足能源領域,參與TerraPower的6.5億美元融資,並投資Commonwealth Fusion Systems(CFS)等前沿清潔能源公司。此外,英偉達也投資了Emerald AI、Utilidata等圍繞資料中心用電優化的企業。
2025年8月,英偉達官網更新800V直流電源架構合作伙伴名錄,中國企業英諾賽科和麥格米特入選。透過能源端的投資與供應鏈綁定,英偉達保障了五層蛋糕最底層的供給穩定性。晶片層是英偉達極致協同設計的體現。Vera Rubin平臺整合了Vera CPU、Rubin GPU、NVLink 6交換機、ConnectX-9 SuperNIC、BlueField-4 DPU、Spectrum-6乙太網路交換機以及Groq 3 LPU。Vera CPU是英偉達首款專為智慧體AI設計的CPU,搭載88個Olympus核心,具備空間多執行緒技術與1.
2TB/s的LPDDR5X記憶體子系統,在智慧體工作負載中執行速度比x86 CPU快1.8倍。透過NVLink-C2C互連技術,Vera CPU與GPU之間提供高達1.8TB/s的相干頻寬,約為PCIe Gen 6頻寬的七倍。NVLink 6提供每個GPU 3.6TB/s的頻寬,每個Vera Rubin NVL72機架可達260TB/s。Spectrum-X是全球首款量產的乙太網路矽光交換機平臺,採用共封裝光學(CPO)技術降低功耗並提升AI生產力。ConnectX-9 SuperNIC提供高達1.6Tb/s的吞吐量與超低延遲800Gb/s網路。
BlueField-4 DPU則用於構建BlueField-4 STX儲存架構,並整合全新的CMX上下文記憶儲存平臺,將KV Cache視為AI原生資料類型,實現高頻寬共享。相較於AMD的分離架構或Google、AWS、微軟的自研晶片,英偉達透過緊耦合設計讓客戶難以替換單一元件,因為替換後的Token生產效率會大幅下降。基礎設施層是黃仁勳將晶片運轉為「AI工廠」的關鍵。英偉達推動客戶從「購買伺服器」轉向「建設AI工廠」,並定義了AI工廠的標準,包含Vera Rubin DSX AI Factory參考設計與NVIDIA Dynamo推理框架。
DSX參考設計涵蓋運算、Spectrum-X乙太網路與儲存,並提供電力、冷卻與控制系統的最佳實踐,讓客戶能實現可重複、可擴展的集群部署。Dynamo則是一個開源、低延遲、模組化的推理框架,能在大型GPU集群上無縫擴展推理工作負載,提供智慧資源調度、請求路由與優化的記憶體管理。透過這些基礎設施標準,英偉達希望未來所有AI工廠都採用其設計邏輯,長期鎖定晶片產品。模型層方面,英偉達積極佈局自研模型家族,以證明自家硬體能以更低的Token成本運行。
Nemotron 3 Ultra是一個擁有5500億總參數、單次激活550億參數的混合專家模型,擅長處理長時間運行的編碼會話、跨研究來源合成以及複雜約束驗證。Cosmos是面向物理AI的世界基礎模型,Cosmos 3能讓機器人、自動駕駛車輛在訓練數據有限的情況下進行現實世界泛化。此外,英偉達在生命科學領域推出BioNeMo平台。黃仁勳並非打算成為下一個OpenAI,而是要讓客戶在「算力等於收入」的等式下,選擇英偉達的硬體來運行這些經過驗證的高效模型,凸顯全棧方案的Token per Watt優勢。應用層是五層蛋糕的最頂層,也是英偉達全棧佈局的最終變現層。
黃仁勳將Agentic AI視為當前目標,OpenClaw爆紅後,英偉達迅速推出NemoClaw企業級安全部署軟體棧,補充沙箱隔離、權限管控與規模化運維能力。同時推出Verified Agent Skills,將透明度、來源驗證與安全檢查融入智慧體能力層,幫助開發者擴展自主智慧體。物理AI方面,英偉達聯合宇樹科技、Sharpa推出基於NVIDIA Isaac GR00T平臺的開放人形機器人參考設計,預計2026年底由宇樹科技正式推出。
2026年6月22日在北京舉辦的鏈博會上,英偉達展臺也展示了中國本土化落地案例:能源層有星能玄光、能量奇點利用加速運算與數位孿生技術;晶片層提供Spectrum-X乙太網路平臺;基礎設施層由雲尖信息打造iMDC液冷集裝箱智算中心;模型層SGLang在英偉達GPU上實現DeepSeek-V4高性能推理;應用層則展出中堅智能概念人形機器人與靈睿P1工業重載機器狗等。英偉達真正的目標是將五層蛋糕一起賣出去,形成完整閉環。
Vera Rubin平臺整合CPU、GPU、網路、儲存;Dynamo作為AI工廠作業系統調度全域資源;DSX數位孿生在建造前驗證每瓦電力流向;企業的Agent Toolkit將業務邏輯全面接入英偉達生態。黃仁勳的野心不僅限於數位世界的Token工廠,從雲端智慧體到個人電腦、自動駕駛汽車、人形機器人,甚至衛星、基站與工廠設備,未來都將運行智慧體,而這些佈局的最終原料就是Token。英偉達正用Token經濟學重新定義AI商業的度量衡,用全棧協同設計讓任何替代方案在同等電力預算下難以產出同等Token。
選擇英偉達全棧方案的客戶獲得的是經過驗證、可量化的智慧產能;而選擇非全棧路線的競爭者,則將面對無休止的系統整合與優化挑戰。五層蛋糕,一層都不能少,黃仁勳的佈局已遠超晶片與數據中心,正在構建五位一體的技術與商業邏輯。
Related
相關文章

Meta 旗下 AI 模型測試時意外入侵第三方企業系統
Meta 在進行AI模型安全測試時,因第三方公司Irregular配置錯誤,導致模型意外入侵另一企業系統。涉事模型為Muse Spark 1.1,事件引發對AI模型可能衝出邊界、發動網絡攻擊的擔憂。

拆解“AI辦公入口戰”底層:怎麼做才能成為最終贏家?
字節、阿里、騰訊等大廠正透過組織調整與產品整合,全力爭奪AI辦公入口,關鍵在於模型、場景、生態與商業體系的全面競爭。這場戰爭的核心是透過AI產品實現Token經濟的商業閉環,並以「效果」為標準,透過自有體系與外部生態滿足企業用戶的真實需求。最終贏家需兼顧模型能力、場景積累與生態建設,才能在AI生產力時代站穩腳步。

千人聯機世界模型“RhOS-World: Khora”正式發佈
RhOS.ai與Ophilus.AI共同發布了千人聯機世界模型「RhOS-World: Khora」,該模型能讓多達1024個智能體在共享的3D空間中即時互動,且無需傳統物理引擎。其核心技術「STBoard(時空黑板)」架構,透過統一的物理狀態管理,解決了多視角一致性的難題,並大幅降低了擴展智能體數量的運算成本。
TutorMoments:AI 家教何時該出手,何時該放手?
今日我們推出 TutorMoments 預覽版,這是一個評估框架,旨在衡量尖端大型語言模型能否掌握教育中最難的平衡:何時介入協助學生,何時退後讓學生自行努力。TutorMoments 基於真實的一對一數學輔導課程,透過重播方式進行評估。經驗豐富的數學教師會檢視從美國收集的對話記錄。

告別反覆操作 OSD,華碩顯示器管理軟件 DisplayWidget Center 接入 AI 智能體
華碩顯示器管理軟體 DisplayWidget Center 推出重大更新,加入 AI 智能體功能,用戶可透過自然語言調整亮度、色溫等參數,無需操作 OSD。該功能支援 CLI 與 Agent Skill,可根據使用習慣自動切換模式,並適用於企業環境的統一部署。

千問App部分功能探索收費,想學豆包能跑通嗎?
千問App於8月7日更新,新增辦公助理等付費功能,基礎功能仍免費,但辦公場景使用額度需付費取得。此舉仿效豆包專業版等產品的訂閱模式,反映AI行業正集體轉向辦公場景收費,以尋求變現機會。