1800億美金逼出來的殺手鐧:谷歌Frozen v2把Gemini燒進硬件,每瓦Token翻10倍,股價先漲3.3%

重點摘要
谷歌推出 Frozen v2,將 Gemini 模型直接燒錄進硬體,使每瓦特產生的 Token 數量提升 10 倍,股價應聲上漲 3.3%。此舉被視為在 1800 億美元壓力下逼出的殺手鐧。
谷歌近日正式發表新一代硬體加速方案「Frozen v2」,這項技術直接將Gemini模型的核心運算邏輯燒錄進專用晶片,成功實現每瓦特產出的Token數量翻升十倍。這項突破被外界視為谷歌在人工智慧軍備競賽中被迫亮出的殺手鐧,背後壓力來自高達1800億美元的資本支出。消息一出,谷歌股價隨即上漲3.3%,顯示市場對這項硬體革新給予高度肯定。Frozen v2的核心優勢在於大幅降低運算能耗,讓Gemini這類大型語言模型在推論階段的效率出現飛躍式提升。傳統上,AI模型仰賴通用GPU或TPU進行運算,但谷歌這次選擇將模型參數與運算邏輯直接固化在硬體中,省去大量資料搬運與動態調度的耗損。
這項設計不僅讓每瓦Token產出達到原先的十倍,也意味著在相同電力預算下,谷歌能承載更多用戶請求或更複雜的模型推論。這項技術的誕生,與谷歌近年來在AI基礎設施上的巨額投資息息相關。為了追上競爭對手在生成式AI領域的進展,谷歌已投入超過1800億美元用於資料中心與晶片研發。Frozen v2正是這筆投資的具體成果之一,透過硬體與模型的深度整合,谷歌試圖在成本與效能之間找到新的平衡點。股價的即時反應,也反映出投資人對這條技術路線的期待。從技術細節來看,Frozen v2並非單純的晶片升級,而是從架構層面重新設計了運算流程。
傳統AI推論過程中,模型參數需要頻繁從記憶體讀取,並透過通用運算單元進行矩陣乘法與激活函數計算,這會產生大量資料搬運與動態排程的能耗。谷歌的工程團隊將Gemini模型的關鍵參數與運算邏輯直接固化在專用晶片中,形成一個高度特化的運算單元。這種「硬體即模型」的設計,讓資料流動路徑大幅縮短,運算延遲與能耗同步下降。根據谷歌內部測試數據,Frozen v2在處理Gemini模型的標準推論任務時,每瓦特能產出的Token數量是前一代方案的十倍。這項效能提升並非來自製程微縮或時脈拉高,而是來自於運算效率的根本性改善。
舉例來說,在同樣的電力預算下,Frozen v2可以同時服務十倍數量的用戶請求,或者處理更複雜的模型版本,這對谷歌的雲端服務與消費者產品都有直接助益。這項技術的發表時機也相當敏感。過去一年,谷歌在生成式AI領域面臨來自OpenAI、微軟與其他新創公司的激烈競爭。為了不落後對手,谷歌不僅加速了Gemini模型的迭代,也大幅擴張資料中心規模。然而,這些基礎設施投資的代價極為驚人,谷歌在過去數季的資本支出累計已超過1800億美元,對公司財務造成顯著壓力。Frozen v2的出現,正是為了讓這筆巨額投資能產生更高的回報。市場分析師指出,Frozen v2的關鍵意義在於它改變了AI運算的成本結構。
過去,大型語言模型的推論成本主要來自於電力消耗與硬體折舊,而Frozen v2透過十倍效能提升,直接將每Token的運算成本壓低一個數量級。這不僅讓谷歌在提供AI服務時擁有更強的定價彈性,也讓它能夠在相同預算下部署更強大的模型,進一步拉開與競爭對手的差距。谷歌股價在消息公布後隨即上漲3.3%,這並非偶然。投資人長期以來一直擔心谷歌在AI領域的巨額投資能否轉化為實際回報,而Frozen v2的技術突破正好回應了這項疑慮。華爾街分析師普遍認為,這項硬體革新將顯著改善谷歌的AI服務利潤率,並可能帶動雲端業務的成長動能。從產業角度來看,Frozen v2也代表了一種新的技術路線。
過去,AI硬體的發展主要依賴通用GPU的效能提升,但隨著摩爾定律放緩與模型規模持續擴大,單純依賴通用運算單元已難以滿足需求。谷歌選擇將模型與硬體深度綁定,走出一條與NVIDIA等GPU供應商截然不同的道路。這種「模型定義硬體」的策略,可能成為未來AI基礎設施的重要發展方向。不過,Frozen v2也並非沒有挑戰。由於它將Gemini模型的參數與運算邏輯固化在晶片中,這意味著一旦模型版本更新,硬體也必須隨之更換。這項限制可能讓谷歌在模型迭代時面臨更高的硬體更新成本,也讓Frozen v2的適用範圍僅限於Gemini系列模型,無法像通用GPU那樣靈活支援多種架構。
儘管如此,谷歌顯然認為這項取捨是值得的。在AI軍備競賽中,效能與成本是決定勝負的關鍵因素,而Frozen v2在能耗效率上的十倍提升,足以讓谷歌在短期內獲得顯著的競爭優勢。隨著這項技術逐步導入資料中心,外界預期谷歌的AI服務將在未來數季內展現出更強的效能與更低的成本。整體而言,Frozen v2的發表不僅是谷歌在硬體技術上的一次重大突破,也是其面對1800億美元資本支出壓力下的關鍵回應。這項技術能否真正改變AI產業的遊戲規則,還需要時間驗證,但至少從市場反應來看,投資人已經給了谷歌一個明確的肯定。
Related
相關文章

OpenAI首款AI硬件,為什麼是個沒有屏幕的「甜甜圈」
OpenAI與Jony Ive團隊合作的首款AI硬體,外型類似無螢幕的冰球大小圓環,被形容為金屬甜甜圈。這款設備定位為以AI為第一交互入口的計算設備,而非傳統智能音箱,售價可能落在300至400美元之間。
OpenAI 首款硬件真容浮現:冰球大小無屏設計,售價 300 至 400 美元
OpenAI首款硬件產品細節曝光,為一款無螢幕的智能音箱,外型類似冰球,售價約300至400美元,由OpenAI與前蘋果設計師Jony Ive的LoveFrom公司合作開發。該設備內建電池與攝影鏡頭,可支援手持使用並將視覺資訊傳給ChatGPT,實現多模態感知。此產品推出時正值蘋果對OpenAI提起商業機密訴訟,OpenAI內部評估其設計細節有望反駁侵權指控。

消息稱英偉達急尋中國 AI 基站供應商,與“下一個中際旭創”合作開發 6G 基站
NVIDIA正積極在中國尋找AI基站供應商,並有意與被視為「下一個中際旭創」的業者合作開發6G基站,顯示其從資料中心延伸至通訊基礎設施的布局。此舉凸顯NVIDIA對6G市場的重視,AI基站被視為整合邊緣運算與智慧調度的關鍵節點,但合作細節與技術方案尚未正式公布。
金剛GC3芯片重新定義視頻AI算力規則,國產RISC-V高端算力商業化提速
近日,第三屆中國計算機學會芯片大會(CCF Chip 2026)在太湖之濱無錫成功舉辦。會場中,兩院院士與頂尖工程師們的討論話題直指底層架構的“根技術”創新。一個核心追問被反覆推至臺前:當摩爾定律逼近物理極限,製程紅利日益稀薄,堆核心、拼頻率的老路越走越窄,是否該徹底換一條路走?換言之,與其在通用架構上不斷打補丁,能否從數據流動的本質出發,為特定場景原生設計一顆芯片?
把512 GiB閃存搬到xPU旁邊,HBF能打破推理內存牆?
HBM已經證明,通過堆疊和共封裝把存儲介質遷移至GPU附近,可以緩解AI計算中的數據搬運瓶頸。現在,SK海力士聯合閃迪,將類似的思路正式應用到NAND上,通過HBF將大容量閃存放到包括GPU在內的各類xPU旁,以緩解AI推理內存牆問題。近日,雙方通過OCP發佈《High Bandwidth Flash(HBF)High-Level Base Die Specification, Version 0.7.0》。

AI的錢,被誰賺走了?
AI 浪潮推動雲端服務供應商大舉擴建資料中心,背後龐大的資本支出正沿著供應鏈層層傳導,最終流向光模塊、晶片與伺服器業者。這條資金鏈路的起點是亞馬遜 AWS、微軟 Azure、Google Cloud 等雲端廠商,他們為了滿足訓練與推論大語言模型所需的算力,持續加碼採購 GPU 伺服器與高速網路設備,帶動上游零組件需求爆發。