DeepSeek、智譜被曝造芯,國產大模型繞開英偉達

2026年7月8日 18:53
DeepSeek、智譜被曝造芯,國產大模型繞開英偉達

重點摘要

DeepSeek與智譜AI被揭露正在秘密自研專用推理晶片,試圖擺脫對英偉達的依賴並降低雲端推理成本。此舉反映出中國頂尖AI公司不再只專注於演算法,而是開始進軍硬體自研領域,以因應外部限制與暴增的算力需求。

站內 AI 整理稿

中國 AI 雙雄 DeepSeek 與智譜 AI 傳出正低調投入自研晶片的消息,目標直指擺脫對英偉達底層硬體的高度依賴。根據路透社與 The Information 的報導,這兩家大模型頭部企業幾乎同時啟動了定製化 AI 晶片的開發計畫,專注於推理場景,試圖從底層算力環節建立自己的技術護城河。消息曝光後,英偉達股價在盤前交易中應聲下跌約 1.6%,市場立刻意識到這場算力遊戲的牌桌正在被掀翻。DeepSeek 向來以低調著稱,但今年 6 月才剛完成一筆高達 70 億美元的鉅額融資,如今傳出自研晶片,並不令人意外。

智譜 AI 的跟進則讓外界看到,中國頂尖 AI 公司已經不再滿足於只做純演算法供應商,而是開始向硬體領域跨界。兩家企業選在相近時間點出手,背後共同的壓力來自於算力賬本與外部環境的雙重夾擊。以智譜 AI 為例,這家公司在海外市場的成長速度超乎預期。隨著最新模型 GLM-5.2 在知名開發者平台 Vercel 上全面上線,其每日 Token 使用量在一週內暴漲 27 倍,流量指數級攀升直接導致計算資源捉襟見肘。然而,智譜 AI 因為受限於無法採購英偉達的最新先進晶片,供貨鏈始終處於不穩定狀態。

同樣的情況也發生在 DeepSeek 身上,其模型以極低的訓練成本與高效能吸引大量全球 API 調用,但英偉達晶片的供應量遠遠跟不上需求。分析師理查德·溫莎甚至直言,英偉達在中國的市場份額正在逐步歸零,而且這個趨勢不會逆轉。正因如此,兩家公司不約而同地選擇了同一條路:自研晶片。值得注意的是,它們正在開發的定製 AI 晶片主要定位於推理場景,也就是模型在訓練完成後、實際為用戶生成回答或執行日常交互的環節。AI 大模型的下半場,勝負關鍵已經從「誰能訓練出最大的參數」轉向「誰能在每一次 Token 輸出中把功耗、延遲與硬體成本壓到最低」。

業界機構數據顯示,在生產環境中,推理可佔模型生命週期計算成本的 80% 到 90%,推理需求的成長速度遠超訓練需求。英偉達的傳統 GPU 為了同時應付複雜的訓練任務,保留了大量冗餘電路設計。拿它來專門做推理,不僅造價高昂,耗電量也相當驚人。相比之下,專用推理晶片(ASIC)則捨棄所有多餘功能,天生為特定演算法的矩陣計算而生,能效比遠高於通用 GPU,量產成本也更低。Trendforce 預測,到 2026 年,ASIC 的增長率將達到 44.6%,而 GPU 的增長率僅為 16.1%。彭博行業研究更指出,到 2033 年,定製 AI 晶片市場規模有望達到 1180 億美元。

智譜 AI 與 DeepSeek 正是看準這個趨勢,希望透過自研推理晶片徹底打下長期的雲端推理成本。放眼全球,頂尖 AI 公司投入晶片領域早已不是新鮮事。OpenAI 在上個月正式推出首款定製推理晶片,內部代號 Jalapeno,由博通協助開發。Anthropic 也一直在評估自研 AI 晶片的可能性,而 Google 的 TPU 更是已經迭代數代,成為自家 AI 帝國的硬體支柱。對 DeepSeek 與智譜 AI 來說,若要實現極致的成本控制與供應鏈自主,就不能再完全依賴其他公司的底層架構規則。

從時間線來看,DeepSeek 的晶片布局大約始於一年前,目前正與外部合作夥伴、晶片設計公司、代工廠及記憶體廠商進行接洽。近幾個月來,DeepSeek 已加大晶片設計工程師的招聘力度,但招募多以私下方式進行,並未在公開平台發布職缺。在此之前,DeepSeek 也曾在軟體層面嘗試適配國產算力。例如,DeepSeek-V3.1 引入 UE8M0 FP8 數據格式,主要用於模型權重與激活值的縮放,以提高計算效率、降低部署成本,並針對下一代國產晶片進行最佳化。

今年 6 月 27 日,DeepSeek 更發布論文提出 DSpark 推測解碼模組,讓大模型在現有算力(包括國產晶片)上跑得更快、更高效,部署後模型生成速度提升 60% 至 85%。這些軟體層面的創新,被視為為自研晶片鋪路的伏筆。智譜 AI 方面,則已開始向本土晶片設計公司垂詢合作可能性。若能順利推進,這款晶片將直接由國內晶圓廠負責製造。由於無法使用台積電、三星最先進的 3 奈米或 5 奈米海外代工廠,智譜 AI 必須具備極高的設計能力,透過架構創新來彌補物理製程的落差。據業界評估,從設計接洽到實際流片,整個過程預計需要兩年以上時間,所需資金規模相當可觀。

這也解釋了為何一向拒絕外部投資的 DeepSeek,會在 6 月突然籌集 70 億美元資金。如果這些計畫最終得以實現,中國 AI 產業將完成一項科技史上的壯舉:在自己的土地上,由本土晶圓廠製造、使用自己設計的晶片、運行自己定義的模型,為全球數億用戶提供算力服務。這場突圍戰才剛剛打響,後續發展值得密切關注。

Related

相關文章

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

2 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

3 小時前

可靈AI核心技術骨幹王鑫濤被曝離職

快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

3 小時前

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了

2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。

3 小時前