量子位模型更新

DeepSeek秘密造芯!專攻推理,一年前已啟動,招聘全程不公開

2026年7月8日 12:55
DeepSeek秘密造芯!專攻推理,一年前已啟動,招聘全程不公開

重點摘要

DeepSeek正祕密開發自研AI晶片,專注於推理任務,該計畫約一年前啟動,已與多家晶片設計與代工廠接洽。這項低調進行的硬體布局旨在降低對輝達的依賴,並獲得約510億人民幣融資支持。公司也同步擴建以國產晶片為主的算力中心,展現從演算法公司跨足硬體的戰略轉向。

站內 AI 整理稿

DeepSeek正在祕密打造自己的AI芯片,目標是降低對英偉達的依賴。根據路透社掌握的訊息,這家以模型算法聞名矽谷的中國人工智能公司,已經低調展開自研推理芯片的開發計畫,項目大約在一年前啟動,目前仍處於早期階段。消息人士透露,DeepSeek已與多家芯片設計公司、晶圓代工廠以及存儲器供應商進行接洽,為後續量產鋪路。長期以來,DeepSeek給外界最深的印象是對算法的極致優化。從2025年1月引爆全球的R1推理模型,到後來成功適配華為昇騰芯片的V4系列,這家公司一直展現「用更少算力達成更多成果」的能力。然而現在,這家算法驅動的公司決定親自投入硬件戰場。

知情人士指出,DeepSeek近幾個月持續招聘芯片設計工程師,但招聘過程極為低調,完全沒有在公開求職平臺上張貼任何職位資訊,顯示其高度保密策略。模型公司自行研發芯片並非首例,全球AI產業已出現明顯趨勢。OpenAI上個月剛公布與博通合作開發的首款定製推理芯片Jalapeño;Anthropic也在今年4月被報導正評估自研AI芯片的可能性。DeepSeek創辦人梁文鋒在2024年一次罕見的媒體專訪中曾坦言,芯片供應不足對公司構成實質挑戰。

當時R1模型的基底是在英偉達H800上訓練完成,後續DeepSeek轉向華為昇騰,今年4月推出的V4模型也已完整適配昇騰芯片,華為方面確認其處理器參與了V4-Flash的部分訓練。儘管如此,將算力分散在兩個供應商仍讓DeepSeek覺得不夠安心。這次自研芯片的定位明確鎖定推理場景,而非訓練。隨著AI應用大規模普及,行業對算力的需求重心正從訓練快速轉向推理——訓練是一次性投入,而推理是持續性消耗,每一位用戶的每一次提問都需要即時算力回應。針對推理場景設計的專用芯片,能在功耗與單位成本上比通用GPU更具優勢,對正在加速商業化的DeepSeek而言至關重要。

值得注意的是,DeepSeek在模型設計層面早已為硬件協同預作準備。DeepSeek-V3.1引入的UE8M0 FP8數據格式,業界普遍認為是專門配合下一代國產芯片的硬件特性所設計,演算法團隊在撰寫模型架構時,已經同步思考芯片的運算邏輯。這種軟硬體協同設計的思維,讓自研芯片的開發更具現實基礎。然而,挑戰同樣不容忽視。打造一款具競爭力的AI芯片通常需要數年時間與巨額資金,過程中技術風險極高,目前還無法保證專案必定成功。DeepSeek對此保持沉默,三位知情人士皆要求匿名,公司層面也未針對此消息做出正式回應。支撐這項硬體布局的關鍵,是剛落袋的資金活水。

2026年6月,DeepSeek完成成立以來的首輪外部融資,籌得約510億元人民幣(約74億美元),投後估值落在520億至590億美元之間。這家過去多年一直拒絕外部投資的公司,此次開放融資本身就是重大戰略轉向。資金用途已明確規劃:擴建以國產芯片為主的算力中心、投入自研AI芯片開發、以及擴充全球頂尖人才團隊。基礎設施層面的動作同步推進。DeepSeek已發布IDC設計規劃工程師的招聘訊息,計畫參與從兆瓦級到吉瓦級數據中心的規劃與建設,招聘資訊中明確提及內蒙古烏蘭察布等建設地點。這意味著,除了自研芯片,DeepSeek也正在為更大規模的算力基礎設施預作準備。

從模型算法到自研芯片,再到大型數據中心布局,DeepSeek正逐步建構一條完整的技術鏈條。這家曾經以「用更少算力做更多事」撼動全球AI競爭格局的公司,如今決定親手改造它腳下的硬件底座。儘管前方仍有技術與資金的高牆,但當自研芯片一旦成功,DeepSeek將有望大幅降低對外部供應商的依賴,進一步掌握AI產業的關鍵命脈。

Related

相關文章

拆解“AI辦公入口戰”底層:怎麼做才能成為最終贏家?

字節、阿里、騰訊等大廠正透過組織調整與產品整合,全力爭奪AI辦公入口,關鍵在於模型、場景、生態與商業體系的全面競爭。這場戰爭的核心是透過AI產品實現Token經濟的商業閉環,並以「效果」為標準,透過自有體系與外部生態滿足企業用戶的真實需求。最終贏家需兼顧模型能力、場景積累與生態建設,才能在AI生產力時代站穩腳步。

2 小時前

千人聯機世界模型“RhOS-World: Khora”正式發佈

RhOS.ai與Ophilus.AI共同發布了千人聯機世界模型「RhOS-World: Khora」,該模型能讓多達1024個智能體在共享的3D空間中即時互動,且無需傳統物理引擎。其核心技術「STBoard(時空黑板)」架構,透過統一的物理狀態管理,解決了多視角一致性的難題,並大幅降低了擴展智能體數量的運算成本。

2 小時前
Hugging Face Blog模型更新

TutorMoments:AI 家教何時該出手,何時該放手?

今日我們推出 TutorMoments 預覽版,這是一個評估框架,旨在衡量尖端大型語言模型能否掌握教育中最難的平衡:何時介入協助學生,何時退後讓學生自行努力。TutorMoments 基於真實的一對一數學輔導課程,透過重播方式進行評估。經驗豐富的數學教師會檢視從美國收集的對話記錄。

2 小時前