獨家丨華為22年老兵從AI終局倒推LPU,元川微完成新一輪數億元融資

2026年7月24日 02:23

重點摘要

早在Groq LPU因為英偉達的押注而名聲大噪前,元川微創始人兼CEO楊濱就已經開始了對推理芯片的構想。雷峰網獨家獲悉,LPU創業公司元川微已完成Pre-A輪數億元融資。本輪融資由IDG資本領投,孚騰資本、九坤創投、尚頎資本、順禧基金、徐匯科創投聯合投資。據瞭解,這也是元川微2026年以來完成的第四輪融資。元川微透露,本輪融資資金將主要用於LPU+芯片研發、軟件生態建設及產品工程化推進。

站內 AI 整理稿

# 獨家丨華為22年老兵從AI終局倒推LPU,元川微完成新一輪數億元融資

在Groq LPU因英偉達的押注而聲名鵲起之前,元川微創始人兼CEO楊濱就已經開始了對推理芯片的構想。雷峰網獨家獲悉,LPU創業公司元川微已完成Pre-A輪數億元融資。本輪融資由IDG資本領投,孚騰資本、九坤創投、尚頎資本、順禧基金、徐匯科創投聯合投資。據瞭解,這也是元川微2026年以來完成的第四輪融資。 元川微透露,本輪融資資金將主要用於LPU+芯片研發、軟件生態建設及產品工程化推進。目前,元川微正與多家產業客戶及雲廠商開展產品驗證與合作,公司下一輪融資也已有序展開。這家成立於2025年9月的初創企業,憑藉清晰的技術路線和強大的團隊背景,在成立短短不到一年時間內便接連獲得資本市場的高度認可。 ## 資本持續加碼,推理芯片賽道迎來新格局

公開資料顯示,元川微今年4月完成的數億元天使輪系列融資,就已獲得頭部VC、政府基金及產業鏈的聯合支持,投資陣容覆蓋從流片製造到終端應用的關鍵環節。資本的持續加碼,反映了推理時代的新一輪芯片競爭,正從GPU延伸至推理專用架構。押注這一方向的元川微,如果只看其芯片形態——時空編譯器、硬流水架構、大帶寬存儲——確實像一家“中國版Groq”。但楊濱並不認同這種簡單對應:“如果我們的目標只是模仿LPU,那麼能拓展的空間實際上並不多。”

在他看來,選擇何種芯片技術,只是在完成市場判斷後自然推導而出的結果,並非創業的起點。這種思考方式與楊濱在華為過去二十多年的經歷密切相關——他曾赴美從零組建華為處理器團隊,回國後負責華為無線基帶算法與芯片相關業務,長期主導大規模硬件調度、數據架構研發等任務。“創業其實是你過去積累的所有資源的兌現。”楊濱總結,這不僅指向對產業的理解、沉澱下來的技術能力,還包括積攢的口碑和資源組織能力。 ## 行業老兵組隊,深厚底蘊鑄就創業底座

元川微的核心團隊堪稱芯片行業的“老將集結”。CTO孫博士對GPGPU、GPU、DSP等高性能計算架構的鑽研超過三十年,首席軟件工程師Will博士擁有20多年編譯器、EDA和異構系統軟件經驗。這些核心成員過去幾十年積累下來的技術能力、產業經驗和人才資源,構成了元川微創業的堅實底座。相比起討論“國產替代”“性價比”等熱門議題,這支由行業老兵組成的新公司更關注的是——當AI進入Agent時代,推理計算究竟應該圍繞什麼來重新組織。 ## 從AI終局倒推,堅定鎖定LPU路線

2025年上半年,當楊濱和CTO在討論AI芯片賽道還有哪些創業機會時,他們就已經意識到相比模型的能力,模型真正落地後才會產生價值。彼時,Deepseek R1憑藉遠低於行業預期的成本,訓練出接近當時頂級模型的性能,加速AI應用走向低成本部署;Manus剛剛打開通用Agent的想象空間;黃仁勳首次將推理和Agent作為GTC大會的核心敘事,並推出面向推理時代的整體解決方案。隨著推理的市場需求不斷釋放,楊濱將目光投向Vibe coding等生產力應用。“就像家庭帶寬從100兆升級到1G,收費並不呈線性增長。”在產業界摸爬滾打多年的他熟悉此類場景的商業邏輯——客戶願意為效率支付更高的溢價。

“主打性價比肯定有市場空間,但會被壓縮得很快。”因此,他們首先要做的不是幫客戶節省成本,而是創造更高的價值。“只做推理且只做最快的推理”開始成為楊濱所信奉的法則。## Agent時代爆發,低時延成為剛性需求

2025年底一份百萬億Token實證研究顯示,推理模型已處理OpenRouter平臺約一半的Token,而Agentic AI推理正成為增長最快的交互方式。這意味著低時延和高穩定性的價值正在被進一步放大。楊濱指出,Agent完成一項任務往往需要經歷任務規劃、工具調用、結果驗證等多個環節,在這背後可能對應幾十次甚至上百次推理。而任何一次推理產生的延遲,都會沿著任務鏈不斷累積。如果進一步發展為多個Agent協同,單Agent的響應變慢,還可能會像蝴蝶效應一樣在整個系統中層層傳導,最終拖慢任務執行。

除此之外,楊濱還注意到人與Agent交互中對高穩定的追求:人與人交流時的停頓本身暗含思考、組織語言等語義;但當Agent輸出Token的節奏忽快忽慢時,用戶感受到的反而是一種機械感。當Agent時代的需求被一步步明確,重新思考推理芯片的設計便成為自然而然的選擇。在楊濱看來,傳統GPU建立在馮·諾依曼架構之上,並不完美匹配當下的計算模式;而完全ASIC化雖然能夠獲得極致性能,卻又難以適應模型快速演進帶來的變化。因此,新的架構需要重新思考哪些能力可以硬化,哪些能力需要保持靈活,最大化算力、存力與運力的系統方案綜合效率。沿著這一思路,楊濱及其團隊最終確定了LPU的技術路線。

## 不是複製Groq,做面向Agentic AI的原生LPU

楊濱並不認為元川微是在複製Groq。他直言兩家公司雖然都關注低延遲、可預測的推理,但誕生於CNN時代的Groq LPU當時面臨的模型架構和應用需求都與今天並不相同。儘管Groq後來將產品名稱從TSP改為LPU,在他看來這並不意味著LPU只能處理語言模型。同樣採用這一命名的元川微,將其架構命名為LPU+,從設計之初便支持多模態模型。此外,作為Transformer時代的原生架構,LPU+還針對MoE模型的動態調度特徵進行優化。但這並不意味著Groq過去的技術積累沒有含金量。“Groq真正值得借鑑的是其一直堅持的硬流水架構。

”據楊濱的觀察,這在一定程度上避免了芯片運行過程中的資源競爭和不必要的數據等待,也為採用大容量SRAM創造了條件。不過,要將這套架構與存儲介質的協同優勢真正發揮出來,還有賴於編譯器的提前規劃。楊濱將這一過程形容為制定高鐵運行圖:每一趟列車何時發車、何時停靠、停留多久,都已經提前安排妥當。直到真正運行時,高鐵只需按照既定路線執行任務即可。## 三大核心技術協同,構築系統級壁壘

正因為此,楊濱強調LPU的時空編譯器、硬流水架構、大帶寬存儲這三大核心很難區分誰的優先級更高,前兩者決定了芯片的理論性能,而時空編譯器則關係到這些能力在實際運行中能夠兌現多少。這些技術最終指向的,並不是一顆單獨的推理芯片。楊濱告訴雷峰網,基於硬流水架構,元川微無需針對不同算力等級重新設計芯片,而是可以根據雲邊端不同場景靈活擴展算力規模。 在剛剛落幕的2026世界人工智能大會上,這套技術路線首次以Agentic AI Token工廠的形式對外亮相,為企業級推理服務提供底層算力支撐。這只是藍圖落地的第一步。在華為二十多年的經歷中,楊濱最大的收穫並非某項具體技術,而是一套從產業價值、商業閉環一路推導至技術選擇的系統工程思維。元川微成立至今的每一步,都在驗證這一思維的有效性,而它也將繼續指引這家創企尋找下一階段的答案。

Related

相關文章

一年砸下110億美元,比紅杉還兇,白宮才是AI圈最猛投資人

美國白宮過去一年在AI領域投入110億美元,規模超越紅杉資本等傳統創投,顯示政府正以國家級資源全面押注AI產業。這筆資金分散於多個聯邦機構,涵蓋基礎模型訓練、醫療及氣候應用等關鍵環節,並強調負責任AI開發。此舉反映美國對維持全球AI領導地位的危機感,但也引發市場機制扭曲與技術商業化延緩的疑慮。

剛剛

一口氣發佈三款教育插件,OpenAI教育產品再升級

OpenAI 推出三款教育插件,分別為課程助手、作業輔導員與互動學習夥伴,旨在協助教師備課與學生自主學習。這些工具整合至教育版平台,強調引導式學習而非直接給答案,並內建防護機制避免學生過度依賴。OpenAI 計畫未來加強多語言支援與特殊教育需求,持續深化教育科技布局。

17 分鐘前

騰訊、字節、阿里,搶著給打工人配「AI助理」

騰訊、字節跳動與阿里巴巴三大中國科技巨頭,近期紛紛推出或升級企業級AI助理,目標是提升白領工作效率。各家AI助理的競爭重點從回答問題轉向執行任務,並分別強調跨應用串聯、主動式智慧與企業級安全等不同特色。儘管面臨資料隱私與AI幻覺等挑戰,但市場調查顯示超過六成中國企業計劃在一年內導入AI辦公工具。

59 分鐘前

推行AI提效後,策劃們開始加班趕工期

當AI開始重寫小遊戲生產流程,真正的變化何時發生?這個問題在近期引發了業界廣泛討論。隨著人工智慧技術逐步滲透進創意與策劃領域,許多公司開始導入AI工具來提升工作效率,然而實際情況卻與預期有所出入。部分策劃人員反映,在推行AI提效後,他們不僅沒有減少工作量,反而因為系統調整與流程磨合,導致加班趕工期的現象頻繁出現。 這場變革的起點,源自於企業對AI生產力的高度期待。許多遊戲開發與內容製作公司,尤其是中小型團隊,紛紛導入AI輔助工具,試圖透過自動化生成文案、腳本、美術素材甚至程式碼,來縮短專案週期。

1 小時前

DeepSeek大漲價,Token價格戰終於要結束了?

DeepSeek大幅調漲API服務價格,引發市場對AI模型價格戰是否結束的討論。業界分析指出,漲價反映營運成本壓力與市場定位調整,可能代表中國AI產業從低價競爭轉向追求盈利與可持續發展。未來競爭焦點將從價格轉向模型效果與生態系統完整性,但漲價能否終結價格戰仍取決於市場供需與競爭對手反應。

1 小時前

狂攬130億!英偉達投的AI基建獨角獸又融資了

澳洲AI基礎設施獨角獸Firmus宣布完成20億美元(約136億人民幣)戰略股權融資,現有投資方英偉達與Coatue持續參投,並新增黑石旗下基金及Jane Street。該公司專注於設計、建設及營運AI工廠,核心產品HyperCube整合供電、液冷與伺服器機架,並提供GPU雲端算力服務。英偉達透過股權投資與技術合作,協助Firmus擴張亞太地區AI數據中心,同時擴大其晶片與計算架構的市場覆蓋。

1 小時前