獨家|面壁智能端側大模型將搭載三星手機上市

2026年7月15日 19:58
獨家|面壁智能端側大模型將搭載三星手機上市

重點摘要

面壁智能與三星手機達成合作,其自主研發的端側模型將搭載於數款旗艦機型上市。同日中國網信部門公告七款手機端側生成式AI服務完成備案,標誌端側AI進入規模化落地階段。面壁智能成立於2022年,累計融資超過50億元,其開源模型下載量已突破3800萬次。

站內 AI 整理稿

端側大模型正式進入規模化落地階段,面壁智能自主研發的 MiniCPM 系列端側模型將搭載於三星手機上市,覆蓋多款旗艦機型。這是《智能湧現》獨家獲悉的消息,也標誌著中國端側 AI 從技術驗證走向商業化的重要一步。就在同一天,網信部門發布公告,包括「Apple 智能」在內的七款提供手機端側生成式人工智慧服務完成備案。這七款服務分別是 Apple 智能、華為小藝 AI 大模型、OPPO Andes GPT、vivo 藍心端側大模型、小米澎湃 AI、三星蓋樂世 AI 以及努比亞豆包手機大模型。

大模型浪潮以來,端側 AI 長期處於技術探索階段,此次同日獲批意味著端側 AI 不再是概念演示,而是進入大規模落地的新階段。同日,阿里巴巴也向媒體確認,阿里千問將作為 AI 能力集成至 Apple 智能,覆蓋 iOS、iPadOS、macOS 和 visionOS 的國行設備。用戶無需切換 App,即可在蘋果設備上體驗千問的文本與圖像理解、內容生成等能力。消息公布後,阿里股價應聲上漲超過 5%。過去,國內手機廠商的端側 AI 能力大多由自研模型支撐,例如華為小藝、OPPO AndesGPT、vivo 藍心、小米澎湃 AI。

如今阿里千問落地 Apple 智能、面壁智能搭載三星手機,顯示 AI 模型公司正成為手機 AI 能力的重要供給方,手機廠商不必事事自研,端側模型的市場化分工正在成形。面壁智能成立於 2022 年 8 月,總部位於北京,孵化自清華大學自然語言處理實驗室。聯合創始人、CEO 李大海曾任知乎合夥人、CTO;聯合創始人、首席科學家劉知遠現任清華大學計算機系教授;聯合創始人、CTO 曾國洋在 22 歲時作為核心工程負責人,訓練了中國第一個大語言模型 CPM-1。據投資界報道,2026 年上半年,面壁智能累計融資超過 50 億元,估值突破 200 億元,成為國內端側 AI 領域估值最高的獨角獸。

面壁智能也是國內最早押注端側 AI 的初創公司。2023 年下半年,當行業還在追趕雲端大模型參數規模時,面壁智能決定全力投入端側。這個選擇在當時並不主流,因為做大模型的公司普遍在卷參數、卷算力,端側模型被視為「做小」的邊緣路線。面壁智能的判斷基於一個核心方法論:知識密度。2024 年,面壁智能與清華大學團隊提出「大模型密度定律」,認為開源大模型的最高能力密度約每 3.5 個月翻一番,同等智能所需的參數規模呈指數級下降。這個判斷在後續的模型發布中逐步獲得驗證。

2026 年 5 月,面壁聯合清華大學、OpenBMB 開源的新一代端側文本基座模型 MiniCPM5-1B,參數量僅 10 億,在 Artificial Analysis Intelligence Index 中獲得 17.9 分,超過多款參數規模更大的開源基座模型。另一款 MiniCPM-V 4.6 僅 1.3B 參數、6GB 內存即可在手機上流暢運行,支持 iOS、Android、HarmonyOS 等主流操作系統。目前 MiniCPM 系列開源模型在 GitHub、Hugging Face 等平台的累計下載量已突破 3800 萬次。

在近期 36 氪對曾國洋的專訪中,他解釋了端側模型的底層邏輯:「端側是硬限制——如果模型太大,跑不動就是跑不動,補貼錢沒用;功耗太高會發熱,你不可能補貼一個冰塊。」在他看來,做端側模型的難度並不亞於做大模型:「做高效是非常難的,不是越大越簡單。」

端側模型的落地不僅要把模型做高效,還要打通算法、芯片適配、功耗優化、終端部署的全鏈路。面壁智能已完成對高通、聯發科、英特爾、瑞芯微、英偉達、AMD 等主流芯片平台的全面適配。在國產芯片方面,面壁智能參與了華為昇騰、寒武紀等國產芯片的軟件棧構建,發布了全國首個三值量化大模型 BitCPM-CANN,推理階段可節省約 6 倍顯存。面壁智能也已建立多樣化的端側模型矩陣。例如最新發布的 MiniCPM-o4.5 是一個全雙工全模態大模型,以 9B 參數量實現語音、視頻、文本的全模態同步交互。端側模型要在手機上運行,必須解決功耗、散熱、內存佔用、響應延遲等問題,每一個環節都不可或缺。

曾國洋指出,端側模型不只看評測效果,還有響應時間、硬件成本,很難從單一維度勝出。在汽車領域,面壁智能已初步驗證了規模化落地能力。其自研端側智能體 SuperMate 到 2026 年底預計將交付超過 30 萬輛量產車,覆蓋吉利、上汽大眾、廣汽、馬自達等品牌,跑通了模型適配、硬件兼容、供應鏈、終端交付的全鏈路。三星是全球出貨量最大的安卓手機廠商之一,其端側 AI 能力此前主要依賴自研的 Galaxy AI 和與谷歌的合作。據韓媒報導,三星正與谷歌深度合作,將 Gemini 整合進其設備生態,包括即將於 7 月 22 日在倫敦發布的 Galaxy Unpacked 2026 系列產品。

面壁智能的端側模型在三星體系中具體扮演怎樣的角色,仍有待進一步確認。不過可以確定,隨著端側 AI 備案落地,以及更多模型公司與手機廠商聯手,端側大模型的商業化時代已經正式開啟。

Related

相關文章

MarkTechPost AI生成式AI

使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線

在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。

47 分鐘前
MarkTechPost AI生成式AI

NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架

NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

1 小時前

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

3 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

4 小時前