安謀科技公開新一代NPU架構 並牽頭髮起開源AI操作系統聯盟

重點摘要
安謀科技在2026世界人工智能大會上首次公開新一代NPU架構「周易」X3-Pro,並牽頭髮起開源AI操作系統聯盟AIOS,展現從IP授權公司轉向平台型生態的意圖。該公司提出三條技術路徑因應端側AI資源受限問題,並推出星辰300異構計算平台,同時聯合多家晶片與模型廠商成立AIOS聯盟,以擴大在終端產品端的影響力。
安謀科技公開新一代NPU架構 並牽頭髮起開源AI操作系統聯盟
安謀科技(Arm China)正加速從IP授權公司轉型為平台型生態參與者。在2026年世界人工智能大會(WAIC 2026)期間,該公司不僅首次公開了專為智能體(Agentic AI)時代設計的新一代NPU架構「周易」X3-Pro,還宣布牽頭髮起開源AI操作系統聯盟AIOS,同時展示了基於自研星辰CPU與Arm Ethos所打造的首代星辰300異構計算平台。市場人士指出,這一連串動作的核心意圖,是向外界傳達安謀科技不再只是單純提供IP授權,而是要積極參與定義端側AI的計算標準與軟體生態。安謀科技CPU產品線負責人朱曉鳴在演講中強調,端側AI目前面臨的最大挑戰在於資源有限。
他指出,用戶期望端側AI能夠隨時在線,並處理更多上下文數據,但電池容量有限,加上記憶體與頻寬的瓶頸,使得技術突破變得更加迫切。他引用行業數據說明,2022年要達到MMLU基準60分的商用門檻,模型需要數百億個參數;到了2026年,這個門檻已經降至接近10億個參數,顯示大模型向端側遷移的可行性正在快速提升。針對資源受限的問題,安謀科技提出了三條技術路徑:在CPU上擴展向量與張量處理指令,外掛通用小算力NPU作為算力補充,以及探索SRAM存內計算。安謀科技自研的星辰STAR系列CPU,從第二代MC2開始就支援Arm Helium指令集。
朱曉鳴表示,Helium在機器學習場景下,相較於上一代產品平均性能提升三倍,部分場景甚至超過八倍。現場展示的星辰300平台,將STAR CPU與Ethos NPU整合在一起,單顆CPU只能追蹤一張人臉,加入NPU後則可同時追蹤五到六張人臉。安謀科技將端側AI的應用場景分為四大類:個人終端強調續航力與隱私保護,視覺與空間智能要求低延遲處理,工業邊緣需要任務確定性與長生命週期,邊緣盒子則要求多路併發與24小時在線運作。該公司認為,端側AI並非雲端AI的縮小版,而是需要獨立設計的架構。
基於此原則,安謀科技推出了周易X3-Pro架構,採用統一分層場景化設計,衍生出Lite、Premium、Subsys三個系列,覆蓋從低功耗端側到大算力複雜推理的各種場景。軟體層保持統一,硬體層則進行差異化抽象。該產品目前仍在研發階段。在端側影片處理方面,安謀科技觀察到,影片消費者的主體正在發生變化。越來越多的影片消費者是AI,用於推理與訓練。如果影片品質有損,將對AI推理精度產生顯著影響。安謀科技今年發布的「玲瓏」VPU峨眉系列,已整合輕量化AI運算子,實現內容感知編碼;明年年初將推出的武當系列,則支援8K 30fps編碼,且面積節省40%。
此外,安謀科技正在研發的端到端影片編碼技術,在目標追蹤與動作識別任務上,編碼品質提升超過10%。本次大會期間,安謀科技牽頭髮起開源AI操作系統聯盟AIOS。安謀市場及生態副總裁梁泉表示,AI設備的互動模式正在從回合制對話,轉向持續感知與具身互動,傳統操作系統已無法應對這項變化。他介紹,AIOS架構包含三個核心模組:模型引擎負責推理與端雲協同路由,Agentic Engine負責多輪工具調用與任務編排,DataFlow引擎則處理多模態數據流。聯盟的開放範圍涵蓋軟體程式碼、AI模型、產品原型與設計文件。首批成員包括紫光展銳、瑞芯微、輝羲等晶片廠商,以及面壁智能等模型公司。
此外,安謀科技也與香港科技大學物理AI實驗室聯合發布了VLA模型。業界分析師指出,傳統IP授權模式的限制在於,晶片設計完成後,IP公司的影響力便基本終止。透過牽頭髮起AIOS聯盟,安謀科技的影響力正從晶片設計端延伸至終端產品端。目前AIOS聯盟仍處於早期推廣階段,但其戰略意圖已相當明確:安謀科技正試圖在端側AI的硬體與軟體層面,同時建立具影響力的生態系統。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。