安謀科技公開新一代NPU架構 並牽頭髮起開源AI操作系統聯盟

重點摘要
安謀科技在2026世界人工智能大會上首次公開新一代NPU架構「周易」X3-Pro,並牽頭髮起開源AI操作系統聯盟AIOS,展現從IP授權公司轉向平台型生態的意圖。該公司提出三條技術路徑因應端側AI資源受限問題,並推出星辰300異構計算平台,同時聯合多家晶片與模型廠商成立AIOS聯盟,以擴大在終端產品端的影響力。
安謀科技公開新一代NPU架構 並牽頭髮起開源AI操作系統聯盟
安謀科技(Arm China)正加速從IP授權公司轉型為平台型生態參與者。在2026年世界人工智能大會(WAIC 2026)期間,該公司不僅首次公開了專為智能體(Agentic AI)時代設計的新一代NPU架構「周易」X3-Pro,還宣布牽頭髮起開源AI操作系統聯盟AIOS,同時展示了基於自研星辰CPU與Arm Ethos所打造的首代星辰300異構計算平台。市場人士指出,這一連串動作的核心意圖,是向外界傳達安謀科技不再只是單純提供IP授權,而是要積極參與定義端側AI的計算標準與軟體生態。安謀科技CPU產品線負責人朱曉鳴在演講中強調,端側AI目前面臨的最大挑戰在於資源有限。
他指出,用戶期望端側AI能夠隨時在線,並處理更多上下文數據,但電池容量有限,加上記憶體與頻寬的瓶頸,使得技術突破變得更加迫切。他引用行業數據說明,2022年要達到MMLU基準60分的商用門檻,模型需要數百億個參數;到了2026年,這個門檻已經降至接近10億個參數,顯示大模型向端側遷移的可行性正在快速提升。針對資源受限的問題,安謀科技提出了三條技術路徑:在CPU上擴展向量與張量處理指令,外掛通用小算力NPU作為算力補充,以及探索SRAM存內計算。安謀科技自研的星辰STAR系列CPU,從第二代MC2開始就支援Arm Helium指令集。
朱曉鳴表示,Helium在機器學習場景下,相較於上一代產品平均性能提升三倍,部分場景甚至超過八倍。現場展示的星辰300平台,將STAR CPU與Ethos NPU整合在一起,單顆CPU只能追蹤一張人臉,加入NPU後則可同時追蹤五到六張人臉。安謀科技將端側AI的應用場景分為四大類:個人終端強調續航力與隱私保護,視覺與空間智能要求低延遲處理,工業邊緣需要任務確定性與長生命週期,邊緣盒子則要求多路併發與24小時在線運作。該公司認為,端側AI並非雲端AI的縮小版,而是需要獨立設計的架構。
基於此原則,安謀科技推出了周易X3-Pro架構,採用統一分層場景化設計,衍生出Lite、Premium、Subsys三個系列,覆蓋從低功耗端側到大算力複雜推理的各種場景。軟體層保持統一,硬體層則進行差異化抽象。該產品目前仍在研發階段。在端側影片處理方面,安謀科技觀察到,影片消費者的主體正在發生變化。越來越多的影片消費者是AI,用於推理與訓練。如果影片品質有損,將對AI推理精度產生顯著影響。安謀科技今年發布的「玲瓏」VPU峨眉系列,已整合輕量化AI運算子,實現內容感知編碼;明年年初將推出的武當系列,則支援8K 30fps編碼,且面積節省40%。
此外,安謀科技正在研發的端到端影片編碼技術,在目標追蹤與動作識別任務上,編碼品質提升超過10%。本次大會期間,安謀科技牽頭髮起開源AI操作系統聯盟AIOS。安謀市場及生態副總裁梁泉表示,AI設備的互動模式正在從回合制對話,轉向持續感知與具身互動,傳統操作系統已無法應對這項變化。他介紹,AIOS架構包含三個核心模組:模型引擎負責推理與端雲協同路由,Agentic Engine負責多輪工具調用與任務編排,DataFlow引擎則處理多模態數據流。聯盟的開放範圍涵蓋軟體程式碼、AI模型、產品原型與設計文件。首批成員包括紫光展銳、瑞芯微、輝羲等晶片廠商,以及面壁智能等模型公司。
此外,安謀科技也與香港科技大學物理AI實驗室聯合發布了VLA模型。業界分析師指出,傳統IP授權模式的限制在於,晶片設計完成後,IP公司的影響力便基本終止。透過牽頭髮起AIOS聯盟,安謀科技的影響力正從晶片設計端延伸至終端產品端。目前AIOS聯盟仍處於早期推廣階段,但其戰略意圖已相當明確:安謀科技正試圖在端側AI的硬體與軟體層面,同時建立具影響力的生態系統。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
騰訊雲開源 TencentDB Agent Memory v2.0:專為 AI 編碼代理打造的團隊級記憶中樞
Tencent Cloud has open-sourced TencentDB Agent Memory v2.0, a team-level memory hub for AI agents. The idea is super simple: if project context was already explained once, a new session should not need it repeated.
使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線
在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。