鈦媒體生成式AI

安謀科技公開新一代NPU架構 並牽頭髮起開源AI操作系統聯盟

2026年7月22日 12:52
安謀科技公開新一代NPU架構 並牽頭髮起開源AI操作系統聯盟

重點摘要

安謀科技在2026世界人工智能大會上首次公開新一代NPU架構「周易」X3-Pro,並牽頭髮起開源AI操作系統聯盟AIOS,展現從IP授權公司轉向平台型生態的意圖。該公司提出三條技術路徑因應端側AI資源受限問題,並推出星辰300異構計算平台,同時聯合多家晶片與模型廠商成立AIOS聯盟,以擴大在終端產品端的影響力。

站內 AI 整理稿

安謀科技公開新一代NPU架構 並牽頭髮起開源AI操作系統聯盟

安謀科技(Arm China)正加速從IP授權公司轉型為平台型生態參與者。在2026年世界人工智能大會(WAIC 2026)期間,該公司不僅首次公開了專為智能體(Agentic AI)時代設計的新一代NPU架構「周易」X3-Pro,還宣布牽頭髮起開源AI操作系統聯盟AIOS,同時展示了基於自研星辰CPU與Arm Ethos所打造的首代星辰300異構計算平台。市場人士指出,這一連串動作的核心意圖,是向外界傳達安謀科技不再只是單純提供IP授權,而是要積極參與定義端側AI的計算標準與軟體生態。安謀科技CPU產品線負責人朱曉鳴在演講中強調,端側AI目前面臨的最大挑戰在於資源有限。

他指出,用戶期望端側AI能夠隨時在線,並處理更多上下文數據,但電池容量有限,加上記憶體與頻寬的瓶頸,使得技術突破變得更加迫切。他引用行業數據說明,2022年要達到MMLU基準60分的商用門檻,模型需要數百億個參數;到了2026年,這個門檻已經降至接近10億個參數,顯示大模型向端側遷移的可行性正在快速提升。針對資源受限的問題,安謀科技提出了三條技術路徑:在CPU上擴展向量與張量處理指令,外掛通用小算力NPU作為算力補充,以及探索SRAM存內計算。安謀科技自研的星辰STAR系列CPU,從第二代MC2開始就支援Arm Helium指令集。

朱曉鳴表示,Helium在機器學習場景下,相較於上一代產品平均性能提升三倍,部分場景甚至超過八倍。現場展示的星辰300平台,將STAR CPU與Ethos NPU整合在一起,單顆CPU只能追蹤一張人臉,加入NPU後則可同時追蹤五到六張人臉。安謀科技將端側AI的應用場景分為四大類:個人終端強調續航力與隱私保護,視覺與空間智能要求低延遲處理,工業邊緣需要任務確定性與長生命週期,邊緣盒子則要求多路併發與24小時在線運作。該公司認為,端側AI並非雲端AI的縮小版,而是需要獨立設計的架構。

基於此原則,安謀科技推出了周易X3-Pro架構,採用統一分層場景化設計,衍生出Lite、Premium、Subsys三個系列,覆蓋從低功耗端側到大算力複雜推理的各種場景。軟體層保持統一,硬體層則進行差異化抽象。該產品目前仍在研發階段。在端側影片處理方面,安謀科技觀察到,影片消費者的主體正在發生變化。越來越多的影片消費者是AI,用於推理與訓練。如果影片品質有損,將對AI推理精度產生顯著影響。安謀科技今年發布的「玲瓏」VPU峨眉系列,已整合輕量化AI運算子,實現內容感知編碼;明年年初將推出的武當系列,則支援8K 30fps編碼,且面積節省40%。

此外,安謀科技正在研發的端到端影片編碼技術,在目標追蹤與動作識別任務上,編碼品質提升超過10%。本次大會期間,安謀科技牽頭髮起開源AI操作系統聯盟AIOS。安謀市場及生態副總裁梁泉表示,AI設備的互動模式正在從回合制對話,轉向持續感知與具身互動,傳統操作系統已無法應對這項變化。他介紹,AIOS架構包含三個核心模組:模型引擎負責推理與端雲協同路由,Agentic Engine負責多輪工具調用與任務編排,DataFlow引擎則處理多模態數據流。聯盟的開放範圍涵蓋軟體程式碼、AI模型、產品原型與設計文件。首批成員包括紫光展銳、瑞芯微、輝羲等晶片廠商,以及面壁智能等模型公司。

此外,安謀科技也與香港科技大學物理AI實驗室聯合發布了VLA模型。業界分析師指出,傳統IP授權模式的限制在於,晶片設計完成後,IP公司的影響力便基本終止。透過牽頭髮起AIOS聯盟,安謀科技的影響力正從晶片設計端延伸至終端產品端。目前AIOS聯盟仍處於早期推廣階段,但其戰略意圖已相當明確:安謀科技正試圖在端側AI的硬體與軟體層面,同時建立具影響力的生態系統。

Related

相關文章

MarkTechPost AI生成式AI

使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線

在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。

1 小時前
MarkTechPost AI生成式AI

NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架

NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

1 小時前

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

3 小時前