IT之家生成式AI

此芯發佈“桌面級 AI 超算”AGX Station:基於 P1,支持多形態算力卡

2026年7月18日 16:25
此芯發佈“桌面級 AI 超算”AGX Station:基於 P1,支持多形態算力卡

重點摘要

此芯在上海發布桌面級AI超算AGX Station,基於P1處理器,支援M.2、MXM、PCIe等多種算力卡,算力可擴展至160-320TOPS,能推理70B至150B參數的大模型。同時推出專為智能體設計的Agentic OS作業系統,整合智譜AI、Kimi等主流大模型,實現動態資源調度與異構設備管理。

站內 AI 整理稿

此芯科技於上海正式發表「桌面級AI超算」AGX Station,同步揭曉全新AGI算力戰略

中國晶片設計公司此芯(CIX)昨日(7月17日)於上海舉行發表會,正式對外公布其「AGX Agentic Compute」智能體計算戰略,並推出首款對應硬體產品——桌面級AI超算工作站AGX Station,以及完整的全棧智能體算力產品系列。此芯表示,AGX Agentic Compute戰略的核心目標是聚焦於智能體專用CPU的研發,透過自研Arm架構系統單晶片(SoC)作為運算中樞,實現從終端裝置、邊緣節點到雲端資料中心的全域算力協同,打造覆蓋端、邊、雲全場景的統一算力底座,最終達成「一芯驅動全場景AGI」的願景。AGX Station即為此戰略的首款硬體實現。

這款被定位為「桌面級AI超算」的設備,採用此芯自研的P1處理器作為核心運算單元,並導入模組化、可擴充的開放式硬體架構設計。機身尺寸僅150×150×60毫米,體積小巧,卻能支援多種規格的算力卡擴充,包括M.2、MXM以及PCIe等不同介面形態,讓使用者可根據實際AI工作負載需求,彈性調整整體運算效能。在算力表現方面,AGX Station可支援從160 TOPS到最高320 TOPS的算力擴展範圍,並具備原生推理70B至150B參數規模大型語言模型的能力。這意味著使用者無需透過雲端連線,即可在本地端直接運行當前主流的大規模AI模型,對於需要高度隱私保護或低延遲回應的應用場景極具吸引力。

連接與擴充性同樣是AGX Station的設計重點。該設備整合了兩組10G RDMA高速網路介面,可提供低延遲、高吞吐量的資料傳輸,適合用於多機叢集或邊緣推理部署。此外,亦配備標準USB、HDMI等通用連接埠,能輕鬆銜接各類周邊裝置與顯示設備,滿足開發者與研究人員在實驗室或辦公環境中的多元使用需求。與硬體同步亮相的,是專為智能體應用場景打造的操作系統軟體——Agentic OS。

此芯說明,Agentic OS基於多智能體分佈式架構設計,能夠實現計算資源的動態調度與異構設備的統一管理,讓不同類型的運算單元(如CPU、GPU、NPU等)在系統層級上協同運作,充分發揮AGX Station的硬體潛力。更重要的是,Agentic OS導入模型即服務(MaaS)能力,內建整合國內外多家主流大模型廠商的服務,包括智譜AI的GLM系列、Kimi、阿里巴巴的通義千問(Qwen),以及百度的文心一言等。開發者可直接透過標準化API呼叫這些模型,無需自行部署與維護模型推理環境,大幅降低AI應用開發的門檻。

同時,此芯也提供全棧開發工具鏈,涵蓋模型訓練、推理優化、部署監控等環節,協助開發者快速打造從原型到落地的智能體應用。此芯此次發表會選在2026世界人工智能大會(WAIC 2026)期間舉行,大會現場亦設有專區展示AGX Station的實際運作情境。業界分析認為,隨著大型語言模型參數量持續攀升,以及邊緣AI、智能體應用的快速普及,市場對具備高算力、低延遲、可在地端部署的硬體設備需求日益強勁。此芯以Arm架構切入桌面級AI運算領域,並透過模組化設計與開放式軟體生態,試圖在AI晶片與系統市場中走出差異化路線。

此芯方面表示,AGX Station預計將於今年下半年開始向特定開發者與企業客戶供貨,後續也將根據市場回饋推出更多周邊擴充模組與軟體更新。隨著AGX Agentic Compute戰略的逐步落地,此芯期望能為AI開發者社群提供更靈活、更高效的端到端算力解決方案,推動智能體技術從概念驗證走向大規模商業部署。

Related

相關文章

MarkTechPost AI生成式AI

NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架

NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

28 分鐘前

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

2 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

3 小時前

可靈AI核心技術骨幹王鑫濤被曝離職

快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

3 小時前