星環科技發佈GPU原生數據庫 試水AI Agent數據底座

重點摘要
星環科技發佈GPU原生數據庫 試水AI Agent數據底座TechPulse2026.07.21 12:46 · 來自河北全文1360字00:00 / 04:21將完整數據庫功能遷移至GPU,在工程上難度極高,涉及存儲引擎、查詢優化器、事務管理等模塊的全面重寫。7月17日,星環科技在上海世界人工智能大會(WAIC)上發佈GPU原生認知數據庫預覽版,該產品將數據庫完整功能遷移至GPU運行,試圖重構數據庫底層計算架構。星環科技創始人孫元浩稱,星環科技是目前全球唯一將完整數據庫功能在GPU上運行的公司,領先國際競爭對手一代。據他介紹,在TPC-DS基準測試中,該產品使用多卡GPU可在數秒內完成1TB數據集的99個複雜查詢,而傳統CPU方案需要數十秒至數百秒。孫元浩表示,該產品研發週期約一年半,預覽版發佈後已開放客戶測試申請,正式版預計今年年底前上線。此次產品發佈的背景是,企業級AI應用正從大模型問答向AI Agent方向演進。孫元浩表示,AI Agent在執行任務過程中會持續調用數據、檢索知識,單次任務可能發起數百次數據訪問。傳統CPU數據庫在面對高併發Agent負載時,計算核心和內存帶寬不足,且數據在CPU與GPU之間搬運帶來的時延問題突出。一位數據庫行業人士表示,將完整數據庫功能遷移至GPU在工程上難度極高,涉及存儲引擎、查詢優化器、事務管理等模塊的全面重寫。GPU擁有萬級並行計算單元和數TB/s級高帶寬顯存。星環科技的方案是將數據庫整體遷移至GPU運行,使數據分析計算與模型推理在同一顯存內完成,避免跨芯片數據搬運。孫元浩稱,這一架構改變了對傳統CPU-GPU 1:1配比的需求,GPU空閒算力也可被充分利用。除計算架構變化外,新產品還將知識檢索、上下文供給與長期記憶管理納入同一數據庫底座。孫元浩將其定義為“認知數據庫”,稱其不只記錄結構化數據,還能理解文檔內容、自動建立關聯。
星環科技發佈GPU原生數據庫 試水AI Agent數據底座TechPulse2026.07.21 12:46 · 來自河北全文1360字00:00 / 04:21將完整數據庫功能遷移至GPU,在工程上難度極高,涉及存儲引擎、查詢優化器、事務管理等模塊的全面重寫。7月17日,星環科技在上海世界人工智能大會(WAIC)上發佈GPU原生認知數據庫預覽版,該產品將數據庫完整功能遷移至GPU運行,試圖重構數據庫底層計算架構。星環科技創始人孫元浩稱,星環科技是目前全球唯一將完整數據庫功能在GPU上運行的公司,領先國際競爭對手一代。
據他介紹,在TPC-DS基準測試中,該產品使用多卡GPU可在數秒內完成1TB數據集的99個複雜查詢,而傳統CPU方案需要數十秒至數百秒。孫元浩表示,該產品研發週期約一年半,預覽版發佈後已開放客戶測試申請,正式版預計今年年底前上線。此次產品發佈的背景是,企業級AI應用正從大模型問答向AI Agent方向演進。孫元浩表示,AI Agent在執行任務過程中會持續調用數據、檢索知識,單次任務可能發起數百次數據訪問。傳統CPU數據庫在面對高併發Agent負載時,計算核心和內存帶寬不足,且數據在CPU與GPU之間搬運帶來的時延問題突出。
一位數據庫行業人士表示,將完整數據庫功能遷移至GPU在工程上難度極高,涉及存儲引擎、查詢優化器、事務管理等模塊的全面重寫。GPU擁有萬級並行計算單元和數TB/s級高帶寬顯存。星環科技的方案是將數據庫整體遷移至GPU運行,使數據分析計算與模型推理在同一顯存內完成,避免跨芯片數據搬運。孫元浩稱,這一架構改變了對傳統CPU-GPU 1:1配比的需求,GPU空閒算力也可被充分利用。除計算架構變化外,新產品還將知識檢索、上下文供給與長期記憶管理納入同一數據庫底座。孫元浩將其定義為“認知數據庫”,稱其不只記錄結構化數據,還能理解文檔內容、自動建立關聯。
據其介紹,該系統記憶準確率超過90%,在BEAM 500K和LongMemEval-S基準測試中超過主流開源記憶系統。在GPU加速數據庫領域,Snowflake和Databricks均在探索相關技術路徑。孫元浩評價稱,國際公司的嘗試時間更長,但僅實現局部加速,加速比平均約1.5倍,GPU比CPU貴兩三倍,1.5倍的加速沒有經濟性。從客戶側看,孫元浩表示,對GPU原生數據庫反饋最積極的行業包括金融、製造、零售和交通。在本次WAIC展會上,星環科技展示了浦發銀行、天津能源投資集團等客戶的案例。以信貸全鏈路分析為例,面對4.
8億條明細數據,GPU原生數據庫實現了特定場景下449倍的性能提升;在智能投研場景中,性能提升覆蓋30倍至5881倍。不過,性能數據能否轉化為商業收入仍存不確定性。星環科技近年財報顯示公司尚未盈利,企業級基礎軟件的拓展受限於客戶預算週期。GPU原生數據庫的定價策略、與現有產品的兼容遷移方案、以及從試用到採購的轉化率,將決定該產品能否成為新的增長點。在產品矩陣方面,星環科技同時展示了大模型運營平臺Sophon LLMOps、智能體開發平臺AgentBox、智能數據平臺XClaw和數據治理平臺Astro,覆蓋從語料治理到智能辦公的鏈路。
但孫元浩強調,公司核心仍是數據基礎軟件,數據庫和大數據平臺是主業。談及算力成本,孫元浩認為,儘管Token單價在下降,但企業實際使用中的總成本仍然高昂,他判斷,未來兩三年硬件將有革命性變化,軟件層面也在重構,必須通過軟硬件聯合創新持續降低推理成本,企業才能大規模用得起AI。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線
在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。