鈦媒體生成式AI

星環科技發佈GPU原生數據庫 試水AI Agent數據底座

2026年7月21日 12:48
星環科技發佈GPU原生數據庫 試水AI Agent數據底座

重點摘要

星環科技發佈GPU原生數據庫 試水AI Agent數據底座TechPulse2026.07.21 12:46 · 來自河北全文1360字00:00 / 04:21將完整數據庫功能遷移至GPU,在工程上難度極高,涉及存儲引擎、查詢優化器、事務管理等模塊的全面重寫。7月17日,星環科技在上海世界人工智能大會(WAIC)上發佈GPU原生認知數據庫預覽版,該產品將數據庫完整功能遷移至GPU運行,試圖重構數據庫底層計算架構。星環科技創始人孫元浩稱,星環科技是目前全球唯一將完整數據庫功能在GPU上運行的公司,領先國際競爭對手一代。據他介紹,在TPC-DS基準測試中,該產品使用多卡GPU可在數秒內完成1TB數據集的99個複雜查詢,而傳統CPU方案需要數十秒至數百秒。孫元浩表示,該產品研發週期約一年半,預覽版發佈後已開放客戶測試申請,正式版預計今年年底前上線。此次產品發佈的背景是,企業級AI應用正從大模型問答向AI Agent方向演進。孫元浩表示,AI Agent在執行任務過程中會持續調用數據、檢索知識,單次任務可能發起數百次數據訪問。傳統CPU數據庫在面對高併發Agent負載時,計算核心和內存帶寬不足,且數據在CPU與GPU之間搬運帶來的時延問題突出。一位數據庫行業人士表示,將完整數據庫功能遷移至GPU在工程上難度極高,涉及存儲引擎、查詢優化器、事務管理等模塊的全面重寫。GPU擁有萬級並行計算單元和數TB/s級高帶寬顯存。星環科技的方案是將數據庫整體遷移至GPU運行,使數據分析計算與模型推理在同一顯存內完成,避免跨芯片數據搬運。孫元浩稱,這一架構改變了對傳統CPU-GPU 1:1配比的需求,GPU空閒算力也可被充分利用。除計算架構變化外,新產品還將知識檢索、上下文供給與長期記憶管理納入同一數據庫底座。孫元浩將其定義為“認知數據庫”,稱其不只記錄結構化數據,還能理解文檔內容、自動建立關聯。

站內 AI 整理稿

星環科技發佈GPU原生數據庫 試水AI Agent數據底座TechPulse2026.07.21 12:46 · 來自河北全文1360字00:00 / 04:21將完整數據庫功能遷移至GPU,在工程上難度極高,涉及存儲引擎、查詢優化器、事務管理等模塊的全面重寫。7月17日,星環科技在上海世界人工智能大會(WAIC)上發佈GPU原生認知數據庫預覽版,該產品將數據庫完整功能遷移至GPU運行,試圖重構數據庫底層計算架構。星環科技創始人孫元浩稱,星環科技是目前全球唯一將完整數據庫功能在GPU上運行的公司,領先國際競爭對手一代。據他介紹,在TPC-DS基準測試中,該產品使用多卡GPU可在數秒內完成1TB數據集的99個複雜查詢,而傳統CPU方案需要數十秒至數百秒。孫元浩表示,該產品研發週期約一年半,預覽版發佈後已開放客戶測試申請,正式版預計今年年底前上線。此次產品發佈的背景是,企業級AI應用正從大模型問答向AI Agent方向演進。孫元浩表示,AI Agent在執行任務過程中會持續調用數據、檢索知識,單次任務可能發起數百次數據訪問。傳統CPU數據庫在面對高併發Agent負載時,計算核心和內存帶寬不足,且數據在CPU與GPU之間搬運帶來的時延問題突出。一位數據庫行業人士表示,將完整數據庫功能遷移至GPU在工程上難度極高,涉及存儲引擎、查詢優化器、事務管理等模塊的全面重寫。GPU擁有萬級並行計算單元和數TB/s級高帶寬顯存。星環科技的方案是將數據庫整體遷移至GPU運行,使數據分析計算與模型推理在同一顯存內完成,避免跨芯片數據搬運。孫元浩稱,這一架構改變了對傳統CPU-GPU 1:1配比的需求,GPU空閒算力也可被充分利用。除計算架構變化外,新產品還將知識檢索、上下文供給與長期記憶管理納入同一數據庫底座。孫元浩將其定義為“認知數據庫”,稱其不只記錄結構化數據,還能理解文檔內容、自動建立關聯。據其介紹,該系統記憶準確率超過90%,在BEAM 500K和LongMemEval-S基準測試中超過主流開源記憶系統。在GPU加速數據庫領域,Snowflake和Databricks均在探索相關技術路徑。孫元浩評價稱,國際公司的嘗試時間更長,但僅實現局部加速,加速比平均約1.5倍,GPU比CPU貴兩三倍,1.5倍的加速沒有經濟性。從客戶側看,孫元浩表示,對GPU原生數據庫反饋最積極的行業包括金融、製造、零售和交通。在本次WAIC展會上,星環科技展示了浦發銀行、天津能源投資集團等客戶的案例。以信貸全鏈路分析為例,面對4.8億條明細數據,GPU原生數據庫實現了特定場景下449倍的性能提升;在智能投研場景中,性能提升覆蓋30倍至5881倍。不過,性能數據能否轉化為商業收入仍存不確定性。星環科技近年財報顯示公司尚未盈利,企業級基礎軟件的拓展受限於客戶預算週期。GPU原生數據庫的定價策略、與現有產品的兼容遷移方案、以及從試用到採購的轉化率,將決定該產品能否成為新的增長點。在產品矩陣方面,星環科技同時展示了大模型運營平臺Sophon LLMOps、智能體開發平臺AgentBox、智能數據平臺XClaw和數據治理平臺Astro,覆蓋從語料治理到智能辦公的鏈路。但孫元浩強調,公司核心仍是數據基礎軟件,數據庫和大數據平臺是主業。談及算力成本,孫元浩認為,儘管Token單價在下降,但企業實際使用中的總成本仍然高昂,他判斷,未來兩三年硬件將有革命性變化,軟件層面也在重構,必須通過軟硬件聯合創新持續降低推理成本,企業才能大規模用得起AI。

Related

相關文章

智東西生成式AI

WAIC現場直擊:端側算力競賽爆發,聆思手握下一代AI終端落地關鍵籌碼

智東西(公眾號:zhidxcom) 作者 | 程茜 編輯 | 漠影 智東西7月21日報道,剛剛落幕的世界人工智能大會(WAIC 2026)上,掀起了一場終端智能硬件的集中爆發浪潮。 縱觀整場大會,行業賽道最直觀的轉向清晰可見:AI賽道的焦點正在從扎堆雲端超算集群、以參數規模和雲端算力論高下,向手機、AI PC、人形機器人、智能座艙、全屋中控等泛終端硬件轉移。 AI的落地形態也隨之革新。

剛剛
IT之家生成式AI

阿里千問 Qwen3.8-Max-Preview 最新版本已上線,前端表現獲提升

首頁 > 智能時代>人工智能 阿里千問 Qwen3.8-Max-Preview 最新版本已上線,前端表現獲提升 2026/7/21 19:29:06 來源:IT之家 作者:遠洋 責編:遠洋 評論: IT之家 7 月 21 日消息,據千問大模型官方消息,Qwen3.8-Max-Preview 最新版本已上線,能力又有提升,前端(WebDev)表現會更好。千問大模型稱:“Qwen3.

剛剛

WAIC觀點:最快兩年,迎來機器人“ChatGPT時刻”

在2026世界人工智能大會上,具身智能企業聚焦機器人真實場景落地,業界認為最快兩年內將迎來機器人「ChatGPT時刻」。然而,訓練世界模型仍面臨數據、表徵與閉環三大挑戰,各企業在數據來源與模型架構上各有不同策略。

剛剛

在下一個模型發佈之前

賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機。

剛剛