賈揚清再創業,造了一支AI軍團,讓GLM-5.2提速534%

重點摘要
好的,這是一篇基於您提供資料重寫的完整新聞稿。 --- ## AI大牛賈揚清再創業「造軍團」,祭出三大殺手鐧,GLM-5.2推理速度狂飆534% AI領域的傳奇人物賈揚清再次成為業界焦點。這位阿里雲前副總裁、Lepton AI創始人,在告別英偉達約一個月後,迅速啟動了新一輪創業項目「Intent Lab」,並組建了一支名為「Fleet」的自主AI團隊,目標是將使用者的模糊意圖直接轉化為可上線的生產級軟體系統,挑戰AI在軟體工程領域的能力邊界。
好的,這是一篇基於您提供資料重寫的完整新聞稿。 ---
## AI大牛賈揚清再創業「造軍團」,祭出三大殺手鐧,GLM-5.2推理速度狂飆534%
AI領域的傳奇人物賈揚清再次成為業界焦點。這位阿里雲前副總裁、Lepton AI創始人,在告別英偉達約一個月後,迅速啟動了新一輪創業項目「Intent Lab」,並組建了一支名為「Fleet」的自主AI團隊,目標是將使用者的模糊意圖直接轉化為可上線的生產級軟體系統,挑戰AI在軟體工程領域的能力邊界。 不同於市面上主要負責生成代碼的「程式設計助手」,Fleet的定位更像是一家麻雀雖小、五臟俱全的「微型軟體公司」。它不僅要會寫程式,更要能完整承擔一支工程團隊的職責:從理解客戶需求、設計系統架構、協調團隊任務,到編寫代碼、進行嚴格的測試驗證,乃至產品上線後的持續監控與迭代,實現全流程的自動化閉環。 為了證明Fleet的實力,Intent Lab一舉公佈了三項極具震撼力的早期成果,涵蓋了模型推理優化、系統重構與底層基礎設施開發,展示了AI在複雜軟體工程中的巨大潛力。 ### 核心突破一:為GLM-5.2加速,效能提升534%
Fleet的第一個任務,是挑戰一個業界公認的難題:為已經過高度優化的AI推理引擎「TensorRT-LLM」進行二次優化,使其能在特定的英偉達計算節點上,以極致效率運行GLM-5.2大模型。由於TensorRT-LLM本身已是效能標杆,想要在此基礎上「擠出」更多潛力,難度極高。 Fleet並未退縮,它像一位經驗豐富的系統工程師,從四個層面展開了系統性的效能剖析與優化。首先是 **核心內核層**,通過內核融合與直接生成更底層的PTX、SASS代碼,減少了啟動開銷,使推理效能提升24%;其次是 **運行時層**,利用H2D批處理實現了解碼階段的零拷貝,再獲16%的性能增益;接著在 **通信層**,Fleet將集合通信、殘差相加和RMSNorm等操作進行融合,又帶來了18%的提升。 最後的殺手鐧是引入了 **推測解碼技術(DSpark)**。模型不再逐個生成token,而是能一次提出並驗證多個候選token,將推理速度直接提升了約4倍。經過這一連串由Fleet自主發現、實現並驗證的優化組合拳,GLM-5.2的端到端推理性能,從原來TensorRT-LLM的102 token/s,一舉躍升至驚人的**647 token/s**,整體提速**534%**。Intent Lab自豪地宣稱,這是目前GLM-5.2所能達到的最快推理速度,且整個過程完全由Fleet獨立完成,無任何人為干預。 ### 核心突破二:「一句話」從零造數據庫,成本僅350美元
Fleet的第二項成就更具科幻色彩。Intent Lab的研究人員只下達了一條簡單的指令:「構建一個與SQLite兼容的SQL數據庫引擎,使其能夠通過全部sqllogictest測試用例,性能達到或超過SQLite。」 他們沒有提供任何SQLite的源代碼或文檔,僅將公開的測試套件作為唯一的驗收標準。 這項任務考驗的是Fleet從零開始設計並建構複雜系統的能力。Fleet內部模擬了軟體開發團隊的分工,將工作分解給「決策者」、「架構師」、「碼農」、「測試員」、「審查員」和「質保員」等不同角色。這些AI角色在整個開發過程中反覆協作,根據代碼的演變不斷調整設計,並進行迭代測試與審查。 整個開發過程堪稱一場巨量的「算力勞動」。整輪運行總共消耗了**8720萬個輸出token**,其中編碼(38.6%)和測試(21.7%)佔據了主體,但值得注意的是,決策和架構設計也分別佔了17.8%和13.3%,這表明Fleet並非簡單的「代碼複讀機」,它將大量精力花費在高層次的設計與驗證上。最終,Fleet不僅成功從無到有構建了一個全新的數據庫,更以百分之百的通過率,**一次性通過了全部600萬項驗收測試**。更令人驚訝的是,當全部使用開源模型時,整輪運行的成本僅約為**350美元**(約合人民幣2368元),展現了極高的成本效益。 ### 核心突破三:打造Agent專屬文件系統,性能碾壓EFS
Fleet的第三個成果,是為AI Agent自身打造一個專用的分佈式文件系統——AgentFS。研究團隊發現,AI Agent在工作時,會頻繁地創建沙箱、掃描目錄、處理大量的小文件,這些工作負載特性與亞馬遜EFS或S3FS等傳統雲存儲方案並不匹配。 為此,Fleet決定從頭開始,為Agent量身定制一個名為AgentFS的分佈式文件系統。結果令人震驚:在標準的mdtest性能測試中,AgentFS執行目錄和文件創建操作的速度是EFS的45倍,文件讀取速度為30倍。而在Agent最常用的狀態查詢操作上,AgentFS的表現更是「降維打擊」,其**目錄狀態查詢速度達到EFS的驚人626倍,文件狀態查詢速度也達到了625倍**。 在貼近實際應用的Git代碼庫操作測試中,AgentFS同樣表現出色,克隆、查詢狀態和刪除代碼庫的速度分別是EFS的2.5至3倍、6.9至9.5倍和13至14倍。除了性能,AgentFS還經歷了極為嚴格的可靠性驗證,Fleet檢查了31個模型中的約190萬個可達狀態,模擬了不同的順序、崩潰和競爭情況。驗證過程中,Fleet甚至自主發現並修復了一個由其他程式設計Agent引入的、可能導致數據損壞的潛在Bug,展現了其在品質保障上的嚴謹性。 從優化AI推理引擎,到從無到有構建數據庫,再到創造專用文件系統,賈揚清的Intent Lab正試圖透過Fleet,將AI從單純的「代碼生成工具」,升級為能夠獨立思考、自主規劃、協同作業並交付完整系統的「AI工程團隊」。雖然Fleet目前的成果仍帶有早期探索性質,能否穩定處理更大型、更複雜的真實商業項目尚需時間驗證,但它無疑為我們描繪了一幅AI驅動軟體工程的未來藍圖,預示著軟體開發模式可能正在迎來一場前所未有的變革。
Related
相關文章

剛剛,OpenAI硬件路線圖曝光:先音箱後手機
OpenAI 的硬體布局終於有了更清晰的輪廓。根據最新曝光的產品路線圖,這家 AI 巨頭並不打算急著推出備受期待的智慧型手機,而是先從一款能夠在家裡自由移動的無螢幕智慧音箱下手。這項策略背後,其實反映了 OpenAI 想要讓 AI 真正融入日常生活,而非僅停留在手機應用程式的野心。 據了解,OpenAI 在一年前斥資 65 億美元收購了由知名設計師 Jony Ive 創辦的公司 io,之後便開始積極籌劃自有硬體產品。

2026年中國工業具身智能行業發展研究報告(上)
賬號設置我的關注我的收藏申請的項目退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機構庫投資機構職位推介投資人認證投資人服務項目推薦36氪Pro創投氪堂企業入駐創業者服務創投平臺AI測評網 首頁快訊資訊推薦財經AI項目推薦廣東最新創投汽車科技專精特新直播視頻專題活動搜索項目推薦我要入駐城市合作2026年中國工業具身智能行業發展研究報告(上)艾瑞諮詢·2026年07月30日 08:45工業具身智能產業發展及落地路徑分析 摘要 工業具身智能的興起,源於工業需求與技術能力的共同變化。 製造業正從大批量、固定流程生產,走向多品種、小批量、柔性化生產,傳統工業機器人在非結構化環境、複雜任務理解和動態適應方面仍存在侷限。與此同時,多模態感知、智能決策、運動控制、仿真訓練與機器人本體技術持續進步,為智能系統進入真實工業現場創造了條件。因此,工業具身智能並非簡單新增一種機器人品類,而是圍繞真實工業任務,將感知、決策、執行、反饋與迭代組織成閉環的現場智能系統。 技術競爭不再只看單點能力突破,而是轉向任務閉環中的系統協同。 工業具身智能不等同於人形機器人,也不由單一本體形態或模型能力定義;固定操作、移動感知、移動操作、廠內物流、產線流轉等載體將按任務長期並存。當前感知、控制和執行等模塊已有一定產業基礎,但複雜任務理解、異常處理、跨場景泛化和持續學習仍處發展階段。技術能否形成產業價值,關鍵在於能否支撐真實工業任務穩定運行、結果驗證、異常恢復和持續優化。 工業具身智能不會在所有場景同步放量,而將從高價值、可閉環任務率先突破。

影視颶風日賺500萬,李一舟捲土重來,49元AI課“割”瘋了?
影視颶風推出49元AI實戰課,上線當天即熱銷10萬份,日收入近500萬元,但被網友質疑內容像廣告、含金量低,屬於「割韭菜」。與此同時,初代AI教父李一舟也以49元低價課捲土重來,再透過私域推銷1980元年費課程,引發爭議。整體而言,AI知識付費市場雖持續增長,但多次割韭菜行為已讓用戶對該領域信任度下降。

楊植麟終於追上梁文鋒了
# 杨植麟终于追上梁文锋了:中国开源大模型双雄格局初成 2026年7月30日,一则消息引爆了全球AI圈——月之暗面(Kimi)正式开源了K3模型权重。这个拥有2.8万亿总参数、性能接近全球最顶级模型Claude Fable 5的大模型,以完全免费下载、本地部署、自由商用的姿态,向世界展示了中国AI力量的又一次跃升。 这不仅仅是一次技术发布。它标志着中国两大独立大模型公司——DeepSeek和Kimi——在技术与影响力的赛道上,终于站到了并肩的位置。

Edge AI Daily 早報(7月30日)
Edge AI Daily 早報(7月30日)Edge AI Daily2026.07.30 08:06 · 來自北京全文4139字00:00 / 11:24Meta資本支出飆升至1250-1450億美元,標誌互聯網公司向AI基礎設施重資產轉型。

OpenAI 計劃向 10 萬名科學家免費開放 GPT-5.6 系列 AI 模型等資源
首頁 > 智能時代>人工智能 OpenAI 計劃向 10 萬名科學家免費開放 GPT-5.6 系列 AI 模型等資源 2026/7/30 7:41:39 來源:IT之家 作者:故淵 責編:故淵 評論: 感謝IT之家網友 華南吳彥祖 的線索投遞!