Agent開始啃長任務,小米把大模型架構改了

2026年9月24日 00:31
Agent開始啃長任務,小米把大模型架構改了
站內 AI 整理稿

鄭敏芳 發表於 2026年09月24日 16:30 摘要:Agent正在反過來改變大模型的底層架構。9月24日,小米MiMo負責人羅福莉公佈面向MiMo ...Agent正在反過來改變大模型的底層架構。9月24日,小米MiMo負責人羅福莉公佈面向MiMo V3的核心架構HySparse2,明確瞄準下一代長上下文Agent。與普通聊天不同,Agent在完成一項複雜任務時,需要反覆搜索網頁、讀取文件、調用工具,再根據返回結果繼續下一步。一條簡單的工具調用可能帶回來一整份文檔或大量執行日誌;隨著任務不斷推進,模型還要保留此前的操作記錄,並從越來越長的歷史信息中找到下一步真正需要的內容。

這也意味著,過去主要面向聊天場景設計的大模型架構,開始需要適應新的工作負載。HySparse2的思路是減少模型反覆“讀材料”的計算量,同時壓低保存歷史信息所需要的緩存。在80B-A3B MoE模型、100萬Token上下文的測試中,相比MiMo-V2.6使用的Hybrid SWA架構,HySparse2的長文本預填充計算量降至約1/5,KV Cache則從約12GB降至2.7GB。這一變化背後是今年以來Agent的工作量正在快速增多。辦公是最典型的場景之一。

今年以來,騰訊WorkBuddy、百度搭子、阿里千問辦公等產品陸續把Agent帶入桌面,能力也從回答問題進一步延伸到讀取本地文件、處理表格、製作文檔以及跨軟件執行任務。當Agent從“聊幾句話”變成連續工作幾十分鐘甚至更久,模型面對的不再只是一段用戶問題,而可能是一份數十頁的報告、多個網頁、會議記錄、代碼以及一長串工具調用歷史。誰能用更低成本保存和讀取這些上下文,也開始直接影響Agent的響應速度和使用成本。小米自己也已經開始試水這一方向。

今年3月,小米啟動Xiaomi miclaw封測,這是基於MiMo大模型構建的Agent測試產品,最初嘗試讓Agent直接調用手機應用、系統能力及米家設備;4月,小米進一步將miclaw擴展到PC和Mac,支持文檔整理、數據分析和批量文件處理等桌面任務,並嘗試手機、電腦和IoT設備之間的跨端協作。不過,miclaw已經在9月21日結束近半年的封測。與此同時,小米在HyperOS 4中計劃上線超級小愛專家模式,將複雜任務規劃、跨應用操作和“人車家”生態聯動進一步放入系統級入口。從產品變化來看,小米的Agent探索正在從一個獨立測試產品,進一步向操作系統和“人車家”生態內部延伸。

HySparse2透露的則是另一層變化:在應用層尋找Agent入口的同時,小米已經開始按照Agent真正工作的方式,重新設計下一代MiMo模型。風險提示及免責條款 市場有風險,投資需謹慎。本文不構成個人投資建議,也未考慮到個別用戶特殊的投資目標、財務狀況或需要。用戶應考慮本文中的任何意見、觀點或結論是否符合其特定狀況。據此投資,責任自負。VC/PE圈 AI全知道 收藏 分享 0條評論 發送

Related

相關文章

量子位生成式AI

PCIe顯卡被低估了!內核補齊+通信重構,DeepSeek推理吞吐翻近7倍

是石科技推出Meta-Infer高效推理引擎,透過內核補齊、算子優化與通信重構等軟體優化,於PCIe架構GPU上將DeepSeek-V4.1-Flash輸入吞吐提升近6.87倍,並在國產GPU上也獲得顯著增益。該方法證明無需依賴頂級硬體,靠軟體調校即可縮小與高階GPU的推理效能差距,為長尾硬體提供規模化生產服務的新途徑。

剛剛
鈦媒體生成式AI

梁文鋒用沙盒開啟RSI

字母AI2026.09.24 18:16 · 來自北京全文4232字00:00 / 11:21DeepSeek聯合清華大學發論文,梁文鋒署名文 | 字母AIDeepSeek聯合清華大學發表了一篇文章,署名的最後一人是梁文鋒。文章表面上是說DeepSeek訓練Agent所使用的沙盒,但是論文第6節越看越不對勁。字裡行間寫了三個英文字母:RSI。通過這個沙盒,Agent能創建自己需要的環境,這個環境會再次訓練Agent,被訓練的更強的Agent會創造更好的環境。由此形成了一個小型的RSI閉環。

剛剛

首部上星AI長劇《後西遊記》幕後:沒有攝影機,100%畫面由Seedance生成,單集成本壓到十幾萬

這部規劃60集、每集約40分鐘的劇集由芒果TV出品、伯璟文化承製,全程沒有一臺攝影機,視頻生成100%交給Seedance完成。上線僅一週,芒果TV正片播放量就衝破1.5億次。把這部劇推出來的,是兩個被傳統影視邏輯卡過的人。總導演李東珅長期拍紀錄片,執導的《河西走廊》豆瓣9.

剛剛
智東西生成式AI

MiMo-V2.6剛發,小米羅福莉扔出MiMo-V3新架構!引用DeepSeek多項成果

(公眾號:zhidxcom) 作者 | 江宇 編輯 | 李水青 9月24日報道,昨晚,小米MiMo大模型負責人羅福莉發文,提前披露了MiMo-V3的新架構,其核心組件HySparse2率先登場,相關技術論文同步公佈。▲羅福莉發文 簡單來說,這套新架構主要解決Agent越做越多輪之後出現的三個問題:長輸入算得太多、緩存佔得太大,以及如何從越來越長的上下文裡準確找到需要的信息。

1 小時前
鈦媒體生成式AI

OpenAI、Anthropic同日模型大戰,“是兄弟就砍一刀”

光錐智能2026.09.24 16:43 · 來自廣西全文3968字00:00 / 10:28刀刀見骨,AI巨頭為自己畫過的大餅“填窟窿”文|光錐智能,作者 | 魏琳華 ,編輯|劉俊宏9月23日凌晨,OpenAI和Anthropic像約好了一樣,前後腳各自放出新模型:OpenAI端出了GPT-6 Sol和GPT-6 Luna兩款模型,把旗艦GPT-6 Astra的能力蒸進更快更便宜的型號裡;Anthropic則亮出Claude Opus 5.5,性能追平Fable 5.1的同時,成本只有上代Opus 5的六成。

1 小時前