每小時燒掉三萬美元!前DeepSeek大牛羅福莉加盟小米後首度直播大模型訓練

2026年9月17日 07:315500 次瀏覽
站內 AI 整理稿

AI資訊AI新閒資訊正文每小時燒掉三萬美元!前DeepSeek大牛羅福莉加盟小米後首度直播大模型訓練發布於AI新閒資訊時間 :Sep 17, 2026閱讀 :1分鐘一、 沉寂半年後重回大眾視野在人工智能領域備受關注的小米迎來新動態。沉寂半年的小米 MiMo 大模型團隊負責人、前 DeepSeek 研究員羅福莉,於9月17日凌晨在 X 平臺發文,正式對外公開並直播了當前大模型的訓練過程。此次動作標誌著她再次捲入激烈的大模型技術競爭中,同時也讓外界得以首次窺探小米最新一代模型的內部訓練狀態。二、 MiMo-V2.

6的 RL 實驗與三大擴展方向根據羅福莉分享的實時訓練頁面顯示,目前小米旗下的最新大模型MiMo-V2.6正在進行大規模的 Agent(智能體)強化學習(RL)實驗。團隊在此次運行中重點推進了三個維度的技術擴展:計算資源擴展:每步計算資源大約消耗20億 token,包含1568個提示乘以16次 rollout,採取完全異步的運行模式。環境和測試框架擴展:構建了多任務代理式 RL,在單次運行中同步混合多個測試框架。評估計算擴展:引入代理式組內信用分配,配備了實際測試用例和基於量規的獎勵機制。羅福莉同時透露,團隊將在未來的幾周內逐步向外界開源相關的技術細節。

三、 高昂的訓練成本與雙版本表現從公開的實時訓練數據來看,此次大模型訓練展現出極高的資金與算力消耗。訓練頁面中目前主要包含兩個並行版本:MiMo-V2.6-Pro:累計訓練時長達到1天19小時,累計耗資約89萬美元,平均每小時的訓練成本超過2萬美元。MiMo-V2.6-Flash:累計訓練時長為1天14小時,累計耗資約39.7萬美元,平均每小時的訓練成本超過1萬美元。兩個版本的累計訓練成本目前已經突破128萬美元,折算下來整體每小時的耗費超過3萬美元,充分凸顯出當前頭部大模型在強化學習階段對海量算力的極致訴求。

四、 團隊背景與此前進展在業務佈局方面,小米高層此前曾多次公開披露 AI 領域的階段性成果。今年3月份,小米創始人雷軍曾在微博發文透露,萬億參數大模型MiMo-V2-Pro曾躋身全球大模型綜合智能排行榜 Artificial Analysis 的全球第八位,在品牌排名中位列全球第五,整體表現超越了 xAI 的 Grok 模型,並計劃在後續保持快速迭代與增強。作為核心領軍人物,羅福莉是一位備受矚目的“95後”AI青年科學家。公開資料表明,她本科畢業於北京師範大學計算機專業,隨後在北京大學攻讀計算語言學碩士學位。

畢業後,她曾加入阿里巴巴達摩院機器智能實驗室擔任研究員,負責多語言預訓練模型 VECO 的開發,並推動了 AliceMind 項目的開源。2022年,羅福莉加入 DeepSeek 母公司幻方量化從事深度學習相關工作,此後擔任 DeepSeek 深度學習研究員,參與了 DeepSeek-V2等核心模型的研發工作。直到去年11月12日,羅福莉在朋友圈發文確認加入小米,投身 Xiaomi MiMo 團隊,並致力於構建從語言邁向物理世界的 AGI(通用人工智能)未來。

相關推薦豆包聯合火山引擎打造AI原生助手,上汽多款車型年內落地9月17日,豆包與火山引擎聯合發佈AI原生車載助手“豆包座艙助手”,標誌大模型技術在智能座艙進一步落地。產品已與上汽集團深度合作,首搭車型榮威家越07即日預售,上汽奧迪相關車型年內亮相,雙方年內還將推出更多落地車型。Sep 17, 2026102.0k蓋茨談AI全球競速:中美各四家模型領跑,中國人形機器人運動會“非常震撼”蓋茨基金會未來兩年將投入10億美元推動人工智能發展,讓前沿技術惠及最貧困地區。蓋茨還就全球大模型格局、算力碳排放及中國人形機器人等話題發表看法,指出按不同衡量方式,中美目前各有四家領先大模型企業。

Sep 15, 2026255.7k螞蟻開源 SingProbe:以輕量探針實現大模型生成風險實時攔截,計算開銷不足 0.5%螞蟻集團AI安全實驗室開源內生式安全護欄技術SingProbe。它不同於外掛式審核,複用基座模型推理隱藏狀態,以不足0.5%額外算力實現token級實時風險評估,可同步完成意圖分類、安全檢測與幻覺識別,在醫療等高風險場景可在輸出前毫秒級阻斷。目前已適配29個主流大模型。Sep 15, 2026201.4k爆料稱 DeepSeek 下一波大模型將至:3 萬億參數,性能劍指 GPT-6 AstraDeepSeek本週發佈V4.1 Flash,架構變化巨大但未升大版本號。

V4.1 Pro已確定,具體升級未公佈,性能上限或較高,但鑑於前代Pro不及預期,外界期待不宜過高。另有Code 2.0被曝即將發佈,主打電腦控制,後續還有更多大模型。Sep 14, 2026277.2k智能體跑長任務為何"失憶跑題":AWS、Claude Code、Manus 們用四套框架機制給出答案大模型長任務中反覆“失憶”、遺忘目標,根源或在執行框架而非模型。AWS指南指出,淺層智能體長週期會上下文溢出、受幹擾跑題、無法維持狀態;修復關鍵是管理除模型外一切的harness。新研究盤點多家主流框架,聚焦這層外殼,為長週期穩定執行提供思路。Sep 14, 2026243.

5k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026

Related

相關文章

量子位生成式AI

無問芯穹與華環電子簽署戰略合作,共同探索國產異構算力AI基礎設施新方向

無問芯穹與華環電子簽署戰略合作協議,雙方將結合各自在AI軟體平台、網路通信與硬體研發的優勢,共同探索國產異構算力基礎設施的協同方案。此次合作聚焦於智算中心解決方案及「Token工廠」新模式,目標是推動計算、網路與AI原生基礎設施深度融合,為AI規模化應用提供高效穩定的支撐。

1 小時前
IT之家生成式AI

優步全球範圍裁員 10%,被裁員工稱 AI 已大舉滲透日常工作

作者:清源 責編:清源 評論: 9 月 18 日消息,據《商業內幕》今天(18 日)晚間報道,在優步(Uber),AI 已經滲透到員工工作的許多環節,從回答 Slack 裡的內部問題,到替乘客行程中聯繫客服時收到的消息撰寫回復。6 名近期遭裁員的員工透露,過去幾個月,AI 在工作中的使用範圍明顯擴大,其中一些人甚至會通過提示詞讓 AI 完成相當一部分任務。

4 小時前
鈦媒體生成式AI

月之暗面遞表之後,Kimi 的成色要被驗算三遍

舒澤品牌手記2026.09.18 18:16 · 來自浙江全文4982字00:00 / 14:05Anthropic 的 30 萬次指控,會成為招股書的第幾頁?文 | 舒澤品牌手記9月17日,月之暗面發佈了一套金融行業解決方案。按官方披露,中信建投、中金公司、易方達等數十家金融機構已經在用 Kimi 處理投研建模、風險排查和盡調材料——研究人員把管理層報表、審計報告和盡調文件交給 Kimi,拿回一份可以繼續調整假設的 Excel 模型。同一天,深圳商報記者就港股上市進展、股東架構調整等事項向月之暗面發去採訪函。

7 小時前

Calibre上手 AI 互動寫作:電子書管理器搖身變成"文字冒險遊戲引擎"

這個遊戲默認藏而不發,不會跟著 Calibre 啟動就冒出來。用戶得主動在"首選項 — 工具欄和菜單"裡把它請到主工具欄,才算真正激活。它的玩法很清晰:由 AI 在後臺搭起並掌管一個虛構世界,用戶通過不斷輸入文字來推著故事往前走,等於把"讀電子書"這件事,翻轉成了"和 AI 一起寫故事"。

8 小時前