開源大模型格局重塑!小米 MiMo-V2.6-Pro 強勢殺回 Code Arena 前十,性能直逼國際第一梯隊

AI資訊AI新聞資訊正文開源大模型格局重塑!小米 MiMo-V2.6-Pro 強勢殺回 Code Arena 前十,性能直逼國際第一梯隊發佈於AI新聞資訊發佈時間 :2026年9月28號 10:07閱讀 :1分鐘人工智能開源生態迎來又一強勁選手。根據 Arena.ai 公佈的最新測評數據顯示,小米旗下的全新全模態旗艦大模型 MiMo-V2.6-Pro 在 Code Arena: WebDev(網頁開發測試場)中表現亮眼,首次亮相便成功重返總榜前十,並在採用 MIT 許可證的開源權重模型中高居前三。在具體的評分表現方面,MiMo-V2.
6-Pro 在早期自動評估(AutoEval)中斬獲了1628分的高分。這一成績不僅與 Claude Fable5(High)持平,還略微領先於得分1624分的 Hy4-preview。與上一代產品 MiMo-V2.5-Pro 此前取得的1475分相比,單次迭代實現了高達153分的顯著跨越。在開源權重模型的橫向對比中,該模型的表現同樣表現優異。目前其積分僅落後排名第二的 Qwen3.8Flash Next 約7分,距離榜首的 Kimi K3Max 也僅有46分的差距。需要指出的是,該成績目前基於由人類偏好數據訓練的獎勵模型進行自動投票得出。
隨著後續更多真實人類投票數據的不斷累積與收斂,模型的最終排名與表現仍將持續得到驗證。此次 MiMo-V2.6-Pro 的強勢登場,再次印證了小米在強化學習與全模態大模型研發領域的持續深耕與技術突破。相關推薦全新深藍 S07 正式官宣接入豆包大模型,9 月 28 日震撼上市深藍汽車董事長鄧承浩宣佈,全新深藍S07將接入字節跳動豆包大模型,並搭載AI激光智駕系統,9月28日上市。他指出,智能座艙競爭正從“堆料”轉向AI大模型深度賦能,改變用戶適應機器的繁瑣交互邏輯,推動汽車智能化規則顛覆。2026年9月23號 15:50266.
0k江西首個 Token 工廠正式落地南昌高新區,聚合超 300 款主流大模型江西省首個Token工廠項目落地南昌高新區,作為重點AI賦能平臺,以集約化、規模化模式提供高效穩定低成本的智能算力服務,支撐大模型訓練推理,加速數智化轉型。該新型算力基礎設施將破解中小科創企業培育體系不完善、場景落地偏慢等難題。2026年9月23號 9:33183.5k中國大模型周調用量達67.46萬億Token,連續21周領先美國上週全球AI大模型調用量達129萬億Token,中國佔比過半且連續21周超美國;美國調用量環比降34.7%。全球前五中4款來自中國,DeepSeek V4.1-Flash以15.
8萬億Token居首,環比增219%,主打編程、智能體和多模態能力。2026年9月21號 11:30268.8kAI 大模型下田"掌舵":四川眉山永豐村 300 畝試點田,水稻最高畝產 863.6 公斤9月14日,四川眉山永豐村千畝高標準農田收割,其中300畝首次應用水稻專用AI大模型管理,實現從“憑經驗”到“靠數據”種田。農技專家和種植戶現場觀摩,四川省科技廳組織專家組,對四川農業大學主持的成都平原稻-菜(藥)優質高產高效生產項目進行實測。2026年9月15號 10:22257.6kDeepSeek 傳聞將推 3 萬億參數 Code 2.
0,劍指 GPT-6 AstraDeepSeek近期動作密集:本週低調發布V4.1 Flash,雖未調整大版本號,但底層架構升級幅度已達V5級別;後續還將推出全新大模型Code2.0及V4.1 Pro系列,其架構換代與新品路線引發行業關注。2026年9月14號 10:01265.2k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026
Related
相關文章

從端側推理到物理AI,芯片行業正面臨新考題
Leo張ToB雜談2026.09.28 10:54 · 來自北京全文4241字00:00 / 12:35物理AI的時代,比拼的將是誰的落地更穩。過去兩年,幾乎所有關於AI的討論都圍繞一個詞展開:規模。更大的模型、更多的參數、更貴的訓練集群。

Muse 登頂、Meta 股價漲 11%,國內大模型卻擠在辦公內卷裡
ICT解讀者一老解2026.09.28 10:33 · 來自北京全文3748字00:00 / 10:50當所有玩家擠在辦公賽道內卷時,C 端場景仍有值得挖的空間。文 | ICT解讀者—老解9月8日,Meta 推出個人 AI 智能體 Muse。上線約 5 天,美國下載量突破73 萬次;上週五(9月18日)它把 ChatGPT 拉下馬,登頂美國 iOS 免費應用榜,並一直佔著第一。受此帶動,Meta 股價週一大漲超過11%,引領美股算力板塊集體走強。

Claude Sonnet 5.5 配置標識符現身並開啟灰度測試,性能直逼 GPT-6 Astra
從多位內測用戶的實測數據來看,Sonnet5.5的綜合表現極為驚豔。在純前端 UI 動畫生成及日常編碼測試中,它展現出了超強的代碼直覺和自然的人機互動質感,其實測表現不僅全面超越了 OpenAI 近期發佈的 GPT-6Sol,甚至在部分高級編碼與智能體能力上直逼 OpenAI 的旗艦大杯 GPT-6Astra。

自信心暴漲但正確率暴跌?最新研究揭示AI輔助下的人類決策悖論
研究團隊專門挑選了極易引發模型幻覺的精細冷門問題進行測試,結果顯示,在無AI輔助的對照組中,參與者對36%至44%的問題選擇放棄作答;而在獲取AI建議後,這一不作答比例驟降至3%至6%。更為矛盾的是,在AI輔助下,參與者的答題自信心從29.

Claude Sonnet 5.5 偷跑:價格打穿地心,實測暴打 GPT-6 Sol、直逼 Astra
從昨晚起,X 平臺流傳其即將發佈的消息,多位開發者稱模型已進入發佈前最後階段,並在 Claude Code 中開啟灰度測試,或被路由至 5.5 版本"暗測"。專屬標識符已現,灰測用戶搶先體驗開發者爆料顯示,artifact 中已出現 Sonnet 5.

Anthropic 資深員工悄然購置偏遠土地,以防"AI 失控"舉家撤離
"逃離 AI"念頭早有,內部推演末日情景對這群人而言,"逃離 AI"的念頭並不新鮮。早期離職員工回憶,早在 Anthropic 創立初期的公司聚餐上,大家就曾熱烈推演過一種"曼哈頓計劃式"的假想情景:未來可能隨時被政府徵調至荒蕪沙漠深處,在具備全套防電磁脈衝屏蔽功能的絕密軍 事基地內,閉門繼續研發前沿 AI。