ICML放榜,清華阿里拿下最高獎,谷歌DeepMind再封經典

重點摘要
ICML今日公布獲獎名單,清華大學與阿里巴巴合作的擴散模型論文獲得傑出論文獎,該算法在數學推理數據集上準確率達89.1%。谷歌DeepMind 2016年發表的強化學習框架論文則獲得時間檢驗獎,引用次數超過1萬次。
全球機器學習領域三大頂級學術會議之一的ICML,於今日正式公布2026年度獲獎名單。其中,來自清華大學與麻省理工學院的兩篇擴散模型相關論文,共同榮獲最高榮譽「傑出論文獎」(Outstanding Paper Award),代表本屆會議論文的最高學術水準。值得注意的是,清華大學的獲獎團隊中,除了校內研究人員外,作者名單亦出現了阿里巴巴集團研究人員的身影,展現出產學合作的深度與實力。清華大學黃高團隊提出的極簡算法「JustGRPO」,在數學推理基準數據集GSM8K上達到了89.1%的準確率,同時完整保留了擴散模型在並行解碼上的優勢。
這項研究不僅在性能上表現亮眼,更在算法設計上追求極致簡潔,為擴散模型的實際應用提供了新的思路。該論文的獲獎,也再次凸顯了中國學術界與產業界在機器學習前沿領域的影響力。另一篇獲得傑出論文獎的論文,則來自麻省理工學院團隊,同樣聚焦於擴散模型的理論與應用突破。兩篇論文從不同角度切入,共同推動了擴散模型在生成式AI領域的發展。ICML評審委員會表示,這兩篇論文在理論深度與實驗驗證上均達到頂尖水準,對未來研究方向具有重要啟發意義。除了傑出論文獎外,ICML今年還設立了「傑出立場論文獎」(Outstanding Position Paper Award),頒發給一篇深入分析當前AI對齊技術的論文。
該論文由慕尼黑大學博士生Sarah Ball與獨立AI治理研究者Phil Hackemann共同撰寫,指出惡意主體可輕易利用現有的對齊技術,實施信息審查與輿論操控。這項研究引發了學界對於AI安全與倫理議題的廣泛討論,也為後續的監管與技術設計提供了重要警示。在經典獎項方面,ICML今年頒發的「時間檢驗獎」(Test of Time Award),由谷歌DeepMind於2016年發表的一篇論文獲得。該論文提出了一套利用多個CPU核心來加速單機強化學習訓練的框架,在arXiv上的被引用次數已超過1萬次,對後續的強化學習研究與應用產生了深遠影響。
這項獲獎不僅是對十年前原創工作的肯定,也再次印證了DeepMind在機器學習領域的經典地位。ICML(International Conference on Machine Learning)是全球機器學習領域最具影響力的學術會議之一,每年吸引來自學術界與產業界的頂尖研究人員參與。今年的獲獎名單涵蓋了從理論創新到應用落地、從技術突破到倫理反思的多個面向,展現出機器學習領域的多元發展趨勢。清華大學與阿里巴巴的合作論文獲獎,也反映出中國在AI基礎研究與產業化應用之間的緊密連結。
隨著擴散模型在圖像生成、語音合成、科學計算等領域的廣泛應用,這類極簡算法的提出,有望進一步降低計算成本,提升模型效率,加速技術落地。整體而言,ICML 2026年的獲獎論文不僅表彰了當前的學術成就,也為未來幾年的研究方向提供了重要指引。從擴散模型的理論深化,到AI對齊技術的風險警示,再到經典強化學習框架的持續影響,這些研究成果將持續推動機器學習領域向前邁進。
Related
相關文章

天才,對AI發展到底有多重要?
加拿大三位科學家傑弗裡·辛頓、約書亞·本希奧和理查德·薩頓對當代人工智慧發展有重大貢獻,凸顯少數天才就能左右一個國家的技術地位。文章從1956年達特茅斯會議談起,探討人工智慧領域的關鍵爭論與發展脈絡。

微軟 Copilot 新版圖標洩露,趨向扁平化、設計更簡潔
微軟 Copilot 圖標在 Edge Canary 測試版中意外曝光,新設計去除了 3D 陰影,變得更加扁平化。據悉,該圖標還曾短暫出現在新版 Microsoft 365 應用中,但上線時間尚未確定。#微軟Copilot#

Jeff Dean們,趕在貝葉斯AI到來之前跳船
Jeff Dean 離開任職27年的Google,創辦Discovery Loop公司,目標是讓AI進入持續運行的科學發現循環。Google DeepMind論文《LLM can't jump》指出,科學發現需要從經驗事實跳躍到新原則,而當前大型語言模型缺乏這種跳躍能力。研究顯示貝葉斯AI時代即將到來,大廠正積極補足Agent的基礎建設。

谷歌推出 WeatherNext 氣旋模型,AI 高精度預報颶風平均提前 24 小時
首頁 > 智能時代>人工智能 谷歌推出 WeatherNext 氣旋模型,AI 高精度預報颶風平均提前 24 小時 2026/8/7 14:11:01 來源:IT之家 作者:故淵 責編:故淵 評論: IT之家 8 月 7 日消息,谷歌 DeepMind 團隊昨日(8 月 7 日)發佈博文,宣佈推出 WeatherNext Cyclones 天氣預測模型,主要。

Meta重新支稜起來了?純推理拿下五項奧賽金牌,兩項滿分
Meta近期在人工智慧領域展現出驚人實力,其開發的純推理模型在國際數學奧林匹亞競賽中一舉奪下五面金牌,其中兩項更獲得滿分成績。這項成果不僅凸顯了Meta在AI推理能力上的突破,也讓外界重新審視這家科技巨頭在深度學習與邏輯運算方面的技術積累。 根據相關資訊,這款模型並未依賴外部知識庫或預先訓練的數據,而是透過純粹的推理機制來解決複雜數學問題。在競賽中,它成功應對多道高難度題目,涵蓋代數、幾何與數論等領域,最終以五項金牌的成績證明其演算法的有效性。其中兩項滿分表現,更顯示模型在特定題型上的精準度已達到頂尖水準。

智元下架了首席科學家羅劍嵐
智元機器人官網合夥人團隊名單中已移除首席科學家羅劍嵐,其個人社群簡介也不再提及智元職務,疑似離職,但官方尚未證實。羅劍嵐於2025年4月加入智元,任職約1年4個月,期間主導真機強化學習與具身智能研究,此次人事變動發生在公司啟動赴港上市流程之後。