Qwen新1號位首次亮相,劉大一恆能否頂住壓力?

字母AI2026.09.23 16:06 · 來自北京全文4820字00:00 / 13:15林俊暘之後,為何阿里選擇了劉大一恆?文 | 字母AI論國內AI圈誰的壓力最大,梁文鋒、楊植麟、姚順雨、唐傑都是榜上有名,不過從現在開始,劉大一恆身上所揹負的,恐怕也不小。3月4日,隨著林俊暘留下的一句“再見了,我摯愛的Qwen”,Qwen在這半年之間進入了一段沒有1號位的日子。一開始,Qwen1號位是由阿里雲CTO周靖人臨時代管,再往後,通義大模型事業部與未來生活實驗室合併,成立由吳泳銘直接負責的Token Foundry事業部。到了9月22日,杭州雲棲大會的主論壇。
阿里巴巴集團CEO吳泳銘演講結束後,2021年入職阿里、在後林俊暘時代負責預訓練、後訓練與編程方向的劉大一恆,以Qwen負責人的身份走上臺前。這也是他第一次作為Qwen新1號位在公眾面前亮相。論開源生態,Qwen依然是全球第一,30億次下載、30萬個衍生模型、460多款開源模型,長期霸榜 Hugging Face。但論模型本身,Qwen並不樂觀。旗艦的Qwen 3.8 Max雖然在Artificial Analysis的Agentic Index上排第一,但是智能指數上只排在了第七位。所以,當劉大一恆今天走上這個舞臺,他講的既是一份路線圖,也是一次表態。
在失去靈魂人物之後,國內國外各路競爭對手紛紛追趕之時,Qwen究竟要靠什麼繼續走下去。劉大一恆,頂得住壓力嗎?Qwen的路線圖雲棲大會上,吳泳銘把“機器智能時代”的三大基石定義為AI模型、AI芯片和AI雲,並給出了兩個判斷:未來機器供給的思考總量將達到人類的1000倍以上,而今天這個比例還不到3%;今天的AI Coding就 1882年的電燈,替代的是既有工作,還不足以開創一個時代。同時吳泳銘表示,Qwen團隊正在遞歸式自我改進(RSI)上取得進展,未來模型將擴展到5到10T參數。緊接著,劉大一恆走上臺前,以Qwen負責人的身份,講述了Qwen未來的路線圖。
圍繞這個判斷,他鋪開了 Qwen 的路線圖,大致可以拆成五條線。第一條線是自我改進,也就是吳泳銘所提到的RSI。Qwen3.8-Max已經能在人類幾乎“零參與”的條件下,自主搭建訓練流程、構造訓練數據、設計實驗並定位缺陷,持續迭代超過一個月、完成33輪有效迭代。結果就是,其Artificial Analysis評測得分從40提升至45,約合12.5%的提升。在硬件協同層面,它自主適配了平頭哥新款架構,使推理框架單實例吞吐量提升96%。在芯片協同設計上,僅依賴總線模塊規範,通過60小時自迭代與超萬次EDA工具調用,把物理實現面積縮減42%。
但劉大一恆表示,RSI目前仍是“初步進入模型訓練、推理及芯模協同等環節”,並非完全無人化的成熟狀態。第二條線是架構迭代。基於新一代架構的Qwen4已進入訓練階段,開源側優先安排Qwen4-27B。至於後續的Qwen4.5、Qwen5,計劃把參數規模擴展到5萬億至10萬億量級。劉大一恆在演講中強調,參數規模的擴展仍是通向ASI的核心路徑之一。與此同時,Qwen3.8-Flash提前開源了下一代架構,官方稱訓練成本降低近90%。第三條線是全模態統一。劉大一恆認為,Qwen3.8-Omni是Qwen進入多模態統一理解階段的標誌。配套產品包括圖像模型Qwen-Image-3.
1、語音模型Qwen-Audio-3.1、同傳模型Qwen3.8-LiveTranslate,以及音樂模型、世界模型和預計11月發佈的下一代視頻生成模型。第四條線是開源開放。“AI的價值不應只屬於少數企業,而應成為全世界用戶都可獲取、使用、創造的基礎能力。”劉大一恆說到,“讓更多人用得起AI、用得上AI、參與創造AI”。隨後劉大一恆表示,Qwen未來仍然堅持開源開放。劉大一恆給出的數據是,阿里累計開源460多款模型,Qwen系列全球下載量超過30億次,衍生模型超過30萬個,位居全球第一。Qwen3.
8-27B發佈僅兩個月,Qwen整個家族的下載數量就超過了DeepSeek、Llama等開源模型,成為Hugging Face上獲贊最多的模型系列。第五條線是端側與終端落地。桌面端,開源的27B模型可本地運行。移動端,阿里發佈了AI手機全棧方案Qwen Intelligence,讓手機能夠完成跨應用的複雜任務。此外還涉及AI眼鏡、桌面機器人,以及基於RISC-V的玄鐵C950 CPU,可以原生運行Qwen3.8-27B。這五條線並非單獨運行,它們組合在一起構成了阿里在AI上的完整戰略。
RSI處理“模型如何自我提升”,架構迭代處理“性能上限能到多高”,全模態處理“能理解什麼”,開源處理“誰能用”,端側處理“在哪裡用”。它們共同服務的,是劉大一恆所說的“真實世界Agent”這一目標,讓模型從對話走向能獨立完成任務的系統。劉大一恆從幕後到公眾前的第一次亮相,就已經覆蓋了硬件、軟件、策略這三大方向。劉大一恆這個人劉大一恆是四川自貢人,名字“大一恆”並不常見,甚至讓很多人以為這是他在阿里的花名。2012年,他進入四川大學計算機學院。2015年,以綜合排名第一的成績保送“3+2+3”本碩博連讀,導師為呂建成教授。2017年,劉大一恆赴新加坡國立大學交流。
2020年獲四川大學計算機博士學位。從本科到博士,他一直在四川大學,沒有海外學歷,也沒有清華、北大的背景。這一點,與AI圈裡常見的那條“名校本科—海外博士—大廠鍍金”的路徑不同。他第一次進入公眾視野,與一篇論文有關。2019年他在ACL(國際計算語言學協會年會)上發表論文,這也是四川大學在讀研究生首次在ACL上發表成果。他後來在採訪中提到,並非自己投遞簡歷,而是論文發表、加上學校官網對其科研成果的報道之後,華為就主動聯繫了他。在這之後,劉大一恆一戰成名。2019年,他參加了谷歌舉辦的Natural Questions(NQ)全球長期公開競賽。
這項競賽的任務可以概括為:讓系統“讀完整個維基百科頁面”,再回答用戶在谷歌搜索引擎裡輸入的問句。它的難點有兩個,第一點是長文檔,一頁維基百科動輒數千上萬字,信息密度很高。第二點是開放領域,問題沒有預設範圍,什麼都可能被問到。長文檔和開放領域,是當時自然語言處理裡公認最難的兩類問題。想要在這場比賽裡獲得名次也是一件難事,因為同場競爭的包括谷歌AI、IBM Research等團隊。即使如此,劉大一恆所在團隊提出的模型在提交時取得世界第一,並保持了三個月。其中單模型首次在該競賽的所有測試指標上超過單人類性能,集成模型在公開排行榜上排名世界第一。
劉大一恆做出的項目叫做RikiNet,名字意為Reading Wikipedia,“讀維基百科的神經網絡”。它的核心邏輯是把整頁維基百科當作閱讀對象,再從整頁裡定位答案。RikiNet由兩個模塊構成:一個是“動態段落雙注意力閱讀器”,負責在超長文本里捕捉遠距離依賴、過濾掉無關內容;另一個是“多層級聯答案預測器”,利用長答案(段落)與短答案(片段)之間的層級關係,依次預測出短答案的位置、長答案所在的段落和答案類型。2020年,經過華為多輪選拔,他入選“天才少年計劃”第一檔,為西南地區首位入選第一檔的學生、當年全國僅5人,最高年薪200萬元。畢業後他加入華為雲語音語義創新LAB。
不過他沒有停留太久,2021年,他就轉投阿里達摩院語言技術實驗室,參與Qwen的研發。他曾自嘲到:“我既非天才,也已不是少年。”在Qwen,劉大一恆長期負責預訓練,並且主導了Qwen 1至Qwen 3.5全系列語言模型的研發,深度參與Qwen多模態、編程、數學(Qwen-Math)等系列,累計參與300多款Qwen模型的開源工作。在Qwen系列名氣最響的Qwen2.5、Qwen3等技術報告中,同樣有劉大一恆的署名。劉大一恆是團隊裡少數同時橫跨預訓練、編程、後訓練這三大核心模塊的人。預訓練決定模型的底層能力。而強化學習、對齊、推理與Agent這樣的後訓練,決定了Qwen在實際業務中的表現。
編程則決定Qwen的商業化能力。所以劉大一恆才會在第一次公開演講中講了完整的Qwen路線圖,那對他來說只是個長久以來的工作報告而已。Qwen在經歷多輪重組之後,需要一個“能穩住盤子的人”。Qwen1號位,也只有劉大一恆能當。劉大一恆與林俊暘的區別過去三年,Qwen在公眾面前的形象,很大程度上與林俊暘個人綁定。他生於1993年3月,比劉大一恆還年輕一些。2019年畢業後,他加入阿里達摩院,從高級算法工程師做起。2020年“通義千問”立項,他是核心架構成員,主導了OFA、Chinese CLIP等多模態基礎框架。
2022年底,達摩院的語言、視覺等團隊整體併入阿里雲、成立通義實驗室,他被正式任命為通義千問系列大模型的技術負責人。此後幾年,林俊暘主導了Qwen系列的開源工作,Qwen也因此成了全球開源生態裡的頭部模型家族。2025年,林俊暘升任P10,是阿里歷史上最年輕的P10之一。林俊暘和劉大一恆最大的不同,在於“方式”。林俊暘是臺前的人,他活躍在社交媒體上,會與馬斯克互動,會親自發招聘帖,強調“模型即產品”,主張研究人員要像產品經理一樣,把成果做成真實世界可用的系統。他不僅是技術負責人,也是Qwen的頭號公關和代言人。劉大一恆則長期在幕後,公開露面極少,風格偏低調、穩健,與Qwen一同成長。
2026年3月,通義實驗室計劃把Qwen團隊從“垂直整合”改為“水平分工”。具體方法是,把原本擰在一起的預訓練、後訓練、文本、多模態、基礎設施等環節,拆分為相對獨立的部門。這與林俊暘長期主張的全鏈路深度協同存在矛盾,他認為拆分打散會拖慢迭代、抬高溝通成本。隨後提出了辭職。離開Qwen不到半年後,林俊暘在上海官宣創辦“語用科技”(Pragmatik Labs),內部簡稱為p7k,方向是“橫跨數字世界與物理世界的下一代AI Agent”。公司天使輪投後估值約20億美元,由高榕創投與紅杉中國各出資約1億美元聯合領投,騰訊跟投約2000萬美元,上海未來產業基金參與。
林俊暘和劉大一恆之間,也代表了Qwen所處的不同時代。林俊暘執掌的幾年,正是Qwen在阿里內部項目成長的階段。這一階段需要的是能把技術講清楚、能在開源社區建立信任、能對外定義產品的人。劉大一恆面對的,是阿里Token Foundry成立後的組織收斂、商業化壓力。這一階段更看重穩定交付、跨模塊協調與組織連續性。從“技術狂飆”到“商業落地”,剛好是整個中國AI產業近期的變化,林俊暘的離開和劉大一恆的上任,恰好落在這個轉折點上。劉大一恆能不能頂住壓力,暫且無法蓋棺定論,但綜合來看,他的確是這個位置最好的人選,沒有之一。
Related
相關文章

達卯科技完成新一輪融資,算電協同核心軟件層“稀缺標的”
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400"> 達卯科技完成新一輪融資,算電協同核心軟件層“稀缺標的” 量子位的朋友們 2026-09-23 17:46:57 來源:量子位 打造算電協同領域“Windows”級操作系統 算電協同AI能源運營操作系統核心企業達卯科技,近期據悉已完成約2億元新一輪融資。去年10月,達卯科技完成由寧德時代旗下溥泉資本領投的近億元A+輪融資。 達卯科技成立於2021年,總部位於上海徐匯模速空間,是國內首家將能源大模型規模化落地算電協同、虛擬電廠與泛能源場景的AI企業,也是算電協同賽道的先行者。公司核心依託自研垂類能源大模型與AI智能體集群,打造算電協同平臺、AI虛擬電廠平臺、智能運維平臺等產品矩陣,面向智算中心客戶提供從諮詢規劃、投資測算、智能運營、精細化運維、能源增值交易的全生命週期服務。 公司推出的核心產品算電協同2.0平臺・AIDC綠電直連能源運營操作系統,是算電協同產業鏈中的關鍵軟件,已形成面向GW級智算中心綠電直連場景的全週期智慧能源運營閉環能力,核心技術指標處於行業領先水平,推動AIDC從傳統“用電負荷”升級為“新型電力系統下可調度、可交易的柔性資源”。 目前,達卯科技股東陣容包含寧德時代、商湯科技、寒武紀等產業鏈龍頭企業,具備優異的產業生態協同與資源聚合能力。 算電協同,係指通過數字化技術、智能算法和通信網絡,將算力基礎設施與電力系統(發電、輸電、配電、用電環節)進行有機整合,實現資源動態匹配與優化配置的基建工程,以提升能源利用效率、保障算力供給穩定性,並推動低碳化發展。2026年初,算電協同首次寫入政府工作報告,成為新基建重點方向。今年9月,國務院層面進

國內開發者如何穩定使用 Claude Code、Codex 和 Gemini CLI:從配置接入到團隊協作
AI資訊AI新聞資訊正文國內開發者如何穩定使用 Claude Code、Codex 和 Gemini CLI:從配置接入到團隊協作發佈於AI新聞資訊發佈時間 :2026年9月23號 17:28閱讀 :2分鐘隨著 AI 編程工具快速發展,Claude Code、Codex、Gemini CLI 等工具已經逐漸從簡單的代碼補全,發展到可以理解項目結構、修改多個文件、執行命令、排查問題,甚至協助完成完整應用開發。對於個人開發者、獨立開發者和企業研發團隊來說,AI 編程工具已經成為提高開發效率的重要組成部分。不過,在實際使用過程中,很多國內開發者遇到的問題並不只是模型能力本身,還包括網絡連接、支付方式、配置流程、額度管理和售後支持等。一、使用 AI 編程工具時,開發者常見的問題網絡連接不穩定在使用 AI 編程 Agent 處理複雜任務時,一次任務可能需要持續運行幾分鐘,甚至更長時間。如果連接過程中出現中斷,就可能導致:代碼修改沒有完成;Agent 執行到一半停止;需要重新提交任務;上下文丟失;項目調試過程被打斷。尤其是在大型代碼庫分析、跨文件重構和連續多輪對話中,穩定性會直接影響使用體驗。配置過程比較複雜Claude Code、Codex 和 Gemini CLI 通常需要配置 API 地址、密鑰、環境變量或命令行參數。對於剛開始接觸 AI 編程工具的用戶來說,可能會遇到:API 地址配置錯誤;環境變量沒有生效;不同系統配置方式不同;模型名稱填寫錯誤;VS Code、JetBrains 或命令行環境無法正常調用。充值和報銷不方便個人開發者更關注價格和充值靈活性,企業和高校用戶則通常還需要考慮:是否支持國內支付;餘額是否會過期;是否可以按量付費;是否支持團隊統一管理;是否能夠提供合同和發票;採購後能否正常報銷。團隊使用缺少統一管理當多個成員同時使用 AI 編程工具時,如果每個人單獨注

Anthropic 擬租賃最高 1 吉瓦算力,減少對雲廠商依賴
AI資訊AI新聞資訊正文Anthropic 擬租賃最高 1 吉瓦算力,減少對雲廠商依賴發佈於AI新聞資訊發佈時間 :2026年9月23號 17:39閱讀 :1分鐘據媒體報道,Anthropic 正處於早期談判階段,擬從阿波羅全球管理(Apollo Global Management)控股的數據中心開發商手中租賃最高 1 吉瓦(GW)算力。這被視為這家 AI 公司降低對雲廠商依賴的重大舉措之一。若交易達成,Anthropic 將直接掌握相當體量的算力供給,而不再單純依賴第三方雲平臺按量分配。目前談判仍處早期,最終租賃規模、期限與具體開發商尚未敲定,但“最高 1 吉瓦”的目標已顯示出 Anthropic 對自有算力底盤的強烈訴求。部分知情人士稱,Anthropic 還在商議由谷歌為該項目提供信貸擔保。不過,目前尚不清楚谷歌將對項目的哪一部分承擔兜底責任。相關推薦醫療 AI 走向全球普惠:Anthropic 攜手 OpenEvidence,將臨床決策支持工具免費覆蓋百國Anthropic與醫學知識平臺OpenEvidence達成戰略合作,將基於人工智能的臨床決策支持工具免費提供給美國和歐洲以外醫療資源匱乏地區的醫生,打破循證醫學知識獲取的地理限制,緩解當地醫學文獻、專科醫生及繼續醫學教育資源不足等痛點,推動全球醫療資源公平可及。2026年9月23號 14:07147.9kAnthropic上線Claude Opus 5.5 ,任務成本大降 40%Anthropic發佈Claude Opus 5.5,為Claude 5.5系列首款。官方稱多數任務表現與Fable 5.1相當,成本較上代Opus 5降40%、速度提升超30%,9項測試中7項領先,編程表現突出。約兩小時後,OpenAI推出GPT-6 Sol和Luna,GPT-6“宇宙”擴容。2026年9月23號 8:53135.9k福

螞蟻百靈開源 Ming-Image-0.1-Design 系列模型,UI 設計專項評測位列開源第一
首頁 > 智能時代>人工智能 螞蟻百靈開源 Ming-Image-0.1-Design 系列模型,UI 設計專項評測位列開源第一 2026/9/23 17:42:16 來源:IT之家 作者:遠洋 責編:遠洋 評論: IT之家 9 月 23 日消息,今日,螞蟻百靈大模型正式開源 Ming-Image-0.1-Design 系列,包含兩個參數量均為 6B 的模型:Ming-Image-0.1-Design,從文字需求生成 UI、信息圖、海報和完整視覺設計;Ming-Image-0.1-Design-Layer,將創意圖或者設計圖拆成可獨立編輯的透明圖層。IT之家注意到,螞蟻百靈同時開源了 Design Skill 和 PPT Skill,將模型能力繼續連接到前端頁面與可編輯演示文稿。據官方介紹,Ming-Image-0.1-Design 重點增強了四項能力:支持 8K 長結構化提示詞增強,將自然語言需求組織為文案、模塊、佈局和視覺風格;優化標題、按鈕、卡片和多區域信息的文字渲染與版式穩定性;通過端到端生成一次性完成整體設計,統一配色、構圖和素材風格;創建原生 RGBA VAE,直接生成人物、商品、圖標和裝飾等透明背景素材。相比通過代碼多次調用通用生圖模型,分別生成背景、插畫和裝飾,端到端生成擁有更完整的全局控制,能夠減少素材之間色系衝突和畫風不一致。在 Artificial Analysis 於 2026 年 9 月 18 日更新的 UI / UX Design 專項評測中,Ming-Image-0.1-Design 位列開源模型第 1,Elo 得分為 1082。模型在 UI / UX 場景中的版式勝率達到 67.4%,複雜構圖達到 67.0%,文字渲染達到 66.7%。官方稱,Ming-Image-0.1-Design 系列仍有明確的能力邊界。Design 目前最穩定的是排版

斑馬智能發佈端模型AutoOmni2.0,讓元神AI更懂“我的世界”
斑馬智能在雲棲大會發表新一代全模態端側大模型AutoOmni 2.0,任務處理能力堪比10倍參數量的雲模型,並推出AutoClaw 2.0智艙協作實車方案。元神AI強調理解用戶的「表世界」與「裡世界」,透過「三個連通」朝Personal AI演進,已覆蓋主流車企68%的服務。AutoOmni與10家晶片廠合作,實現低延遲、隱私保護及高效能推理,並展示免喚醒與主動智能等場景,未來將從單體智能擴展至群體智能。

它石智航頂尖團隊引領中國具身智能率先邁入規模化落地階段
它石智航創辦人陳亦倫於上海跨國企業推介會中,強調具身智能須經真實產線驗證,並指出中國憑藉豐富製造業場景,率先進入規模化落地階段。該公司已透過自研AWE基座大模型與自製機器人硬件,完成從模型突破到規模化應用的三級躍遷,並計畫擴大研發團隊與生產基地,提升交付能力。未來將以中國為研發核心,面向全球推動工業智能化轉型。