Qwen新1號位首次亮相,劉大一恆能否頂住壓力?

2026年9月23日 16:07
Qwen新1號位首次亮相,劉大一恆能否頂住壓力?
站內 AI 整理稿

字母AI2026.09.23 16:06 · 來自北京全文4820字00:00 / 13:15林俊暘之後,為何阿里選擇了劉大一恆?文 | 字母AI論國內AI圈誰的壓力最大,梁文鋒、楊植麟、姚順雨、唐傑都是榜上有名,不過從現在開始,劉大一恆身上所揹負的,恐怕也不小。3月4日,隨著林俊暘留下的一句“再見了,我摯愛的Qwen”,Qwen在這半年之間進入了一段沒有1號位的日子。一開始,Qwen1號位是由阿里雲CTO周靖人臨時代管,再往後,通義大模型事業部與未來生活實驗室合併,成立由吳泳銘直接負責的Token Foundry事業部。到了9月22日,杭州雲棲大會的主論壇。

阿里巴巴集團CEO吳泳銘演講結束後,2021年入職阿里、在後林俊暘時代負責預訓練、後訓練與編程方向的劉大一恆,以Qwen負責人的身份走上臺前。這也是他第一次作為Qwen新1號位在公眾面前亮相。論開源生態,Qwen依然是全球第一,30億次下載、30萬個衍生模型、460多款開源模型,長期霸榜 Hugging Face。但論模型本身,Qwen並不樂觀。旗艦的Qwen 3.8 Max雖然在Artificial Analysis的Agentic Index上排第一,但是智能指數上只排在了第七位。所以,當劉大一恆今天走上這個舞臺,他講的既是一份路線圖,也是一次表態。

在失去靈魂人物之後,國內國外各路競爭對手紛紛追趕之時,Qwen究竟要靠什麼繼續走下去。劉大一恆,頂得住壓力嗎?Qwen的路線圖雲棲大會上,吳泳銘把“機器智能時代”的三大基石定義為AI模型、AI芯片和AI雲,並給出了兩個判斷:未來機器供給的思考總量將達到人類的1000倍以上,而今天這個比例還不到3%;今天的AI Coding就 1882年的電燈,替代的是既有工作,還不足以開創一個時代。同時吳泳銘表示,Qwen團隊正在遞歸式自我改進(RSI)上取得進展,未來模型將擴展到5到10T參數。緊接著,劉大一恆走上臺前,以Qwen負責人的身份,講述了Qwen未來的路線圖。

圍繞這個判斷,他鋪開了 Qwen 的路線圖,大致可以拆成五條線。第一條線是自我改進,也就是吳泳銘所提到的RSI。Qwen3.8-Max已經能在人類幾乎“零參與”的條件下,自主搭建訓練流程、構造訓練數據、設計實驗並定位缺陷,持續迭代超過一個月、完成33輪有效迭代。結果就是,其Artificial Analysis評測得分從40提升至45,約合12.5%的提升。在硬件協同層面,它自主適配了平頭哥新款架構,使推理框架單實例吞吐量提升96%。在芯片協同設計上,僅依賴總線模塊規範,通過60小時自迭代與超萬次EDA工具調用,把物理實現面積縮減42%。

但劉大一恆表示,RSI目前仍是“初步進入模型訓練、推理及芯模協同等環節”,並非完全無人化的成熟狀態。第二條線是架構迭代。基於新一代架構的Qwen4已進入訓練階段,開源側優先安排Qwen4-27B。至於後續的Qwen4.5、Qwen5,計劃把參數規模擴展到5萬億至10萬億量級。劉大一恆在演講中強調,參數規模的擴展仍是通向ASI的核心路徑之一。與此同時,Qwen3.8-Flash提前開源了下一代架構,官方稱訓練成本降低近90%。第三條線是全模態統一。劉大一恆認為,Qwen3.8-Omni是Qwen進入多模態統一理解階段的標誌。配套產品包括圖像模型Qwen-Image-3.

1、語音模型Qwen-Audio-3.1、同傳模型Qwen3.8-LiveTranslate,以及音樂模型、世界模型和預計11月發佈的下一代視頻生成模型。第四條線是開源開放。“AI的價值不應只屬於少數企業,而應成為全世界用戶都可獲取、使用、創造的基礎能力。”劉大一恆說到,“讓更多人用得起AI、用得上AI、參與創造AI”。隨後劉大一恆表示,Qwen未來仍然堅持開源開放。劉大一恆給出的數據是,阿里累計開源460多款模型,Qwen系列全球下載量超過30億次,衍生模型超過30萬個,位居全球第一。Qwen3.

8-27B發佈僅兩個月,Qwen整個家族的下載數量就超過了DeepSeek、Llama等開源模型,成為Hugging Face上獲贊最多的模型系列。第五條線是端側與終端落地。桌面端,開源的27B模型可本地運行。移動端,阿里發佈了AI手機全棧方案Qwen Intelligence,讓手機能夠完成跨應用的複雜任務。此外還涉及AI眼鏡、桌面機器人,以及基於RISC-V的玄鐵C950 CPU,可以原生運行Qwen3.8-27B。這五條線並非單獨運行,它們組合在一起構成了阿里在AI上的完整戰略。

RSI處理“模型如何自我提升”,架構迭代處理“性能上限能到多高”,全模態處理“能理解什麼”,開源處理“誰能用”,端側處理“在哪裡用”。它們共同服務的,是劉大一恆所說的“真實世界Agent”這一目標,讓模型從對話走向能獨立完成任務的系統。劉大一恆從幕後到公眾前的第一次亮相,就已經覆蓋了硬件、軟件、策略這三大方向。劉大一恆這個人劉大一恆是四川自貢人,名字“大一恆”並不常見,甚至讓很多人以為這是他在阿里的花名。2012年,他進入四川大學計算機學院。2015年,以綜合排名第一的成績保送“3+2+3”本碩博連讀,導師為呂建成教授。2017年,劉大一恆赴新加坡國立大學交流。

2020年獲四川大學計算機博士學位。從本科到博士,他一直在四川大學,沒有海外學歷,也沒有清華、北大的背景。這一點,與AI圈裡常見的那條“名校本科—海外博士—大廠鍍金”的路徑不同。他第一次進入公眾視野,與一篇論文有關。2019年他在ACL(國際計算語言學協會年會)上發表論文,這也是四川大學在讀研究生首次在ACL上發表成果。他後來在採訪中提到,並非自己投遞簡歷,而是論文發表、加上學校官網對其科研成果的報道之後,華為就主動聯繫了他。在這之後,劉大一恆一戰成名。2019年,他參加了谷歌舉辦的Natural Questions(NQ)全球長期公開競賽。

這項競賽的任務可以概括為:讓系統“讀完整個維基百科頁面”,再回答用戶在谷歌搜索引擎裡輸入的問句。它的難點有兩個,第一點是長文檔,一頁維基百科動輒數千上萬字,信息密度很高。第二點是開放領域,問題沒有預設範圍,什麼都可能被問到。長文檔和開放領域,是當時自然語言處理裡公認最難的兩類問題。想要在這場比賽裡獲得名次也是一件難事,因為同場競爭的包括谷歌AI、IBM Research等團隊。即使如此,劉大一恆所在團隊提出的模型在提交時取得世界第一,並保持了三個月。其中單模型首次在該競賽的所有測試指標上超過單人類性能,集成模型在公開排行榜上排名世界第一。

劉大一恆做出的項目叫做RikiNet,名字意為Reading Wikipedia,“讀維基百科的神經網絡”。它的核心邏輯是把整頁維基百科當作閱讀對象,再從整頁裡定位答案。RikiNet由兩個模塊構成:一個是“動態段落雙注意力閱讀器”,負責在超長文本里捕捉遠距離依賴、過濾掉無關內容;另一個是“多層級聯答案預測器”,利用長答案(段落)與短答案(片段)之間的層級關係,依次預測出短答案的位置、長答案所在的段落和答案類型。2020年,經過華為多輪選拔,他入選“天才少年計劃”第一檔,為西南地區首位入選第一檔的學生、當年全國僅5人,最高年薪200萬元。畢業後他加入華為雲語音語義創新LAB。

不過他沒有停留太久,2021年,他就轉投阿里達摩院語言技術實驗室,參與Qwen的研發。他曾自嘲到:“我既非天才,也已不是少年。”在Qwen,劉大一恆長期負責預訓練,並且主導了Qwen 1至Qwen 3.5全系列語言模型的研發,深度參與Qwen多模態、編程、數學(Qwen-Math)等系列,累計參與300多款Qwen模型的開源工作。在Qwen系列名氣最響的Qwen2.5、Qwen3等技術報告中,同樣有劉大一恆的署名。劉大一恆是團隊裡少數同時橫跨預訓練、編程、後訓練這三大核心模塊的人。預訓練決定模型的底層能力。而強化學習、對齊、推理與Agent這樣的後訓練,決定了Qwen在實際業務中的表現。

編程則決定Qwen的商業化能力。所以劉大一恆才會在第一次公開演講中講了完整的Qwen路線圖,那對他來說只是個長久以來的工作報告而已。Qwen在經歷多輪重組之後,需要一個“能穩住盤子的人”。Qwen1號位,也只有劉大一恆能當。劉大一恆與林俊暘的區別過去三年,Qwen在公眾面前的形象,很大程度上與林俊暘個人綁定。他生於1993年3月,比劉大一恆還年輕一些。2019年畢業後,他加入阿里達摩院,從高級算法工程師做起。2020年“通義千問”立項,他是核心架構成員,主導了OFA、Chinese CLIP等多模態基礎框架。

2022年底,達摩院的語言、視覺等團隊整體併入阿里雲、成立通義實驗室,他被正式任命為通義千問系列大模型的技術負責人。此後幾年,林俊暘主導了Qwen系列的開源工作,Qwen也因此成了全球開源生態裡的頭部模型家族。2025年,林俊暘升任P10,是阿里歷史上最年輕的P10之一。林俊暘和劉大一恆最大的不同,在於“方式”。林俊暘是臺前的人,他活躍在社交媒體上,會與馬斯克互動,會親自發招聘帖,強調“模型即產品”,主張研究人員要像產品經理一樣,把成果做成真實世界可用的系統。他不僅是技術負責人,也是Qwen的頭號公關和代言人。劉大一恆則長期在幕後,公開露面極少,風格偏低調、穩健,與Qwen一同成長。

2026年3月,通義實驗室計劃把Qwen團隊從“垂直整合”改為“水平分工”。具體方法是,把原本擰在一起的預訓練、後訓練、文本、多模態、基礎設施等環節,拆分為相對獨立的部門。這與林俊暘長期主張的全鏈路深度協同存在矛盾,他認為拆分打散會拖慢迭代、抬高溝通成本。隨後提出了辭職。離開Qwen不到半年後,林俊暘在上海官宣創辦“語用科技”(Pragmatik Labs),內部簡稱為p7k,方向是“橫跨數字世界與物理世界的下一代AI Agent”。公司天使輪投後估值約20億美元,由高榕創投與紅杉中國各出資約1億美元聯合領投,騰訊跟投約2000萬美元,上海未來產業基金參與。

林俊暘和劉大一恆之間,也代表了Qwen所處的不同時代。林俊暘執掌的幾年,正是Qwen在阿里內部項目成長的階段。這一階段需要的是能把技術講清楚、能在開源社區建立信任、能對外定義產品的人。劉大一恆面對的,是阿里Token Foundry成立後的組織收斂、商業化壓力。這一階段更看重穩定交付、跨模塊協調與組織連續性。從“技術狂飆”到“商業落地”,剛好是整個中國AI產業近期的變化,林俊暘的離開和劉大一恆的上任,恰好落在這個轉折點上。劉大一恆能不能頂住壓力,暫且無法蓋棺定論,但綜合來看,他的確是這個位置最好的人選,沒有之一。

Related

相關文章

量子位生成式AI

斑馬智能發佈端模型AutoOmni2.0,讓元神AI更懂“我的世界”

斑馬智能在雲棲大會發表新一代全模態端側大模型AutoOmni 2.0,任務處理能力堪比10倍參數量的雲模型,並推出AutoClaw 2.0智艙協作實車方案。元神AI強調理解用戶的「表世界」與「裡世界」,透過「三個連通」朝Personal AI演進,已覆蓋主流車企68%的服務。AutoOmni與10家晶片廠合作,實現低延遲、隱私保護及高效能推理,並展示免喚醒與主動智能等場景,未來將從單體智能擴展至群體智能。

剛剛
IT之家生成式AI

科大訊飛發佈全新語音識別大模型 Spark-ASR-2.0,明日上線訊飛輸入法

作者:遠洋 責編:遠洋 評論: 9 月 23 日消息,今日,科大訊飛正式發佈最新一代語音識別大模型 Spark-ASR-2.0。據官方介紹,Spark-ASR-2.0 通過非自迴歸與 LLM 增強自迴歸協同、中英文混合文本與聲學聯合增強、動態上下文注入等關鍵技術創新,整體的語音識別效果大幅提升,尤其在通用識別(中英文混合、方言、專業術語)、複雜聲學場景識別(高噪、小音量、快語速、兒童)、上下文識別和文本流暢規範性等方面改善明顯。

剛剛
鈦媒體生成式AI

別急著找“中國版Muse”,先看看股價的臉色

來咖智庫2026.09.23 16:33 · 來自重慶全文1557字00:00 / 04:25Muse火不火,是真問題;“中國版Muse”炒不炒,是假問題。文 | 來咖智庫9月8日,Meta上線個人AI智能體Muse。上線5天,下載量突破73萬次;13天累計超250萬次,登頂美國蘋果應用商店免費榜,把ChatGPT、Claude、Grok統統壓在身下。Apptopia的數據更狠:Muse美國移動端日活已達64.2萬,是ChatGPT上線同期23.1萬的近三倍。

剛剛
IT之家生成式AI

適用榮耀、小米、階躍手機,網信部門發佈 3 款提供手機端側生成式 AI 服務已備案信息

首頁 IT圈 最會買 設置 日夜間 隨系統 淺色 深色 主題色 黑色 投稿 訂閱 RSS訂閱 收藏 軟媒應用 App客戶端 要知App 軟媒魔方 業界 手機 電腦 測評 視頻 AI 蘋果 iPhone 鴻蒙 軟件 智車 數碼 學院 遊戲 直播 5G 微軟 Win10 Win11 專題 搜索 首頁 > 智能時代>人工智能 榮耀 YOYO Claw、小米 miclaw、階躍終端 AI 三款手機端側生成式 AI 服務通過網信部門備案 2026/9/23 16:33:24 作者:清源 責編:清源 評論: 感謝網友 Autumn_Dream、xxy171070、補藥吖 的線索投遞!

剛剛

​全新深藍 S07 正式官宣接入豆包大模型,9 月 28 日震撼上市

深藍汽車董事長鄧承浩於今日正式對外宣佈,全新深藍 S07將全面接入字節跳動旗下的豆包大模型,並同步搭載 AI 激光智駕系統,新車已定於9月28日正式推向市場。在談及智能座艙的發展演變時,鄧承浩指出,過去的汽車座艙競爭主要停留在“堆料”層面,用戶不得不去適應機器繁瑣的交互邏輯。

剛剛