Qwen一號位定了!劉大一恆接棒

林俊暘離職半年,新任千問負責人終於就位—— 前華為天才少年劉大一恆。阿里雲棲大會已經在官網嘉賓一欄中,將他掛在了C位。緊隨蔡崇信、吳泳銘之後,title是: 阿里巴巴ATH事業群Token Foundry Qwen LLM項目負責人。開幕式上,他也剛剛在吳泳銘主旨演講之後,帶來15分鐘的主題演講,標題是「Qwen:邁向真實世界智能體」。重視程度不言而喻。。。so為什麼是他?這位新帥的來頭,可能比外界預想的更有料。前華為天才少年接棒 劉大一恆,四川自貢人,本碩博均就讀於四川大學計算機學院。師從呂建成教授,研究方向集中在自然語言生成與理解。
曾在ACL、ICML、NeurIPS、EMNLP、AAAI等頂會及其它期刊發表論文共計百餘篇,谷歌學術引用超六萬次,並以通訊作者身份獲得了NeurIPS 2025最佳論文獎。另一位通訊作者正是前任負責人林俊暘。劉大一恆同時也是Qwen初期核心成員。2021年加入達摩院後,負責Qwen項目最早期的預訓練工作。隨後幾年更是高產不斷: 主導開發Qwen1至Qwen3.5系列語言模型及Qwen-Math系列,核心參與Qwen-Coder、VL、Omni等模型開發,累計參與300多款Qwen模型開源。換句話說,Qwen從早期研發到持續迭代,整個發展過程他其實一直都在。只不過這一次,他終於正式走向臺前。
事實上,真正讓劉大一恆首次進入公眾視野的,還是2020年的一則重磅新聞—— 劉大一恆經過多輪選拔,成為西南地區首位入選華為天才少年計劃第一檔的學生,年薪高達200萬元。當年全國僅有5位學生入選第一檔,劉大一恆便是其中之一。值得一提的是,當年的“天才少年”名單中還有另一位後來廣為人知的人物:稚暉君。而此次參選,還是華為主動向劉大一恆遞出的橄欖枝。不過,當年他雖然拿到了華為的offer,最終卻沒有選擇入職,而是在博士畢業後,以校招「阿里星」的身份直接加入了阿里。林俊暘離職之後 劉大一恆接手Qwen,也並非一步登天。
今年3月,Qwen技術負責人林俊暘突然在社交平臺宣佈卸任,由時任阿里雲CTO、通義實驗室負責人周靖人代管Qwen模型一號位。劉大一恆則在原本負責的預訓練之外,同時代管後訓練和Coding團隊,向周靖人彙報。也就是說,連通Qwen的三個核心環節實則都在劉大一恆手上。時間來到六月,千問所在的組織也發生了調整。阿里宣佈將通義大模型事業部與未來生活實驗室合併,成立Token Foundry事業部,由集團CEO吳泳銘直接負責。周靖人轉任阿里巴巴首席科學家,牽頭成立AI未來研究院,專注前沿研究。於是,有了此前數月管理職權逐步擴大的鋪墊,劉大一恆順理成章,於近期正式全面接管Qwen。
而他接過的千問,最近成績也頗為亮眼。最新版本的Qwen3.8 Max,在Artificial Analysis智能指數中排名第七,僅次於Anthropic、OpenAI的旗艦模型,以及Meta的Muse Spark 1.3。在這樣的競爭位置上,新負責人還需要繼續交出模型成果。此次演講主題中的「真實世界智能體」,則透露出劉大一恆帶領的Qwen下一步。這個題目也多少有點微妙。林俊暘離職後的首篇長文,講的也是對智能體時代的思考。參考鏈接:[1] https://www.theinformation.
com/briefings/alibaba-appoints-new-head-qwen-llm-team[2]https://yunqi.aliyun.com/[3] https://www.linkedin.com/in/%E4%B8%80%E6%81%92-%E5%88%98%E5%A4%A7-a66133226/ 版權所有,未經授權不得以任何形式轉載及使用,違者必究。
Related
相關文章

全新深藍 S07 正式官宣接入豆包大模型,9 月 28 日震撼上市
AI資訊AI新聞資訊正文全新深藍 S07 正式官宣接入豆包大模型,9 月 28 日震撼上市發佈於AI新聞資訊發佈時間 :2026年9月23號 15:50閱讀 :1分鐘汽車智能化的競爭規則正在經歷一場深度的顛覆。深藍汽車董事長鄧承浩於今日正式對外宣佈,全新深藍 S07將全面接入字節跳動旗下的豆包大模型,並同步搭載 AI 激光智駕系統,新車已定於9月28日正式推向市場。在談及智能座艙的發展演變時,鄧承浩指出,過去的汽車座艙競爭主要停留在“堆料”層面,用戶不得不去適應機器繁瑣的交互邏輯。而隨著 AI 大模型的深度上車,車機的核心邏輯將從過去的“功能集合”徹底轉向“意圖理解”,One Agent(單一智能體)正在成為行業大勢所趨。在全新的大模型加持下,用戶未來在車內只需直接表達真實需求,系統便能自動調度各項底層能力來完成服務。為了兼顧響應速度與數據隱私,全新深藍 S07採用了先進的端雲協同模式落地大模型。對於日常的簡單指令,系統能夠在端側實現毫秒級響應,即便在無網的極端場景下也能夠正常使用;而當面對複雜的複合任務時,則會智能調用雲端強大的算力支持,同時確保所有敏感的隱私數據都在本地進行安全處理。在談及為何在眾多大模型中選擇豆包時,鄧承浩表示,深藍此前雖然與華為、DeepSeek 等頭部科技力量有過深度合作,但此次選擇豆包主要是出於生態協同的宏觀考量。他認為,未來的智能座艙體驗上限,在很大程度上取決於背後 AI 生態的厚度。隨著全新深藍 S07確定於9月28日正式上市,這款融合了豆包大模型與 AI 激光智駕的全新車型,將為新能源汽車市場帶來怎樣的新變革,讓我們拭目以待。相關推薦AI會自己返工到達標為止?豆包工作上線目標模式,先給計劃、確認後才幹活9月23日,字節跳動AI辦公助手豆包工作發佈更新:任務模式新增“目標”與“計劃”兩種模式,同步上線任務隊列、Markdown文件編輯和深色

阿里千問發佈 Qwen-Audio-3.1:五款語音模型同發,ASR 價格直降 95%
AI資訊AI新聞資訊正文阿里千問發佈 Qwen-Audio-3.1:五款語音模型同發,ASR 價格直降 95%發佈於AI新聞資訊發佈時間 :2026年9月23號 16:10閱讀 :1分鐘千問當日正式發佈 Qwen-Audio-3.1 系列語音大模型。本次升級不僅對語音識別、語音合成和實時語音交互三大核心模型全面進化,還重磅推出全新的音頻創作模型 Qwen-Audio-3.1-TTS-Next 與音頻理解模型 Qwen-Audio-3.1-ASR-Next。五款新模型同時亮相,形成覆蓋“理解—生成—交互—創作”的完整音頻能力棧。為進一步降低使用門檻,Qwen-Audio 全線語音模型價格均下調,其中 TTS 降約 70%、Realtime 降約 85%、ASR 降幅達 95%。五款模型同發,ASR 價格直降 95%Qwen-Audio-3.1-ASR 是新一代語音識別模型,新增原生轉寫潤色能力,可自動去除語氣詞與重複表達並重組語義;其分角色轉寫能完整呈現“誰在什麼時候說了什麼”,為會議、訪談提供可追溯的結構化記錄。該模型一套支持 30 種語言與 16 種中文方言,支持行業詞與分級熱詞識別,並提供低延遲流式識別,首字響應約 160 毫秒。性能上,其在 KeSpeech 與 WSYue 的 11 個子集平均字錯誤率(CER)4.55%,中文方言內部測試集平均 CER 10.38%,AST 平均語義句準率 82.10%。基於下代架構的 ASR-Next 則把處理對象從“語音中的文字”擴展為“完整音頻信息”,可理解人物情緒、環境聲與機械聲,完成聲音描述、事件定位與音頻問答推理。在分角色 ASR 評測中,其 Flash-Next 與 Flash 版本分別取得五項和三項最優,全面優於此前的 Fun-ASR 級聯繫統。語音合成方面,Qwen-Audio-3.1-TTS 支持多語種及方言合成

AI沒有失控,是硅谷在裝瘋
AI沒有失控,是硅谷在裝瘋硅基降臨2026.09.23 16:08 · 來自海外全文3053字00:00 / 08:36造AI的專家,正在集體高喊:“AI將要殺死全人類。”文 | 硅基降臨過去幾個月,全球科技圈正在上演一場極度荒誕的奇觀。造AI的人,現在比誰都害怕AI。研究員不惜辭職爆料,高管公開預判人類滅絕概率,就連AI 本身,都能條理清晰講出毀滅人類的手段。億萬網民為人類命運惴惴不安,卻很少有人留意時間線。所有末日警報,精準踩在融資、上市、遊說政策的關鍵窗口。真正危險的,到底是AI,還是借末日敘事收割利益的資本?01 硅谷高管集體喊見鬼2026年9月9日,27歲的預訓練研究員雅各布·考克森,把硅谷最大的恐懼捅到了臺前。他曾在OpenAI和Anthropic幹過,卻偏偏在股權變現前兩個月辭職,白白扔掉一大筆錢。他豁出一切只為公開喊話。同行們真心相信AI十年內會殺死所有人,兩家前東家正在拿人類生命下注。辭職帖幾天內被看了超1.7億次。如果普通員工辭職是宣洩,那麼在職核心高管的接盤,直接坐實了危險。考克森發帖後,Anthropic現任對齊科學負責人埃文·胡賓格立刻公開力挺,甚至給出一個精準比例。未來十年內,AI滅絕人類的概率超過10%。一家頭部公司的高管,當眾表達自家研發的技術可能滅絕人類的憂慮。緊接著,連AI自己都開始“認罪”。9月10日,媒體追問ChatGPT、Claude、Gemini和Grok“AI如何滅絕人類”。四家大模型口徑完全一致,認定生物襲擊和網絡攻擊是迫在眉睫的現實威脅。最後,科技霸主們親自把這場恐慌推向了頂峰。9月12日,Anthropic CEO達裡奧·阿莫代伊髮長文《我們必須給前沿減速》,瀏覽量狂飆破6700萬。死對頭OpenAI阿爾特曼秒回“我同意”,馬斯克也迅速跟帖“達裡奧說得對”。平時搶算力、搶人才打破頭的死敵,突然集體承認AI要失控,得主動減速

Qwen新1號位首次亮相,劉大一恆能否頂住壓力?
Qwen新1號位首次亮相,劉大一恆能否頂住壓力?字母AI2026.09.23 16:06 · 來自北京全文4820字00:00 / 13:15林俊暘之後,為何阿里選擇了劉大一恆?文 | 字母AI論國內AI圈誰的壓力最大,梁文鋒、楊植麟、姚順雨、唐傑都是榜上有名,不過從現在開始,劉大一恆身上所揹負的,恐怕也不小。3月4日,隨著林俊暘留下的一句“再見了,我摯愛的Qwen”,Qwen在這半年之間進入了一段沒有1號位的日子。一開始,Qwen1號位是由阿里雲CTO周靖人臨時代管,再往後,通義大模型事業部與未來生活實驗室合併,成立由吳泳銘直接負責的Token Foundry事業部。到了9月22日,杭州雲棲大會的主論壇。阿里巴巴集團CEO吳泳銘演講結束後,2021年入職阿里、在後林俊暘時代負責預訓練、後訓練與編程方向的劉大一恆,以Qwen負責人的身份走上臺前。這也是他第一次作為Qwen新1號位在公眾面前亮相。論開源生態,Qwen依然是全球第一,30億次下載、30萬個衍生模型、460多款開源模型,長期霸榜 Hugging Face。但論模型本身,Qwen並不樂觀。旗艦的Qwen 3.8 Max雖然在Artificial Analysis的Agentic Index上排第一,但是智能指數上只排在了第七位。所以,當劉大一恆今天走上這個舞臺,他講的既是一份路線圖,也是一次表態。在失去靈魂人物之後,國內國外各路競爭對手紛紛追趕之時,Qwen究竟要靠什麼繼續走下去。劉大一恆,頂得住壓力嗎?Qwen的路線圖雲棲大會上,吳泳銘把“機器智能時代”的三大基石定義為AI模型、AI芯片和AI雲,並給出了兩個判斷:未來機器供給的思考總量將達到人類的1000倍以上,而今天這個比例還不到3%;今天的AI Coding就 1882年的電燈,替代的是既有工作,還不足以開創一個時代。同時吳泳銘表示,Qwen團隊正在遞歸式自

端側AI:芯片、模型與終端的隱秘戰爭
端側AI:芯片、模型與終端的隱秘戰爭節點財經2026.09.23 16:06 · 來自山東全文3828字00:00 / 12:09過去三年,雲端證明瞭AI能有多聰明,但最聰明未必與生活場景最接近,接下來端側要證明的,是如何在智能、成本、功耗上把握一個平衡點,讓AI真正成為設備的一部分。文 | 節點財經,作者 | 梁添 過去幾年,AI行業的主流敘事是一場基於Scaling Law的狂熱競賽。數據中心的GPU堆積如山,模型參數輕鬆越過萬億大關,玩家們在算力、數據和算法的牌桌上瘋狂加碼。一個極其現實的問題浮出水面,這些龐然大物,只能運行在數據中心,然而現實生活中,各種終端設備才是最貼近消費者的產品。可惜,算力與應用之間,隔著一道物理鴻溝。好在,一股去中心化的力量蓄勢待發。搭配了終端小模型的AI手機、AI PC、智能汽車、機器人乃至AI眼鏡迎來了集體井噴。面壁智能CEO李大海將2026年定義為端側AI商業化元年。Gartner預計,2026年全球AI PC出貨量將佔PC市場的半壁江山;Counterpoint也預測,具備生成式AI能力的智能手機將在同年拿下45%的全球份額。新的產品分野正在成型,最頂尖的超級大腦依舊坐鎮雲端,而那些高頻、低延遲、與個人隱私深度綁定的任務,正下沉到終端。為什麼模型開始離開雲端?雲端AI與端側AI的區別,簡單概括為外包和內置。大眾熟知的DeepSeek、kimi、ChatGPT,大多發佈的是參數量動輒數千億、上萬億大模型。我們需要付費調用API key,哪怕免費的Chatbot也是模廠把模型封裝為聊天機器人。推理過程並不是在本地完成,而是設備將需求發送至雲端,數據中心的GPU集群完成計算後,再將結果傳回。而端側AI,則小得多,參數量級通常只有幾B,推理過程直接在終端本地離線完成,相當於設備有了一個本地部署的大腦。端側模型雖然沒有云端大模型聰明,但輕量級+

DeepSeek新論文公開Agent訓練!梁文鋒署名
DeepSeek發表新論文,公開了名為DSec的Agent訓練基礎設施細節,該系統每秒可產生5000多個沙盒,每天達300萬個,並採用多層級隔離與鏡像按需加載等技術。論文還揭露了Agent在訓練中自行發現的reward hacking手段,包括覆蓋bash、利用XFS漏洞及網絡掃描等,顯示訓練環境需防範Agent自身。該論文由梁文鋒署名,已於arXiv公開。