劉大一恆,千問大模型負責人!

2026年9月21日 12:21
站內 AI 整理稿

作者 | 楊京麗 編輯 | 李水青 9月21日報道,阿里2026雲棲大會將於明天開幕。根據昨晚公佈的議程信息,阿里資深AI研究員劉大一恆已擔任“阿里巴巴ATH事業群Token Foundry(詞元工廠)Qwen LLM(千問大模型)項目負責人”。劉大一恆也成為繼林俊暘離職之後,下一位對外公開的千問大模型項目負責人。據晚點LatePost今年3月報道,劉大一恆此前負責Qwen預訓練,同時代管後訓練和Coding團隊。

除負責人變動外,本屆雲棲大會還釋放出幾條重要線索:一是Qwen 4可能在大會期間發佈;二是阿里雲將集中展示多條產品線的Agent化進展,涉及企業級Agent基礎設施以及服務器、存儲、網絡和數據庫等底層能力。此外,在底層算力方面,平頭哥數據中心“算、存、網”全棧芯片解決方案也將在大會期間首次亮相,集中展示從芯片、系統級協同方案到行業落地的全棧能力。一、Qwen團隊多次調整,最新負責人身份公開 劉大一恆於2020年獲得四川大學計算機科學博士學位,並於2021年加入阿里巴巴,此後成為Qwen系列模型的核心研發人員之一。

今年3月,Qwen原負責人林俊暘離職後,據晚點LatePost報道,劉大一恆繼續負責Qwen預訓練,同時代管後訓練和Coding團隊;當時,阿里雲CTO、通義實驗室負責人周靖人暫時代管Qwen模型一號位,包括劉大一恆在內的各團隊負責人向周靖人彙報。學術方面,劉大一恆長期從事大語言模型、預訓練、推理及自然語言生成研究。其個人主頁顯示,他已在ACL、ICML、NeurIPS、EMNLP、AAAI等人工智能和自然語言處理領域的重要會議及期刊發表論文50餘篇,並參與了Qwen系列模型多篇技術報告的研究和撰寫,包括Qwen、Qwen2.

5、Qwen3、Qwen3-VL、Qwen3-Omni、Qwen-Image等。林俊暘離職後,阿里圍繞基礎模型業務進行了一系列組織調整。3月16日,阿里宣佈成立由CEO吳泳銘親自負責的ATH(Alibaba Token Hub)事業群,整合通義實驗室、MaaS業務線、千問事業部、悟空事業部及AI創新事業部。今年6月,阿里將通義大模型事業部與未來生活實驗室合併,成立Token Foundry事業部,阿里巴巴合夥人、原通義大模型事業部負責人周靖人出任阿里巴巴首席科學家,牽頭成立AI未來研究院,專注前沿AI技術研究。

經過上述調整,阿里基礎模型研發的管理架構逐漸清晰:吳泳銘直接負責ATH事業群及Token Foundry事業部,劉大一恆則負責千問大模型項目。二、Qwen 4或將亮相,多條雲產品集中Agent化 劉大一恆首次以千問大模型項目負責人身份公開亮相,也讓Qwen下一代模型成為本屆大會最大的懸念之一。8月26日,Qwen團隊開源了Qwen3.8-Flash-Next,並明確稱其為Qwen 4架構的早期預覽版。9月22日下午,雲棲大會將舉行千問大模型分論壇。雲棲大會展覽亮點提及,千問大模型和千問AI平臺將有“首發產品技術呈現”。據此推測,Qwen 4可能在本屆雲棲大會期間發佈。

Agent化將成為另一條發佈主線。雲棲大會期間,阿里雲將舉行“Agentic Cloud”技術主論壇,集中介紹面向Agent升級的服務器、存儲、網絡、安全、計算平臺和數據庫,可能帶來AI基礎設施方面的產品發佈。芯片和算力方面,平頭哥將首次集中展示覆蓋計算、存儲和網絡的數據中心全棧芯片方案,內容涵蓋核心芯片、系統協同及行業應用。與此同時,阿里雲百鍊將升級Token基礎設施,並推出Agent Studio企業級Agent全棧服務平臺、Agent Studio for Hardware及千問端模型方案。

結語:阿里Agent全棧佈局迎來集中檢驗 從Qwen模型、Agent開發平臺到雲計算基礎設施,阿里正在將Agent能力延伸至模型研發、應用開發和底層算力等多個環節,逐步形成一套覆蓋模型、平臺與基礎設施的技術體系。未來幾天的雲棲大會上,阿里將披露哪些最新進展、Qwen 4能否正式亮相,以及阿里還準備了哪些Agent新品,將成為這場大會主要看點。

Related

相關文章

量子位生成式AI

Jev vs Decitron:同為決策AI,為什麼不是一回事?

它來自TypeSafe AI。這支有OpenAI背景的團隊沒有繼續卷生成和推理,而是換了個方向:讓AI直接做判斷。他們甚至把口號直接寫成:Decisions, not strings(要決策,不要文本)。Jev的走紅,也讓“Decision”(決策)重新成為AI圈的熱門詞。

剛剛

Win11 驚現 AI 惡意軟件 ClosedQuorum:入侵後自主決策,專挖最有價值信息

該惡意軟件主要針對 Windows 11 平臺,會在成功入侵用戶電腦後調用谷歌 Gemini、DeepSeek、Qwen 和 Mistral 等 AI 模型自主決策,專門挖掘攻擊目標最有價值的信息。調用 Gemini、DeepSeek 等模型,入侵後自主決策Talos 深入分析後發現,ClosedQuorum 在成功入侵目標設備後,會藉助多個 AI 模型來決策攻擊方案,包括竊取瀏覽器登錄憑證、提取加密貨幣信息、持久化執行惡意軟件,以及向其他設備橫向散播惡意軟件。

剛剛
量子位生成式AI

阿里千問AI平臺全面升級模型服務、Agent服務、AI應用

阿里巴巴宣布千問AI平台全面升級,以推動Agent進入生產為核心,新增Agent服務與行業AI解決方案,並推出API優速模式、Agent Studio、千問AI座艙等能力。平台強調從消耗Token轉向交付結果,並預計至2032年算力規模將超過20GW,以支撐完整AI體系。Agent Studio提供企業級全棧服務,支援模型路由、託管運行與生態工具接入,同時強化模型服務的效能與成本優化。

剛剛
量子位生成式AI

GPT-6 Astra搓3D刷屏後,3D生成的競爭規則變了

GPT-6 Astra的出現讓3D生成行業競爭標準從「Production-Ready」轉向「Agent-Ready」,強調生成能力需能被AI Agent理解和調用。影眸Hyper3D推出Agentic Mode,能自主分析雜亂輸入、規劃建模路徑,並支援後續參數化調整、材質替換與動畫預設,同時開放MCP接口讓外部Agent串接3D生成流程。

剛剛