阿里研究員透露Qwen4.5後模型將擴展至5-10T參數

2026年9月22日 11:51
阿里研究員透露Qwen4.5後模型將擴展至5-10T參數
站內 AI 整理稿

未來Qwen4.5、Qwen5等版本將擴展至5-10T參數。9月22日,阿里巴巴在雲棲大會上公佈了大模型一系列進展,大模型遞歸自我改進(RSI)已初步進入模型訓練、推理及芯模協同等環節中,基於新一代架構的Qwen4已在訓練中,未來Qwen4.5、Qwen5等版本將擴展至5-10T參數。同時,視頻生成模型、語音模型、圖像模型、世界模型、音樂模型以及全模態模型等均在當天或近期推出新版本。追求更高智能,Qwen加速自我進化 大模型正走向自我迭代,本屆雲棲大會,阿里系統展示了千問大模型自我進化的最新探索成果。在模型自我訓練上,Qwen3.

8-Max通過自主搭建訓練流程、構造訓練數據,並自主設計實驗、定位缺陷,在人類完全“零參與”的情況下持續迭代超1個月,完成33輪有效迭代。基於RSI、後訓練等系列技術聯合優化,Qwen3.8-Max新版本在Artificial Analysis上的得分從40漲至45分,與Claude、GPT最強模型同處第一陣營,領先於GLM5.3、Kimi-K3等所有國產模型。在推理優化上,Qwen3.8-Max在從未見過的平頭哥新款GPU上,自主適配優化了下代架構的Qwen3.8-Flash新模型的推理框架,實現單實例推理吞吐量提升 96%。在芯片模型協同設計上,Qwen3.

8-Max僅基於一份真實的總線模塊規範,自主展開前端、驗證、後端的全鏈路自迭代,在自主運行超60小時、調用EDA工具超萬次後,完成了減少42%面積的物理實現優化。圖說:Qwen LLM項目負責人劉大一恆表示,Scaling是邁向ASI的關鍵路徑,Qwen4.5、Qwen5參數規模計劃邁向5到10T 大會現場,阿里展示了大模型核心領域的系列技術創新。在架構優化方面,Qwen3.

8-Flash提前開源下一代千問大模型架構,通過注意力機制和模型內信息傳遞機制等核心技術創新,在實現前沿模型性能的同時,訓練成本驟降近90%;同時依託於極少的參數激活,將推理計算效率推至全新的帕累託前沿,成為行業性價比“斬殺線”模型。在模態擴充方面,全模態模型Qwen3.8-Omni正式亮相,將音視頻等不同模態高效納入統一理解框架中,為大模型開闢全新的思考分區。在參數擴展方面,參數越大依然能帶來更強的性能,未來千問大模型總參數量將擴展至5萬億甚至10萬億的規模。這些技術創新將成為新一代千問大模型的基石,據介紹,Qwen4模型正採用全新架構展開訓練,Qwen4.5、Qwen5均在穩步推進中。

在不斷探索大模型性能前沿的同時,阿里還通過“全模態”“全尺寸”的大模型開源,與全球開發者和企業共享前沿的AI技術紅利。在全球最大的AI開源社區Hugging Face中,Qwen3.8-27B模型超越DeepSeek-R1、Meta-Llama3.1等史上熱門模型,斬獲該平臺歷史上最受歡迎(Most Likes)的開源大模型。公開數據顯示,阿里已開源460餘個Qwen大模型,Qwen開源模型下載量突破30億次,衍生模型數超30萬個,穩居全球第一開源模型家族。

視聽生成模型升級,全新視頻生成模型擬11月發佈 在最富創意的視覺生成領域,阿里正通過視覺生成模型的持續迭代升級,讓AI創造出更好的作品,讓用戶享受到更好的體驗。圖像生成模型Qwen-Image-3.1亮相,它面向電商、創意、設計等真實商用場景全新優化升級,將原本數小時的視覺設計壓縮至秒級交付,水準堪比專業設計師,還支持圖像精準編輯。音樂生成模型Happy Shrimp 1.1 版本發佈,在音樂表現、人聲質量、多語種演唱及指令理解四個專業維度進一步提升,支持百餘種曲風與十餘種主流語言,覆蓋人聲歌曲與純音樂兩大生成場景。世界模型最新版本HappyOyster 2.

0 Preview亮相,通過對模型架構、訓練方法和數據體系的全面升級,顯著提升了智能實時交互、記憶能力、實時響應、物理規律遵循等核心能力,讓世界模型真正從實驗室走向真實可用。圖說:阿里巴巴ATH技術副總裁,淘天集團首席科學家鄭波在雲棲大會現場提到, 三年內會出現一個原生全模態統一模型,體驗將不再受限於模態的邊界 全新的下一代視頻生成模型也將於11月發佈,朝著更長、更可控、更完整、更智能的方向演進:在更長的時間裡,新模型仍然能保持一致性,創作者可精準掌控人物、場景與鏡頭;同時,模型能具備導演級的創作思維,從生成單個鏡頭邁向理解完整敘事。

下代語音模型發佈,Qwen落地多款智能終端 當前,語音正發展成為AI與人之間更自然的交互入口,Qwen模型也在手機、AI眼鏡、桌面機器人等硬件領域落地。語音模型家族Qwen-Audio-3.1全新升級,包含語音轉寫(ASR)、語音合成(TTS)和實時語音交互(Realtime)三大系列。基於下代架構的音頻理解模型Qwen-Audio-3.1-ASR-Next全新發布,它能夠理解人物情緒、音樂、環境聲與機械聲,完成聲音描述、事件定位、音頻問答與推理,讓“這段錄音中人的情緒怎樣”這樣的問題能夠被理解和準確回答。同時,音頻創作模型Qwen-Audio-3.

1-TTS-Next全新亮相,它採用全新架構,可根據一段腳本,直接生成融合對白和環境聲的完整音頻,極大提高有聲書、影視劇和播客等專業創作的效率。Qwen-Audio-3.1-Realtime實時交互能力再提升,能夠邊聽、邊想、邊說,並進一步增強多語言交互、角色扮演和共情能力。目前,該系列模型已應用於千問辦公和Qoder,並接入QwenNote A2隨身助理、QwenNote Eva桌面機器人和千問AI眼鏡等硬件產品。此外,同聲傳譯模型Qwen3.8-LiveTranslate首次登場,人類同傳平均時延在4秒以上,但該模型可將時延壓縮至不到2.5秒。

據瞭解,新模型已接入千問AI眼鏡、QwenNote A2、釘釘耳機等AI硬件。阿里大模型加速走向終端。AI手機全棧解決方案Qwen Intelligence發佈,專為手機場景深度優化,為合作伙伴提供基於千問大模型的 Agent 技術平臺,讓手機能夠更可靠地完成跨應用的複雜任務。阿里巴巴AI大模型全景圖

Related

相關文章

量子位生成式AI

阿里公佈全模態模型新進展,Qwen4和下代視頻模型均在訓練中

阿里巴巴在2026雲棲大會上公布多項大模型進展,包括基於新架構的Qwen4已開始訓練,未來參數規模將擴展至5到10萬億。多模態方面,影片生成模型Wan3.0在評測中取得雙榜第一,下一代影片模型預計11月發布;語音、影像、音樂及世界模型等也同步升級。此外,Qwen3.8-Max透過自我進化技術,在零人工參與下持續迭代,整體下載量已超過30億次。

剛剛

華為雲碼道全面升級:全球首個鴻蒙專屬AI編碼智能體登場,從想法到上架一條龍

官方給它的定位很硬:這是全球首個、也是目前唯一一個專為鴻蒙生態打造的AI編碼智能體,等於給鴻蒙開發者配了一位從頭跟到尾的數字搭檔。扛大樑的是鴻蒙編碼大模型。它依託鴻蒙增強訓練體系,在訓練數據、代碼生成、編譯通過率和Token消耗這幾個開發者最在意的維度上都佔著優勢,目前已經上線可調用。

剛剛

蘋果零售先驅質疑AI代理購物:消費者不會完全交給機器

現年66歲的約翰遜曾於2000年加入蘋果,負責搭建零售業務,並參與建立後來成為蘋果產品銷售與用戶服務核心的實體門店網絡。谷歌正通過Universal Commerce Protocol推動AI代理覆蓋商品發現、比較和結賬流程,OpenAI也在將ChatGPT打造為購物平臺。

剛剛

阿里平頭哥發佈AI芯片真武V900,算力達M890三倍

基於真武V900構建的單一集群可擴展至50萬卡,可為前沿AI模型訓練與推理提供大規模算力支持。阿里表示,隨著平頭哥芯片產品線逐步成熟並獲得廣泛客戶應用,預計芯片年出貨量將大幅提升。阿里集團CEO吳泳銘透露,阿里自研M890AI超節點目前已具備支撐2萬億參數大模型推理的能力,並已於本季度規模化上架阿里雲數據中心。

剛剛

騰訊混元圖像3.5來了:畫字更準、修圖更強、一張2K圖只要一毛五

新版本在畫質、排版、修圖等核心能力上全面升級,同時大幅降低使用成本,主打"便宜又好用"。據官方介紹,Hy Image3.5preview相比上一代能力提升了約30%。在畫字能力上,模型對文字內容的還原更加精準,不再出現"缺胳膊少腿"的尷尬;排版能力也顯著增強,可以更好地理解用戶對畫面佈局的要求;修圖方面,模型支持最多5張參考圖同時輸入,用戶可以根據多張圖片的風格或元素進行融合調整,最高支持2K分辨率輸出。

剛剛