Qwen4已投入訓練,阿里公佈10萬億參數模型演進路線

2026年9月22日 06:306400 次瀏覽
站內 AI 整理稿

AI資訊AI新閒資訊正文Qwen4已投入訓練,阿里公佈10萬億參數模型演進路線發布於AI新閒資訊時間 :Sep 22, 2026閱讀 :1分鐘9 月 22 日, 2026 雲棲大會在杭州開幕。阿里巴巴集團公佈大模型領域多項進展:基於下一代架構的Qwen4 已投入訓練,Qwen4.5、Qwen5 等後續模型參數規模計劃擴展至 5 萬億至 10 萬億;大模型遞歸自我改進(RSI)已進入模型訓練、推理及芯片協同等環節;多模態模型矩陣全面升級,下一代視頻生成模型將於 11 月發佈。Qwen LLM項目負責人劉大一恆表示,Scaling是邁向ASI的重要路徑。阿里披露,Qwen3.

8-Max發佈後在Artificial Analysis Agentic智能體、CodeArena前端編程等評測中位居前列。更值得關注的是,Qwen3.8-Max已能夠自主搭建訓練流程、構造數據、設計實驗並定位缺陷,在人類“零參與”情況下持續迭代超過 1 個月,完成 33 輪有效迭代,使Artificial Analysis得分提升12.5%。在推理優化和芯片模型協同設計方面,RSI也已實現落地。架構層面,Qwen3.8-Flash通過注意力機制等創新將訓練成本降低近90%,並以較少參數激活提升推理效率。多模態方面,Qwen3.8-Omni-Flash統一處理視頻、音頻、圖片和文字;Wan3.

0 支持單次生成 30 秒視頻及結構化輸入,下一代視頻模型將於 11 月發佈。Qwen-Audio-3.1 系列覆蓋ASR、TTS和Realtime,Qwen3.8-LiveTranslate將字均延遲降至2.3 秒;Qwen-Image-3.1、Qwen-Image-2.1、HappyShrimp 1.1 及HappyOyster 2.0-Preview也同步推進。開源生態方面,一個月內Qwen3.8 相關模型下載量已超 5600 萬次,衍生模型超 1900 個;截至目前,阿里已開源 460 多個千問模型,整體下載量超 30 億次,衍生模型超 30 萬個。

阿里稱,Perplexity、Airbnb、Pinterest及路透社等企業已基於Qwen開展Agent、AI助手或自研模型等應用。相關推薦千問上線 Qwen3.8-Omni-Flash:1M 上下文,30項評測平均提升超26%千問18日上線新一代原生全模態模型Qwen3.8-Omni-Flash,支持文本、圖像、音頻、視頻輸入及1M長上下文,已在千問AI平臺開放體驗。該模型在編程、文本知識、GUI操作等通用Agentic能力上,重點拓展音視頻Agentic應用,覆蓋視頻剪輯、MV創作、影視製作解說、音視頻轉圖文摘要與對話等,並已完成累計30項評測。Sep 18, 2026313.

8kAnthropic頂尖大牛憤然離職:AI失控倒計時,人類正在飲鴆止渴Anthropic資深研究員Jacob Coxon因認為AI行業無序狂飆,毅然辭職並退出人工智能領域,引發科技界震盪,凸顯大模型高速演進背後的安全危機。Coxon年僅27歲,數學背景深厚,曾在OpenAI任職。Sep 9, 2026270.

7k微信 WeMM-Embedding 已被大規模使用:朋友圈搜索、視頻號推薦都在跑,日調用 10 億次微信AI於9月4日開源多模態嵌入模型WeMM-Embedding,含2B、4B、9B三個版本,支持文本、圖像、視頻、視覺文檔等交錯輸入,可在統一語義空間比較檢索,已在朋友圈搜索、視頻號推薦等場景落地。Sep 8, 2026220.2kDeepSeek首個視覺實驗模型正式開源,3050億參數對標頂尖水平DeepSeek開源V4系列首個實驗性多模態模型V4-Flash-Vision-Exp。

該模型基於V4-Flash架構融合視覺模塊,在原有文本能力上新增深度圖像理解與分析能力,總參數量達3050億,視覺與文本架構有機結合,可精準解讀圖像並實現多模態融合。Sep 1, 2026222.1k價格砍至四十分之一!智譜開源原生多模態大模型GLM-5.3-Flash智譜開源原生多模態模型GLM-5.3-Flash(320B-A18B),以領先性能和極致定價推動AI普惠。該模型測評獲57分,與Claude Opus4.8持平,編程能力相當,綜合性能超越GLM-5.2。發佈前以匿名“Ox-Alpha”公開測試,登頂OpenCode、OpenRouter平臺調用。Aug 27, 2026307.

2k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026

Related

相關文章

阿里雲棲大會亮出最激進AI藍圖: 5 萬億至 10 萬億參數模型在途,自研真武V900 芯片算力翻三倍

首席執行官吳泳銘宣佈,公司正準備訓練參數規模介於5萬億至10萬億之間的新一代模型,這是阿里迄今最激進的AI發展計劃,也意味著它要從雲計算服務商進一步蛻變為全棧人工智能平臺。按照披露,這款仍在研發中的新模型將成為通義千問(Qwen)系列的重要後續產品。

剛剛

消息稱高瓴創投合夥人嚴文韜加入DeepSeek,擔任CFO

此次任命意味著DeepSeek成立三年來長期空缺的CFO職位正式補齊,也顯示其公司治理和財務管理體系進一步完善。資料顯示,嚴文韜1991年出生,畢業於復旦大學,2013年至2020年間先後任職於騰訊投資、H Capital,2020年加入高瓴創投。

剛剛

Qwen4已投入訓練,阿里公佈10萬億參數模型演進路線

Qwen-Image-2.1、HappyShrimp 1.1 及HappyOyster 2.0-Preview也同步推進。開源生態方面,一個月內Qwen3.8 相關模型下載量已超 5600 萬次,衍生模型超 1900 個;截至目前,阿里已開源 460 多個千問模型,整體下載量超 30 億次,衍生模型超 30 萬個。

剛剛
鈦媒體生成式AI

工業AI正在走向產線,但規模化仍有卡點丨ToB產業觀察

Leo張ToB雜談2026.09.22 13:51 · 來自江蘇全文3920字00:00 / 11:45工業軟件的玩法,正在從“賣一套標準產品”轉向“幫客戶把AI能力長在自己身上”。過去,一家造船廠給排一份為期三個月的生產計劃,要把時間和空間約束都考慮進去,需要兩個員工,花費超過半個月的時間。

剛剛
量子位生成式AI

阿里研究員透露Qwen4.5後模型將擴展至5-10T參數

阿里巴巴在雲棲大會上宣布新一代架構的Qwen4模型已開始訓練,未來Qwen4.5、Qwen5等版本參數規模將擴展至5至10兆。大會同時展示大模型遞歸自我改進技術已應用於訓練與推理,並推出多款影像、音樂、語音及全模態模型新版本。阿里也宣布下代視頻生成模型預計11月發布,並將語音模型落地於手機、AI眼鏡等終端裝置。

剛剛
量子位生成式AI

阿里公佈全模態模型新進展,Qwen4和下代視頻模型均在訓練中

阿里巴巴在2026雲棲大會上公布多項大模型進展,包括基於新架構的Qwen4已開始訓練,未來參數規模將擴展至5到10萬億。多模態方面,影片生成模型Wan3.0在評測中取得雙榜第一,下一代影片模型預計11月發布;語音、影像、音樂及世界模型等也同步升級。此外,Qwen3.8-Max透過自我進化技術,在零人工參與下持續迭代,整體下載量已超過30億次。

剛剛