Qwen4已投入訓練,阿里公佈10萬億參數模型演進路線

2026年9月22日 06:306400 次瀏覽
站內 AI 整理稿

AI資訊AI新閒資訊正文Qwen4已投入訓練,阿里公佈10萬億參數模型演進路線發布於AI新閒資訊時間 :Sep 22, 2026閱讀 :1分鐘9 月 22 日, 2026 雲棲大會在杭州開幕。阿里巴巴集團公佈大模型領域多項進展:基於下一代架構的Qwen4 已投入訓練,Qwen4.5、Qwen5 等後續模型參數規模計劃擴展至 5 萬億至 10 萬億;大模型遞歸自我改進(RSI)已進入模型訓練、推理及芯片協同等環節;多模態模型矩陣全面升級,下一代視頻生成模型將於 11 月發佈。Qwen LLM項目負責人劉大一恆表示,Scaling是邁向ASI的重要路徑。阿里披露,Qwen3.

8-Max發佈後在Artificial Analysis Agentic智能體、CodeArena前端編程等評測中位居前列。更值得關注的是,Qwen3.8-Max已能夠自主搭建訓練流程、構造數據、設計實驗並定位缺陷,在人類“零參與”情況下持續迭代超過 1 個月,完成 33 輪有效迭代,使Artificial Analysis得分提升12.5%。在推理優化和芯片模型協同設計方面,RSI也已實現落地。架構層面,Qwen3.8-Flash通過注意力機制等創新將訓練成本降低近90%,並以較少參數激活提升推理效率。多模態方面,Qwen3.8-Omni-Flash統一處理視頻、音頻、圖片和文字;Wan3.

0 支持單次生成 30 秒視頻及結構化輸入,下一代視頻模型將於 11 月發佈。Qwen-Audio-3.1 系列覆蓋ASR、TTS和Realtime,Qwen3.8-LiveTranslate將字均延遲降至2.3 秒;Qwen-Image-3.1、Qwen-Image-2.1、HappyShrimp 1.1 及HappyOyster 2.0-Preview也同步推進。開源生態方面,一個月內Qwen3.8 相關模型下載量已超 5600 萬次,衍生模型超 1900 個;截至目前,阿里已開源 460 多個千問模型,整體下載量超 30 億次,衍生模型超 30 萬個。

阿里稱,Perplexity、Airbnb、Pinterest及路透社等企業已基於Qwen開展Agent、AI助手或自研模型等應用。相關推薦千問上線 Qwen3.8-Omni-Flash:1M 上下文,30項評測平均提升超26%千問18日上線新一代原生全模態模型Qwen3.8-Omni-Flash,支持文本、圖像、音頻、視頻輸入及1M長上下文,已在千問AI平臺開放體驗。該模型在編程、文本知識、GUI操作等通用Agentic能力上,重點拓展音視頻Agentic應用,覆蓋視頻剪輯、MV創作、影視製作解說、音視頻轉圖文摘要與對話等,並已完成累計30項評測。Sep 18, 2026313.

8kAnthropic頂尖大牛憤然離職:AI失控倒計時,人類正在飲鴆止渴Anthropic資深研究員Jacob Coxon因認為AI行業無序狂飆,毅然辭職並退出人工智能領域,引發科技界震盪,凸顯大模型高速演進背後的安全危機。Coxon年僅27歲,數學背景深厚,曾在OpenAI任職。Sep 9, 2026270.

7k微信 WeMM-Embedding 已被大規模使用:朋友圈搜索、視頻號推薦都在跑,日調用 10 億次微信AI於9月4日開源多模態嵌入模型WeMM-Embedding,含2B、4B、9B三個版本,支持文本、圖像、視頻、視覺文檔等交錯輸入,可在統一語義空間比較檢索,已在朋友圈搜索、視頻號推薦等場景落地。Sep 8, 2026220.2kDeepSeek首個視覺實驗模型正式開源,3050億參數對標頂尖水平DeepSeek開源V4系列首個實驗性多模態模型V4-Flash-Vision-Exp。

該模型基於V4-Flash架構融合視覺模塊,在原有文本能力上新增深度圖像理解與分析能力,總參數量達3050億,視覺與文本架構有機結合,可精準解讀圖像並實現多模態融合。Sep 1, 2026222.1k價格砍至四十分之一!智譜開源原生多模態大模型GLM-5.3-Flash智譜開源原生多模態模型GLM-5.3-Flash(320B-A18B),以領先性能和極致定價推動AI普惠。該模型測評獲57分,與Claude Opus4.8持平,編程能力相當,綜合性能超越GLM-5.2。發佈前以匿名“Ox-Alpha”公開測試,登頂OpenCode、OpenRouter平臺調用。Aug 27, 2026307.

2k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026

Related

相關文章

小米18 Pro系列首發傳奇一瞬大模型影像,用端到端大模型把相機級光學虛化裝進手機

這一代最惹眼的王牌,是首發傳奇一瞬大模型影像——靠一套端到端的影像大模型,把相機級的光學虛化搬到了手機上,官方宣稱成像質感足以媲美專業相機。它的打法很聰明:把傳感器數據直接送上雲端,依託百萬量級樣片做多維度訓練,最終讓虛化效果落到接近光學鏡頭的質感。

剛剛

阿里試水QwenBook AI設備,團隊規模約150人

目前該產品仍處於早期試水階段,主打辦公場景,接入模型包括Qwen3.8-Max和Qwen3.8-Flash。據一位阿里雲人士透露,QwenBook的產品定義和硬件部分由團隊自主研發,同時將無影此前在雲電腦領域積累的系統及端雲能力帶入項目。目前QwenBook團隊約150人,系統團隊主要基於無影和阿里雲OS團隊重新組建,硬件團隊則吸納了多名頭部手機廠商相關人才。

剛剛
鈦媒體生成式AI

企業爆買AI Box

半導體產業縱橫2026.09.22 15:53 · 來自北京全文4115字00:00 / 11:32AIBox是算力買斷,還是買內存送處理器的營銷手段?文 | 半導體產業縱橫一臺放在辦公桌上、比機頂盒大不了多少的機器,塞著上百 GB 統一內存,斷網也能跑千億參數大模型。不用機房,不用機櫃,插電即用,數據不出房門。這就是AI Box,一臺搬上辦公桌的數據中心。AI Box賽道中蘋果、英偉達、AMD、微軟、英特爾悉數到場。但這種形態並不新鮮,為何2026年“連上顯示器就是臺電腦”的小盒子成了必爭之地?

剛剛

羅福莉押注大規模RL、小米最強開源模型亮相:6天燒掉2000多萬,多個 Agent 基準比肩閉源旗艦

準確提取圖片中的標題、關鍵數字、單位和註釋; 2、描述主要元素之間的空間位置和對應關係; 3、總結這張圖試圖表達的核心結論; 4、指出至少兩處容易被誤讀的細節; 我們想重點觀察是否抄錯數字、單位和模型名稱;能否理解圖例與曲線的對應關係;是否把推測寫成事實。

剛剛

阿里雲棲大會亮出最激進AI藍圖: 5 萬億至 10 萬億參數模型在途,自研真武V900 芯片算力翻三倍

首席執行官吳泳銘宣佈,公司正準備訓練參數規模介於5萬億至10萬億之間的新一代模型,這是阿里迄今最激進的AI發展計劃,也意味著它要從雲計算服務商進一步蛻變為全棧人工智能平臺。按照披露,這款仍在研發中的新模型將成為通義千問(Qwen)系列的重要後續產品。

剛剛

消息稱高瓴創投合夥人嚴文韜加入DeepSeek,擔任CFO

此次任命意味著DeepSeek成立三年來長期空缺的CFO職位正式補齊,也顯示其公司治理和財務管理體系進一步完善。資料顯示,嚴文韜1991年出生,畢業於復旦大學,2013年至2020年間先後任職於騰訊投資、H Capital,2020年加入高瓴創投。

剛剛