千問上線全模態新模型
千問上線 Qwen3.8-Omni-Flash:1M 上下文,30項評測平均提升超26%AIbase基地發佈於AI新聞資訊 · 1 分鐘閱讀 · Sep 18, 202648千問於18日上線新一代原生全模態模型 Qwen3.8-Omni-Flash,支持文本、圖像、音頻與視頻輸入及1M 長上下文,已在千問 AI 平臺開放體驗。該模型在此前編程、文本知識工作與 GUI 操作等通用 Agentic 能力之上,著重拓展以音視頻為核心的 Agentic 應用,覆蓋視頻剪輯、MV 創作、影視製作與解說、音視頻轉圖文摘要及音視頻對話等需綜合處理多模態內容的工作流。
在累計30項評測中,其平均得分較上一代 Qwen3.5-Omni-Plus 提升超26%。音視頻 Agent、Coding 與長程任務方面,WildClawBench-MM 提升36.5分,AgenticVBench 提升22.3分,UniClawBench 取得69.6分;基礎能力上,LongAudioSpan 提升8.3分,OmniVideoBench 提升9.6分,OmniCap-IF 的 CSR/ISR 分別提升8.5/14.1分,AliMeeting 的 DER/cpWER 由88.11/89.61降至3.35/17.18。官方稱其音視頻能力接近 Gemini3.
8Flash,音頻能力整體超過後者;API 每小時音頻輸入價格降幅超98%,音視頻輸入價格降幅超93%。為支撐長程工作流與實時交互,千問擴展了 Qwen-MM-Plugins 並開源 Qwen-Live Harness。在 Agentic Understanding 模式下,OmniVideoBench 準確率由63.4升至67.8,Token 消耗從145,736降至79,117,降幅約45.7%。團隊還將模型推向研發環節本身:12小時內自主完成評測集選擇、數據構建與4輪迭代,累計構建3,413條訓練數據,將 Qwen2.5-Omni-3B 的四川話識別字符錯誤率從25.79% 降至15.
30%,相對下降約40.7%。同步推出的 Realtime 版本為首個支持"聽聲辨位"的全模態大模型。Qwen3.8-Omni-FlashAgentic音視頻處理多模態模型
Related
相關文章

阿里千問發佈同聲傳譯大模型 Qwen3.8-LiveTranslate,支持原文譯文同幀同出
作者:沁滄(實習) 責編:沁滄 評論: 9 月 19 日消息,阿里千問今日發佈同聲傳譯大模型 Qwen3.8-LiveTranslate ,模型以 Interleave 架構重構實時同傳,準確度、流暢度、簡潔度全面提升,字均延遲(LAAL)從 2.

陶哲軒代表SAIR Foundation宣佈正式啟動“開放數學模型計劃”
讓開放模型與可負擔的算力成為數學研究的共享基石 2026 年 9 月 18 日,菲爾茲獎得主、SAIR Foundation聯合創始人陶哲軒(Terence Tao)代表機構宣佈啟動「開放數學模型計劃」,意在聯合學術界與產業界,為數學及科學研究構建開放權重模型與配套開源工具。

華為朱照生:昇騰已經跨越了生態拐點,完全有能力、有機會在 Agentic 時代構建 AI 新生態
作者:沁滄(實習) 責編:沁滄 評論: 感謝網友 不一樣的體驗 的線索投遞!9 月 19 日消息,據 21 世紀經濟報道,9 月 19 日,華為計算戰略與業務發展部部長朱照生表示,昇騰已經跨越了生態的拐點,完全有能力、有機會在 Agentic 時代構建 AI 新生態。

OpenAI 示警:先進 AI 可在 2 臺相鄰物理隔離 PC 間“對話”
作者:故淵 責編:故淵 評論: 9 月 19 日消息,科技媒體 Wccftech 昨日(9 月 18 日)發佈博文,報道稱在先進 AI 模型交互方面,物理隔離電腦未必能完全阻斷兩臺相鄰計算機間的信息交換。OpenAI 研究員諾姆 · 布朗(Noam Brown)表示:“人類絕對不要低估 AI 的能力”,基於學術研究成果,發現相鄰的物理隔離計算機可借 CPU 升溫與溫度傳感器讀數,形成低帶寬隱蔽通信通道,充當“摩斯電碼”通信。

OpenAI 研究員示警:AI 能力越強,越容易“隱藏內心想法”
o3 系列的核心貢獻者,目前領導多智能體研究團隊。因其創新性的工作,他被《麻省理工科技評論》(MIT Tech Review) 評為“35 位 35 歲以下創新者” (35 Innovators Under 35) 之一。布朗表示:“思維鏈可監測性下降已成為主要問題,我們正努力尋找問題根源,從而扭轉這種局勢,但是我們發現 AI 模型能愈發自如地控制其思維鏈表達”。

Gemini 4 Pro疑似洩露,“AI減速”又成空話
字母AI2026.09.19 10:54 · 來自北京全文4800字00:00 / 12:44RSI正在逼近,三巨頭誰也沒停。文 | 字母AI前幾個月,OpenAI和Anthropic輪番把旗艦模型往前推,谷歌卻顯得異常安靜。Flash幾乎3週一更,3.6、3.7、3.8連續往前,但代表最高能力上限的Pro遲遲沒有動靜。直到這兩天,大模型盲測競技場Arena裡,突然冒出一個掛著gemini-3.8-flash名字的模型。開發者一上手就發現了不對勁,真正的Gemini 3.