千問發佈 Qwen-Audio-3.1系列語音大模型,五款模型全線降價最高95%
AI資訊AI新閒資訊正文千問發佈 Qwen-Audio-3.1系列語音大模型,五款模型全線降價最高95%發布於AI新閒資訊時間 :Sep 23, 2026閱讀 :1分鐘千問大模型9月23日發佈 Qwen-Audio-3.1系列語音大模型,形成覆蓋理解、生成、交互與創作的完整音頻能力棧。系列包含語音識別 Qwen-Audio-3.1-ASR、音頻理解 ASR-Next、語音合成 TTS、音頻創作 TTS-Next 與實時交互 Realtime,API 已上架千問 AI 平臺,ASR-Next API 即將上線。同期全線降價,TTS 降幅約70%,Realtime 約85%,ASR 達95%。
能力層面,ASR 增強多語種、方言識別與上下文理解,新增原生轉寫潤色,可自動去除語氣詞與重複表達,並支持端到端分角色轉寫,聯合輸出說話人標籤、時間戳與文本;一套模型支持30種語言和16種中文方言,流式識別首字響應約160毫秒。ASR-Next 基於下代架構,把音頻理解從語音中的文字擴展至情緒、環境聲與機械聲,支持聲音描述、事件定位與音頻問答推理。TTS 支持同音色跨語言自然遷移,並以指令控制情緒與語速。TTS-Next 面向音頻創作,統一生成人聲、音效與環境音,支持多角色音色復刻、細粒度時間戳與48kHz 輸出,服務播客、有聲書與影視遊戲場景。
Realtime 基於多教師蒸餾架構實現全雙工交互,可隨時插話打斷,支持多語言實時切換、情緒理解與對話中調用工具。實測方面,ASR 在開源方言測試集平均 CER4.55%,中文方言自建集平均 CER10.38%,方言轉普通話平均語義句準率82.10%;ASR-Flash-Next 與 ASR-Flash 在四測試集八項指標中分獲五項、三項最優,全面優於此前的 Fun-ASR 級聯繫統。目前 Realtime 正與 Qoder、千問辦公等 Agent 及千問 AI 眼鏡等智能硬件結合,延續語音成為人機交互自然入口的趨勢。Qwen-Audio-3.1-ASR:https://www.
qianwenai.com/models/qwen-audio-3.1-asr-flashQwen-Audio-3.1-TTS:https://www.qianwenai.com/models/qwen-audio-3.1-tts-flashQwen-Audio-3.1-TTS-Next:https://www.qianwenai.com/models/qwen-audio-3.1-tts-nextQwen-Audio-3.1-Realtime:https://www.qianwenai.com/models/qwen-audio-3.1-realtime-plus(Qwen-Audio-3.
1-ASR-Next API即將上線)相關推薦千問一口氣端出五款語音大模型,TTS價格腰斬七成、ASR砍掉九成五,把耳朵和嗓子全打包給了開發者阿里千問9月23日升級語音棧,推出Qwen-Audio-3.1系列五款模型,覆蓋識別、合成、實時交互、音頻創作與理解,形成“理解—生成—交互—創作”完整矩陣。價格大幅下調:TTS降約70%、Realtime降約85%、ASR降95%,大幅降低語音使用門檻。Sep 23, 202670.
2k韶音首款AI開放式耳機OpenFit 2 AI重磅發佈,深度接入千問大模型劍指高端商務韶音發佈首款AI耳機OpenFit 2 AI,深度接入阿里千問大模型,並針對金融、法律等商務場景專項調優,標誌其從硬件優勢全面邁向AI驅動,定位新一代商務生產力工具。Aug 20, 2026264.1k阿里Qwen-Audio-3.0系列語音模型上線千問AI平臺,斬獲國際評測“大滿貫”阿里巴巴在千問AI平臺全面上線Qwen-Audio-3.0系列語音模型,涵蓋語音識別、語音合成和實時語音交互三款。
官方稱,該系列在權威評測平臺Artificial Analysis今年7月語音排行榜中表現卓越,包攬語音識別、實時交互和語音合成三項第一。Aug 17, 2026280.0k韶音推出 OpenFit 2 AI 開放式耳機,升級千問大模型售 1698 元韶音推出OpenFit2AI開放式耳機,定價1698元,8月17日發售。新品延續海豚弧耳掛設計,貼耳部分採用雙層硅膠包裹,內層為Shokz Ultra-Soft Silicone2.0超零度硅膠材質,核心升級在於深度整合AI功能。Aug 10, 2026286.
6k蘋果國內Apple智能迎來重大升級:Siri正式接入阿里千問大模型蘋果更新Mac使用手冊,國行Apple智能正式接入阿里巴巴千問大模型。搭載macOS 26.6以上系統並開啟權限後,將徹底解鎖全新AI體驗,Siri功能與智能迎來質變。此舉彌補了國內蘋果設備AI短板,藉助成熟中文大模型,Siri可針對複雜請求輸出更具深度的回答。Aug 10, 2026299.7k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026
Related
相關文章

斑馬智能發佈端模型AutoOmni2.0,讓元神AI更懂“我的世界”
斑馬智能在雲棲大會發表新一代全模態端側大模型AutoOmni 2.0,任務處理能力堪比10倍參數量的雲模型,並推出AutoClaw 2.0智艙協作實車方案。元神AI強調理解用戶的「表世界」與「裡世界」,透過「三個連通」朝Personal AI演進,已覆蓋主流車企68%的服務。AutoOmni與10家晶片廠合作,實現低延遲、隱私保護及高效能推理,並展示免喚醒與主動智能等場景,未來將從單體智能擴展至群體智能。

它石智航頂尖團隊引領中國具身智能率先邁入規模化落地階段
它石智航創辦人陳亦倫於上海跨國企業推介會中,強調具身智能須經真實產線驗證,並指出中國憑藉豐富製造業場景,率先進入規模化落地階段。該公司已透過自研AWE基座大模型與自製機器人硬件,完成從模型突破到規模化應用的三級躍遷,並計畫擴大研發團隊與生產基地,提升交付能力。未來將以中國為研發核心,面向全球推動工業智能化轉型。

科大訊飛發佈全新語音識別大模型 Spark-ASR-2.0,明日上線訊飛輸入法
作者:遠洋 責編:遠洋 評論: 9 月 23 日消息,今日,科大訊飛正式發佈最新一代語音識別大模型 Spark-ASR-2.0。據官方介紹,Spark-ASR-2.0 通過非自迴歸與 LLM 增強自迴歸協同、中英文混合文本與聲學聯合增強、動態上下文注入等關鍵技術創新,整體的語音識別效果大幅提升,尤其在通用識別(中英文混合、方言、專業術語)、複雜聲學場景識別(高噪、小音量、快語速、兒童)、上下文識別和文本流暢規範性等方面改善明顯。

別急著找“中國版Muse”,先看看股價的臉色
來咖智庫2026.09.23 16:33 · 來自重慶全文1557字00:00 / 04:25Muse火不火,是真問題;“中國版Muse”炒不炒,是假問題。文 | 來咖智庫9月8日,Meta上線個人AI智能體Muse。上線5天,下載量突破73萬次;13天累計超250萬次,登頂美國蘋果應用商店免費榜,把ChatGPT、Claude、Grok統統壓在身下。Apptopia的數據更狠:Muse美國移動端日活已達64.2萬,是ChatGPT上線同期23.1萬的近三倍。

適用榮耀、小米、階躍手機,網信部門發佈 3 款提供手機端側生成式 AI 服務已備案信息
首頁 IT圈 最會買 設置 日夜間 隨系統 淺色 深色 主題色 黑色 投稿 訂閱 RSS訂閱 收藏 軟媒應用 App客戶端 要知App 軟媒魔方 業界 手機 電腦 測評 視頻 AI 蘋果 iPhone 鴻蒙 軟件 智車 數碼 學院 遊戲 直播 5G 微軟 Win10 Win11 專題 搜索 首頁 > 智能時代>人工智能 榮耀 YOYO Claw、小米 miclaw、階躍終端 AI 三款手機端側生成式 AI 服務通過網信部門備案 2026/9/23 16:33:24 作者:清源 責編:清源 評論: 感謝網友 Autumn_Dream、xxy171070、補藥吖 的線索投遞!

全新深藍 S07 正式官宣接入豆包大模型,9 月 28 日震撼上市
深藍汽車董事長鄧承浩於今日正式對外宣佈,全新深藍 S07將全面接入字節跳動旗下的豆包大模型,並同步搭載 AI 激光智駕系統,新車已定於9月28日正式推向市場。在談及智能座艙的發展演變時,鄧承浩指出,過去的汽車座艙競爭主要停留在“堆料”層面,用戶不得不去適應機器繁瑣的交互邏輯。