千問發佈 Qwen-Audio-3.1系列語音大模型,五款模型全線降價最高95%
AI資訊AI新閒資訊正文千問發佈 Qwen-Audio-3.1系列語音大模型,五款模型全線降價最高95%發布於AI新閒資訊時間 :Sep 23, 2026閱讀 :1分鐘千問大模型9月23日發佈 Qwen-Audio-3.1系列語音大模型,形成覆蓋理解、生成、交互與創作的完整音頻能力棧。系列包含語音識別 Qwen-Audio-3.1-ASR、音頻理解 ASR-Next、語音合成 TTS、音頻創作 TTS-Next 與實時交互 Realtime,API 已上架千問 AI 平臺,ASR-Next API 即將上線。同期全線降價,TTS 降幅約70%,Realtime 約85%,ASR 達95%。
能力層面,ASR 增強多語種、方言識別與上下文理解,新增原生轉寫潤色,可自動去除語氣詞與重複表達,並支持端到端分角色轉寫,聯合輸出說話人標籤、時間戳與文本;一套模型支持30種語言和16種中文方言,流式識別首字響應約160毫秒。ASR-Next 基於下代架構,把音頻理解從語音中的文字擴展至情緒、環境聲與機械聲,支持聲音描述、事件定位與音頻問答推理。TTS 支持同音色跨語言自然遷移,並以指令控制情緒與語速。TTS-Next 面向音頻創作,統一生成人聲、音效與環境音,支持多角色音色復刻、細粒度時間戳與48kHz 輸出,服務播客、有聲書與影視遊戲場景。
Realtime 基於多教師蒸餾架構實現全雙工交互,可隨時插話打斷,支持多語言實時切換、情緒理解與對話中調用工具。實測方面,ASR 在開源方言測試集平均 CER4.55%,中文方言自建集平均 CER10.38%,方言轉普通話平均語義句準率82.10%;ASR-Flash-Next 與 ASR-Flash 在四測試集八項指標中分獲五項、三項最優,全面優於此前的 Fun-ASR 級聯繫統。目前 Realtime 正與 Qoder、千問辦公等 Agent 及千問 AI 眼鏡等智能硬件結合,延續語音成為人機交互自然入口的趨勢。Qwen-Audio-3.1-ASR:https://www.
qianwenai.com/models/qwen-audio-3.1-asr-flashQwen-Audio-3.1-TTS:https://www.qianwenai.com/models/qwen-audio-3.1-tts-flashQwen-Audio-3.1-TTS-Next:https://www.qianwenai.com/models/qwen-audio-3.1-tts-nextQwen-Audio-3.1-Realtime:https://www.qianwenai.com/models/qwen-audio-3.1-realtime-plus(Qwen-Audio-3.
1-ASR-Next API即將上線)相關推薦千問一口氣端出五款語音大模型,TTS價格腰斬七成、ASR砍掉九成五,把耳朵和嗓子全打包給了開發者阿里千問9月23日升級語音棧,推出Qwen-Audio-3.1系列五款模型,覆蓋識別、合成、實時交互、音頻創作與理解,形成“理解—生成—交互—創作”完整矩陣。價格大幅下調:TTS降約70%、Realtime降約85%、ASR降95%,大幅降低語音使用門檻。Sep 23, 202670.
2k韶音首款AI開放式耳機OpenFit 2 AI重磅發佈,深度接入千問大模型劍指高端商務韶音發佈首款AI耳機OpenFit 2 AI,深度接入阿里千問大模型,並針對金融、法律等商務場景專項調優,標誌其從硬件優勢全面邁向AI驅動,定位新一代商務生產力工具。Aug 20, 2026264.1k阿里Qwen-Audio-3.0系列語音模型上線千問AI平臺,斬獲國際評測“大滿貫”阿里巴巴在千問AI平臺全面上線Qwen-Audio-3.0系列語音模型,涵蓋語音識別、語音合成和實時語音交互三款。
官方稱,該系列在權威評測平臺Artificial Analysis今年7月語音排行榜中表現卓越,包攬語音識別、實時交互和語音合成三項第一。Aug 17, 2026280.0k韶音推出 OpenFit 2 AI 開放式耳機,升級千問大模型售 1698 元韶音推出OpenFit2AI開放式耳機,定價1698元,8月17日發售。新品延續海豚弧耳掛設計,貼耳部分採用雙層硅膠包裹,內層為Shokz Ultra-Soft Silicone2.0超零度硅膠材質,核心升級在於深度整合AI功能。Aug 10, 2026286.
6k蘋果國內Apple智能迎來重大升級:Siri正式接入阿里千問大模型蘋果更新Mac使用手冊,國行Apple智能正式接入阿里巴巴千問大模型。搭載macOS 26.6以上系統並開啟權限後,將徹底解鎖全新AI體驗,Siri功能與智能迎來質變。此舉彌補了國內蘋果設備AI短板,藉助成熟中文大模型,Siri可針對複雜請求輸出更具深度的回答。Aug 10, 2026299.7k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026
Related
相關文章

斑馬智能發佈端模型AutoOmni2.0,讓元神AI更懂“我的世界”
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400"> 斑馬智能發佈端模型AutoOmni2.0,讓元神AI更懂“我的世界” 量子位的朋友們 2026-09-23 16:45:22 來源:量子位 9月23日雲棲大會期間,斑馬智能發佈新一代全模態端側大模型AutoOmni 2.0-23B-A3B 9月23日雲棲大會期間,斑馬智能發佈新一代全模態端側大模型AutoOmni 2.0-23B-A3B,任務處理能力堪比10倍參數量級的雲模型;基於讓AI更懂“我的世界”,亮相全新AutoClaw2.0智艙協作服務實車方案。 “端智能的核心價值是開啟交互新範式。”斑馬智能聯席CEO郝飛表示,基於端模型的全車全時免喚醒,以及上下文和記憶,是新範式的關鍵要素,讓更加懂我的主動服務成為可能。 智駕要懂“物理世界”,智艙要懂“我的世界” 在雲棲大會斑馬智能展臺上,騰勢Z9GT、智己LS6、神行者8、紅旗天工06的智駕分別是天神之眼、Momenta、華為乾崑和卓馭,但在智艙領域都選擇了斑馬智能元神AI。據悉,元神AI實現了對主流車企68%的服務覆蓋。 “AI上車不代表贏得用戶,深度使用才是真正的戰場。”斑馬智能首席產品官蔡明表示,AI進行復雜規劃、再有效組織各方能力的前提,是對用戶的理解。一方面,AI要理解物理空間、規律和軌跡構成的“表世界”;另一方面,要理解個人意圖、偏好和生活場景構成的“裡世界”,進而在感知、理解、執行與反饋的循環中持續進化。 據蔡明介紹,元神AI正從智艙AI邁向Personal AI,形成了“三個連通”:連通雲端與車端的算力和服務;連通用戶的多個終端,打通全時空場景數據;連通用戶與服務,實現跨App、跨終

科大訊飛發佈全新語音識別大模型 Spark-ASR-2.0,明日上線訊飛輸入法
首頁 > 智能時代>人工智能 科大訊飛發佈全新語音識別大模型 Spark-ASR-2.0,明日上線訊飛輸入法 2026/9/23 16:35:48 來源:IT之家 作者:遠洋 責編:遠洋 評論: IT之家 9 月 23 日消息,今日,科大訊飛正式發佈最新一代語音識別大模型 Spark-ASR-2.0。據官方介紹,Spark-ASR-2.0 通過非自迴歸與 LLM 增強自迴歸協同、中英文混合文本與聲學聯合增強、動態上下文注入等關鍵技術創新,整體的語音識別效果大幅提升,尤其在通用識別(中英文混合、方言、專業術語)、複雜聲學場景識別(高噪、小音量、快語速、兒童)、上下文識別和文本流暢規範性等方面改善明顯。在效果提升的同時,Spark-ASR-2.0 的整體推理成本相對 Spark-ASR-1.0 僅增加了 10%。官方稱,“如果說過去的語音識別追求的是一字不差地還原所說內容,那麼 Spark-ASR-2.0 則更進一步,讓識別結果‘流暢成文’—— 在提升識別準確率的同時,結合上下文邏輯與語境理解,精簡冗餘表達、精修各類細節,讓文字更連貫、語義更清晰。”相較於 Spark-ASR-1.0,Spark-ASR-2.0 在語音識別各核心場景上的效果有明顯進步,尤其在中英文混合、方言、高噪聲、文本流暢規範性等維度上的效果實現了大幅提升,WER(詞錯誤率)明顯降低。Spark-ASR-2.0 與當前業界最好水平相比,在方言、高噪和小音量上擁有顯著優勢,也再次證明瞭在複雜聲學場景上語音識別的強大實力,主要任務效果均好於業界最優水平。測試集中 ASR 任務使用 WER / CER 作為評價指標,數值越低表示效果越好* 測試集來自於語音真實任務請求數據,來源分佈包括訊飛星火 APP、訊飛聽見 APP、訊飛翻譯機、訊飛輸入法、訊飛開放平臺語音 API 真實開發者場景等進行滾動更新。據IT之家瞭解,

別急著找“中國版Muse”,先看看股價的臉色
別急著找“中國版Muse”,先看看股價的臉色來咖智庫2026.09.23 16:33 · 來自重慶全文1557字00:00 / 04:25Muse火不火,是真問題;“中國版Muse”炒不炒,是假問題。文 | 來咖智庫9月8日,Meta上線個人AI智能體Muse。上線5天,下載量突破73萬次;13天累計超250萬次,登頂美國蘋果應用商店免費榜,把ChatGPT、Claude、Grok統統壓在身下。Apptopia的數據更狠:Muse美國移動端日活已達64.2萬,是ChatGPT上線同期23.1萬的近三倍。資本市場直接用錢投票,Meta股價單日大漲超11%,市值一夜暴增近1.3萬億元。大洋這邊,資金的動作更快。9月22日,A股和港股開盤就開始滿場找“中國版Muse”:騰訊被公認為最優解,單日漲5%,傳媒、計算機板塊領漲,AI Agent概念全面引爆。然後,截至9月23日午盤,騰訊跌2.3%,收報441.2港元;阿里跌2.87%,小米跌2.5%,恒生科技指數跌0.97%。一場映射式炒作,從點燃到熄火,只用了24小時。先說Muse到底做對了什麼。它不是又一個聊天機器人。ChatGPT的模式是你問我答,Muse的模式是替你辦事:在用戶授權下讀郵件、訂餐廳、管日程、網購下單,聯動Instagram、日曆、外賣平臺等各種服務。它把AI從“對話工具”升級成了“執行工具”,這是全球消費級AI第一次把智能體做成全民產品。支撐這件事的是什麼是Meta手裡幾十億月活用戶的社交圖譜,是Instagram、Facebook、WhatsApp內置的分發通道。Muse超過95%的用戶同時在用Facebook,產品還沒推廣,入口已經焊死在用戶每天必開的App裡。問題是,“中國版Muse”這個提法,從第一天起就是個偽命題。Muse的壁壘不是模型,是社交圖譜加系統級分發。這個組合,全世界只有Meta一家有。資金

適用榮耀、小米、階躍手機,網信部門發佈 3 款提供手機端側生成式 AI 服務已備案信息
首頁 IT圈 最會買 設置 日夜間 隨系統 淺色 深色 主題色 黑色 投稿 訂閱 RSS訂閱 收藏IT之家 軟媒應用 App客戶端 要知App 軟媒魔方 業界 手機 電腦 測評 視頻 AI 蘋果 iPhone 鴻蒙 軟件 智車 數碼 學院 遊戲 直播 5G 微軟 Win10 Win11 專題 搜索 首頁 > 智能時代>人工智能 榮耀 YOYO Claw、小米 miclaw、階躍終端 AI 三款手機端側生成式 AI 服務通過網信部門備案 2026/9/23 16:33:24 來源:IT之家 作者:清源 責編:清源 評論: 感謝IT之家網友 Autumn_Dream、xxy171070、補藥吖 的線索投遞! IT之家 9 月 23 日消息,據網信中國公眾號,網信部門會同有關部門按照《生成式人工智能服務管理暫行辦法》要求,有序開展生成式人工智能服務備案工作,現將新增的“YOYO Claw”等 3 款提供手機端側生成式人工智能服務備案信息予以公告。IT之家彙總此次備案的生成式人工智能服務如下表:序號屬地大模型名稱備案單位備案編號備案時間適用場景1廣東省YOYO Claw深圳榮耀軟件技術有限公司GuangDong-YOYOClaw-2026072801952026/9/22榮耀手機2北京市Xiaomi miclaw小米科技有限責任公司Beijing-Xiaomimiclaw-2026051802252026/9/22小米手機3上海市階躍終端 AI智源星辰(上海)智能科技有限公司Shanghai-JieYueZhongDuanAI-2026072801842026/9/22階躍手機 投訴水文 我要糾錯 下載IT之家APP,簽到賺金幣兌豪禮 相關文章關鍵詞:網信辦,生成式AI備案中央網信辦召開網絡直播規範發展工作會議:對直播亂象實現靶向治理網信辦通報 30 款 App 個人信息收集使用問

全新深藍 S07 正式官宣接入豆包大模型,9 月 28 日震撼上市
深藍汽車董事長鄧承浩於今日正式對外宣佈,全新深藍 S07將全面接入字節跳動旗下的豆包大模型,並同步搭載 AI 激光智駕系統,新車已定於9月28日正式推向市場。在談及智能座艙的發展演變時,鄧承浩指出,過去的汽車座艙競爭主要停留在“堆料”層面,用戶不得不去適應機器繁瑣的交互邏輯。
