科大訊飛發佈全新語音識別大模型 Spark-ASR-2.0,明日上線訊飛輸入法

作者:遠洋 責編:遠洋 評論: 9 月 23 日消息,今日,科大訊飛正式發佈最新一代語音識別大模型 Spark-ASR-2.0。據官方介紹,Spark-ASR-2.0 通過非自迴歸與 LLM 增強自迴歸協同、中英文混合文本與聲學聯合增強、動態上下文注入等關鍵技術創新,整體的語音識別效果大幅提升,尤其在通用識別(中英文混合、方言、專業術語)、複雜聲學場景識別(高噪、小音量、快語速、兒童)、上下文識別和文本流暢規範性等方面改善明顯。在效果提升的同時,Spark-ASR-2.0 的整體推理成本相對 Spark-ASR-1.0 僅增加了 10%。
官方稱,“如果說過去的語音識別追求的是一字不差地還原所說內容,那麼 Spark-ASR-2.0 則更進一步,讓識別結果‘流暢成文’—— 在提升識別準確率的同時,結合上下文邏輯與語境理解,精簡冗餘表達、精修各類細節,讓文字更連貫、語義更清晰。”相較於 Spark-ASR-1.0,Spark-ASR-2.0 在語音識別各核心場景上的效果有明顯進步,尤其在中英文混合、方言、高噪聲、文本流暢規範性等維度上的效果實現了大幅提升,WER(詞錯誤率)明顯降低。Spark-ASR-2.
0 與當前業界最好水平相比,在方言、高噪和小音量上擁有顯著優勢,也再次證明了在複雜聲學場景上語音識別的強大實力,主要任務效果均好於業界最優水平。測試集中 ASR 任務使用 WER / CER 作為評價指標,數值越低表示效果越好* 測試集來自於語音真實任務請求數據,來源分佈包括訊飛星火 APP、訊飛聽見 APP、訊飛翻譯機、訊飛輸入法、訊飛開放平臺語音 API 真實開發者場景等進行滾動更新。據瞭解,Spark-ASR-2.0 將從明天開始逐步上線訊飛輸入法,並且通過訊飛開放平臺提供 API 服務。此外,Spark-ASR-2.
0 還將陸續在訊飛 AI 眼鏡、訊飛智能辦公本、訊飛聽見等更多產品業務上落地應用。投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:科大訊飛,語音識別大模型,SparkASR2.0訊飛 AI 錄音卡上架:支持 10 種外語翻譯、30 小時續航,999 元基於全國產化算力訓練,訊飛星火語音基座大模型 Spark-Audio-1.0-Preview 上線科大訊飛星火 X2.5 模型正式發佈:293B-A30B MoE,全國產平臺訓練國產智能化工大模型 3.0 Pro 發佈,中國科學院大連化物所、科大訊飛、阿里雲等研發端側唯一百萬 Token 上下文模型開源:科大訊飛詞元星火 X2.
5-4B&1.7B 正式發佈科大訊飛推出學生耳機 Pro 頭戴式產品:30 小時續航、支持“實時耳返與跟讀”功能,399 元
Related
相關文章

斑馬智能發佈端模型AutoOmni2.0,讓元神AI更懂“我的世界”
斑馬智能在雲棲大會發表新一代全模態端側大模型AutoOmni 2.0,任務處理能力堪比10倍參數量的雲模型,並推出AutoClaw 2.0智艙協作實車方案。元神AI強調理解用戶的「表世界」與「裡世界」,透過「三個連通」朝Personal AI演進,已覆蓋主流車企68%的服務。AutoOmni與10家晶片廠合作,實現低延遲、隱私保護及高效能推理,並展示免喚醒與主動智能等場景,未來將從單體智能擴展至群體智能。

它石智航頂尖團隊引領中國具身智能率先邁入規模化落地階段
它石智航創辦人陳亦倫於上海跨國企業推介會中,強調具身智能須經真實產線驗證,並指出中國憑藉豐富製造業場景,率先進入規模化落地階段。該公司已透過自研AWE基座大模型與自製機器人硬件,完成從模型突破到規模化應用的三級躍遷,並計畫擴大研發團隊與生產基地,提升交付能力。未來將以中國為研發核心,面向全球推動工業智能化轉型。

別急著找“中國版Muse”,先看看股價的臉色
來咖智庫2026.09.23 16:33 · 來自重慶全文1557字00:00 / 04:25Muse火不火,是真問題;“中國版Muse”炒不炒,是假問題。文 | 來咖智庫9月8日,Meta上線個人AI智能體Muse。上線5天,下載量突破73萬次;13天累計超250萬次,登頂美國蘋果應用商店免費榜,把ChatGPT、Claude、Grok統統壓在身下。Apptopia的數據更狠:Muse美國移動端日活已達64.2萬,是ChatGPT上線同期23.1萬的近三倍。

適用榮耀、小米、階躍手機,網信部門發佈 3 款提供手機端側生成式 AI 服務已備案信息
首頁 IT圈 最會買 設置 日夜間 隨系統 淺色 深色 主題色 黑色 投稿 訂閱 RSS訂閱 收藏 軟媒應用 App客戶端 要知App 軟媒魔方 業界 手機 電腦 測評 視頻 AI 蘋果 iPhone 鴻蒙 軟件 智車 數碼 學院 遊戲 直播 5G 微軟 Win10 Win11 專題 搜索 首頁 > 智能時代>人工智能 榮耀 YOYO Claw、小米 miclaw、階躍終端 AI 三款手機端側生成式 AI 服務通過網信部門備案 2026/9/23 16:33:24 作者:清源 責編:清源 評論: 感謝網友 Autumn_Dream、xxy171070、補藥吖 的線索投遞!

全新深藍 S07 正式官宣接入豆包大模型,9 月 28 日震撼上市
深藍汽車董事長鄧承浩於今日正式對外宣佈,全新深藍 S07將全面接入字節跳動旗下的豆包大模型,並同步搭載 AI 激光智駕系統,新車已定於9月28日正式推向市場。在談及智能座艙的發展演變時,鄧承浩指出,過去的汽車座艙競爭主要停留在“堆料”層面,用戶不得不去適應機器繁瑣的交互邏輯。

阿里千問發佈 Qwen-Audio-3.1:五款語音模型同發,ASR 價格直降 95%
本次升級不僅對語音識別、語音合成和實時語音交互三大核心模型全面進化,還重磅推出全新的音頻創作模型 Qwen-Audio-3.1-TTS-Next 與音頻理解模型 Qwen-Audio-3.1-ASR-Next。五款新模型同時亮相,形成覆蓋“理解—生成—交互—創作”的完整音頻能力棧。