騰訊混元Hy ASR 3.0 preview:讓語音識別理解上下文

2026年8月4日 17:05
騰訊混元Hy ASR 3.0 preview:讓語音識別理解上下文

重點摘要

< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.png" width="400" height="400"> 騰訊混元Hy ASR 3.0 preview:讓語音識別理解上下文 允中 2026-08-04 16:58:21 來源:量子位 元寶已接入 8 月 4 日,騰訊混元正式發佈新一代語音識別模型 Hy ASR 3.

站內 AI 整理稿

騰訊混元於8月4日正式推出新一代語音識別模型Hy ASR 3.0 preview,這款模型基於最新一代大語言模型Hy3的語言理解能力,將高精度語音識別與深度語義理解技術融合在一起,實現了從「逐字轉寫、單點優化」到「理解語境、兼容場景、一鍵直出」的關鍵演進。這項突破不僅讓語音識別更準確,更能結合上下文脈絡,還原用戶的真實意圖。 在傳統語音識別系統中,模型往往只能根據單一音頻片段進行逐字轉寫,缺乏對語境、語氣或前後文連貫性的判斷能力。Hy ASR 3.0 preview則透過Hy3大語言模型的語義理解能力,在辨識語音的同時,能夠解析語句內部的邏輯關係與場景背景,即便在複雜的真實輸入環境中,也能給出連貫且貼近用戶意圖的轉寫結果。這項技術讓語音識別不再只是「聽寫工具」,而是具備語言理解能力的智能助手。 在通用識別、上下文感知、多場景魯棒性以及方言覆蓋等核心維度上,Hy ASR 3.0 preview都實現了全面提升。根據官方公布的評測數據,該模型在多個開源評測集與自建評測集上的整體表現均領先業界。特別是在多語種的詞錯誤率(WER)控制上,Hy ASR 3.0 preview將WER穩定在3%左右,其中中文普通話的WER同樣維持在3%的水準,顯示出極高的辨識精度。 針對方言與多語種場景,Hy ASR 3.0 preview也展現出顯著優勢。在自建評測集中,該模型在語種及方言的整體表現上同樣領先,能夠有效應對不同地區的口音、語速與用詞差異,進一步拓展了語音識別技術在多元語言環境下的應用範圍。這對於中國市場常見的方言混合使用情境,以及跨國溝通中的多語言需求,都提供了更穩定的技術基礎。 騰訊混元團隊表示,Hy ASR 3.0 preview的技術突破,代表語音識別正從單點優化走向系統性理解。過去,語音辨識模型往往需要針對不同場景進行單獨調校,例如會議記錄、語音搜索、客服對話等各有不同的優化策略;而Hy ASR 3.0 preview透過大語言模型的語義融合,能夠在單一模型內同時兼顧多種場景,真正實現「一鍵直出」的便利性。 值得一提的是,這款語音識別模型已經接入騰訊旗下的元寶產品,用戶可以透過元寶體驗到更流暢、更準確的語音輸入與轉寫服務。從實際應用來看,無論是日常對話、會議記錄,還是語音指令操作,Hy ASR 3.0 preview都能大幅降低錯誤率,並減少後續人工修正的需求。 在業界看來,語音識別技術的長期挑戰在於如何平衡「聽得準」與「理解對」。傳統模型往往在純淨語音環境下表現出色,一旦遇到背景噪音、口音變化、語速不均或語義模糊的情況,準確率便會大幅下降。Hy ASR 3.0 preview的出現,正是透過大語言模型的語境理解能力,填補了這道鴻溝,讓模型在複雜條件下仍能保持穩定的辨識品質。 隨著AI技術不斷演進,語音識別正從單純的聲學模型轉向與語言模型深度協同的架構。騰訊混元此次推出的Hy ASR 3.0 preview,不僅是技術層面的升級,更代表著語音交互體驗的質變。未來,這類具備上下文理解能力的語音識別模型,有望在智慧家居、車載語音、客服系統、教育輔助等領域發揮更大作用,讓用戶與機器之間的自然語言溝通更加順暢。 總體而言,Hy ASR 3.0 preview的發布,為語音識別技術樹立了新的標竿。透過大語言模型賦能,語音識別不再只是記錄聲音的符號,而是能夠真正「聽懂」人話的智能系統。隨著模型持續迭代與應用場景擴展,這項技術的影響力將會進一步顯現。

Related

相關文章

博導稱月之暗面 Kimi 創始人楊植麟有很多機會留在美國,但他毅然拒絕蘋果、堅持回國創業

月之暗面創辦人楊植麟的博士生導師透露,楊植麟在攻讀博士期間及畢業後,曾收到蘋果等美國科技巨頭的優渥工作邀約,但他最終放棄這些機會,毅然選擇回國創業。這項決定催生了月之暗面公司及其AI產品Kimi,讓他在短時間內成為中國AI領域的重要人物。

1 小時前

歐盟AI透明度新規生效

歐盟AI透明度新規生效。 歐盟正式實施透明度規則���️方案。詳情可以參考歐盟透明規則執行條例細則。大模型生成的內容必須帶機讀標記。深偽視頻必須向公眾進行明確告知。

10 小時前

大模型抗汙染對齊評測框架

大模型抗污染对齐评测框架近日成为关注焦点。该框架旨在系统评估大语言模型在数据污染或对抗干扰下的对齐表现,为检验模型的安全性与鲁棒性提供新的评测维度。 站内已清除先前混入的模型思考或安全判断文字,保持内容纯净,并保留来源可确认的主题供读者追踪,以确保信息准确可溯。

5 天前

結構化輸出庫有效解決大模型胡言亂語

結構化輸出庫有效解決大模型胡言亂語。 開發者常為語言模型輸出不穩感到頭疼。我們可以用模型結構化輸出開源項目解決此痛點。開源庫支持 (o^^o) 強制模型生成符合模式響應。項目目前在社區已經獲得了超過一萬五千星。這對開發高可靠自動化工作流具有重要意義。

1 週前