單模型支持 30 種語言 + 16 種方言,阿里千問升級 Fun-ASR-Realtime 語音識別模型

2026年7月6日 14:39
單模型支持 30 種語言 + 16 種方言,阿里千問升級 Fun-ASR-Realtime 語音識別模型

重點摘要

首頁 > 智能時代>人工智能 單模型支持 30 種語言 + 16 種方言,阿里千問升級 Fun-ASR-Realtime 語音識別模型 2026/7/6 14:39:48 來源:IT之家 作者:沁滄(實習) 責編:沁滄 評論: 感謝IT之家網友 Domado 的線索投遞!

站內 AI 整理稿

阿里千問於今(6)日正式宣布升級旗下即時語音辨識大模型 Fun-ASR-Realtime,新版本在單一模型架構內實現對 16 種方言與 30 種語言的同步支援,相關 API 已同步上架至阿里雲百鍊平台,提供開發者與企業用戶直接調用。這項更新標誌著阿里在語音辨識領域朝多語言、多方言通用化方向跨出重要一步,尤其適合跨國溝通、在地化服務與即時轉寫等複雜場景。根據官方公布的測試數據,Fun-ASR-Realtime 在涵蓋中國八大方言區的 16 種方言辨識任務中,平均字符準確率達到 88.62%。值得注意的是,該模型在 12 類方言上表現領先,超越火山引擎與騰訊的同類型產品。

這意味著在閩語、粵語、客家話、吳語等主要方言的即時轉寫上,Fun-ASR-Realtime 能夠提供更高精度的辨識結果,對於需要與在地使用者直接互動的客服系統、語音輸入工具或智慧家電來說,是一項實質進步。除了方言辨識的精準度,延遲表現也是即時語音辨識的關鍵指標。官方強調 Fun-ASR-Realtime 的首個字輸出延遲控制在百毫秒等級,這意味著用戶在說話後幾乎感受不到等待時間,能夠在對話過程中即時取得文字結果。同時,流式辨識的準確率已接近離線模型的水平,讓即時處理的品質不再明顯低於批次處理。

此外,模型支援在多種語言之間無縫切換,使用者可以在同一段對話中混合使用不同語言,系統會自動辨識並正確輸出,大幅提升跨語言溝通的流暢度。針對東亞與東南亞市場的特定需求,Fun-ASR-Realtime 也進行了專項優化。官方透露,在泰語等東南亞語言的辨識準確率提升了 20%,這項改進直接回應了出海企業在客服、國際會議、線上教育等場景中對非英語語音辨識的高要求。隨著台灣、東南亞供應鏈與服務業的數位轉型加速,能夠準確處理泰語、越南語、印尼語等語言的語音模型,將成為許多跨國團隊不可或缺的基礎設施。除了即時模型,阿里千問也於近期上線了離線版本的 Fun-ASR-Flash。

離線模式允許使用者在無網路或網路不穩定的環境下進行語音轉文字,適合偏遠地區、移動裝置或敏感資料無法上雲的應用場景。值得注意的是,在國際 AI 評測平台 Artificial Analysis 上,Fun-ASR-Flash(榜單上使用其曾用名「Fun-realtime-ASR-preview」)的字元錯誤率僅 1% 左右,顯示其離線辨識品質已達到業界頂尖水準。這項成績進一步驗證了阿里千問在語音辨識底層演算法上的技術積累。整體來看,Fun-ASR-Realtime 的升級不僅在語言與方言覆蓋範圍上取得突破,更在延遲、準確率、多語言切換與離線能力等面向同步提升。

阿里雲百鍊平台的上架,也讓中小型開發者能夠直接透過 API 串接這項能力,無需從零訓練模型。對於有意拓展海外市場的台灣企業來說,一套能同時應對國語、閩南語、客家話以及東南亞主要語言的語音辨識系統,有望大幅降低在地化營運的成本與障礙。未來,隨著阿里千問持續迭代語音模型,預期將有更多針對特定行業(如醫療、金融、教育)的垂直優化版本問世。Fun-ASR-Realtime 作為通用即時辨識方案,已為後續的場景化應用打下堅實基礎。開發者可前往阿里雲百鍊平台查閱 API 文件與定價,並開始測試這套支援 30 種語言與 16 種方言的單模型方案。

Related

相關文章

天才,對AI發展到底有多重要?

加拿大三位科學家傑弗裡·辛頓、約書亞·本希奧和理查德·薩頓對當代人工智慧發展有重大貢獻,凸顯少數天才就能左右一個國家的技術地位。文章從1956年達特茅斯會議談起,探討人工智慧領域的關鍵爭論與發展脈絡。

剛剛

Jeff Dean們,趕在貝葉斯AI到來之前跳船

Jeff Dean 離開任職27年的Google,創辦Discovery Loop公司,目標是讓AI進入持續運行的科學發現循環。Google DeepMind論文《LLM can't jump》指出,科學發現需要從經驗事實跳躍到新原則,而當前大型語言模型缺乏這種跳躍能力。研究顯示貝葉斯AI時代即將到來,大廠正積極補足Agent的基礎建設。

2 小時前

Meta重新支稜起來了?純推理拿下五項奧賽金牌,兩項滿分

Meta近期在人工智慧領域展現出驚人實力,其開發的純推理模型在國際數學奧林匹亞競賽中一舉奪下五面金牌,其中兩項更獲得滿分成績。這項成果不僅凸顯了Meta在AI推理能力上的突破,也讓外界重新審視這家科技巨頭在深度學習與邏輯運算方面的技術積累。 根據相關資訊,這款模型並未依賴外部知識庫或預先訓練的數據,而是透過純粹的推理機制來解決複雜數學問題。在競賽中,它成功應對多道高難度題目,涵蓋代數、幾何與數論等領域,最終以五項金牌的成績證明其演算法的有效性。其中兩項滿分表現,更顯示模型在特定題型上的精準度已達到頂尖水準。

5 小時前

智元下架了首席科學家羅劍嵐

智元機器人官網合夥人團隊名單中已移除首席科學家羅劍嵐,其個人社群簡介也不再提及智元職務,疑似離職,但官方尚未證實。羅劍嵐於2025年4月加入智元,任職約1年4個月,期間主導真機強化學習與具身智能研究,此次人事變動發生在公司啟動赴港上市流程之後。

8 小時前