AI日報:豆包、千問下線AI擬人化功能;騰訊混元Hy3發佈;Gemini3.5 Pro7月17日發佈

2026年7月6日 08:317400 次瀏覽

重點摘要

AI資訊最新AI日報正文AI日報:豆包、千問下線AI擬人化功能;騰訊混元Hy3發佈;Gemini3.5 Pro7月17日發佈發布於最新AI日報時間 :Jul 6, 2026閱讀 :2分鐘歡迎來到【AI日報】欄目!這裡是你每天探索人工智能世界的指南,每天我們為你呈現AI領域的熱點內容,聚焦開發者,助你洞悉技術趨勢、瞭解創新AI產品應用。新鮮AI產品點擊瞭解:https://app.aibase.

站內 AI 整理稿

近日人工智慧領域迎來多項重要動態,涵蓋語音技術升級與法規遵循調整。通義千問大模型宣布推出全新的即時語音辨識模型 Fun-ASR-Realtime,同步提升辨識效能與語言涵蓋範圍;與此同時,豆包與通義千問兩款主流 AI 應用均開始下線可自訂的 AI 擬人化代理功能,以因應即將於 7 月 15 日上路的新規範,整體行業呈現集體收縮趨勢。通義千問此次推出的 Fun-ASR-Realtime 模型,主打低延遲與多語言支援。官方資訊顯示,該模型的首字辨識延遲已控制在百毫秒等級,能夠實現「即說即反饋」的流暢互動體驗,大幅降低使用者等待時間,尤其適合即時對話、語音助理與即時轉寫等應用場景。

這項升級讓語音辨識的反應速度更接近人類自然對話節奏。在語言覆蓋面上,Fun-ASR-Realtime 支援多達 30 種語言的語音辨識處理,同時涵蓋 16 種中文方言。這使得通義千問的語音能力不僅限於標準普通話或主流國際語言,還能應對閩南語、粵語、客家話等多樣化地方方言,擴大了模型在跨文化、多語言環境下的應用邊界。對於需要處理少數族群語言或特定地區服務的開發者與企業來說,這項功能具備實際價值。此次模型發布被視為通義千問強化核心音頻能力的關鍵布局。隨著即時語音辨識效能提升,大模型在智慧客服、遠距會議記錄、語音搜尋、教育輔助等領域的落地潛力也隨之增加。

特別是在多語言混雜的即時場景中,Fun-ASR-Realtime 有機會提供更準確的辨識結果,減少因口音或語種切換造成的錯誤率。除了技術升級,AI 應用在合規層面也出現重大調整。據了解,豆包與通義千問兩款在中國市場相當普及的 AI 應用,均將下線其可自訂的 AI 擬人化代理功能。此類功能過去允許使用者設定 AI 角色的個性、語氣、外觀甚至行為模式,讓 AI 以更接近真人的方式與使用者互動。然而隨著監管環境趨嚴,這類帶有強烈「擬人」屬性的功能必須重新檢視。業內資訊指出,一項針對 AI 擬人化功能的新規範將於 7 月 15 日正式實施。為配合法規要求,豆包與通義千問決定提前下線相關功能。

此舉並非單一事件,而是整個行業集體收縮的信號。其他同類型應用也可能在未來數週內跟進,逐步縮減或取消可自訂的擬人化代理服務。AI 擬人化功能的背後涉及多重考量。一方面,擬人化設計能提升使用者互動的親切感與黏著度,尤其應用於聊天機器人、虛擬伴侶或角色扮演場景時,更容易獲得使用者好感。但另一方面,過度擬人可能引發隱私、安全與倫理爭議,例如使用者對 AI 產生情感依賴、角色設定被濫用於誤導或詐騙等問題。新規的落地正是為了在技術創新與社會風險之間取得平衡。對於已習慣使用擬人化功能的使用者來說,功能下線將直接影響互動體驗。

過去能為 AI 角色命名、設定性格或調整對話風格的功能將不再提供,AI 將回歸較為中性的標準對話模式。部分使用者可能因此轉向其他未受影響的應用,或對現有服務的黏著度產生變化。通義千問在擬人化功能下線的同時,仍積極強化語音辨識等底層技術能力。兩項動向看似方向相反,實則反映 AI 產業正在經歷「技術深耕」與「法規調適」並行的階段。一方面持續提升核心效能,另一方面主動配合監管要求,避免因合規漏洞而面臨業務風險。從整體市場格局來看,豆包與通義千問的下線決定,可能促使競爭對手重新評估自家產品的擬人化設計。

部分業者可能選擇在合規範圍內保留有限度的個性化設定,例如僅允許調整語氣風格而不涉及完整角色塑造;也有業者可能直接放棄這條產品線,轉向其他更無爭議的功能開發。值得注意的是,這波調整不僅限於中國市場。隨著各國對 AI 監管的態度日趨明確,擬人化、深度偽造、情緒模擬等技術都將面臨更高強度的審查。企業在設計 AI 互動介面時,必須更審慎地拿捏「人性化」與「誤導性」之間的界線。通義千問 Fun-ASR-Realtime 的發布,則為語音技術領域注入新動能。即時辨識的低延遲特性與多語言覆蓋,有助於拓展 AI 應用在國際市場的適用性。尤其在跨國客服、即時翻譯、智慧穿戴裝置等領域,這項技術有機會成為標準配備。

綜合來看,今日的 AI 動態呈現兩條主線:一是技術層面的語音辨識躍進,二是合規層面的功能收縮。兩者共同描繪出 2026 年下半年的 AI 產業樣貌——創新與規範並進,企業必須在快速迭代與穩健經營之間找到平衡點。後續業界將持續關注新規實施後的實際影響,以及是否會有更多應用跟進調整擬人化功能。

Related

相關文章

拆解“AI辦公入口戰”底層:怎麼做才能成為最終贏家?

字節、阿里、騰訊等大廠正透過組織調整與產品整合,全力爭奪AI辦公入口,關鍵在於模型、場景、生態與商業體系的全面競爭。這場戰爭的核心是透過AI產品實現Token經濟的商業閉環,並以「效果」為標準,透過自有體系與外部生態滿足企業用戶的真實需求。最終贏家需兼顧模型能力、場景積累與生態建設,才能在AI生產力時代站穩腳步。

剛剛

千人聯機世界模型“RhOS-World: Khora”正式發佈

RhOS.ai與Ophilus.AI共同發布了千人聯機世界模型「RhOS-World: Khora」,該模型能讓多達1024個智能體在共享的3D空間中即時互動,且無需傳統物理引擎。其核心技術「STBoard(時空黑板)」架構,透過統一的物理狀態管理,解決了多視角一致性的難題,並大幅降低了擴展智能體數量的運算成本。

剛剛

內部賽馬暫停,騰訊、阿里、字節AI辦公產品“合兵”對陣

過去半年,騰訊、阿里巴巴、字節跳動等大廠在AI辦公產品領域經歷內部賽馬後,近期紛紛收攏資源,推出整合方案。騰訊將QClaw業務調整至雲產品六部,與WorkBuddy統一管理;阿里整合三款產品推出千問辦公;字節則將飛書團隊併入豆包。市場數據顯示,6月國內AI辦公智能體平臺月訪問量突破6000萬次,顯示此領域競爭日益激烈。

1 小時前