谷歌發佈 Gemini 3.5 Transcribe 語音轉文本模型,能自動刪除口頭禪

谷歌今日(8 月 27 日)宣布推出 Gemini 3.5 Transcribe 語音轉文本模型,這是 Gemini 3.5 系列中率先亮相的新成員。外界原本還在等待 Gemini 3.5 Pro 的發布,谷歌卻先端出了這款專注於語音輸入體驗的 AI 模型,為後續的旗艦產品鋪路。 這款模型的核心功能在於優化語音轉文字的品質。Gemini 3.5 Transcribe 能夠在轉錄過程中自動辨識並刪除「嗯」、「呃」這類口頭禪,同時也會過濾掉說話者說錯之後自行糾正的片段,最終產出更為通順、乾淨的文本內容。對於需要頻繁使用語音輸入、或是依賴逐字稿的用戶來說,這項技術能大幅減少後續手動編輯的負擔,讓語音轉錄結果更接近可直接使用的成品。
Related
相關文章

DeepSeek一張漲價單,繁榮了一條產業鏈?
師天浩2026.08.27 11:52 · 來自河北全文3584字00:00 / 11:45漲價,是缺貨的證詞文|師天浩觀察,作者|辰聰七天裡,DeepSeek調了兩次價。第一次發生在8月13日晚。與V4 Pro正式版上線同一份公告裡,Deepseek給出了新價格。8月17日零時起,旗艦模型V4-Pro高峰時段的輸出價從每百萬Tokens 6元漲到27元,漲幅350%;緩存命中的輸入價從0.025元漲到0.30元,是原來的12倍。

智譜認領“牛來”模型,實測:“牛馬”友好
智譜認領「牛來」模型的消息在科技圈迅速發酵,這個略帶戲謔意味的名字,瞬間點燃了開發者與AI愛好者的討論熱情。不同於過往以英文代號或嚴肅技術命名為主的慣例,「牛來」這個接地氣的名稱,反而在社群平台上創造了極高的聲量,讓原本可能僅限於專業圈層的技術發布,意外破圈成為大眾關注的焦點。 根據的實際測試與體驗,「牛來」模型在諸多應用場景中展現出對「牛馬」群體的高度友善。這裡所謂的「牛馬」,是當前網路語境下廣大上班族、打工人的自嘲式稱呼,而這款模型在處理繁雜的文書工作、程式碼生成、數據整理等日常高壓任務時,表現得格外得心應手。

AI自己出題自己練,兩個月狂漲11%,編碼自測反超Opus 4.8
AI 自行出題、自行批改、再針對弱點反覆練習,這種全新的自主學習模式正在讓模型能力出現驚人躍進。最新曝光的測試數據顯示,一款代號為 Fable 5.1 的模型在短短兩個月內編碼能力大幅提升 11%,其自測成績甚至一舉反超目前業界標竿 Opus 4.8,引發開發者社群熱烈討論。 據了解,Fable 5.1 目前正處於灰度測試階段,約在 37 分鐘前才剛對外開放部分用戶體驗。

B端收入漲7倍反超C端,MiniMax換了個活法 | 看財報
TechPulse2026.08.27 10:43 · 來自河北全文2525字00:00 / 08:00MiniMax預告了後續的模型計劃,M3.1主打大規模可用,M3 Pro參數規模提升到約3T,搭載MSA 2.0架構,計算效率預計提升約3倍。

Perplexity AI 推出 Portable Computer 本地智能體應用
作者:溯波(實習) 責編:溯波 評論: 8 月 27 日消息,Perplexity AI 當地時間 25 日宣佈推出 Portable Computer。這是其 Perplexity Computer 多模型編排智能體數字員工的本地化版本,可實現私密的工作流,僅在需要時才調用雲端算力。

特斯拉的產線還未投產,Figure已交付350臺機器人
硅谷Tech news2026.08.27 09:38 · 來自北京全文3803字00:00 / 11:04特斯拉拆解汽車產線轉產人形機器人,與Figure的量產競速。人形機器人的量產競賽正逼近窗口期,但發佈會上的敘事與產線上的真實進度之間存在明顯落差。