谷歌DeepMind發佈SL2T,手語AI首次進入消費級手機

2026年8月13日 07:006100 次瀏覽
站內 AI 整理稿

AI資訊AI新閒資訊正文谷歌DeepMind發佈SL2T,手語AI首次進入消費級手機發布於AI新閒資訊時間 :Aug 13, 2026閱讀 :1分鐘谷歌旗下DeepMind發佈全新多語言手語轉文本模型SL2T,並將其搭載至Pixel11手機系統,首次推動手語AI進入普通消費電子產品。該模型率先接入Gboard鍵盤和Live Transcribe,用戶通過前置攝像頭完成手語動作,即可進行消息編輯、網頁檢索及與Gemini對話,替代傳統鍵盤輸入。SL2T基於超過50種手語、累計10萬小時手語素材訓練,其中約四分之一來自美國手語數據集。

跨語種聯合訓練幫助模型學習不同手語之間的共通動作邏輯,並在FLEURS-ASL評測中刷新手語轉寫模型紀錄。與依賴固定詞彙標籤的傳統方案不同,SL2T可直接解析人體動作生成文本,同時處理面部表情、肢體空間位置和唇部動作等非手部語義信息。隱私方面,手機端MediaPipe Holistic實時追蹤手部、面部和軀幹共130處關鍵點,僅向外傳輸動作座標,原始視頻會即時刪除,不上傳雲端。目前該功能僅支持美國手語轉英文,谷歌計劃後續擴展更多手語及安卓機型。DeepMind此前於2025年5月開源手語互譯模型SignGemma,為SL2T落地提供算法基礎。

此外,其WaveNet、Euphonia及Live Transcribe等無障礙技術也積累了語音、視覺多模態經驗。隨著谷歌、科大訊飛、華為和蘋果持續佈局,AI無障礙交互正從科研驗證加速走向消費級產品。相關推薦深度融合Gemini與全系進階:谷歌正式發佈全新Pixel11 系列智能手機谷歌正式發佈Pixel 11系列,外觀和核心硬件改動有限,主打軟件體驗與Gemini人工智能深度融合。Gemini具備更強的自主代理執行能力,可在後臺高效完成日常繁雜任務,進一步提升智能化使用體驗。Aug 13, 2026146.

0kGoogle AI 雙柱同日動搖:Jeff Dean 出走創業,Gemini 換帥迎戰關鍵期谷歌AI高層罕見動盪:DeepMind負責人哈薩比斯卸任日常管理,轉任主席兼Alphabet首席科學家;首席科學家Jeff Dean結束27年Google生涯,攜三名資深研究員創辦新公司。消息引發Alphabet股價單日下跌近4%。哈薩比斯仍留任公司,Gemini 4項目持續推進。Aug 6, 2026245.3k靈動聲紋與情感釋放:Google DeepMind推出Lyria 3.5音樂生成模型Google DeepMind發佈新一代音樂生成模型Lyria3.

5,在音樂性、歌詞與人聲表現力及創作控制上大幅提升,可構建更復雜自然的旋律織體,推動AI音樂向專業應用邁進。Jul 30, 2026248.3k谷歌解散AI系統AlphaFold團隊 將重心放在Gemini上谷歌DeepMind已悄然解散曾獲諾貝爾化學獎的AlphaFold團隊。該系統的核心人物哈薩比斯與江珀剛在2024年憑此獲獎,但過去一年中,多數原始論文作者已被重新分配至其他項目,這支明星團隊正被悄然拆解。Jul 29, 2026202.4k​打破專用模型桎梏!

谷歌 DeepMind 發佈 GenCeption,一個 AI 搞定五大視覺任務谷歌DeepMind推出GenCeption模型,將視頻生成AI逆向改造為視覺分析引擎,單一模型即可同時完成深度估計、圖像分割、3D姿態估計等五項核心視覺任務。模型基於阿里通義萬相Wan2.1框架訓練,一次前向傳播實現預測,打破任務孤立格局。Jul 21, 2026228.5k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026

Related

相關文章

鈦媒體生成式AI

王興興“錯配”梁文鋒?

王興興“錯配”梁文鋒?字母榜2026.08.24 17:44 · 來自河北全文4818字00:00 / 13:21關於世界模型,宇樹和DeepSeek理念分歧明顯。文 | 字母榜宇樹科技的股價還在持續下跌。市值從上市首日的4449億元高點,跌至2400億元,截至8月24日收盤,市值較最高點蒸發了2000億元。然而比股價更值得關注的是,宇樹接下來要怎麼走。8月20日,也就是宇樹上市第二天,王興興出現在北京世界機器人大會論壇。十多分鐘的分享裡,AI成為了高頻詞彙。他談到AI實時生成、實時識別,也談到AI模型投入,更透露了宇樹正在預研的一件事:讓物理AI機器人實現“自進化”。王興興講的每一件事,最後都指向一個關鍵要素:AI大模型。特別是最後一點,王興興說,要實現“物理AI自進化”,要用目前最前沿、最頂尖的AI大模型來驅動。而這恰恰是宇樹目前不太擅長的部分。不過,宇樹找到了DeepSeek。今年8月,兩家公司已經達成合作,圍繞AI大模型與具身智能相關技術展開合作。說到具身智能公司和AI大模型公司的合作,就不得不提當年Figure AI和OpenAI的合作。2024年,OpenAI在投資Figure AI後,雙方簽署了三年合作協議,合作開發人形機器人AI模型。但是僅一年後,FigureAI終止合作,轉向自研。於是問題來了:王興興和梁文鋒,會不會重走Figure AI和OpenAI的老路?01為什麼宇樹需要DeepSeek?對於宇樹來說,過去幾年,模型研發已經有了一些積累,但顯然投入不足,進展緩慢,所以找到一個頂尖的AI大模型公司合作,是一個比較自然的選擇。先來看宇樹目前的模型研發進展。當前,具身智能大模型沒有一個統一的技術路線,但VLA和世界模型,是行業重點探索的兩個方向。行業甚至也在探索兩者融合的技術路線。宇樹也在摸索,採取了“兩條腿走路”的策略,並行研發兩種模型。所謂VLA(視覺

剛剛
量子位生成式AI

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”

阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

剛剛
IT之家生成式AI

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入

作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。

剛剛