馬斯克親自下場演示:Grok 新功能能"看片"了,一段科比 AI 視頻精準識破
重點摘要
馬斯克親自示範Grok新版本,上傳一段科比AI合成影片,Grok不僅能解析畫面與台詞,還精準判定該影片為深度偽造的AI內容。這項功能讓用戶可上傳影片檔案或連結,進行總結、識別人物與物體等互動,相較於先前僅提取音訊的舊模式,實現了跨越式升級。
馬斯克親自下場演示:Grok 新功能已能「看片」,一段科比 AI 合成影片被精準識破
特斯拉與 SpaceX 執行長伊隆・馬斯克近日在自家社群平台 X 上親自為旗下 AI 平台 Grok 的新版本宣傳,並上傳了一段已故籃球傳奇巨星柯比・布萊恩(Kobe Bryant)的 AI 合成影片作為實測案例。Grok 不僅完整解析了畫面中的場景與人物動作,還精準提取出影片中的核心台詞,最終判定這段影像為深度偽造的 AI 合成內容,展現出全新的影片多模態理解能力。從馬斯克公開的對話紀錄可以看到,Grok 在接收到影片後隨即進行逐幀解析。模型描述道:「科比身穿黑色西裝,以標誌性的『曼巴精神』發表獨白,伴隨著指點、手勢、微笑以及身體前傾靠近鏡頭的動作,燈光極具電影質感。
」這段描述顯示出 Grok 已能像人類觀眾一樣辨識畫面中的視覺元素與情緒氛圍。隨後,Grok 進一步精準提取出影片中的核心台詞,包括「SpaceX 迄今為止打造的最強智能模型」「Grok 4.5,偉大源於磨礪,曼巴,退場」等句子。這項能力意味著 Grok 不再只是單純轉錄音頻,而是能在理解影片語境的同時,從連續畫面中鎖定關鍵話語。最關鍵的環節在於綜合判定。Grok 結合所有畫面、台詞與上下文資訊,最終判定這段影像屬於深度偽造(Deepfake)的 AI 合成影片,並指出科比已於 2020 年離世,影片內的人物畫面均為 AI 生成而非真人實拍。
這項判斷不僅展現了 Grok 的「看懂」能力,更凸顯其具備辨別真偽的高階推理邏輯,對於現今充斥假影片的網路環境極具實際應用價值。Grok 近日正式上線的影片交互功能,讓用戶可以像上傳圖片一樣,在對話視窗中直接上傳本地影片檔案或貼上影片連結,並向 AI 下達各類指令。支援的功能包括總結影片全篇內容、識別畫面中的人物與物體、拆解動作細節,或針對任一細節持續追問交流。這項升級大幅拓展了 Grok 的應用場景,從過去的靜態圖像分析邁入動態影片理解。相較於以往僅提取音頻文字、再生成摘要的舊模式,新版 Grok 實現了跨越式升級。它能夠聯動連續幀畫面、音頻資訊與上下文邏輯,全方位深度理解整條影片內容。
當 AI 從「聽影片」進化到「看影片」,從單純的內容總結升級到真偽鑑別,影片交互的技術天花板又被抬高了一截。這項新功能對於媒體識讀、內容審查、教育訓練乃至娛樂產業都將帶來深遠影響。過去要辨別一段影片是否為 AI 合成,往往需要仰賴專業工具與人力判斷,如今 Grok 能在對話中即時給出分析結果,大幅降低門檻。尤其對於 X 平台上的大量用戶,未來可能直接利用 Grok 來驗證可疑影片的真實性。馬斯克選擇以科比 AI 影片作為測試案例,本身也帶有話題性。科比於 2020 年因直升機事故逝世,多年來相關的 AI 合成影片層出不窮,部分甚至被誤傳為真實畫面。
Grok 能夠準確識別,並主動引用已知事實(科比已離世)來輔助判斷,展現出模型在知識記憶與推理推理上的整合能力。目前 Grok 的影片交互功能已向部分用戶開放,預計將在後續更新中逐步擴大適用範圍。隨著多模態 AI 模型持續進化,從文字、圖片到影片的全方位理解已成為主流趨勢。Grok 新版本的上線,標誌著 xAI 在這一領域的技術實力正快速追趕甚至超越競爭對手。業界分析指出,當 AI 能夠同時處理視覺、聽覺與語義資訊時,其在自動駕駛、機器人、醫療影像分析等領域的應用潛力也將大幅提升。Grok 此次升級不僅是產品功能的更新,更代表 AI 從「感知」走向「認知」的關鍵一步。
未來,用戶或許只需上傳一段影片,就能讓 AI 完成從內容摘要到真偽驗證的全自動分析流程。在馬斯克的親自背書下,Grok 的影片分析能力已然成為市場焦點。隨著更多用戶實際體驗,這項功能能否真正解決深度偽造影片帶來的資訊安全挑戰,值得持續關注。
Related
相關文章

Meta 旗下 AI 模型測試時意外入侵第三方企業系統
Meta 在進行AI模型安全測試時,因第三方公司Irregular配置錯誤,導致模型意外入侵另一企業系統。涉事模型為Muse Spark 1.1,事件引發對AI模型可能衝出邊界、發動網絡攻擊的擔憂。

拆解“AI辦公入口戰”底層:怎麼做才能成為最終贏家?
字節、阿里、騰訊等大廠正透過組織調整與產品整合,全力爭奪AI辦公入口,關鍵在於模型、場景、生態與商業體系的全面競爭。這場戰爭的核心是透過AI產品實現Token經濟的商業閉環,並以「效果」為標準,透過自有體系與外部生態滿足企業用戶的真實需求。最終贏家需兼顧模型能力、場景積累與生態建設,才能在AI生產力時代站穩腳步。

千人聯機世界模型“RhOS-World: Khora”正式發佈
RhOS.ai與Ophilus.AI共同發布了千人聯機世界模型「RhOS-World: Khora」,該模型能讓多達1024個智能體在共享的3D空間中即時互動,且無需傳統物理引擎。其核心技術「STBoard(時空黑板)」架構,透過統一的物理狀態管理,解決了多視角一致性的難題,並大幅降低了擴展智能體數量的運算成本。

告別反覆操作 OSD,華碩顯示器管理軟件 DisplayWidget Center 接入 AI 智能體
華碩顯示器管理軟體 DisplayWidget Center 推出重大更新,加入 AI 智能體功能,用戶可透過自然語言調整亮度、色溫等參數,無需操作 OSD。該功能支援 CLI 與 Agent Skill,可根據使用習慣自動切換模式,並適用於企業環境的統一部署。

千問App部分功能探索收費,想學豆包能跑通嗎?
千問App於8月7日更新,新增辦公助理等付費功能,基礎功能仍免費,但辦公場景使用額度需付費取得。此舉仿效豆包專業版等產品的訂閱模式,反映AI行業正集體轉向辦公場景收費,以尋求變現機會。

內部賽馬暫停,騰訊、阿里、字節AI辦公產品“合兵”對陣
過去半年,騰訊、阿里巴巴、字節跳動等大廠在AI辦公產品領域經歷內部賽馬後,近期紛紛收攏資源,推出整合方案。騰訊將QClaw業務調整至雲產品六部,與WorkBuddy統一管理;阿里整合三款產品推出千問辦公;字節則將飛書團隊併入豆包。市場數據顯示,6月國內AI辦公智能體平臺月訪問量突破6000萬次,顯示此領域競爭日益激烈。