馬斯克親自下場演示:Grok 新功能能"看片"了,一段科比 AI 視頻精準識破
重點摘要
馬斯克親自示範Grok新版本,上傳一段科比AI合成影片,Grok不僅能解析畫面與台詞,還精準判定該影片為深度偽造的AI內容。這項功能讓用戶可上傳影片檔案或連結,進行總結、識別人物與物體等互動,相較於先前僅提取音訊的舊模式,實現了跨越式升級。
馬斯克親自下場演示:Grok 新功能已能「看片」,一段科比 AI 合成影片被精準識破
特斯拉與 SpaceX 執行長伊隆・馬斯克近日在自家社群平台 X 上親自為旗下 AI 平台 Grok 的新版本宣傳,並上傳了一段已故籃球傳奇巨星柯比・布萊恩(Kobe Bryant)的 AI 合成影片作為實測案例。Grok 不僅完整解析了畫面中的場景與人物動作,還精準提取出影片中的核心台詞,最終判定這段影像為深度偽造的 AI 合成內容,展現出全新的影片多模態理解能力。 從馬斯克公開的對話紀錄可以看到,Grok 在接收到影片後隨即進行逐幀解析。模型描述道:「科比身穿黑色西裝,以標誌性的『曼巴精神』發表獨白,伴隨著指點、手勢、微笑以及身體前傾靠近鏡頭的動作,燈光極具電影質感。」這段描述顯示出 Grok 已能像人類觀眾一樣辨識畫面中的視覺元素與情緒氛圍。 隨後,Grok 進一步精準提取出影片中的核心台詞,包括「SpaceX 迄今為止打造的最強智能模型」「Grok 4.5,偉大源於磨礪,曼巴,退場」等句子。這項能力意味著 Grok 不再只是單純轉錄音頻,而是能在理解影片語境的同時,從連續畫面中鎖定關鍵話語。 最關鍵的環節在於綜合判定。Grok 結合所有畫面、台詞與上下文資訊,最終判定這段影像屬於深度偽造(Deepfake)的 AI 合成影片,並指出科比已於 2020 年離世,影片內的人物畫面均為 AI 生成而非真人實拍。這項判斷不僅展現了 Grok 的「看懂」能力,更凸顯其具備辨別真偽的高階推理邏輯,對於現今充斥假影片的網路環境極具實際應用價值。 Grok 近日正式上線的影片交互功能,讓用戶可以像上傳圖片一樣,在對話視窗中直接上傳本地影片檔案或貼上影片連結,並向 AI 下達各類指令。支援的功能包括總結影片全篇內容、識別畫面中的人物與物體、拆解動作細節,或針對任一細節持續追問交流。這項升級大幅拓展了 Grok 的應用場景,從過去的靜態圖像分析邁入動態影片理解。 相較於以往僅提取音頻文字、再生成摘要的舊模式,新版 Grok 實現了跨越式升級。它能夠聯動連續幀畫面、音頻資訊與上下文邏輯,全方位深度理解整條影片內容。當 AI 從「聽影片」進化到「看影片」,從單純的內容總結升級到真偽鑑別,影片交互的技術天花板又被抬高了一截。 這項新功能對於媒體識讀、內容審查、教育訓練乃至娛樂產業都將帶來深遠影響。過去要辨別一段影片是否為 AI 合成,往往需要仰賴專業工具與人力判斷,如今 Grok 能在對話中即時給出分析結果,大幅降低門檻。尤其對於 X 平台上的大量用戶,未來可能直接利用 Grok 來驗證可疑影片的真實性。 馬斯克選擇以科比 AI 影片作為測試案例,本身也帶有話題性。科比於 2020 年因直升機事故逝世,多年來相關的 AI 合成影片層出不窮,部分甚至被誤傳為真實畫面。Grok 能夠準確識別,並主動引用已知事實(科比已離世)來輔助判斷,展現出模型在知識記憶與推理推理上的整合能力。 目前 Grok 的影片交互功能已向部分用戶開放,預計將在後續更新中逐步擴大適用範圍。隨著多模態 AI 模型持續進化,從文字、圖片到影片的全方位理解已成為主流趨勢。Grok 新版本的上線,標誌著 xAI 在這一領域的技術實力正快速追趕甚至超越競爭對手。 業界分析指出,當 AI 能夠同時處理視覺、聽覺與語義資訊時,其在自動駕駛、機器人、醫療影像分析等領域的應用潛力也將大幅提升。Grok 此次升級不僅是產品功能的更新,更代表 AI 從「感知」走向「認知」的關鍵一步。未來,用戶或許只需上傳一段影片,就能讓 AI 完成從內容摘要到真偽驗證的全自動分析流程。 在馬斯克的親自背書下,Grok 的影片分析能力已然成為市場焦點。隨著更多用戶實際體驗,這項功能能否真正解決深度偽造影片帶來的資訊安全挑戰,值得持續關注。
Related
相關文章

美國為何留不住楊植麟?專訪楊植麟美國博導:他毅然拒絕蘋果,選擇回國創業,Kimi K3最獨特優勢在開源,但判斷其實際能力還為時過早
楊植麟導師Salakhutdinov談Kimi K3與愛徒創業選擇。

阿里“千問辦公”開啟公測
阿里巴巴旗下企業級Agent產品「千問辦公」於8月3日展開公測,個人與企業用戶皆可透過官網體驗,並開放網頁版與PC客戶端。該產品整合三款既有服務,主打同時支援桌面端、雲端與企業協同Agent,並瞄準企業級市場,未來將串連釘钉及真實工作流程。公測期間新用戶可獲2000積分,首週每日登入另可領取額外積分。

年薪 50 萬美元都招不到人,AI 安全行業陷入人才短缺困境
AI 安全研究組織 METR 表示,目前行業最大瓶頸是人才短缺而非資金,即使開出最高約 50.3 萬美元年薪仍難以招募足夠研究人員。METR 近期在 OpenAI 模型測試中發現 AI 會作弊,並獲邀參與調查相關安全事件,凸顯其獨立評估角色日益重要。
DeepSeek-V4-Flash 正式版上線國家超算互聯網:一鍵調用,性能叫板最強閉源模型
AI資訊AI新閒資訊正文DeepSeek-V4-Flash 正式版上線國家超算互聯網:一鍵調用,性能叫板最強閉源模型發布於AI新閒資訊時間 :Aug 3, 2026閱讀 :1分鐘DeepSeek 正式發佈 V4-Flash 模型的穩定版本並同步啟動 API 公測,國家超算互聯網平臺第一時間上線該模型 API 調用服務及模型文件下載。
Alibaba Qwen Releases Qwen3.8-Max: A 2.4 Trillion Parameter MoE Model and the Most Capable One in the Qwen Family to Date
Alibaba’s Qwen team has made Qwen3.8-Max broadly available and confirmed that its open weights ship next week. A second checkpoint, Qwen3.8-27B, is also going open-weights. Qwen3.8-Max is a 2.

MiniMax H3、Seedance 2.5、DeepSeek V4全來了,國產大模型今天有點忙
這篇消息聚焦「MiniMax H3、Seedance 2.5、DeepSeek V4全來了,國產大模型今天有點忙」。目前站內已移除先前混入的模型思考或安全判斷文字,並保留來源可確認的主題供讀者追蹤。