智能助手打通跨界壁壘
重點摘要
Google 宣布 AI Mode 現可串接 Instacart、Canva 及 YouTube 等應用,讓用戶在對話式搜尋中直接完成購物、設計及建立播放清單等任務。此更新旨在拓展 AI Mode 功能,並與 OpenAI 的 ChatGPT 及 Anthropic 的 Claude 等對手競爭。目前僅限美國用戶,Google 正計劃支援更多 App。
Google 於美東時間週四宣布,正式在旗下的 AI 模式(AI Mode)中開放用戶連結並直接操作常用的第三方應用程式。這項更新讓這家科技巨頭的對話式搜尋體驗不再只停留在回答問題,而是進一步跨入「跨應用完成任務」的階段。首批支援的應用程式包括 Instacart、Canva 與 YouTube Music,用戶可以直接在 AI 模式的對話框內串連這些服務並執行購物、設計或播放清單管理等操作。AI 模式是 Google 在搜尋引擎中導入的生成式 AI 介面,能夠以自然語言回覆複雜查詢。過去它主要負責提供資訊彙整,如今則加入「行動」環節。
Google 表示,若使用者正在規劃一場烤肉聚會,並透過 AI 模式建立採購清單,只要連結個人的 Instacart 帳號,系統就能直接將食材加入購物車,並引導用戶在 Instacart 應用程式或網站上快速結帳,大幅縮短從規劃到執行的流程。除了採購,這項整合也延伸到創意與娛樂場景。在設計工作方面,用戶可以對 AI 模式說出「我需要一份傳單的設計靈感」,接著連動 Canva 搜尋並顯示一系列合適的模板,省去手動切換應用程式的麻煩。若正在為派對準備音樂,AI 模式也能協助策劃播放清單,並一鍵儲存至 YouTube Music 中。
這些範例清楚展現 Google 試圖將 AI 模式從「問答工具」升級為「生活幫手」的企圖心。值得注意的是,這次的跨應用連結功能並非憑空出現。Google 早在今年稍早的 I/O 開發者大會上就曾公布一項基礎能力:讓使用者將第三方應用程式連接到 Gemini 應用程式,以更快完成任務。當時支援的 app 包括 Canva、OpenTable、Spark、Instacart 等,而 AI 模式如今更進一步把這項整合融入搜尋介面中,等同於將 Gemini 的擴充能力直接帶入使用率最高的搜尋框。業界分析認為,Google 此舉也帶有明確的競爭考量。
對手 OpenAI 的 ChatGPT 以及 Anthropic 的 Claude 早已支援應用程式整合,用戶可以在對話中直接呼叫第三方服務。Google 必須讓 AI 模式變得更「有用」,才能留住並擴大用戶對其生成式 AI 的依賴,特別是在規劃行程、購物比價等日常高頻使用場景中。目前這項更新先向美國用戶推送。Google 強調正在與多家合作夥伴洽談,並計劃在短期內增加對更多應用程式的支援。從產品演進時間軸來看,AI 模式自 2025 年初上線後持續快速迭代。最近一次更新是讓 AI 模式能夠協助查詢附近商店的商品庫存狀況,使用戶不必實際跑一趟就能確認商品是否有貨。
此外,Google 也在 AI 模式中加入「並排瀏覽」功能,讓用戶可以同時查看搜尋結果網頁與 AI 對話,並在保留搜尋脈絡的情況下進行比對細節與追問。更早之前,今年初 Google 還推出了「個人智慧」(Personal Intelligence)功能,允許 AI 模式存取用戶的 Gmail 與 Google 相簿,提供更具個人化的回應,例如根據電子郵件中的行程或照片中的物品來回答問題。隨著這些功能逐步到位,Google 正將 AI 模式打造成一個能串聯資訊、行動與個人資料的整合入口。
對於經常在搜尋與各類應用之間切換的使用者來說,未來或許只需在同一個對話視窗中就能完成從發想到執行的所有步驟,而不再需要手動打開多個網站或 App。不過,目前這項服務仍限於美國地區,且僅支援特定合作夥伴,後續能否快速擴展到更多國家與應用,將是觀察 Google AI 模式能否真正普及的關鍵。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線
在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。