ChatGPT終於能「搜自己」,攢了近4年的對話,一鍵翻出

重點摘要
ChatGPT 推出即將屆滿四年,這四年間使用者累積的對話紀錄、上傳文件與生成內容早已多到難以統計。然而,想從茫茫歷史中翻出一次三個月前的討論,過去幾乎只能靠運氣。側邊欄那小小的搜尋框長年被抱怨形同虛設,一旦對話數量暴增,要找舊內容就變得近乎不可能。開發者社群裡,這類不滿從未停歇:很多人直言「舊搜尋欄從來沒好用過」「翻舊對話簡直是噩夢」。如今,OpenAI 終於端出解決方案。 七月十四日,OpenAI 為 ChatGPT 推出全新的統一搜尋功能,將使用者在平台內的所有資料全部納入同一個搜尋入口。
ChatGPT 推出即將屆滿四年,這四年間使用者累積的對話紀錄、上傳文件與生成內容早已多到難以統計。然而,想從茫茫歷史中翻出一次三個月前的討論,過去幾乎只能靠運氣。側邊欄那小小的搜尋框長年被抱怨形同虛設,一旦對話數量暴增,要找舊內容就變得近乎不可能。開發者社群裡,這類不滿從未停歇:很多人直言「舊搜尋欄從來沒好用過」「翻舊對話簡直是噩夢」。如今,OpenAI 終於端出解決方案。七月十四日,OpenAI 為 ChatGPT 推出全新的統一搜尋功能,將使用者在平台內的所有資料全部納入同一個搜尋入口。
範圍涵蓋歷史聊天記錄、專案(Projects)、上傳的文件以及生成的圖片,無論是網頁版、iOS 還是 Android 都能使用,且從免費方案到企業版同步開放。入口就放在側邊欄,支援按內容類型過濾,點擊結果即可直達目標對話,不必再一屏一屏往回滑。這項新功能與 ChatGPT 原本的網路搜尋(ChatGPT Search)截然不同。後者幫助使用者在網際網路上查找資訊,新搜尋則是「搜自己」——搜尋你帳號裡與 AI 互動所產生的內容。
必須留意的是,目前跨內容搜尋僅涵蓋直接上傳進 ChatGPT、或在專案與工作(Work)當中生成的檔案;已經串接的外部服務如 Google Drive 等內容並不在範圍內,官方也未給出擴展時間表。這個搜尋框的出現,補上了 ChatGPT 問世近四年來一塊關鍵拼圖。過去 ChatGPT 本質上只是會話工具,每一次互動都鎖在各自獨立的對話裡,聊完當下價值最高,過了一週就幾乎石沉大海。現在,這些內容終於變得可以隨時撈回,ChatGPT 也從單純的聊天機器人逐漸長成「個人知識庫」,開始擁有自己的檔案系統——能存、能管、能搜。
把 OpenAI 近一年半載的動作串起來看,方向更加清晰:從檔案上傳、Projects、Memory,到可執行長任務的 ChatGPT Work、能直接生成網站與輕應用的 Sites,再到將 Chat、Work、Codex 三者整合的新桌面端,以及接連登場的 GPT‑5.6 系列模型。幾乎所有布局都在把 ChatGPT 打造成一個「工作場所」,而非只是聊天介面。隨著使用者將專案資料、寫作記錄、程式碼討論、生成圖像持續沉澱進去,內容只會越堆越多,若無法有效檢索,整個閉環就會卡住。搜尋功能,正是那最後一塊關鍵拼圖。然而,搜尋功能在提升資料可用性的同時,也讓敏感度隨之升高。
多數消費者方案(Free、Plus、Pro)的對話紀錄預設會被用於模型訓練,除非使用者手動進入 Data Controls 關閉該設定,但大量用戶從未更改過這項預設。此外,今年一月五日,在紐約時報等媒體對 OpenAI 提起的版權訴訟中,美國聯邦法院維持裁定,要求 OpenAI 交出二千萬條去識別化的 ChatGPT 對話日誌給原告。這僅佔 OpenAI 已留存日誌的 0.5%,後者總量達數百億條。OpenAI 曾以用戶隱私為由抗辯,但法院未接受,其中一條關鍵理由是:這些對話是用戶「自願提交」給 OpenAI 的。
更耐人尋味的是,原告曾指控 OpenAI 始終謊稱無法搜尋這些日誌,如今 OpenAI 卻反手為每位用戶端出了一個「隨便搜」的工具。搜尋升級本身沒有修改隱私政策,也未宣布新的數據用途,但它讓使用者這幾年累積的資料分量更重——既是資產,在某些情況下也可能被翻開、被呈上法庭。放眼整個 AI 行業,三巨頭幾乎在同一時間做著類似的事,路徑卻不盡相同。ChatGPT 走個人助理路線,把使用者與 AI 共同生產的內容收入一個入口;Google 的 Gemini 倚靠全家桶,將郵件、雲端硬碟、日曆全部打通;Anthropic 的 Claude 則押注長期記憶與 Skills 技能,逐步累積上下文。
方向雖異,終點一致:替你把數據組織好、檢索好,隨叫隨到。有用戶在社群平台直接喊話,希望 Anthropic 趕快抄襲這項功能,直言 Claude 目前的搜尋「爛得可怕」。如果說大模型競爭的上半場在比誰回答得像人,下半場的賽點正悄悄轉向「誰能攥住、又盤活使用者的數據」。過去兩年,AI 公司拼命卷模型,卻幾乎沒有人認真管理過用戶累積下來的那些內容。如今 ChatGPT 的統一搜尋雖然遲到,卻代表整個行業的一次重新認知:你和 AI 一起攢下的那批數據,才是最值錢的資產。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。
騰訊雲開源 TencentDB Agent Memory v2.0:專為 AI 編碼代理打造的團隊級記憶中樞
Tencent Cloud has open-sourced TencentDB Agent Memory v2.0, a team-level memory hub for AI agents. The idea is super simple: if project context was already explained once, a new session should not need it repeated.
使用 NVIDIA NeMo Retriever、託管 NIM、LanceDB、重新排序與基於事實生成建立多模態 RAG 管線
在本教學中,我們將使用 NVIDIA NeMo Retriever 建立一個先進的多模態檢索增強生成管線。首先設定 Python 3.12 環境、安裝必要套件,並在無需 GPU 或外部 API 金鑰的情況下進行離線 PDF 文字提取。接著,我們透過託管的 NVIDIA NIM 端點來偵測頁面元素、提取表格、圖表與資訊圖形、產生稠密向量嵌入,並將處理後的內容儲存至 LanceDB。最後,我們實作了稠密檢索、視覺語言重新排序、後設資料過濾搜尋、附行內引用的基於事實回應生成,以及輕量級的 recall-at-k 評估,以驗證跨多模態文件內容的檢索品質。
NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架
NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。