GPT-5 一週年之際 OpenAI 推出 Agent Plugins 標準:終結智能體插件碎片化,定義跨客戶端互通規範

2026年8月7日 02:025200 次瀏覽

重點摘要

OpenAI在GPT-5系列上線一週年之際推出Agent Plugins標準,這是一套開放且廠商中立的AI智能體插件打包規範,旨在統一跨客戶端的插件格式,解決當前生態碎片化與重複開發的問題。該標準定義了包含plugin.json、skills目錄及mcp.json的共享目錄結構,讓開發者只需編寫一次組件即可在兼容客戶端中載入,並保留各客戶端對分發、權限等功能的自主控制,被視為智能體生態走向標準化的重要一步。

站內 AI 整理稿

在 GPT-5 系列模型上線屆滿一週年的時間點,OpenAI 正式對外發布 Agent Plugins 標準,這是一套專為 AI 智能體設計的插件打包規範。該標準以開放、廠商中立為核心定位,希望透過統一的格式,將可重複使用的元件打包成具備可攜性的插件,進而改變目前各家智能體各自為政、擴充能力方式分歧的現況。目前這套規範的 1.0.0 版本已經正式上線,內容涵蓋了 Agent Skills 與 MCP Servers 的共享格式,相容的客戶端可以依照相同規則來發現並載入這些元件,開發者不再需要為了不同平台而重複進行適配工作。 OpenAI 在官方公告中明確點出當前 AI 智能體生態系面臨的核心問題:不同客戶端之間已經各自發展出獨立的插件格式,即使插件內部包含的是相同的底層元件,開發者往往還是必須針對不同客戶端重新排列或複製這些元件。一個客戶端可以正常運作的插件,換到另一個客戶端時,通常還需要額外的調整與適配才能使用,這種情況導致插件開發效率低落,也造成大量重複勞動。Agent Plugins 的出現,正是試圖為這些可以跨客戶端移植的部分,建立一個輕量級的互通基礎。 在技術架構上,Agent Plugins 採用可預測的目錄結構來管理共享元件,而分發方式、安裝流程、權限控管以及使用者體驗等與客戶端高度相關的功能,則仍然保留給各客戶端自行決定。這樣一來,既保留了標準化的互通性,也讓各家客戶端維持自身的特色與控制權。根據規範內容,一個標準的 Agent Plugin 目錄必須包含清單檔案 plugin.json,這個檔案負責標示插件身分以及其對應的目標版本。除此之外,skills 目錄內放置的是由 Agent Skills 規範所定義的技能元件,而 mcp.json 則用來描述 stdio、Streamable HTTP 或傳統 HTTP+SSE 類型的 MCP 伺服器。規範也保留了 hooks 目錄,讓客戶端可以依據自身需求進行專屬的擴充。 這套結構化的目錄設計,最大的意義在於讓插件作者只需要編寫一次元件,就能在所有相容的客戶端中被發現與載入。過去開發者必須針對不同平台分別調整的困境,有望因此獲得大幅改善,跨平台的開發與維護成本也將隨之降低。對開發者社群而言,這代表著更低的進入門檻與更高的效率,也讓元件共享變得更為實際可行。 Agent Plugins 的推出,也反映出 AI 智能體生態系統正從早期的各自發展,逐步走向標準化協同的階段。過去一段時間,MCP 協議已經被愈來愈多廠商所採用,智能體之間的工具呼叫與能力共享逐漸成為業界共識。在這樣的趨勢下,插件格式的統一可以視為自然延伸,也是生態系統成熟的重要指標。OpenAI 選擇在 GPT-5 週年這個時間點發布此規範,一方面可以視為對過去一年智能體生態快速成長的回應,另一方面也是為了在下一階段的競爭中,搶先佔據標準制定者的戰略位置。 從產業角度觀察,若 Agent Plugins 這套規範能夠獲得廣泛的採納,AI 智能體的插件生態將有機會迎來類似瀏覽器擴充功能商店那樣的繁榮景象。開發者可以更專注於元件本身的品質與功能,而不必耗費心力在各種相容性問題上;企業用戶也能更容易地在不同平台之間遷移與部署智能體解決方案,整體生態的活力與可用性都將因此受益。這項標準的最終影響力,仍有待市場與開發者社群的實際反應來驗證,但 OpenAI 已經明確地將自己置於這波標準化浪潮的關鍵位置。

Related

相關文章

IT之家生成式AI

Neon 開源 4B 模型:文檔搜索能力超 GPT-5.6 Sol,成本僅為 1/100

首頁 > 智能時代>人工智能 Neon 開源 4B 模型:文檔搜索能力超 GPT-5.6 Sol,成本僅為 1/100 2026/8/7 13:25:16 來源:IT之家 作者:故淵 責編:故淵 評論: IT之家 8 月 7 日消息,Neon 昨日(8 月 6 日)發佈博文,宣佈攜手 Castform 公司,披露一套面向檢索模型的訓練方案。IT之家注:Neon 是一款完全託管的無服務器(Serverless)PostgreSQL 數據庫。它分離計算與存儲,支持自動擴展、按需縮容至零以及類似 Git 的數據庫分支功能,非常適合現代雲原生應用和 AI 智能體。而 Castform 主要提供面向企業和開發者的 AI 語音智能體與模型訓練平臺。它通過高度擬真的語音交互和自動化工作流,幫助企業處理日常通話、銷售跟進及客戶支持。博文指出一個好的 AI 智能體,需要具備以下 2 種能力:一是通過工具找到正確的上下文數據;二是路由判斷該搜索使用什麼模型。因此 Neon 團隊攜手 Castform 公司使用強化學習,後訓練 1 個 4B 參數開源模型。在搜索任務中,該模型的準確率與 OpenAI 的 GPT-5.6 Sol 相當、甚至更高,而成本約為後者的 1/100。Neon 團隊指出在文檔搜索方面,目前主流做法是嵌入式搜索(embedded search),通常把文檔轉換為數值化數據,再查找相似內容。而伴隨著 AI 智能體的普及,搜索流程開始轉向智能體式搜索。在這類系統中,AI 模型會把大型問題拆成多個小問題,自主決定搜索查詢,查看搜索結果,並基於結果發起下一次搜索,直到收集到所需信息。Neon 表示,智能體式搜索更適合處理複雜問題,但每次搜索都需要調用高性能模型,因此會增加耗時和成本。按 Neon 給出的典型請求口徑,使用 GPT-5.6 Sol 的一次搜索請求耗時超過 10 秒,成本

剛剛

當大模型不再稀缺,AI產業在拼什麼?

賬號設置我的關注我的收藏申請的項目退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機構庫投資機構職位推介投資人認證投資人服務項目推薦36氪Pro創投氪堂企業入駐創業者服務創投平臺AI測評網 首頁快訊資訊推薦財經AI項目推薦廣東最新創投汽車科技專精特新直播視頻專題活動搜索項目推薦我要入駐城市合作當大模型不再稀缺,AI產業在拼什麼?德外5號·2026年08月07日 13:02國產AI正在從“卷參數”轉向“卷交付” 最近半年關於AI新聞,看久了你會發現:當大模型不再是稀缺品,吵架的人開始變少,做事的人越來越變多。 2026年5月,國產大模型開始集中推付費套餐。行業裡"AI到底能不能賺錢"的討論安靜了一大截,問題也跟著換了——從"模型能力夠不夠"換成"能不能穩定、合規地賺到錢"。曾經人人都追的基準跑分、參數規模,在這一輪產業競速裡反而沒那麼關鍵。 這個信號意味著行業從"用戶增長"轉向"價值驗證"——單純靠免費獲客跑流量的邏輯,正在被產業客戶重新審視。 依託央視市場研究(CTR)對主流央媒的嚴肅新聞的長期監測能力,CTR媒體融合研究院對中央廣播電視總檯2026年5-6月大屏端AI相關的全部新聞資訊做了系統性整理,最終形成1,840條結構化記錄。這份記錄不僅全面反映了AI行業近期的發展特點,也呈現了政策層面國家在關注什麼? 一、AI競爭已經跑出實驗室,進入工程化落地現場 從報道分佈看,機器人與具身智能332條(18.0%),治理倫理與標準295條(16.0%),算力芯片與基礎設施263條(14.3%)。三類合計89

剛剛

珍貴訪談:Jeff Dean談AI的下一次範式升級

賬號設置我的關注我的收藏申請的項目退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機構庫投資機構職位推介投資人認證投資人服務項目推薦36氪Pro創投氪堂企業入駐創業者服務創投平臺AI測評網 首頁快訊資訊推薦財經AI項目推薦廣東最新創投汽車科技專精特新直播視頻專題活動搜索項目推薦我要入駐城市合作珍貴訪談:Jeff Dean談AI的下一次範式升級Alpha Engineer·2026年08月07日 13:00AI下一個核心範式是遞歸與自動化。 給大家強烈推薦一篇Jeff Dean的訪談,內容非常乾貨,對未來幾年AI的發展有著前瞻指導意義。 Jeff Dean是何許人也?他是Google的技術奠基人,你所熟知的TPU、TensorFlow、MapReduce、Gemini都是他的作品。 而就在昨天,Jeff Dean決定離開待了27年的Google,創辦AI創業公司Discovery Loop。 圖:好友近日和Jeff Dean的合影 這家公司的名稱是最大的劇透:AI下一個核心範式是遞歸與自動化。 (1)任何可以明確度量的問題,都將很快取得巨大進展 我認為到 2027 年,你會看到 ML 系統本身被大量自動化。 我們可以讓系統通過跑大量實驗來不斷提升自己的能力。 AI會自動把問題拆成子問題,每個子問題放進一個快速的自動實驗循環裡,再把結果拼起來,最後產出一個改進過的系統,整個過程無需人類深度幹預。 這種範式不只適用於 ML,也適用於其他科學與工程領域。 基本上只要一個任務的目標是可度量的,就會在這兩年取得很大

剛剛

DeepSeek Harness 負責人吐槽“融資材料”吹過頭:V4-Pro編程能力僅差Claude旗艦0.3%,前端服務費高達10%

賬號設置我的關注我的收藏申請的項目退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機構庫投資機構職位推介投資人認證投資人服務項目推薦36氪Pro創投氪堂企業入駐創業者服務創投平臺AI測評網 首頁快訊資訊推薦財經AI項目推薦安徽最新創投汽車科技專精特新直播視頻專題活動搜索項目推薦我要入駐城市合作DeepSeek Harness 負責人吐槽“融資材料”吹過頭:V4-Pro編程能力僅差Claude旗艦0.3%,前端服務費高達10%AI前線·2026年08月07日 12:55DeepSeek的股權份額倒被中間商賣出了天價 就在 DeepSeek 第二輪融資重啟的敏感節點,一份涉及 DeepSeek 股權投資的材料在社交平臺上流出,不僅爆出了極具爭議的財務條款,也將 DeepSeek 尚未發佈的 V4-Pro 推向了聚光燈下。 根據該流出文件,V4-Pro 的編程性能僅比 Claude 的旗艦型號低 0.3%,支持 100 萬詞元上下文,其 API 定價在海外競爭對手的 1/10 到 1/100 之間。 參考用於評估 AI 編程智能體最具含金量的兩大前沿基準: Terminal-Bench 2.1(含 DeepSWE 1.1)與 SWE-bench。如果這裡的“Claude 的旗艦型號”對標的是 Opus 5,那麼 V4-Pro 正式版對應的性能表現應該如下: Terminal-Bench 2.1: ~83.5% (Opus 5 scores 83.8%) DeepSWE: ~69.7% (Opus 5 scor

剛剛

Meta重新支稜起來了?純推理拿下五項奧賽金牌,兩項滿分

賬號設置我的關注我的收藏申請的項目退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機構庫投資機構職位推介投資人認證投資人服務項目推薦36氪Pro創投氪堂企業入駐創業者服務創投平臺AI測評網 首頁快訊資訊推薦財經AI項目推薦廣東最新創投汽車科技專精特新直播視頻專題活動搜索項目推薦我要入駐城市合作Meta重新支稜起來了?純推理拿下五項奧賽金牌,兩項滿分機器之心·2026年08月07日 12:50還糾正了錯誤的官方答案! 今天凌晨,OpenAI 免費了 GPT-5.6 Luna。幾乎在同一時間段,另一家曾經打造出 Llama 系列、隨後在大模型競賽中一度掉隊的公司也發了聲——Meta 在 𝕏 上宣佈,它把自家 AI 模型送進了五項 STEM 學科奧林匹克競賽,全部拿到金牌或金牌水平成績,其中兩項物理競賽的理論考試直接滿分。 更驚人的是,Meta 表示,其 AI 是純靠推理能力取得的這些成績:「我們禁止了所有工具的使用,這意味著沒有搜索、沒有編碼,也沒有計算器。」 對此,曾在 OpenAI、DeepMind、谷歌大腦工作過的 Meta 研究者 Lucas Beyer 還在 𝕏 上揶揄了 Gary Marcus 和 Yann LeCun。不過,這兩位長期批評自迴歸 LLM 的著名研究者並未直接答覆。 看起來,Meta 似乎又重新支稜起來了? 不過,Meta 目前尚未發佈相關技術博客或研究報告,但參與了該項目的 Meta 研究者 Shuchao Bi 也發了兩條推文,補充了更多細節,包括該模型是是來自 Muse

剛剛

梁文鋒,告別“價格屠夫”

DeepSeek宣布近期將大幅調漲API服務定價,結束過去兩年的「地板價」策略,引發開發者社群熱議。此舉主因是全球算力資源緊張與推理成本高漲,也反映大模型行業正從「貼錢換規模」的價格戰,轉向更理性的定價框架。

剛剛