鈦媒體模型更新

禁掉所有工具後,Opus 5和GPT-5.6的差距終於藏不住了

2026年8月4日 16:43
禁掉所有工具後,Opus 5和GPT-5.6的差距終於藏不住了

重點摘要

禁掉所有工具後,Opus 5和GPT-5.6的差距終於藏不住了字母AI2026.08.04 16:41 · 來自北京全文3996字00:00 / 11:09實測Opus5:提示詞工程可能將不復存在了。文 | 字母AI 且不論性能,自Claude Opus 5發佈以後有一件事讓AI圈特別在意,就是Anthropic在提示詞上的改進。

站內 AI 整理稿

Claude Opus 5 發布後,AI 圈內最熱的話題不是它的參數規模或運算速度,而是一項看似簡單卻可能顛覆業界慣例的改變:提示詞(Prompt)設計的門檻正在急速降低。長期以來,使用者必須花費大量心力琢磨如何下指令,才能讓模型輸出理想結果,但 Opus 5 的表現似乎預告著,這套「提示詞工程」的時代可能即將終結。Anthropic 在 Opus 5 上做出的提示詞優化,成為近期社群討論的焦點。AI 投資人 Matt Shumer 在 X 平台上發布了一則影片,播放量迅速突破 400 萬次。他在影片中示範,只用了短短三段話作為提示詞,Opus 5 便透過 Three.

js 從零生成了一個可玩的 3D 第一人稱射擊遊戲。整個過程沒有使用任何外部素材,模型直接產出超過 5 萬行程式碼,並自行建構出 11 個子系統。這項成果讓許多開發者驚訝,因為過去要完成類似任務,通常需要撰寫極其詳細的指令,甚至反覆調校才能避免模型偏離方向。更令人關注的是 Anthropic 內部工程團隊的動向。Claude Code 核心開發者 Boris Cherny 透露,他們在調整 Opus 5 的系統提示詞時,大幅刪減了原本 Claude Code 提示詞中多達 80% 的內容。

按照常理,減少提示詞的細節可能會讓模型失去方向,但結果卻完全相反——模型不僅沒有變笨,反而表現得更加穩定、精準。這項發現直接挑戰了過去「提示詞越長、越詳細,模型表現越好」的普遍認知。這兩件事指向同一個結論:Opus 5 已經不再需要使用者精心設計複雜的提示詞。過去,AI 從業者花費大量時間研究如何用最精確的語言引導模型,甚至發展出「提示詞工程師」這個新興職位。但 Opus 5 的出現,讓這些努力顯得有些多餘。模型本身的理解能力與生成品質,已經強大到能夠從簡單的幾句話中掌握使用者意圖,並自動完成從規劃到執行的一系列複雜任務。

這項進展的意義不僅在於使用者體驗的提升,更可能改寫整個 AI 應用的生態。過去,提示詞的品質直接決定了模型輸出的好壞,因此擁有優秀提示詞技巧的使用者或團隊,往往能獲得更好的結果。但當模型能夠「聽懂」日常語言,甚至能從模糊的指令中推導出合理行動時,AI 工具的普及門檻將大幅降低。一般使用者不再需要學習特定指令格式,只要用自然的語言表達需求,就能獲得專業級別的成果。從 Matt Shumer 的測試來看,Opus 5 不僅能理解遊戲開發的抽象概念,還能自行拆解成具體的子系統,並逐一生成可運行的程式碼。

這顯示模型已經具備某種程度的「規劃能力」,能夠在沒有外部提示的前提下,自主決定該如何完成一個大型任務。這種能力在過去往往需要透過多次反饋和修正才能實現,但 Opus 5 似乎將這一步內化成了模型的基本能力。Anthropic 在提示詞上的簡化策略,也反映出他們對模型本質能力的自信。當系統提示詞占比從 100% 降到 20%,模型反而變得更強,這意味著原本那些冗長的指令可能反而限制了模型的發揮空間。或許,過多的提示詞會讓模型產生不必要的框架,干擾其自主推理的流暢性。而削減提示詞後,模型得以更自由地運用自身參數中儲存的知識與邏輯。這項變化對整個 AI 產業的影響可能相當深遠。

首先,提示詞工程師的角色將面臨重新定義,未來可能不再需要專人撰寫複雜的提示詞模板,而是將重心轉向如何設計更友善的使用者介面或更直覺的互動方式。其次,模型之間的競爭焦點,將從「誰能設計出更好的提示詞」,轉向「誰的模型本質上更聰明、更可靠」。這也讓外界對 Opus 5 與其他頂尖模型(如 GPT-5.6)的差距,有了更直觀的比較基準。過去,用戶在比較不同模型時,往往會受到提示詞設計品質的干擾。一個精心設計的提示詞,可能讓原本能力相近的模型產生明顯的輸出差異。但當 Opus 5 幾乎不需要提示詞工程時,它與其他模型之間的差距就變得更加赤裸。

如果其他模型仍需要大量提示詞才能達到類似效果,那麼兩者在智慧層級上的落差就會被放大。從這個角度看,Opus 5 的發布不僅是一次產品更新,更是一場對 AI 互動方式的重新定義。Anthropic 用實際行動證明,模型進步的方向不應該是讓使用者越來越會下指令,而是讓模型越來越聽得懂人話。當提示詞工程逐漸失去意義,AI 的「人性化」程度將迎來新的里程碑。當然,這並不代表所有任務都不需要提示詞。對於極度專業或罕見的應用場景,適當的引導仍然有幫助。但對於絕大多數日常使用場景,Opus 5 已經展示出「一句話搞定」的潛力。

這也讓業界開始思考:未來的 AI 競賽,或許不再是比誰的提示詞寫得更好,而是比誰的模型能從更少的資訊中,理解更多真實意圖。

Related

相關文章

拆解“AI辦公入口戰”底層:怎麼做才能成為最終贏家?

字節、阿里、騰訊等大廠正透過組織調整與產品整合,全力爭奪AI辦公入口,關鍵在於模型、場景、生態與商業體系的全面競爭。這場戰爭的核心是透過AI產品實現Token經濟的商業閉環,並以「效果」為標準,透過自有體系與外部生態滿足企業用戶的真實需求。最終贏家需兼顧模型能力、場景積累與生態建設,才能在AI生產力時代站穩腳步。

3 小時前

千人聯機世界模型“RhOS-World: Khora”正式發佈

RhOS.ai與Ophilus.AI共同發布了千人聯機世界模型「RhOS-World: Khora」,該模型能讓多達1024個智能體在共享的3D空間中即時互動,且無需傳統物理引擎。其核心技術「STBoard(時空黑板)」架構,透過統一的物理狀態管理,解決了多視角一致性的難題,並大幅降低了擴展智能體數量的運算成本。

3 小時前
Hugging Face Blog模型更新

TutorMoments:AI 家教何時該出手,何時該放手?

今日我們推出 TutorMoments 預覽版,這是一個評估框架,旨在衡量尖端大型語言模型能否掌握教育中最難的平衡:何時介入協助學生,何時退後讓學生自行努力。TutorMoments 基於真實的一對一數學輔導課程,透過重播方式進行評估。經驗豐富的數學教師會檢視從美國收集的對話記錄。

4 小時前