鈦媒體模型更新

禁掉所有工具後,Opus 5和GPT-5.6的差距終於藏不住了

2026年8月4日 16:43
禁掉所有工具後,Opus 5和GPT-5.6的差距終於藏不住了

重點摘要

禁掉所有工具後,Opus 5和GPT-5.6的差距終於藏不住了字母AI2026.08.04 16:41 · 來自北京全文3996字00:00 / 11:09實測Opus5:提示詞工程可能將不復存在了。文 | 字母AI 且不論性能,自Claude Opus 5發佈以後有一件事讓AI圈特別在意,就是Anthropic在提示詞上的改進。

站內 AI 整理稿

Claude Opus 5 發布後,AI 圈內最熱的話題不是它的參數規模或運算速度,而是一項看似簡單卻可能顛覆業界慣例的改變:提示詞(Prompt)設計的門檻正在急速降低。長期以來,使用者必須花費大量心力琢磨如何下指令,才能讓模型輸出理想結果,但 Opus 5 的表現似乎預告著,這套「提示詞工程」的時代可能即將終結。 Anthropic 在 Opus 5 上做出的提示詞優化,成為近期社群討論的焦點。AI 投資人 Matt Shumer 在 X 平台上發布了一則影片,播放量迅速突破 400 萬次。他在影片中示範,只用了短短三段話作為提示詞,Opus 5 便透過 Three.js 從零生成了一個可玩的 3D 第一人稱射擊遊戲。整個過程沒有使用任何外部素材,模型直接產出超過 5 萬行程式碼,並自行建構出 11 個子系統。這項成果讓許多開發者驚訝,因為過去要完成類似任務,通常需要撰寫極其詳細的指令,甚至反覆調校才能避免模型偏離方向。 更令人關注的是 Anthropic 內部工程團隊的動向。Claude Code 核心開發者 Boris Cherny 透露,他們在調整 Opus 5 的系統提示詞時,大幅刪減了原本 Claude Code 提示詞中多達 80% 的內容。按照常理,減少提示詞的細節可能會讓模型失去方向,但結果卻完全相反——模型不僅沒有變笨,反而表現得更加穩定、精準。這項發現直接挑戰了過去「提示詞越長、越詳細,模型表現越好」的普遍認知。 這兩件事指向同一個結論:Opus 5 已經不再需要使用者精心設計複雜的提示詞。過去,AI 從業者花費大量時間研究如何用最精確的語言引導模型,甚至發展出「提示詞工程師」這個新興職位。但 Opus 5 的出現,讓這些努力顯得有些多餘。模型本身的理解能力與生成品質,已經強大到能夠從簡單的幾句話中掌握使用者意圖,並自動完成從規劃到執行的一系列複雜任務。 這項進展的意義不僅在於使用者體驗的提升,更可能改寫整個 AI 應用的生態。過去,提示詞的品質直接決定了模型輸出的好壞,因此擁有優秀提示詞技巧的使用者或團隊,往往能獲得更好的結果。但當模型能夠「聽懂」日常語言,甚至能從模糊的指令中推導出合理行動時,AI 工具的普及門檻將大幅降低。一般使用者不再需要學習特定指令格式,只要用自然的語言表達需求,就能獲得專業級別的成果。 從 Matt Shumer 的測試來看,Opus 5 不僅能理解遊戲開發的抽象概念,還能自行拆解成具體的子系統,並逐一生成可運行的程式碼。這顯示模型已經具備某種程度的「規劃能力」,能夠在沒有外部提示的前提下,自主決定該如何完成一個大型任務。這種能力在過去往往需要透過多次反饋和修正才能實現,但 Opus 5 似乎將這一步內化成了模型的基本能力。 Anthropic 在提示詞上的簡化策略,也反映出他們對模型本質能力的自信。當系統提示詞占比從 100% 降到 20%,模型反而變得更強,這意味著原本那些冗長的指令可能反而限制了模型的發揮空間。或許,過多的提示詞會讓模型產生不必要的框架,干擾其自主推理的流暢性。而削減提示詞後,模型得以更自由地運用自身參數中儲存的知識與邏輯。 這項變化對整個 AI 產業的影響可能相當深遠。首先,提示詞工程師的角色將面臨重新定義,未來可能不再需要專人撰寫複雜的提示詞模板,而是將重心轉向如何設計更友善的使用者介面或更直覺的互動方式。其次,模型之間的競爭焦點,將從「誰能設計出更好的提示詞」,轉向「誰的模型本質上更聰明、更可靠」。這也讓外界對 Opus 5 與其他頂尖模型(如 GPT-5.6)的差距,有了更直觀的比較基準。 過去,用戶在比較不同模型時,往往會受到提示詞設計品質的干擾。一個精心設計的提示詞,可能讓原本能力相近的模型產生明顯的輸出差異。但當 Opus 5 幾乎不需要提示詞工程時,它與其他模型之間的差距就變得更加赤裸。如果其他模型仍需要大量提示詞才能達到類似效果,那麼兩者在智慧層級上的落差就會被放大。 從這個角度看,Opus 5 的發布不僅是一次產品更新,更是一場對 AI 互動方式的重新定義。Anthropic 用實際行動證明,模型進步的方向不應該是讓使用者越來越會下指令,而是讓模型越來越聽得懂人話。當提示詞工程逐漸失去意義,AI 的「人性化」程度將迎來新的里程碑。 當然,這並不代表所有任務都不需要提示詞。對於極度專業或罕見的應用場景,適當的引導仍然有幫助。但對於絕大多數日常使用場景,Opus 5 已經展示出「一句話搞定」的潛力。這也讓業界開始思考:未來的 AI 競賽,或許不再是比誰的提示詞寫得更好,而是比誰的模型能從更少的資訊中,理解更多真實意圖。

Related

相關文章

鈦媒體模型更新

騰訊字節阿里齊下場:AI辦公要大繁榮大發展了?

騰訊字節阿里齊下場:AI辦公要大繁榮大發展了?新莓2026.08.04 18:14 · 來自河南全文5744字00:00 / 17:14從辦公切入,不止於辦公。文 | 新莓,作者|程佳,編輯|翟文婷僅僅一個週末之隔,字節和阿里相繼出牌。週一,傳言已久的「千問辦公」正式公測,這個整合了QoderWork、MuleRun、悟空三款阿里產品的全新Agent,主要面向個人與企業的生產辦公場景。阿里官方對千問辦公的特色提煉是,激活組織生產力。

剛剛

數學家24小時駁回OpenAI攻破的猜想!“AI證對了每句話,但已跟原猜想無關”

OpenAI宣稱新一代AI模型推翻Connes剛性猜想,但堪薩斯大學數學家Nielsen隔天提出反駁,指出AI構造的其中一個群並未滿足ICC與性質(T)等附加條件。他逐行比對OpenAI公開的37000行Lean 4代碼,發現AI證明的形式雖然正確,卻與原猜想無關,凸顯機器驗證只能檢查形式、無法確保命題對應原意的限制,猜想目前仍未被解決。

剛剛

剛剛,Claude Fable 5,又拿第一了

這則新聞宣布Claude Fable 5再次拿下第一名,但全文未提供具體評測細節。文中僅說明站內已移除先前混入的模型思考或安全判斷文字,並保留來源可確認的主題供讀者追蹤。

剛剛
IT之家模型更新

AI 助推獨行創業者時代到來:1 個人可撐起公司 100 萬美元年收入

首頁 > 智能時代>人工智能 AI 助推獨行創業者時代到來:1 個人可撐起公司 100 萬美元年收入 2026/8/4 13:58:23 來源:IT之家 作者:故淵 責編:故淵 評論: IT之家 8 月 4 日消息,華爾街日報於 7 月 29 日發佈博文,報道稱在 AI 時代,一個人撐起整家公司,年收入超過 100 萬美元已不再是天方夜譚,市場正迎來“獨行創業者時代”。

剛剛
IT之家模型更新

美國政府完成先進 AI 模型自願性評估框架制定,內容未公開

美國政府已按期完成針對先進 AI 模型評估的自願性框架制定,但白宮未對外公開具體內容、審閱機構及採用時程。該框架原應涵蓋保密、網路安全、風險管理與智慧財產權等要求,不過相關基準測試與適用門檻被列為機密。白宮計劃與業界召開會議審查該框架,並與更多合作夥伴討論後續步驟。

6 分鐘前