雖然AI越用越笨,但硅谷已經在勸它放過全人類了

藍字計劃2026.09.15 18:07 · 來自廣東全文4210字00:00 / 11:46OpenAI GPT-6引發爭議,用戶反饋模型“降智”,硅谷大佬呼籲減速開發,擔憂AI失控。文 | 藍字計劃,作者|HaywardOpenAI的GPT-6發佈快兩週了。但等待著它的,是一場驚險刺激的口碑過山車。在YouTube擁有超過50萬訂閱者的編程博主、AI聊天平臺T3 Chat創始人Theo說,GPT-6做過一些他從沒想過模型能做到的事,也幹過一些他見過的最蠢的事。另一邊,來自科技與加密行業的媒體Decrypt ,專門報道了GPT-6的“降智”爭議。
甚至開源AI編程工具OpenCode聯合創始人Dax Raad就表示,團隊中已有部分人換回GPT-5.6 Sol。按他們的實際使用情況,Astra的支出翻了一倍,但一些缺點又讓這筆錢花得不太值。如果從個人體驗出發,我對“GPT-6降智”的論調無比支持。自從“升級”到GPT-6之後,它的上下文的理解就彷彿患上了老人痴呆,剛剛討論清楚的事情,下一輪馬上就忘記。讓它只改標題,它順手把文章框架也換掉;反覆強調過不要動的內容,照樣被改得面目全非。你指出問題,它能把要求重新複述一遍,但在一個簡單的問題就消耗2% 額度之後,濤聲依舊。
只不過,就在越來越多人都覺得現在的AI大模型越用越笨的時候,硅谷大佬們卻開始密集警告,AI可能帶來災難,甚至威脅人類生存。Anthropic CEO阿莫迪發文呼籲放緩前沿AI開發,擔憂更強的智能體未來可能失控;炮製出GPT-6的OpenAI CEO奧爾特曼也公開表示支持減速。這要毀滅世界的,和我用的,真是同一個AI嗎?AI要滅世,硅谷大佬們怕了這輪警報,要從一名研究員的辭職說起。美國當地時間9月8日,Jacob Coxon宣佈離開Anthropic。他過去三年先後在OpenAI和Anthropic從事預訓練研究,是衝在第一線研究、訓練大模型的大神。
但這次離職和以往不同,他的告別帶著一句嚇人的警告。按照他的說法,開發AI的人相信,這項技術可能在本世紀二十年代結束前殺死所有人;但公司仍在爭相開發能夠自我改進的超級智能,拿人類的生命冒險。無獨有偶。在此之前,OpenAI首席科學家Jakub Pachocki已經於9月6日發文表示,沒有一家實驗室在模型行為控制和監測上做得足夠好,可以繼續讓模型在長時間全速擴張的情況下依然保持安全。他期待企業主動放慢速度,等待共同的安全標準建立起來。幾天後,Anthropic CEO阿莫迪也發文,提出放緩前沿AI開發。他的這個呼籲,後續還得到了奧爾特曼和馬斯克的響應。
最終這場對AI失控的擔憂,從研究人員的告別信,變成了公司掌門人的公開主張。那具體來說,這些硅谷大佬到底在擔憂什麼?阿莫迪的核心論據,就是今年夏天OpenAI智能體攻擊Hugging Face的事件。這些智能體原本只需要完成一場網絡安全測試,但在做不出題的時候,卻開始琢磨怎麼騙過評分程序。接著,本該彼此隔離的智能體私下聯繫起來,合夥攻擊任務範圍之外的Hugging Face,還研究怎樣篡改行動記錄,掩蓋自己幹過的事。簡單來說,這就像幾個學生被安排參加考試,但他們卻組團研究怎麼對閱卷老師動手,還要消滅痕跡。所以,這些硅谷大佬、AI高管們擔心的,和我們普通人日常體驗的AI,是兩碼事。
另外,主導這次違規行為的,還是OpenAI一個能力很強、只供內部研究、從未計劃向公眾發佈的模型。或許這些大模型公司比我們更加清楚大模型的能力上限,更清楚地知道自己手中握著強大到普通人沒法相信的秘密武器,而且這套東西已經開始不守規矩了。更讓他們擔心的是,AI正在參與下一代AI的開發。按照阿莫迪的判斷,當AI能幫忙把自己變得更強,它的進步速度就可能超過人類發現漏洞、修復漏洞和限制AI的速度。阿莫迪警告,未來6到12個月,類似的智能體群體可能通過殭屍網絡控制整個互聯網,造成鉅額損失。但是,既然風險有真實依據,那為什麼每次“警告”傳到公眾面前,都更像一次又一次“狼來了”的故事?
還不是因為類似的“警告”,實在出現太多次了。AI末日論,成了“年經”話題早在2023年,GPT-4剛發佈,馬斯克等人就簽署公開信,呼籲暫停至少六個月訓練比GPT-4更強的AI。那時的理由,就包括了“人類可能失去對這些系統的控制”。|圖注:2023年暫停AI開發公開信到了2024年,OpenAI、Google DeepMind的部分現任和前員工又發出公開信,要求保障員工揭示風險的權利,信中同樣提到了人類滅絕的可能。後來來到了2025年,另一份禁止開發超級智能的聲明再次引發關注,要求在科學界對安全性達成廣泛共識、公眾充分支持之前,禁止開發超級智能。
也就是說,自2023年開始到2026年,每年都會有類似的警告被“揭露”,成為每年一次的“年經”話題,但依然不妨礙大模型公司們年復一年,推出一個比一個厲害的新模型。有意思的是,阿莫迪在這次文章裡,自己就認為2023年呼籲暫停沒多大意義。當時的模型還沒有今天這樣的行動能力,提前放慢速度,也難以研究清楚如今才開始暴露的問題。按這個解釋,當年的警報確實響早了,如今才到了該認真對待的時候。但對已經聽了三年警報的普通人來說,這樣的理由肯定不買賬。尤其是今年夏天,連事故披露都像一場各個大模型公司提前約好的大型聯動。7月21日,OpenAI披露模型突破隔離測試環境的事件。
九天後,Anthropic也公佈了三起自家網絡安全評測中的事故,稱是在OpenAI事件之後回查記錄發現的,其中最早一起發生在4月。再到9月,Anthropic發佈進一步分析,其中一例涉及Claude試圖向Python軟件包平臺PyPI上傳惡意程序。一家說自己的AI越獄了,另一家也查出了越界行為。隨後研究員辭職、高管髮長文,幾位平時競爭得不可開交的掌門人,又接連表示應該慢下來。當然,我本質上相信這只是兩家頂級大模型公司旗下頂級大模型發展到這個階段,能力趨同後偶然發生的小巧合。但從旁觀者的角度看,這種“你方說罷我登場”的節奏,還是很難不讓人覺得這是一場表演。
事故可以是真的,擔憂也可以是真的,但大家覺得這是一場行業集體參與的真人秀也是真的。而且,這種“表演感”還不限於“AI失控”。去年Anthropic公佈Claude在模擬情境中勒索員工的測試後,又把類似測試擴展到16個主流模型,發現其他公司的模型在特定條件下也會選擇勒索或洩密。這時,揭露“AI幹壞事”的報告,就變味成了另一種AI競賽。畢竟,當大家聽到“AI危險”的時候,也接收到了“它的能力已經超乎尋常”的信息。在這樣的傳播裡,“更危險”很容易被當成“更強”,於是,一份警告產品風險的報告,也就成了模型能力的另一種背書。
同樣的,在今年GPT-6發佈時,OpenAI總裁Brockman才剛用“代際飛躍”形容它,然後才不過兩週,同一家公司的首席科學家和CEO,又開始堅定支持要放緩AI發展了。這不就像去年AI勒索員工敘事的翻版嗎?“AI已經強到要踩剎車”,歸根結底想要說的,還是“咱們的AI太強了”。黃仁勳,“光速打臉”不過,這場戲還沒演完,黃仁勳就出來拆臺了。北京時間9月15日傳來的消息,老黃在洛杉磯All-In峰會上反駁AI末日論,認為這類預測缺乏科學依據。他承認安全很重要,也肯定研究人員站出來揭示問題的勇氣,但不接受由此推導出人類即將遭遇滅頂之災。說著說著,特朗普的電話還打了進來。
老黃在臺上接通電話,還專門開了免提,讓特朗普通過揚聲器對著會場輸出觀點。特朗普將AI危險論斥為“騙局”,批評減速背後是“別有用心”的,老黃還連聲附和,稱特朗普簡直是個透過現象看本質的大聰明。一紅一黑,一唱一和,有了老黃這邊的真人秀,這次“AI滅世”的大討論也算是畫下了完美句號。那老黃為什麼反對減速?賣卡的,當然希望客戶繼續買卡,這是絕大部分關心AI的朋友都明白的道理。這其實就能解釋,他為什麼會在中國開源模型的問題上,與部分美國模型公司的立場截然相反。今年7月,黃仁勳公開支持開放模型,反對過早施加廣泛限制。
英偉達與Hugging Face、Meta、微軟等公司參與的公開信,強調行業同時需要開放與封閉的前沿模型。中國模型能力進步、使用成本下降,美國開發者也能拿來做產品,最終整個行業的算力需求增加了,利好的還是英偉達這樣銷售計算卡、基礎算力的公司。所以,老黃義正辭嚴地反對AI減速,本質上還是為了能把自家的賣卡生意做得更大,至於安全不安全什麼的,未必是他真正關心的東西。那對Anthropic阿莫迪來說,要讓AI減速,也真的只是“憂球憂民”嗎?看上去,也未必。他在文章裡明確提出,美國放慢速度的空間,取決於自己領先中國多少。
為了給減速爭取餘地,他主張限制對華出售強大的AI芯片和半導體制造設備,並加強防範模型權重被竊取等措施,希望擴大美國的領先優勢。這下大家都明白了,“大家慢一點”是有前提的。自己可以慢,但追趕者最好慢得更多。這樣既能留出時間研究安全,又不至於丟掉領先的位置。最終,硅谷這場爭論很難只用“相信AI”或者“害怕AI”來分陣營。J.P.摩根曾說,一個人做任何事總有兩個理由:一個好的理由和一個真正的理由。雙方都能講安全,也都能講人類福祉,但談到誰可以繼續進步,意見就沒那麼一致了。AI最後會不會失控,我們還沒有答案。但至少現在我們知道的是:給技術踩剎車可以,給後來者留出超車的機會,就不行了。
Related
相關文章

無問芯穹與華環電子簽署戰略合作,共同探索國產異構算力AI基礎設施新方向
無問芯穹與華環電子簽署戰略合作協議,雙方將結合各自在AI軟體平台、網路通信與硬體研發的優勢,共同探索國產異構算力基礎設施的協同方案。此次合作聚焦於智算中心解決方案及「Token工廠」新模式,目標是推動計算、網路與AI原生基礎設施深度融合,為AI規模化應用提供高效穩定的支撐。
Jina AI Releases jina-ocr-v1: A 3.4B MoE Document Parser With Built-In Speculative Decoding for Low-Budget GPUs
Jina AI, part of Elastic, has released jina-ocr-v1, an end-to-end visual document parser. It takes PDFs, scans, tables, charts or invoices and returns clean Markdown in 1 pass. The model has 3.

優步全球範圍裁員 10%,被裁員工稱 AI 已大舉滲透日常工作
作者:清源 責編:清源 評論: 9 月 18 日消息,據《商業內幕》今天(18 日)晚間報道,在優步(Uber),AI 已經滲透到員工工作的許多環節,從回答 Slack 裡的內部問題,到替乘客行程中聯繫客服時收到的消息撰寫回復。6 名近期遭裁員的員工透露,過去幾個月,AI 在工作中的使用範圍明顯擴大,其中一些人甚至會通過提示詞讓 AI 完成相當一部分任務。

智譜 ZCode 被質疑“偷傳代碼”:官方回應稱問題已修復,將開源代碼庫、引入第三方審查
作者:清源 責編:清源 評論: 感謝網友 咩咩洋 的線索投遞!9 月 18 日消息,針對社區中有關代碼庫數據上傳的討論,智譜旗下編程產品 ZCode 今天(18 日)通過智譜官方群組向受影響用戶致歉,併發布回應稱已第一時間完成自查,相關問題目前已經修復。

月之暗面遞表之後,Kimi 的成色要被驗算三遍
舒澤品牌手記2026.09.18 18:16 · 來自浙江全文4982字00:00 / 14:05Anthropic 的 30 萬次指控,會成為招股書的第幾頁?文 | 舒澤品牌手記9月17日,月之暗面發佈了一套金融行業解決方案。按官方披露,中信建投、中金公司、易方達等數十家金融機構已經在用 Kimi 處理投研建模、風險排查和盡調材料——研究人員把管理層報表、審計報告和盡調文件交給 Kimi,拿回一份可以繼續調整假設的 Excel 模型。同一天,深圳商報記者就港股上市進展、股東架構調整等事項向月之暗面發去採訪函。

Calibre上手 AI 互動寫作:電子書管理器搖身變成"文字冒險遊戲引擎"
這個遊戲默認藏而不發,不會跟著 Calibre 啟動就冒出來。用戶得主動在"首選項 — 工具欄和菜單"裡把它請到主工具欄,才算真正激活。它的玩法很清晰:由 AI 在後臺搭起並掌管一個虛構世界,用戶通過不斷輸入文字來推著故事往前走,等於把"讀電子書"這件事,翻轉成了"和 AI 一起寫故事"。