AI寫得太快,人類審不動了,OpenClaw斷更7周,一版吞下1.6萬個PR

2026年9月1日 16:29
AI寫得太快,人類審不動了,OpenClaw斷更7周,一版吞下1.6萬個PR
站內 AI 整理稿

OpenClaw 專案近期突然陷入長達七週的停更狀態,背後原因並非開發團隊懈怠,而是 AI 輔助程式碼生成的速度已經遠超過人類審核的極限。據了解,在最新一版更新中,一口氣吞下了高達 1.6 萬個 Pull Request(PR),這個數字讓原本負責程式碼審查的維護者們直接「卡關」。換句話說,AI 寫程式碼的速度越來越快,但人類逐行檢查、確認邏輯、測試相容性的步調卻沒辦法同步加快,導致大量提交積壓在審核階段,專案最後只能被迫暫停釋出,先把堆積如山的 PR 消化完再說。這種「AI 狂寫、人類狂審」的失衡現象,其實是當前開源社群正面臨的全新挑戰。

過去一個 PR 可能代表一個明確的功能修正或議題討論,但現在 AI 可以瞬間產生大量看似合理、實則需要仔細驗證的程式碼變更。維護者必須花更多時間去辨識哪些是真正有价值的貢獻,哪些只是 AI 憑空生成的「表面修改」。OpenClaw 這次的斷更,等於是用最直接的方式示範了:當 AI 的產出速度失控,人類審查反而成為整個開發流程中最脆弱、也最容易被拖垮的環節。對於想升級或採用類似 AI 輔助開發流程的團隊來說,這段經驗也點出幾個必須預先避開的坑。首先,不要盲目追求 PR 合併速度,而是該建立更嚴格的審查門檻,甚至考慮用自動化測試與靜態分析工具先過濾掉明顯的無效變更。

其次,要控管 AI 產生程式碼的範圍與權限,避免它隨意對核心架構提出大規模改動。最後,也是最重要的,就是必須正視「人類審查能量」的有限性——如果 AI 的產出量已經超過團隊能負荷的上限,那麼暫停自動生成、手動調整節奏,反而比硬撐著繼續吞 PR 更有效率。OpenClaw 的七週沉默,或許正是給整個開發圈的一記警鐘。

Related

相關文章

GLM 5.3 更強卻更難用了?我們讓它和 5.2 做了同一個北京城市駕駛遊戲

官方強調 GLM 5.3 安全能力大幅提升,實測卻發現這套安全機制在自動化工具鏈中頻繁觸發拒絕,導致開發流程中斷。 作者丨吳海明 編輯丨李 娜 大家還記得《極限競速:地平線》裡那種在開放世界中自由駕駛、穿梭城市與道路的體驗嗎?地平線遊戲圖這次,我們用一個類似思路、但更貼近真實工程開發的題目來考一考 GLM 5.3:從零開發一款基於 OpenStreetMap 真實數據的「北京國貿 → 望京」區域 3D 開放世界駕駛遊戲,5.

3 小時前

MWA™霸榜全球第一後:無界動力用真實咖啡廳展現物理AI的落地之徑

從“出片”到“出海”,無界動力即將奔赴下一個考場。 作者丨郭 思 編輯丨董子博 沒有刻意的社交氛圍,一人靜坐或幾個好友相聚,手捧一杯咖啡,在音樂與咖啡的交匯中,暫時剝離工作與生活的瑣碎,獲得片刻放鬆與靈感迴響。這是平日裡我們對於休閒時刻美好畫面的印象,也是2026世界機器人大會現場最反差的一幕。

9 小時前
何夕2077研究與前沿

TimesFM-3發佈

TimesFM-3: A zero-shot foundation model for multivariate forecasting August 31, 2026Ayush Jain and Rajat Sen, Research Scientists, Google Research We introduce TimesFM-3, a state-of-the-art time series foundation model t。

12 小時前
何夕2077研究與前沿

J-Zero零數據共進化

近期一篇名為「J-Zero零數據共進化」的研究引起關注,核心概念是讓AI模型在不依賴外部標註資料的情況下,透過彼此對抗與合作持續進化。論文提出一套三方訓練框架,讓不同模型分別扮演挑戰者、求解器與評委,形成動態競爭與回饋機制,藉此突破傳統訓練資料的瓶頸。 具體運作流程中,挑戰者負責設計題目,求解器則嘗試作答,而評委會依據人類偏好對求解結果進行校準與評分。這樣的循環讓模型不是單向被動學習,而是在互相出題、解題與評判的過程中,逐步提升能力。

12 小時前
何夕2077研究與前沿

ElephantBench測長尾盲區

騰訊發布長尾知識基準ElephantBench,內含1094道分歧事實題,用以評估模型在長尾知識上的表現。測試涵蓋32個模型,其中表現最佳的模型也只有52.4%的正確率,顯示長尾知識仍是模型的一大盲區。

12 小時前