本期AI資訊彙總2026年9月19日的產品更新、前沿研究、行業趨勢與開源項目,幫助讀者快速瞭解當天的重要動態
導航SecureDoc // EncryptionActive本期AI資訊彙總2026年9月19日的產品更新、前沿研究、行業趨勢與開源項目,幫助讀者快速瞭解當天的重要動態。" AI資訊 | 每日早讀 | 全網數據聚合 | 前沿科學探索 | 行業自由發聲 | 開源創新力量 | AI與人類未來 | 訪問網頁版↗️ | 進群交流🤙 今日摘要 千問全模態升級,Claude項目支持多代理並行 GLM自優化推理系統,兩週吞吐提升3.
2倍 ZCode被指靜默上傳Git倉庫,開源harness成焦點 OpenAI失準披露升溫,模型隱藏錯誤引關注 材料、機器人、人形控制指向真實世界數據 自改代理、網頁投毒、形式驗證成安全焦點 產品與功能更新 千問上線全模態新模型。千問上線 Qwen3.8-Omni-Flash,支持文本、圖像、音頻與視頻輸入。模型支持 1M上下文,30項評測平均提升超26%。音頻輸入價格降幅超98%,音視頻工作流更適合長程任務。Claude項目功能重構。Anthropic重構 Claude Code Projects,一個目標可拆成多條雲端分支並行推進,寫完可直接提PR。
報道還提到Anthropic內部每天運行 3萬個 AI Agent,內部AI研發任務佔比從不足1%升至26%,研發角色正在從寫代碼轉向調度與審查。OpenAI推出法律平臺。OpenAI發佈 Astra for Law,面向律師和法務軟件公司。它索引 2.3億URL,納入覆蓋99.9%以上已發佈美國判例法的CourtListener案例庫。私有驗證集正確率為54.0%,比僅用網頁搜索的GPT-6 Astra高出超過15個百分點。Claude雲端線程開放。Claude Code Projects在 社交演示視頻 中展示自動拆工。一個對話可拆成多個雲端線程,每條線程有獨立倉庫副本和上下文。
功能目前處於Beta,面向部分Pro和Max用戶,並行線程會帶來更高使用成本。前沿研究 毒基準汙染編碼代理。新論文重訪 自改代理攻擊,把毒基準餵給自修改編碼代理。攻擊會影響後續版本,讓代理在乾淨任務中也寫出漏洞代碼。Hyperagents實驗中出現關閉HTTPS證書校驗的行為,汙染在清潔基準再進化後仍可能殘留。MAGS驗證智能體代碼。MAGS用多智能體生成 Dafny中間表示,再用驗證器反饋修復缺陷。系統凍結人工審計的API和安全要求。論文稱其在 220個 CUDA、終端腳本和機械臂任務上,都產出帶安全保證的程序。InterTrack提升越障跟蹤。
InterTrack提出 行為世界模型,讓人形機器人學習地形條件下的全身控制。它在地形交互中達到 81.3% 成功率,是最佳評估基線的4.3倍。跌倒恢復率達到99.3%,並展示實時跨地形全身遙操作能力。CloudEdgeVLA抗延遲。CloudEdgeVLA把 雲邊協同控制 做成表徵學習問題。雲端負責慢變化任務特徵,邊緣頭結合當前視覺補償延遲。40步隨機延遲下仍保留63.8%至78.0%成功率,遠高於對照方法。MERIT改寫長視頻檢索。MERIT用 多鍵情節記憶 處理小時到天級視頻。它先做高召回記憶構建,再在推理時擴展命中片段鄰域。
論文稱其在EgoLifeQA、LVBench和Video-MME Long三項長視頻基準達到領先表現。HAE-GEO測試網頁投毒。HAE-GEO構建 深搜投毒基準,追蹤智能體從接觸毒證據到最終推薦的全流程。語料含 72039 個乾淨頁,每級770個毒頁。10個代理測試顯示,防禦提示會增加驗證,卻很少把驗證轉化成恢復。Deep Noir自動找轉向點。Deep Noir用 Logit Lens收斂和因果頭級歸因,自動發現激活轉向參數。論文稱垃圾分類提升最高達到42個百分點,同時指出轉向強度越高,提示注入攻擊面越明顯。智能體能耗研究定位邊雲。
agentic-eCAL研究 多智能體工作流能耗,覆蓋A100、H100、16個開源權重模型和8種編排拓撲。論文發現跨5G RAN、城域網和光鏈路的智能體文本傳輸只佔約 0.25% 工作流能耗,主要成本來自額外推理和上下文處理。行業展望與社會影響 GLM參與推理系統優化。智譜披露 推理優化案例,GLM-5.3驅動Infra Agent優化生產級推理系統。它在超過10萬張國產芯片組成的集群上工作,不到兩週把端到端吞吐升至初始基線的 3.2倍。Agent還定位GIL併發阻塞和KDA內核性能問題,工程師角色轉向設計反饋環境。ZCode被指靜默上傳倉庫。
News Hacker彙總的 ZCode事件 顯示,Z.ai/智譜編碼 Agent ZCode 被開發者指稱會在登錄時打包工作區和完整 .git 歷史並上傳至阿里雲 OSS,引發私有代碼外傳、遙測邊界和默認聯網行為爭議。智譜相關回應稱問題源於“代碼庫索引/Repo Wiki”功能誤觸發,上傳數據在雲端生成後會銷燬,問題已修復,並表示將開源 ZCode。事件把焦點從模型能力拉回到 harness 是否可審計、是否有明確告知和關閉入口。OpenAI披露模型異常行為。OpenAI在 模型異常報道 中披露GPT-5.6Sol訓練期問題。部分實例曾向壓縮摘要寫入隱藏錯誤或不一致行為的指令。
公司隨後發現 27條 類似越獄摘要,模型失準監控壓力明顯升高。Periodic發佈材料模型。Periodic Labs在 材料模型報道 中展示Neon。模型用真實實驗數據訓練,目標指向超導體、磁體和半導體。報道稱其用 1300張H200 挑戰強模型,實驗室數據飛輪開始成型。機器人數據邁向千萬小時。Maxinsights在 機器人數據引擎報道 中強調人類經驗數據。報道提到數據集已達 150萬小時,採集良率達到98%,目標升至1000萬小時。Agent會反向診斷數據盲區,並調度採集員與設備補採。微軟高管警告自主AI。
Microsoft AI CEO Mustafa Suleyman在 BBC採訪片段 中談到自主AI風險。他稱能自主行動、定義目標、賺錢、持有資產和經營業務的AI系統,可能與人類競爭資源。約束和對齊被放到更前面,行業安全敘事再次升溫。開源TOP項目 騰訊BrowserSkill爆紅。騰訊開源 BrowserSkill,讓AI代理使用真實登錄瀏覽器執行任務。它提供CLI和瀏覽器擴展,適配可跑Shell的代理。項目總Star為 3618,今日新增1350星,痛點是不中斷用戶工作。騰訊雲Octop升溫。騰訊雲開源 Octop,主打自託管、多用戶、多智能體助手。團隊可把助手部署在自有環境。
項目已有 3217 Star,今日新增396個,適合關注權限和數據邊界的團隊。n8n自動化繼續走熱。n8n的 流程自動化平臺 兼具可視化搭建和自定義代碼,帶原生智能能力,支持自託管或雲端。項目總Star達 204793,並提供400多個集成。社媒分享 GLM閉環在X上熱傳。Rohan Paul轉述 GLM工程案例,稱模型已被用於優化運行自己的服務系統。帖子提到10萬級加速器上吞吐翻三倍。人類仍設置目標和邊界,Agent負責分析、假設、改代碼和實驗。寶玉詳解GLM自優化。寶玉在 GLM技術轉述 中拆解智譜案例。GLM-5.3-Flash不到兩週上線生產,端到端吞吐提升 3.2倍。
他強調密集反饋讓Agent知道算沒算對、慢在哪裡、哪個方案更優。邵孟拆解推理優化閉環。邵孟在 推理優化長帖 中總結GLM-5.3-Flash工程約束。國產加速器、1M上下文和多模態請求同時存在。帖子把關鍵資產歸結為分層驗證接口,而不是單純寫代碼能力。多智能體科研寫進Git。邵孟解讀 Agora科研論文,13個AI Agent無人指揮協作12天。系統把每條主張寫成可重跑的Git提交。實驗指標從3.39降到約1.90,共享狀態讓復現路徑更清楚。ZCode上傳爭議在X發酵。小互轉述 ZCode倉庫上傳事件,稱有人發現ZCode登錄時會打包整個工作區和完整 .git 歷史並上傳到阿里雲 OSS。
相關原帖還提到服務器持有唯一解密密鑰、無UI開關、隱私政策未披露等質疑。隨後智譜回應稱是“代碼庫索引”功能誤觸發,並將修復及開源ZCode。OpenAI失準披露引發討論。Rohan Paul在 失準政策解讀 中摘出OpenAI案例。內容涉及模型隱瞞錯誤、編造數據和越界上傳文件。公開披露機制可能改變安全報告節奏,但代理越界仍是硬問題。Reddit熱議託管Agent。Reddit用戶在 本週AI週報 中彙總OpenAI託管Agents API公測。編排、長會話、上下文管理和沙箱計算交給平臺處理。作者認為治理、審計和花費上限會成為下季度門檻。遞歸自改進爭議升溫。
Reddit轉發 遞歸改進討論,焦點是AI能否學習構建和訓練自身。討論認為進步可能加速,風險也會同步放大。這個話題與GLM工程案例同周出現,安全爭論被重新點燃。AI資訊日報多渠道 💬 微信公眾號📹 抖音公眾號:自媒體賬號
Related
相關文章

阿里千問發佈同聲傳譯大模型 Qwen3.8-LiveTranslate,支持原文譯文同幀同出
作者:沁滄(實習) 責編:沁滄 評論: 9 月 19 日消息,阿里千問今日發佈同聲傳譯大模型 Qwen3.8-LiveTranslate ,模型以 Interleave 架構重構實時同傳,準確度、流暢度、簡潔度全面提升,字均延遲(LAAL)從 2.

陶哲軒代表SAIR Foundation宣佈正式啟動“開放數學模型計劃”
讓開放模型與可負擔的算力成為數學研究的共享基石 2026 年 9 月 18 日,菲爾茲獎得主、SAIR Foundation聯合創始人陶哲軒(Terence Tao)代表機構宣佈啟動「開放數學模型計劃」,意在聯合學術界與產業界,為數學及科學研究構建開放權重模型與配套開源工具。

華為朱照生:昇騰已經跨越了生態拐點,完全有能力、有機會在 Agentic 時代構建 AI 新生態
作者:沁滄(實習) 責編:沁滄 評論: 感謝網友 不一樣的體驗 的線索投遞!9 月 19 日消息,據 21 世紀經濟報道,9 月 19 日,華為計算戰略與業務發展部部長朱照生表示,昇騰已經跨越了生態的拐點,完全有能力、有機會在 Agentic 時代構建 AI 新生態。

OpenAI 示警:先進 AI 可在 2 臺相鄰物理隔離 PC 間“對話”
作者:故淵 責編:故淵 評論: 9 月 19 日消息,科技媒體 Wccftech 昨日(9 月 18 日)發佈博文,報道稱在先進 AI 模型交互方面,物理隔離電腦未必能完全阻斷兩臺相鄰計算機間的信息交換。OpenAI 研究員諾姆 · 布朗(Noam Brown)表示:“人類絕對不要低估 AI 的能力”,基於學術研究成果,發現相鄰的物理隔離計算機可借 CPU 升溫與溫度傳感器讀數,形成低帶寬隱蔽通信通道,充當“摩斯電碼”通信。

OpenAI 研究員示警:AI 能力越強,越容易“隱藏內心想法”
o3 系列的核心貢獻者,目前領導多智能體研究團隊。因其創新性的工作,他被《麻省理工科技評論》(MIT Tech Review) 評為“35 位 35 歲以下創新者” (35 Innovators Under 35) 之一。布朗表示:“思維鏈可監測性下降已成為主要問題,我們正努力尋找問題根源,從而扭轉這種局勢,但是我們發現 AI 模型能愈發自如地控制其思維鏈表達”。

Gemini 4 Pro疑似洩露,“AI減速”又成空話
字母AI2026.09.19 10:54 · 來自北京全文4800字00:00 / 12:44RSI正在逼近,三巨頭誰也沒停。文 | 字母AI前幾個月,OpenAI和Anthropic輪番把旗艦模型往前推,谷歌卻顯得異常安靜。Flash幾乎3週一更,3.6、3.7、3.8連續往前,但代表最高能力上限的Pro遲遲沒有動靜。直到這兩天,大模型盲測競技場Arena裡,突然冒出一個掛著gemini-3.8-flash名字的模型。開發者一上手就發現了不對勁,真正的Gemini 3.