智譜正式發佈 GLM-5.3:編程能力最強開源模型,較 GLM-5.2 提升 50%

2026年8月14日 13:36
智譜正式發佈 GLM-5.3:編程能力最強開源模型,較 GLM-5.2 提升 50%
站內 AI 整理稿

作者:汪淼 責編:汪淼 評論: 感謝網友 CuSO4_5H2O、啊呦歐剋、軟媒用戶2014882、REDX、發財、SJJ 的線索投遞!8 月 14 日消息,智譜今日正式發佈 GLM-5.3,與 GLM-5.2 相比,基座模型沒變,但通過後訓練 Scaling 大大提高了模型的智能上界:數十倍的長程任務環境、更豐富多樣的環境類型、超長的後訓練時間。相比前代,GLM-5.3 的新能力包括:更強的編程能力。GLM-5.3 是編程能力最強的開源模型,在內部自建體感評測中較 GLM-5.2 提升 50%,在包括 Terminal Bench 3.

0、Agents' Last Exam (CLI) 在內的公開基準測試中取得開源第一。網絡安全能力。在白盒代碼審查與漏洞發現等安全任務中,GLM-5.3 的表現持平 Mythos 5,展現出面向網絡安全防禦場景的強大潛力。後訓練 Scaling。上述全部提升都來自後訓練。基於 IndexShare、SAO、以及持續演進的新一代 Slime 框架,智譜在與 GLM-5.2 完全相同基座上高效推進強化學習,可能智譜還遠未開發出這個基座的智能上界。開源。智譜將在發佈兩週後開放模型權重,此前完成安全評估與模型加固。智譜表示,在多項主流基準測試中 GLM-5.

3 是當前排名最高的開源模型,編程與智能體能力接近 Claude Fable 5,編程體感超過其他國產模型。在衡量模型於真實終端環境中完成複雜任務的 Terminal-Bench 3.0 上,GLM-5.3 得分從 4.6 提升至 28.3;在聚焦長程軟件工程與持續代碼修改能力的 DeepSWE v1.1 上,得分從 46.2 提升至 66.9;在覆蓋多類真實專業場景、強調跨工具協作與長程任務的 Agents' Last Exam 上,得分從 23.8 提升至 28.

5;在覆蓋 44 種職業、考察真實高價值知識工作的 GDPval-AA v2 中得分 1,769,展現基於編程能力湧現的專業任務執行能力。智譜自研的 Z.ai Code Bench 評估模型在真實編程場景中的綜合體感。模型會被置於複雜的本地開發環境,並在不同思考檔位下執行端到端任務,更接近開發者實際使用 Coding Agent 時的體驗。測試結果顯示,GLM-5.3 在效果和 Token 利用率之間取得了更好的平衡。在 High 檔位下,GLM-5.3 達到 31.4% 的準確率,超過 Claude Opus 4.8 最高檔位的 29.

5%,每項任務平均輸出約 5 萬 tokens,而 Opus 4.8 需要約 12 萬 tokens,意味著 GLM-5.3 可以用更短的執行路徑完成任務。即日起上線智譜官方編程工具 ZCode、效率工具 AutoClaw,上線 GLM Coding Plan 全量用戶及開放訂閱。TraeWork / TraeCode / 釦子、WorkBuddy / CodeBuddy、Qoder / QwenWork、CatPaw、JoyCode、OpenCode 等編碼平臺開放搶先體驗。API 很快上線,完整模型權重將在兩週內開源,此前需完成必要的安全加固,儘可能限制其潛在攻擊能力,保留其防禦價值。

從智譜公告獲悉,今天 13:00,GLM Coding Plan 全員額度重置,所有用戶後臺「用量統計」可見使用額度回滿。投訴水文 我要糾錯 下載APP,簽到賺金幣兌豪禮 相關文章關鍵詞:智譜,GLM5.3,開源模型消息稱智譜 API 用戶接近 700 萬,已啟用超 5 萬塊國產算力芯片智譜:公司英文名稱已變更為 Z.AI Co., Ltd智譜回應“撤回 A 股輔導備案”:有關報道失實,存在惡意炒作之嫌智譜市值首次突破 1 萬億港元,股價年內漲超 2000%智譜:建議 A 股發行並在科創板上市智譜 GLM-5.1 高速版 AI 模型發佈,跑出全球最快速度 400 tokens/s

Related

相關文章

鈦媒體生成式AI

王興興“錯配”梁文鋒?

王興興“錯配”梁文鋒?字母榜2026.08.24 17:44 · 來自河北全文4818字00:00 / 13:21關於世界模型,宇樹和DeepSeek理念分歧明顯。文 | 字母榜宇樹科技的股價還在持續下跌。市值從上市首日的4449億元高點,跌至2400億元,截至8月24日收盤,市值較最高點蒸發了2000億元。然而比股價更值得關注的是,宇樹接下來要怎麼走。8月20日,也就是宇樹上市第二天,王興興出現在北京世界機器人大會論壇。十多分鐘的分享裡,AI成為了高頻詞彙。他談到AI實時生成、實時識別,也談到AI模型投入,更透露了宇樹正在預研的一件事:讓物理AI機器人實現“自進化”。王興興講的每一件事,最後都指向一個關鍵要素:AI大模型。特別是最後一點,王興興說,要實現“物理AI自進化”,要用目前最前沿、最頂尖的AI大模型來驅動。而這恰恰是宇樹目前不太擅長的部分。不過,宇樹找到了DeepSeek。今年8月,兩家公司已經達成合作,圍繞AI大模型與具身智能相關技術展開合作。說到具身智能公司和AI大模型公司的合作,就不得不提當年Figure AI和OpenAI的合作。2024年,OpenAI在投資Figure AI後,雙方簽署了三年合作協議,合作開發人形機器人AI模型。但是僅一年後,FigureAI終止合作,轉向自研。於是問題來了:王興興和梁文鋒,會不會重走Figure AI和OpenAI的老路?01為什麼宇樹需要DeepSeek?對於宇樹來說,過去幾年,模型研發已經有了一些積累,但顯然投入不足,進展緩慢,所以找到一個頂尖的AI大模型公司合作,是一個比較自然的選擇。先來看宇樹目前的模型研發進展。當前,具身智能大模型沒有一個統一的技術路線,但VLA和世界模型,是行業重點探索的兩個方向。行業甚至也在探索兩者融合的技術路線。宇樹也在摸索,採取了“兩條腿走路”的策略,並行研發兩種模型。所謂VLA(視覺

剛剛
量子位生成式AI

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”

阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

剛剛
IT之家生成式AI

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入

作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。

剛剛