智譜 GLM-5.3 發佈:7400 億參數沒漲,靠後訓練硬拉 50% 性能,編程能力逼近 Fable 5
AI資訊AI新閒資訊正文智譜 GLM-5.3 發佈:7400 億參數沒漲,靠後訓練硬拉 50% 性能,編程能力逼近 Fable 5發布於AI新閒資訊時間 :Aug 14, 2026閱讀 :1分鐘8月14日,智譜正式發佈大模型 GLM-5.3。基座參數量仍然是7400多億,跟 GLM-5.2同一套底子,此前傳聞的萬億參數升級並沒有出現——那枚牌大概被留給了 GLM-5.5。但智譜靠著後訓練這招,硬是讓 GLM-5.3的性能比上一代提升了50%,在多項主流基準測試中拿下了當前開源模型最高排名,編程與智能體能力接近 Claude Fable5,編程體感超過其他國產模型。
幾項關鍵基準的成績躍升很有說服力。在衡量模型於真實終端環境中完成複雜任務的 Terminal-Bench3.0上,得分從4.6一口氣躥到28.3;聚焦長程軟件工程與持續代碼修改能力的 DeepSWE v1.1,從46.2漲到66.9;覆蓋多類真實專業場景、強調跨工具協作與長程任務的 Agents' Last Exam,從23.8提升到28.5。在覆蓋44種職業、考察真實高價值知識工作的 GDPval-AA v2中,GLM-5.3拿到1769分,展現出基於編程能力湧現出的專業任務執行力。整體來看,它在複雜軟件工程、終端操作和更廣泛的真實世界 Agent 任務上都有顯著進步。
最能說明問題的是智譜自研的 Z.ai Code Bench——這套評估把模型塞進真實的本地開發環境,在不同思考檔位下執行端到端任務,儘可能還原開發者實際用 Coding Agent 時的體感。測試結果顯示,GLM-5.3在效果和 Token 利用率之間找到了更好的平衡:High 檔位下準確率達到31.4%,超過 Claude Opus4.8最高檔位的29.5%,而每項任務平均只輸出約5萬 tokens,Opus4.8則需要約12萬 tokens——意味著 GLM-5.3能用更短的執行路徑走完同樣的事。產品落地方面,GLM-5.
3即日起上線智譜官方編程工具 ZCode 和效率工具 AutoClaw,同步開放給 GLM Coding Plan 全量用戶及訂閱用戶。TraeWork、TraeCode、釦子、WorkBuddy、CodeBuddy、Qoder、QwenWork、CatPaw、JoyCode、OpenCode 等第三方編碼平臺也開放了搶先體驗。API 很快上線,完整模型權重將在兩週內完成必要的安全加固後開源——智譜的策略是儘可能限制模型的潛在攻擊能力,同時保留其防禦價值。今天13:00,GLM Coding Plan 全員額度已經重置,所有用戶後臺的用量統計均可看到額度回滿。相關推薦智譜發佈 GLM-5.
3:不換底座、只煉後訓,開源編程王座易主智譜發佈GLM-5.3,基座模型完全未變,提升全部來自後訓練Scaling。通過數十倍規模長程任務環境、更豐富環境類型和超長後訓練時間,相同基座智能上界被顯著抬高。內部評測編程體感較GLM-5.2提升約50%,成為當前編程能力最強的開源模型,公開基準表現同樣亮眼。Aug 14, 2026113.3k韓國AI新王Solar Pro 4登場,直接硬剛全球頂尖大模型?韓國Upstage推出商用大模型Solar Pro4,具備512K上下文窗口,最高支持128K輸出,單次會話可處理多份合同、報告及數據文件。定價頗具競爭力:每百萬Tokens輸入0.
3美元,緩存讀取0.06美元,輸出1.2美元。Aug 13, 2026169.5k傳Anthropic正洽談收購AI初創公司Decart,交易估值達 60 億美元據媒體報道,AI企業Anthropic正就收購初創公司Decart展開深入談判,交易估值約60億美元。Decart是近年受關注的新銳團隊,技術路線獨特。若收購達成,將擴充Anthropic技術版圖與研發實力,並影響前沿大模型市場競爭格局。Aug 13, 2026157.4k註冊資本增至223.85 萬元,北京月之暗面科技完成最新工商變更國內大模型企業月之暗面完成工商變更,註冊資本由152.36萬元增至223.85萬元,引發業界關注。
該公司自2023年成立以來發展迅速,經營範圍涵蓋人工智能基礎軟件、應用軟件開發等核心前沿領域。Aug 13, 2026155.4k阿里重磅開源2.4萬億參數大模型,多項性能比肩Fable 5阿里千問首次全面開源Max旗艦模型Qwen3.8-2.4T-A95B權重。該模型總參數2.4萬億,單Token激活950億,原生支持26萬Token上下文,可擴展至101萬;架構延續Qwen3.5優勢,擅長編程、辦公、科研及長週期智能等任務。Aug 13, 2026182.7k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026
Related
相關文章

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”
阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

月之暗面第一代萬億參數多模態模型 Kimi K2.5 官宣月底結束服役
作者:歸瀧 責編:歸瀧 評論: 8 月 24 日消息,月之暗面 Kimi 官方微博今日宣佈,其第一代萬億參數多模態模型 —— Kimi K2.5 本月底即將結束服役。據此前報道,今年 1 月,月之暗面宣佈推出並開源了其最新的 Kimi K2.

消息稱知名 AI 研究員 Luke Metz 離開 OpenAI,加入 Meta 超級智能實驗室
作者:遠洋 責編:遠洋 評論: 感謝網友 華南吳彥祖 的線索投遞!8 月 24 日消息,據知情人士向 Axios 證實,知名 AI 研究員 Luke Metz 已加入 Meta 的超級智能實驗室(Superintelligence Labs)。

Anthropic 最強大模型 Fable 5 遇冷,企業用戶轉向更便宜 AI 產品
作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,據英國《金融時報》報道,Anthropic 的美國客戶正在使用更便宜的替代品來替代其最強大的 AI 工具,這在其預計將實現有史以來規模最大的 IPO 之前,對其高支出的商業模式提出了質疑。

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入
作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。
