智譜提前劇透GLM-6.0:完全自訓練方法公開了

智譜在港交所發佈公告:配售新H股加發行201.4億元人民幣零息可轉債,合計預計淨募約393億港元。6成資金指向同一個目標,遞歸式自我改進(Recursive Self-Improvement,RSI), 但在智譜這裡有一個新名字,“完全自訓練”。在8月底的半年報業績溝通會上,唐傑就曾回應“只會後訓練”質疑,透露過下一代GLM-6.0瞄準自進化。現在模型、論文都還沒出,沒想到先從財務公告上劇透了。智譜的完全自訓練 300多億元要怎麼花,公告給出了明確的分配方案。
約60%的所得款項淨額(約235億港元)將投入下一代GLM基礎模型和“完全自訓練”體系的研發,以及大規模訓練、推理和算力基礎設施的部署與升級。“完全自訓練”(Fully Self Training)是智譜對RSI的具體技術表述,公告釋義部分給出了定義: 下一代GLM模型將在上一代GLM所搭建的環境裡訓練,形成遞歸式自我改進(Recursive Self-Improvement)閉環,涵蓋數據自產、環境自造、基礎設施自我優化三個維度。數據自產,不再完全依賴人類標註。
通過模型間自我對弈、規則校驗、執行驗證、模型評審和人工抽檢等方式,自動生成、篩選和積累高質量訓練數據,持續迴流到預訓練、中訓練和後訓練各階段。環境自造,讓智能體去採集和轉化真實世界的任務。智能體自己試做、自己生成驗證器、自己檢查任務是否可解,不斷擴充訓練環境的數量、類型和複雜度。要讓任務環境成為“可規模化生產及複用的訓練資源”。基礎設施自我優化,模型已經會寫代碼了,那就讓它幫忙優化自己賴以運行的訓練和推理系統。利用模型在編碼和系統工程方面的能力,協助開發和優化訓練及推理系統的算子、內核、調度、緩存和服務棧,使模型能夠逐步參與支撐其自身迭代的基礎設施升級。
閉環之外,模型本身的能力方向也在公告中預告。智譜下一步要做的事情包括提升基礎模型的有效規模和原生多模態統一建模能力,在不過度增加推理成本的前提下加深有效計算深度,讓模型能跑更長鏈條的推理、規劃和自我校驗。長程任務強化學習是另一個重點,目標是建設貼近真實專業工作的任務環境,訓練模型去拆解任務、調用工具、和環境交互、從錯誤中恢復、驗證最終結果。算力方面,智譜在公告中提到,當前市場上“優質算力資源的供給及交付條件較為有利”,將綜合推進算力資源的採購與租賃,投入芯片適配、算子開發、集群互聯和性能調優,建立來源多元且可靈活調配的算力供給體系。
自研推理引擎和服務棧同樣在投入清單之列,覆蓋多模態編碼、提示詞預填充、逐Token解碼、量化、緩存、通信及彈性擴縮容等環節,目標是在同等硬件條件下提升推理吞吐和成本效率。剩餘資金中,約15%(約59億港元)用於業務拓展、戰略投資和潛在併購。公告列出了投資標的的篩選標準:業務與AI技術及應用密切相關、擁有可靠的用戶或客戶群且穩定經營不少於兩年、具備成熟的產品或技術平臺並有持續研發和技術迭代能力,涵蓋大模型、智能算法、算力運營、算力基礎設施、AI平臺、智能體及AI賦能應用等方向。業務層面將支持MaaS平臺、API、Coding Plan以及Agent和Co-work相關產品與服務的市場拓展。
約25%(約98億港元)用於優化資本結構和補充運營資金。全部所得款項預計將在2028年6月30日前悉數動用。上市八個月,三輪融資 回看智譜在港股的融資時間線。2026年1月8日,智譜以每股116.20港元的價格完成H股全球發售,包含超額配股權在內共發行約4,304萬股H股,淨募約48.96億港元。截至2026年8月31日,這筆IPO所得款項已全部花完。僅隔半年,2026年7月9日,智譜以每股1,588港元的價格完成首次配售,發行1,978萬股新H股,淨募約313.75億港元。從IPO定價116.20港元到首次配售定價1,588港元,間隔6個月,每股價格翻了約13.7倍。
截至8月底,首次配售所得款項已動用約34.92%(約109.55億港元),仍有約204.2億港元尚未使用。然後就是9月12日這一次。H股收盤價已從高位回落至793港元,配售價從7月的1,588港元降至714港元。公告解釋稱,隨著公司業務進展加快,“原有募資計劃下的資金使用節奏相應提速”,而“算力資源從簽約到部署上線需要一定週期”,現階段完成融資安排有助於使新增算力部署節奏與擴張計劃相銜接。三輪融資合計,智譜上市後已累計淨募約755億港元(約646億元人民幣)。
公告中還有一處細節透露了智譜的A+H計劃,可轉債條款明確提到“不會因本公司目前預期將於上海證券交易所科創板上市的股份的首次公開發行”而對換股價作出調整。論文地址: https://ea-cdn.eurolandir.com/press-releases-attachments/4179721/HKEX-EPS2026091312330384_0.PDF 版權所有,未經授權不得以任何形式轉載及使用,違者必究。
Related
相關文章

長安汽車首席專家譚歡:未來要用機器人造車、賣車,讓機器人上車、造機器人
作者:清源 責編:清源 評論: 9 月 18 日消息,在今天(18 日)的第 22 屆中國汽車產業發展(泰達)國際論壇“新賽道生態專場:具身智能新賽道”活動中,長安汽車首席專家、長安天樞智能機器人公司總經理譚歡在演講中指出,AI 正推動以物理具身智能為核心的基礎設施革新,汽車未來形態是“汽車機器人”—— 自學習、自組織、自進化的組合智能體。

具身智能技術路線尚未定型,基礎設施卻先收斂
具身智能技術路線尚未成形,但基礎設施需求已開始收斂,重點從製造機器人轉向持續迭代機器人能力。百度集團沈抖指出,智能體能力邊界快速擴展,進入規模化部署階段,但機器人學習新任務與跨環境適應性仍待突破。

88小時抵一個人思考4000年,OpenAI核心研究員:除了自我進化,更可怕的是AI正學會“隱藏自己”
AI正在把4000年的人類認知勞動壓縮進88小時,OpenAI研究員Noam Brown坦言連他自己也被進展速度持續震驚。AI正在把過去需要數千年完成的認知勞動壓縮到數天。真正的問題已經不只是模型能否變得更聰明,而是實驗能否跟上、人類能否在模型繼續自我改進前確認它仍然安全。
Agent辦事、花式P圖、動嘴玩電腦……實測Wildcat Lake輕薄本玩AI有多爽
作者 | ZeR0 編輯 | 漠影 桂林依山傍水,連城市的輪廓,都是一座座山勾勒出來的。抬眼一望,便是翰墨丹青般的自然光景,既沉靜婉約,又意境悠遠。這種乾淨的留白之美,早已被古人融入山水畫藝中,幾筆山石,一帶煙雲,餘下的留給水色,也留給看畫的人。 淨,並非空無一物,而是通過剋制的取捨,讓真正重要的東西凸顯出來。這與今年推出的第三代英特爾酷睿處理器(代號Wildcat Lake)的設計理念不謀而合。

吳恩達回應AI末日論:別被科幻敘事帶偏,應解決現實工程問題
吳恩達曾參與創辦Google Brain和Coursera。吳恩達稱,科技行業早期曾放大AI潛在災難性風險,以獲取關注並影響監管方向;近兩週相關討論再次升溫,也可能存在類似動機。他認為AI確實存在現實風險,尤其包括網絡安全等領域,但不認同將人類滅絕風險作為當前AI發展的核心判斷依據。

智譜 GLM-5.3-FlashX 模型上線,更快、更流暢
作者:汪淼 責編:汪淼 評論: 感謝網友 Agent 的線索投遞!9 月 18 日消息,智譜今日宣佈推出 GLM-5.3-FlashX(最高 200 tokens/s),為企業與開發者帶來更快、更流暢的模型體驗。智譜官方表示,GLM-5.3-Flash 此前以“Ox Alpha”之名與全球開發者見面,獲得海內外開發者的廣泛認可,調用量持續攀升。