IT之家生成式AI

馬斯克:Grok 4.6 訓練進入最後階段,2 萬億參數模型下週完成初步訓練

2026年7月18日 22:56
馬斯克:Grok 4.6 訓練進入最後階段,2 萬億參數模型下週完成初步訓練

重點摘要

馬斯克透露xAI正在訓練的Grok 4.6模型參數規模達2萬億,預計下週完成初步訓練,並預估其表現可能超越月之暗面的Kimi 3。該模型在擴大規模的同時,力求維持與前代相近的推理速度與Token效率。

站內 AI 整理稿

馬斯克今日在社群平台 X 上回覆網友提問時透露,旗下人工智慧公司 xAI 正在訓練的新一代大型語言模型 Grok 4.6,其參數規模將達到 2 萬億,預計最快下週就能完成初步訓練階段。這項消息立即引發 AI 圈的廣泛關注,因為這將是 xAI 至今為止規模最大的模型版本。根據馬斯克的說法,2 萬億參數的 Grok 4.6 在各項能力上都將優於目前正在運行的 1.5 萬億參數版本(即 Grok 4.5),同時在推理速度與 Token 效率方面則能維持與現有 1.5T 模型相近的水準。換句話說,xAI 在擴大模型規模的同時,仍試圖兼顧實際運行時的效能表現,避免因參數暴增而導致回應變慢或成本失控。

馬斯克還在對話中猜測,這款新模型的能力「可能會超過月之暗面最新的 Kimi 3」。不過這僅是他個人的初步判斷,xAI 官方目前尚未公布 Grok 4.6 的正式發布時間、具體訓練細節以及完整的技術指標,外界仍需等待後續官方資訊才能驗證其實際表現。回顧 xAI 的模型發展歷程,該公司在今年 5 月曾由馬斯克親自證實,Grok 基礎模型 V9-Medium(擁有 1.5T 參數)已完成訓練,後續進入微調與強化學習階段。業界普遍將該模型視為 Grok 4.5 的基礎版本。如今若 2T 參數的 Grok 4.6 順利完成並發布,將標誌著 xAI 在參數規模上的又一次重大躍進。

值得注意的是,雖然參數數量常被用來衡量大語言模型的規模,但模型真正的實際能力仍深受訓練資料品質、訓練方法、推理架構、可用計算資源以及後訓練優化等多項因素影響。馬斯克強調,xAI 的策略是在擴大模型規模的同時,力求維持與上一代模型接近的運行效率,避免陷入「越大越慢」的困境。在運算基礎設施方面,xAI 持續加大投入。此前公開資訊顯示,Grok 4 的訓練使用了名為 Colossus 的大型 AI 計算集群,該集群配備約 20 萬塊 GPU,專門用於強化學習與模型訓練。這樣的硬體規模在業界屬於頂尖水準,也讓 xAI 得以在短時間內快速迭代模型。

當前 AI 大模型領域的競爭日趨激烈,各家業者圍繞模型規模、推理能力、回應速度以及成本效率展開角力。OpenAI、Google、Anthropic 等企業同樣持續推出新一代模型,業界普遍關注如何在提升模型能力的同時,有效壓低推理成本。xAI 選擇在此時推進 2 萬億參數的 Grok 4.6,無疑將進一步激化這場技術競賽。隨著下週初步訓練的完成,xAI 是否會隨即展開後續的微調與強化學習,以及最終產品何時能上線提供服務,都將是市場密切觀察的焦點。

Related

相關文章

MarkTechPost AI生成式AI

NVIDIA AI 推出 NOOA:將 AI 代理轉化為單一 Python 類別的物件導向框架

NVIDIA 實驗室開源了 NOOA(NVIDIA 物件導向代理),這是一個與模型無關的 Python 框架,用於建構 AI 代理。傳統的代理開發分散在提示模板、工具架構、回呼程式碼和工作流程圖中,而 NOOA 將所有這些整合到一個 Python 類別中:方法代表模型可採取的動作,欄位代表代理狀態,文件字串作為提示,型別註解則是執行時期強制執行的合約。主體為「...」的方法由 LLM 驅動的迴圈在執行時期完成,而具有正常主體的方法則保持確定性的 Python 程式碼。開發者與模型因此共享同一介面,使代理行為能像一般軟體一樣進行測試、追蹤、重構和版本控制。NVIDIA 報告在 SWE-bench Verified 上達到 82.2%,在 CyberGym L1 上達到 86.8%,平均 RHAE 為 85.1%。

28 分鐘前

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

2 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

3 小時前

可靈AI核心技術骨幹王鑫濤被曝離職

快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

3 小時前