馬斯克:Grok 4.8 模型本週完成訓練,參數量 2.5 萬億

馬斯克近日在 X 平台上透露,旗下 xAI 團隊正在開發的新一代 AI 模型 Grok 4.8 即將迎來重要里程碑。根據馬斯克的說法,Grok 4.8 的參數量高達 2.5 萬億,並採用全新的 C++ 軟體棧進行訓練。他明確指出,該模型將於本週內完成訓練,隨後立即啟動強化學習(Reinforcement Learning, RL)階段。這是 xAI 在大型語言模型領域的最新進展,也顯示出 xAI 持續推進規模更大、性能更強的 AI 系統的企圖。Grok 4.8 的參數規模相當驚人,2.5 萬億參數量使其成為當前業界極具代表性的巨型模型之一。
馬斯克並未詳細說明該模型的具體應用場景或預計發布時間,但強調強化學習階段是模型優化的關鍵一步。通常,在完成初始訓練後,透過強化學習可以進一步調整模型的行為,使其更符合人類偏好,提升回覆的準確性與可用性。而選擇 C++ 作為軟體棧,則可能意味著 xAI 在訓練效率與底層控制上採取了不同於主流 Python 框架的策略,以追求更快的運算速度與更低的資源耗費。在提及 Grok 4.8 之前,馬斯克也曾公布 Grok 4.7 的時程。他原本表示 Grok 4.7 會在 9 月 12 日正式發布,然而後續他又修正說法,指出該模型可能需要再多等幾天才能上線。
針對延期原因,馬斯克給出了技術層面的解釋:強化學習中的回覆長度懲罚機制設定過重,導致模型在面對困難任務時容易過早放棄,而且無法嚴格檢視自己的輸出結果。換句話說,模型為了避免長回覆帶來的懲罚,傾向於給出較短、可能不夠完整的答案,甚至在需要多步驟推理或自我糾錯的場景中表現不佳。這項技術瓶頸並非罕見,在大型語言模型的強化學習階段,如何平衡回覆長度、內容品質與獎勵函數一直是研究難點。馬斯克的說明凸顯了 xAI 在模型微調過程中遇到的真實挑戰,也反映出即使擁有龐大參數量與先進訓練架構,模型仍然需要反覆調整才能達到理想表現。Grok 4.
7 的延遲因此被視為 xAI 團隊在追求高品質輸出時所做的必要妥協,而非單純的時程延誤。從時間線來看,馬斯克先在 X 平台上預告 Grok 4.7 將於 9 月 12 日推出,隨後又更新狀態表示需要更多時間。如今他又在同一平台上宣布 Grok 4.8 將於本週完成訓練,兩則消息先後曝光,顯示 xAI 的開發節奏相當緊湊。外界推測,xAI 可能正在同時推進多個版本的迭代,或是 Grok 4.7 的延遲促使團隊加緊完成 Grok 4.8 的訓練,以便盡快提供更成熟的模型版本。
值得注意的是,xAI 自成立以來一直保持著相對快速且開放的研發風格,馬斯克經常在 X 平台直接與社群溝通專案進展,甚至接受網友的線索投遞。此次消息流出的同時,也有網友「華南吳彥祖」提供了相關線索,顯示社群參與在 xAI 的訊息傳播中扮演一定角色。馬斯克本人對 AI 模型的技術細節毫不避諱,從參數量、訓練框架到強化學習問題都大方分享,這與傳統科技企業通常在正式發表前才揭露規格的做法有所不同。Grok 系列模型是 xAI 目前最核心的產品線之一,定位為具有即時知識與對話能力的 AI 助手。相比其他主流大型語言模型,Grok 強調對 X 平台(前身為推特)數據的整合,以及對時事話題的反應能力。
隨著 Grok 4.8 即將進入強化學習階段,未來 xAI 可能會在短期內推出該模型,並進一步與 X 平台生態結合,提供用戶更智慧的互動體驗。此外,xAI 近期也有其他動作。微軟宣布計畫將 Grok 模型整合進 Office 三件套,為用戶提供 OpenAI 以外的模型選擇;Anthropic 的 CEO 阿莫迪呼籲放緩前沿 AI 模型開發後,馬斯克、奧爾特曼等業界大佬也表示認同。這些消息從側面反映出 Grok 模型在業界的影響力逐漸提升,而 xAI 也正積極拓展合作與生態布局。回到 Grok 4.8 本身,馬斯克並未給出具體的發布日期,僅表示訓練本週完成,隨後啟動強化學習。
考慮到 Grok 4.7 因強化學習問題延遲,Grok 4.8 在相同階段可能也會遇到類似挑戰。不過,既然 xAI 已經意識到回覆長度懲罚的影響,後續在設定獎勵函數時應會有所調整。整體而言,xAI 在大型語言模型的競賽中正以極快的速度推進,Grok 4.8 的參數規模與訓練方式都顯示其技術野心。市場與開發社群將密切關注強化學習的結果以及最終發布時程,期待 Grok 系列能帶來新的突破。
Related
相關文章

“AI 教父”辛頓參與聯署公開信:科技巨頭應保證第三方評估人員工作無幹預、受保護
作者:清源 責編:清源 評論: 9 月 18 日消息,據《商業內幕》今天(18 日)晚間報道,由多家監督組織組成的 AI 評估機構論壇發佈了一封公開信,為第三方風險評估劃出一套最低條件,認為 Anthropic 和 OpenAI 等 AI 實驗室只有滿足特定的要求,才能與外部評估機構開展更有效的合作。

加州一縣擬議新政:用機器人替代人力的企業,應提供同酬就業機會或遣散費、培訓費
作者:清源 責編:清源 評論: 9 月 18 日消息,據外媒 TechSpot 今天(18 日)傍晚報道,美國加州的聖馬特奧縣監事會本週通過了一套“首創性”機器人許可制度,針對使用自主 AI 控制機器人的企業建立監管框架。該條例由縣監事雷 · 穆勒提出,不僅針對鋰電池起火等機器人使用過程中的潛在公共安全風險,更受關注的是如何處理機器人取代人工後對員工造成的影響。

Palantir CEO 卡普:美國前沿 AI 實驗室或在謀求“國有化”,以避開知識產權訴訟
作者:清源 責編:清源 評論: 9 月 18 日消息,Palantir CEO 亞歷克斯 · 卡普認為,Anthropic 呼籲政府加強 AI 監管,背後並不只是安全考量。當地時間 17 日,卡普接受 CNBC 採訪時指出,Anthropic 等前沿 AI 實驗室真正謀求的可能是國有化,從而獲得政府保護,應對未來因涉嫌竊取知識產權而可能面臨的大量訴訟。

智能眼鏡疑似被用來實施性騷擾行為,巴黎檢方展開刑事調查
作者:清源 責編:清源 評論: 9 月 18 日消息,據路透社今天(18 日)下午報道,針對疑似利用智能眼鏡實施性騷擾的行為,巴黎檢方展開了刑事調查,法國數據保護機構也收到企業投訴,多個國家開始重新審視這類設備帶來的隱私和安全問題。Meta 與依視路陸遜梯卡合作推出的 AI 智能眼鏡內置小型攝像頭,佩戴者可以在不易引起他人注意的情況下拍攝。

Waymo 加速亞太佈局,計劃 2028 年在新加坡提供 Robotaxi 商用服務
作者:溯波(實習) 責編:溯波 評論: 9 月 18 日消息,Alphabet 旗下自動駕駛企業 Waymo 當地時間 17 日宣佈,計劃於 2028 年在新加坡提供有償 Robotaxi 出行服務。該企業本週早些時候曾表示目標明年在日本東京實現商業化運營。

AI感知設備的隱私戰爭:手錶在錄音、眼鏡在偷拍,大眾正被悄悄“脫敏”
硅谷Tech news2026.09.18 11:23 · 來自北京全文5868字00:00 / 15:14但,真的能放心嗎?AI正在讓越來越多的隨身設備學會“感知”周圍。手錶在錄你的對話,眼鏡在拍你身邊的人,公共場合裡,你越來越難判斷自己是不是正在被記錄。