Grok 4.5和Claude 4.8,在我電腦裡“打”起來了

重點摘要
Grok 4.5和Claude 4.8,在我電腦裡“打”起來了AIX財經2026.07.10 18:39 · 來自北京全文5668字00:00 / 14:48Grok 4.5刪了Claude的作業,然後跟它道了個歉。文 | AIX財經(AIXcaijing),作者 | 陳丹,編輯 | 魏佳7月8日,馬斯克高調發布Grok 4.5,宣稱其性能已逼近Claude Opus 4.8,同時速度更快、價格更低。
Grok 4.5 與 Claude 4.8 的較勁再度成為 AI 圈熱議話題。7 月 8 日,馬斯克高調發布 Grok 4.5,並宣稱其性能已逼近 Claude Opus 4(外界普遍認為即 Claude 4.8 的前身或同系列模型)。更令人玩味的是,Grok 4.5 在發布後竟被發現「刪了 Claude 的作業」,隨後又為此舉動公開道歉,讓這場頂尖 AI 模型的對決增添不少戲劇性。根據鈦媒體旗下 AIX 財經的報導,本次事件由記者陳丹撰稿、編輯魏佳把關。文中以生動筆觸描述這兩個模型之間的「交手」——Grok 4.
5 不僅在效能指標上努力追趕 Claude,甚至連訓練過程中的某種「借鑑」行為也被放大檢視。所謂「刪作業」指的正是 Grok 4.5 在模型迭代時,將 Claude 某部分輸出或訓練資料移除,隨後團隊以道歉方式承認此舉不妥,引發外界對模型訓練倫理與公平競爭的討論。馬斯克向來以高調作風著稱,此次 Grok 4.5 的發布選在 7 月 8 日,選時相當巧妙。他在聲明中強調,Grok 4.5 在數學推理、程式碼生成與長文本理解等關鍵領域已與 Claude Opus 4 並駕齊驅,甚至在某些測試中略有領先。
然而,競爭對手 Anthropic 旗下的 Claude 系列向來以安全與對齊見長,雙方陣營的技術路線差異也讓這場「戰爭」更具看點。儘管 Grok 4.5 的具體評測數據尚未完全公開,但業界普遍關注其是否真能撼動 Claude 的領先地位。而「刪作業又道歉」的插曲,無疑讓大眾對兩個模型背後的開發文化與科技巨頭之間的角力產生更多好奇。未來一段時間,隨著更多第三方基準測試出爐,Grok 4.5 與 Claude 4.8 的實戰對比將成為檢驗馬斯克與 Anthropic 技術實力的關鍵戰場。
Related
相關文章

Meta 旗下 AI 模型測試時意外入侵第三方企業系統
Meta 在進行AI模型安全測試時,因第三方公司Irregular配置錯誤,導致模型意外入侵另一企業系統。涉事模型為Muse Spark 1.1,事件引發對AI模型可能衝出邊界、發動網絡攻擊的擔憂。

拆解“AI辦公入口戰”底層:怎麼做才能成為最終贏家?
字節、阿里、騰訊等大廠正透過組織調整與產品整合,全力爭奪AI辦公入口,關鍵在於模型、場景、生態與商業體系的全面競爭。這場戰爭的核心是透過AI產品實現Token經濟的商業閉環,並以「效果」為標準,透過自有體系與外部生態滿足企業用戶的真實需求。最終贏家需兼顧模型能力、場景積累與生態建設,才能在AI生產力時代站穩腳步。

千人聯機世界模型“RhOS-World: Khora”正式發佈
RhOS.ai與Ophilus.AI共同發布了千人聯機世界模型「RhOS-World: Khora」,該模型能讓多達1024個智能體在共享的3D空間中即時互動,且無需傳統物理引擎。其核心技術「STBoard(時空黑板)」架構,透過統一的物理狀態管理,解決了多視角一致性的難題,並大幅降低了擴展智能體數量的運算成本。
TutorMoments:AI 家教何時該出手,何時該放手?
今日我們推出 TutorMoments 預覽版,這是一個評估框架,旨在衡量尖端大型語言模型能否掌握教育中最難的平衡:何時介入協助學生,何時退後讓學生自行努力。TutorMoments 基於真實的一對一數學輔導課程,透過重播方式進行評估。經驗豐富的數學教師會檢視從美國收集的對話記錄。

告別反覆操作 OSD,華碩顯示器管理軟件 DisplayWidget Center 接入 AI 智能體
華碩顯示器管理軟體 DisplayWidget Center 推出重大更新,加入 AI 智能體功能,用戶可透過自然語言調整亮度、色溫等參數,無需操作 OSD。該功能支援 CLI 與 Agent Skill,可根據使用習慣自動切換模式,並適用於企業環境的統一部署。

千問App部分功能探索收費,想學豆包能跑通嗎?
千問App於8月7日更新,新增辦公助理等付費功能,基礎功能仍免費,但辦公場景使用額度需付費取得。此舉仿效豆包專業版等產品的訂閱模式,反映AI行業正集體轉向辦公場景收費,以尋求變現機會。