Grok 4.6 發佈即登頂性價比榜:智能指數追平 GPT-5.6 Sol,定價卻便宜 60% 以上

2026年8月13日 09:307200 次瀏覽
站內 AI 整理稿

AI資訊AI新閒資訊正文Grok 4.6 發佈即登頂性價比榜:智能指數追平 GPT-5.6 Sol,定價卻便宜 60% 以上發布於AI新閒資訊時間 :Aug 13, 2026閱讀 :2分鐘xAI 正式發佈 Grok 4.6,在 AI 智能指數上獲得 61 分,追平 GPT-5.6 Sol(Max),僅次於 Claude Opus 5(63 分)和 Claude Fable 5(62 分)。這一成績使 Grok 4.6 一舉躋身全球前沿模型第一梯隊,與 OpenAI、Anthropic 的旗艦產品正面掰手腕。模型在 Grok 4.

5 基礎上擴展訓練,核心改進包括使用模型生成的精選數據進行推理和高級技術概念訓練,結合高質量工程數據和改進的優化器。訓練方法上的關鍵變化在於數據閉環:Grok 4.5 被用於重新生成監督微調軌跡,涵蓋推理、代理工具使用以及 STEM、軟件工程和知識工作等領域。模型還在廣泛的代理強化學習任務上接受訓練,包括知識工作、通用編碼、內核優化、網頁開發和計算機輔助設計,這一策略明顯瞄準了"智能體時代"的核心工作負載。Agent 基準全面飆升,長週期任務省力驚人在智能體類基準測試中,Grok 4.6 表現尤為亮眼。

GDPval-AA v2 達到 1753 Elo,僅次於 Claude Opus 5;DeepSWE v1.1 提升至 65.9%,較 Grok 4.5 的 54% 大幅躍升;APEX-Agents 從 47.1% 飆升至 57.5%;Terminal-Bench v3.0 也從 15.7% 漲到 26%。此外在 CursorBench v3.2 上獲得 69.9%,在 FrontierCode v1.1 上獲得 61.3%,編碼與代理能力均實現顯著突破。更值得關注的是成本效率優勢。Grok 4.

6 定價維持在每百萬輸入 token 2 美元、每百萬輸出 token 6 美元,比 Claude Opus 5(5 美元 /25 美元)和 GPT-5.6 Sol(5 美元 /30 美元)低 60% 以上。在 AA-Briefcase 長週期知識工作基準中,Grok 4.6 平均僅用 53 個回合和約 5 億輸入 token 完成任務,而 Claude Opus 5 需要約 103 個回合和約 20 億 token——用不到四分之一的資源完成同等任務,性價比差距一目瞭然。

模型已通過 Cursor、Grok Build、API 及 OpenRouter、Vercel、Cloudflare 等渠道提供,首周在 Grok Build 和 Cursor 中還有 2 倍用量優惠,上下文窗口維持在 50 萬 token,一場圍繞"同等智能、更低價格"的性價比大戰已經打響。相關推薦深夜震撼發佈:DeepSeek V4 Pro正式版亮相,比肩頂尖Fable大模型8月13日AI產品密集發佈,馬斯克推出Grok4.6、千問開源Qwen3.8Max。

DeepSeek同步低調上線V4Pro正式版DeepSeek-V4-Pro-0813,API與Chat端均已更新,用戶按原方式指定名稱即可接入。官方跑分顯示其核心指標表現優異。Aug 13, 2026225.8k性能狂飆!Grok 4.6正式發佈,實力比肩GPT-5.6 SolSpaceX AI推出旗艦模型Grok4.6,專注複雜長程Agent任務,多項基準測試比肩或超越OpenAI GPT-5.6 Sol。此前7月聯合Cursor推出基於數萬張英偉達GB300 GPU訓練的Grok4.5,Grok4.6在其基礎上進一步優化長程複雜任務能力。Aug 13, 2026174.

2kxAI 發佈 Grok Bot:給 AI 智能體配一臺專屬雲端電腦,當"打工人"而非"聊天工具"xAI發佈測試版Grok Bot,定位為常駐AI智能體團隊。每個智能體配置雲端電腦,可登錄用戶現有工具,在無人監督下自主執行多步驟任務。與傳統需逐步指揮的自動化不同,其核心是模仿人類員工:即使用戶關掉筆記本,任務仍在雲端推進,僅在需審批時通知。用戶可通過桌面端管理。Aug 12, 2026163.9k支持5張參考圖融合與智能擴圖,xAI Imagine Image2.0正式上線xAI推出Imagine Image2.

0,作為Grok的全新質量模式,主打可控佈局、清晰字體與視覺元素一致性,適用於創意場景。該模型可理解複雜指令,在密集構圖中規劃字體佈局,保持小文字清晰,並支持多輪生成編輯,保留用戶指定的視覺特徵。API訪問仍在計劃中。Aug 10, 2026252.9k馬斯克放話:Grok 4.6 下週登場,SpaceX 全部歷史數據將灌入模型訓練馬斯克在SpaceX首次財報電話會上公佈AI路線圖:Grok4.6下週推出,隨後幾週上Grok4.7;此前xAI剛發佈主打代碼及財法任務的Grok4.5。更關鍵的是,馬斯克宣佈將把SpaceX有史以來全部數據整合至Grok訓練中。Aug 5, 2026245.

3k智啟未來,您的人工智能解決方案智庫English簡體中文繁體中文にほんご© 2026

Related

相關文章

量子位生成式AI

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”

阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

剛剛
IT之家生成式AI

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入

作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。

剛剛
全天候科技生成式AI

企業AI最後一公里:三路人馬在此交鋒

鄭敏芳 發表於 2026年08月24日 03:09 摘要:尋找自己的位置 2026年世界機器人大會現場,談到這一輪突然走紅的FDE(前線部署工程師),明略科技CEO吳明輝先把時間往回撥了十多年。“12年前我們就在非常認真地研究。”當華爾街見聞·問及FDE與傳統軟件部署有什麼區別時,吳明輝說,兩者都會進入客戶現場,但今天的FDE需要做得更深:一邊把Agent接進真實業務,一邊把現場形成的能力繼續沉澱回後臺。

剛剛