IT之家生成式AI

谷歌 Gemini 3.5 Pro 曝 200 萬 Tokens 上下文,前端部分 AI 測試趕超 Claude Fable 5

2026年7月7日 08:38
谷歌 Gemini 3.5 Pro 曝 200 萬 Tokens 上下文,前端部分 AI 測試趕超 Claude Fable 5

重點摘要

首頁 > 智能時代>人工智能 谷歌 Gemini 3.5 Pro 曝 200 萬 Tokens 上下文,前端部分 AI 測試趕超 Claude Fable 5 2026/7/7 8:38:02 來源:IT之家 作者:故淵 責編:故淵 評論: 感謝IT之家網友 刺客 的線索投遞!

站內 AI 整理稿

谷歌被爆將於近期推出新一代大型語言模型 Gemini 3.5 Pro,據傳該模型不僅支援高達 200 萬 Tokens 的上下文視窗,更導入全新「深度思考」推理模式,並在部分前端編碼測試中展現出超越 Anthropic Claude Fable 5 的實力,引起業界高度關注。根據消息來源 @HarshithLucky3 於 7 月 6 日在 X 平台發布的貼文,Google 計劃在 7 月 17 日正式發表 Gemini 3.5 Pro。

這款模型被定位為專為複雜智能體(Agent)工作流程所設計的系統,圍繞動作執行、子智能體協作、程式編寫、多模態生成以及長時間跨度任務等核心能力打造,承擔比目前已經推出的 Gemini 3.5 Flash 更高階的推理與執行角色。其中,最受矚目的規格之一便是支援 200 萬 Tokens 的上下文處理能力。這意味著 Gemini 3.5 Pro 能夠同時處理極大量的文字、程式碼或圖像資訊,對於需要長篇文件分析、複雜對話歷史或大型程式庫理解的應用場景將帶來顯著幫助。與此同時,報導中提及的「深度思考」模式,據信是為了讓模型在回答困難問題時能夠進行更縝密的逐步推理,從而提升答案的準確性與邏輯一致性。

在性能表現方面,該消息來源分享了一張據稱來自 LMSYS Chatbot Arena 評測平台的截圖。在該平台的一項編碼任務中——要求生成「極簡等距刷卡機」的 SVG 圖形——Gemini 3.5 Pro 的輸出成果被評為勝過 Anthropic 的 Claude Fable 5 High 版本。LMSYS Chatbot Arena 是業界知名的模型對戰平台,透過隨機雙盲比對來評估各模型的能力,因此這項比較結果具有一定參考價值。此外,消息來源後續還公布了兩段對比影片,進一步檢視 Gemini 3.5 Pro 與 Claude Fable 5 在前端生成方面的表現。

根據其觀察,Gemini 3.5 Pro 在生成使用者介面的設計品味上更為精緻,SVG 圖形的生成能力也更強,並且在自主智能體工作流程的執行上展現出更為流暢的體驗。這些影片雖然屬於單一樣本測試,但仍反映出 Gemini 3.5 Pro 在多模態生成與程式碼實作方面的潛力。從產品定位來看,Gemini 3.5 Pro 的出現顯然是為了補足 Google 在高端 AI 模型上的布局。早前推出的 Gemini 3.5 Flash 雖然以快速回應與較低成本受到開發者歡迎,但在需要深度推理與複雜任務處理的場景中仍有力有未逮之處。Gemini 3.

5 Pro 不僅在上下文長度上直接翻倍,更透過深度思考模式與強化的智能體功能,瞄準企業級應用與進階開發需求。值得注意的是,這並非 Google 近期在 AI 領域的唯一動作。該公司近來陸續推出多項與 Gemini 相關的更新,包括針對 macOS 平台的 Gemini Spark 智能體、以及免費用戶的個人化 AI 圖像生成功能,展現其在終端應用與開發者工具兩端並進的策略。然而,在人才競爭方面,Google 也面臨部分核心研究人員陸續離職轉投競爭對手 Anthropic 的挑戰,這使得 Gemini 3.5 Pro 的最終表現格外受到業界矚目。

截至目前,Google 官方尚未對這項爆料做出回應或確認。爆料中提及的 7 月 17 日發布時程是否屬實,以及 Gemini 3.5 Pro 在真實場景下的效能能否達到預期,仍有待官方正式公告或後續獨立評測來驗證。但可以確定的是,隨著上下文窗口突破百萬等級,並結合更深度的推理能力,AI 模型的應用邊界勢必將再次被拓寬。對於關注 AI 發展的讀者而言,Gemini 3.5 Pro 與 Claude Fable 5 之間日益激烈的競爭,無疑將為市場帶來更多元的選擇與更快速的技術迭代。

業界也普遍預期,此類具備超大上下文與深度推理能力的模型,將在軟體開發、數據分析、自動化流程等領域扮演越來越關鍵的角色。後續發展值得持續追蹤。

Related

相關文章

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

剛剛
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

13 分鐘前

可靈AI核心技術骨幹王鑫濤被曝離職

快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

14 分鐘前

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了

2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。

18 分鐘前