時隔三週,谷歌再更Flash模型,年內打五折

2026年8月14日 15:58
站內 AI 整理稿

編譯 | 楊京麗 編輯 | 李水青 8月14日消息,今日,谷歌發佈Gemini 3.7 Flash,這是谷歌迄今面向編程和Agent場景能力最強的Flash系列主力模型。▲谷歌發佈Gemini 3.7 Flash(圖源:X) 距離Gemini 3.6 Flash發佈僅過去三週,新模型在編程、網頁開發、複雜文檔處理和企業自動化等任務上均有提升,其中DeepSWE v1.1成績從49.0%升至65.3%,與Claude Sonnet 5和GPT-5.6 Terra得分近似;AutomationBench成績從17.0%升至30.4%。

目前,在第三方模型測評機構Artificial Analysis上,Gemini 3.7 Flash(high)在Intelligence Index中取得56分,與GPT-5.6 Terra(max)、GPT-5.5(xhigh)、Grok 4.5(high)、Claude Sonnet 5(max)得分相近。▲Gemini 3.7 Flash測評情況(圖源:Artificial Analysis) 價格方面,2026年年底前,Gemini 3.7 Flash每百萬輸入Token的價格為0.75美元(約合人民幣5.06元),每百萬輸出Token價格為3.75美元(約合人民幣25.

28元),均為Gemini 3.6 Flash最初價格的一半。2027年1月1日起,兩項價格將分別恢復至1.50美元(約合人民幣10.11元)和7.50美元(約合人民幣50.55元)。除了向開發者和企業開放,Gemini 3.7 Flash還將成為谷歌個人AI Agent Gemini Spark的新底座,幫助用戶跨Gmail、Google日曆、Google文檔等應用執行多步驟任務。一、編程任務提升明顯,知識密集型領域準確性提高 與Gemini 3.6 Flash相比,Gemini 3.7 Flash在排查故障、解決問題等編程任務上的表現明顯提升。

其首次生成結果的準確率更高,生成可直接用於生產環境的程序時也有更好表現。在FrontierCode 1.1 Main測試中,Gemini 3.7 Flash得分為43.6%,與Claude Sonnet 5和GPT-5.6 Terra得分近似,領先Gemini 3.6 Flash的34.4%;在DeepSWE v1.1測試中,Gemini 3.7 Flash的成績為65.3%,略低於GPT-5.6 Terra的69.6%。▲Gemini 3.7 Flash的編程能力(圖源:谷歌) 網頁開發方面,Gemini 3.7 Flash能用更少的提示,生成實用性更強的頁面佈局和功能較完整的應用。

在根據截圖、圖片或完整設計系統生成UI(交互界面)時,新模型對參考設計的遵循和還原能力也有所提升。在Arena.ai的WebDev Arena測試中,Gemini 3.7 Flash的Elo得分為1588,領先Claude Sonnet 5、GPT-5.6 Terra和Muse Spark 1.2。▲Gemini 3.7 Flash的網頁開發能力(圖源:谷歌) 在金融、法律和生物科學等知識密集型領域,Gemini 3.7 Flash的推理能力和準確性同樣有所提高。在用於測試複雜文檔處理能力的GDP.pdf基準中,新模型取得34.0%的成績,高於上一代的22.

0%;在企業工作流測試AutomationBench中,其成績由17.0%升至30.4%。▲Gemini 3.7 Flash的複雜文檔處理能力及企業工作能力(圖源:谷歌) 谷歌還展示了多項應用案例:Gemini 3.7 Flash配合Nano Banana,可以根據一段文本提示,生成畫面精緻、可玩性高的3D遊戲。▲3D遊戲案例(圖源:谷歌) 模型還可以調用子Agent,配合Gemini Omni生成帶有交互式組件的落地網頁。▲交互網頁案例(圖源:谷歌) 二、執行多步驟任務更穩,年內半價優惠 谷歌稱,與Gemini 3.6 Flash相比,Gemini 3.

7 Flash能夠更好地適應任務執行過程中遇到的障礙,在必要時確認用戶意圖,並更嚴格地遵循指令。新模型會投入更多計算完成多步驟規劃和工具調用,更有條理的執行方式可以減少工程工作流中的人工監督和重複嘗試。2026年年底前,Gemini 3.7 Flash每百萬輸入Token的價格為0.75美元(約合人民幣5.06元),每百萬輸出Token的價格為3.75美元(約合人民幣25.28元)。谷歌稱,早期客戶反饋認為,Gemini 3.7 Flash在保持較低成本的同時,性能和準確性均明顯優於Gemini 3.6 Flash。

Databricks AI研究經理伊萬·周(Ivan Zhou)說:“過去,要規模化地從複雜的企業數據中獲得高質量答案,成本一直很高,Gemini 3.7 Flash等模型正在改變這一狀況。通過Databricks AI Gateway接入Gemini 3.7 Flash後,企業能以更低成本預測營收、識別關鍵客戶並制定投資決策。” 三、Gemini Spark換用新模型,可跨Workspace執行任務 谷歌同步宣佈,Gemini Spark從發佈當日起開始使用Gemini 3.7 Flash。

Spark是谷歌在I/O大會上推出的個人AI Agent,能夠全天候運行,並在用戶指示和監督下代為執行任務。換用新模型後,Spark將增強對Google Workspace應用的工具調用能力,重點改善需要多項技能配合的複雜工作流。用戶可以讓它整合不同文件中的信息、起草郵件、更新項目狀態文檔,並把初步想法轉化為具體操作。目前,Spark面向160多個國家和地區的Google AI Pro及Ultra訂閱用戶提供。個人用戶則可以在支持Gemini Spark的國家和地區,通過Google AI Pro或Ultra訂閱使用Gemini 3.

7 Flash;開發者可通過Google Antigravity、Gemini API、Google AI Studio和Android Studio使用新模型;企業客戶則可從Gemini Enterprise Agent Platform及Gemini Enterprise應用接入。結語:月活突破10億,Gemini更新提速 近期,Gemini應用月活躍用戶突破10億。短短三週內連發兩代Flash模型、限時降低調用價格,並將新模型接入Gemini Spark,反映出谷歌正在加快Gemini模型的迭代,並繼續拓展其在Agent和Workspace工作流中的應用。

產品提速的同時,谷歌AI團隊上週經歷了重要人事調整:德米斯·哈薩比斯卸任谷歌DeepMind CEO,轉任董事長;傑夫·迪恩等4名核心AI人員離職創業。未來,Gemini能否在組織調整中保持模型迭代速度,並將性能、成本和產品入口優勢轉化為穩定的Agent體驗,值得持續關注。來源:谷歌

Related

相關文章

鈦媒體生成式AI

偷書要賠15億美元,AI巨頭燒幾百萬本書反而合法了

偷書要賠15億美元,AI巨頭燒幾百萬本書反而合法了藍字計劃2026.08.24 18:01 · 來自廣東全文4120字00:00 / 11:49只要能訓練出更好的大模型,究竟要銷燬多少本實體書,甚至在實體書之外還會消耗多少前AI時代的“資產”,也許就再也沒人關心了。文 | 藍字計劃,作者|Chester一場現代版的“焚書”,正在美國發生。最近幾年,美國二手書市場出現了一個奇怪現象:不少神秘買家,一次性採購成百上千本書,不挑書、不問價,甚至連冷門舊書都照買不誤。隨著電子閱讀的普及,現在還有多少人看實體書?更別說這種成百上千的掃貨始買書。書商們自然也開始好奇:究竟是誰在買走這批書?最近,美國科技媒體404 Media聯繫到一名二手書商。對方剛剛通過書籍交易平臺Biblio,接到了一筆大約1000本舊書的訂單,其中還包括不少稀有、絕版和具有收藏價值的書。為了找出背後的買家,404 Media把一枚AirTag塞進其中一本書裡,然後一路追蹤。最終,這本書被送進了亞馬遜位於拉斯維加斯的一家倉庫。據404 Media調查,這些書到了亞馬遜倉庫後,命運卻只有三步:切掉書脊、批量掃描、然後扔進碎紙機。負責這項工作的VGT3團隊,甚至還給自己設計了一個頗為應景的Logo:一隻露著牙齒、手裡抓著書的霸王龍。 自己也賣書的亞馬遜卻幹起了銷燬實體書的活已經夠驚奇了,但更驚奇的是同樣這樣乾的,不只有亞馬遜。在更早之前,Anthropic就被曝光過一個代號為“巴拿馬計劃”的秘密項目。他們的目標,是把全世界的書都“破壞性掃描”一遍。在大約一年時間裡,Anthropic為此花費數千萬美元,買下數百萬本實體書,然後切掉書脊、掃描內容,再把剩下的紙張送去回收。美國的AI大公司,怎麼就和舊書幹上了?互聯網內容,不夠AI用了AI公司瘋狂買二手書,其實是想買下書裡的內容和數據。過去,互聯網是大模型最方便的數據來源。

剛剛
量子位生成式AI

阿里視頻大模型Wan3.0正式上線,行業評價“穩定、真實、有質感”

阿里巴巴影片生成大模型Wan3.0正式上線,單次可生成30秒影片,並首次支援doc、xls、ppt、pdf、md等文檔輸入。企業用戶普遍評價其「穩定、真實、有質感」,能穩定保持角色與場景一致性,並已進入短劇、影視、廣告等生產流程。即日起可於阿里雲百鍊、千問等平台體驗,標準版並推出限時7折優惠。

剛剛
IT之家生成式AI

阿里雲視頻生成模型 Wan3.0 正式上線,支持單次生成 30 秒視頻、文檔輸入

作者:遠洋 責編:遠洋 評論: 8 月 24 日消息,阿里雲消息,今天,視頻生成模型 Wan3.0 正式上線。官方稱,Wan3.0 在生成時長、萬能創作、全能參考以及真實世界還原等維度全面升級,單次可生成 30 秒視頻,並首次支持 doc、xls、ppt、pdf、md 等文檔格式輸入,力求準確還原真實世界。

剛剛