全天候科技生成式AI

谷歌推出Gemini 3.6 Flash,3.5 Flash-LITE,以及3.5 Flash Cyber

2026年7月21日 23:19
谷歌推出Gemini 3.6 Flash,3.5 Flash-LITE,以及3.5 Flash Cyber

重點摘要

谷歌AI突然“開火”:三款Gemini模型齊發,最高降價近七成,旗艦3.5 Pro仍難產 李丹 發表於 2026年07月21日 15:19 摘要:Gemini 3.6 Flash主打代碼、知識工作和多模態任務,在減少輸出Token消耗的同時,價格也低於上一代;Gemini 3.5 Flash-Lite瞄準高吞吐、低延遲場景;Gemini 3.

站內 AI 整理稿

谷歌在美東時間7月21日宣布一次推出三款Gemini系列模型,分別是Gemini 3.6 Flash、Gemini 3.5 Flash-Lite以及專攻網路安全的Gemini 3.5 Flash Cyber。這波更新並非單純以更強模型取代舊版,而是把焦點轉向更便宜、更快、更適合大規模部署的AI智能體,回應企業客戶對推理成本與Token效率日益增加的重視。Gemini 3.6 Flash被定位為「工作馬」模型,強化程式碼編寫、知識工作與多模態任務。根據谷歌公布的數據,相較於3.5 Flash,3.

6 Flash在輸出Token消耗上減少約17%,同時完成多步驟工作流所需的推理步驟與工具調用次數也降低。這對需要長時間運行、反覆呼叫工具的AI智能體而言,整體任務的計算量有望縮減,而不只是單純按Token價格降價。價格方面,3.6 Flash的輸入價格為每百萬Token 1.5美元,輸出價格為每百萬Token 7.5美元,低於3.5 Flash原本的9美元輸出價。效能測試也顯示明顯進步:DeepSWE從37%拉升至49%,MLE Bench從49.7%升至63.9%,OSWorld-Verified從78.4%提升至83%,GDPval-AA v2則從1349分增至1421分。谷歌強調,3.

6 Flash能減少不必要的程式碼修改與執行循環,產出更接近生產環境的高品質程式碼,這正是當前AI模型競爭從單純追求高分轉向「單位智能成本」的縮影。第二款模型Gemini 3.5 Flash-Lite則瞄準高吞吐量、低延遲的規模化應用場景。谷歌將其定位為3.5系列中速度最快、成本效率最高的模型,特別適用於智慧搜尋、文件處理等大量重複性任務。根據Artificial Analysis的數據,Flash-Lite的輸出速度達到每秒350個Token,定價更是大幅下探:輸入每百萬Token 0.30美元,輸出每百萬Token 2.50美元。

這讓開發者可以用更便宜的模型處理海量請求,而不必讓昂貴的旗艦模型負擔所有工作。測試成績方面,Flash-Lite在Terminal-Bench 2.1從31%提升至54%,GDM-MRCR v2從60.1%升至72.2%,GDPval-AA v2則從642分躍升至1140分。更值得注意的是,谷歌指出Flash-Lite在SWE-Bench Pro與OSWorld-Verified等測試中甚至超越了高一階的Gemini 3 Flash,反映出未來AI應用可能由多個不同成本、不同能力的模型協同運作,而非單一超級模型包辦所有任務。第三款模型Gemini 3.

5 Flash Cyber最具戰略意義,專為發現、驗證與修復程式碼安全漏洞而設計,並與谷歌的CodeMender程式碼安全智能體搭配使用。在CodeMender體系中,多個Flash Cyber智能體可協同工作,產出綜合安全報告。谷歌表示,Flash Cyber的目標是在低於大型模型的每Token成本下,實現具競爭力的網路安全能力。隨著AI生成程式碼的速度越來越快,企業面臨安全審查跟不上生產速度的困境,這類自動化安全工具需求快速升溫。谷歌將Flash Cyber與CodeMender結合,試圖打造低成本、可規模化的自動化防禦系統。

由於網路安全AI具有雙重用途屬性,Flash Cyber初期僅透過有限訪問試點向政府與受信任合作夥伴提供,不直接全面開放。儘管谷歌一口氣推出三款新模型,但市場最期待的旗艦模型Gemini 3.5 Pro仍然缺席。該模型原定於今年6月發布,目前仍處於與合作夥伴測試階段。路透社引述知情人士說法指出,Gemini 3.5 Pro延期的關鍵原因在於內部測試中,尤其程式碼任務的表現未達預期。程式碼能力正是當前企業AI市場成長最快、商業價值最高的應用場景之一,這也解釋了為何谷歌在旗艦缺陣的情況下,選擇繼續加碼Flash系列,以迅速覆蓋開發者與企業客戶,同時透過更低價格擴大Gemini模型的實際調用量。

在競爭格局上,谷歌正面臨Anthropic與OpenAI的壓力。Anthropic近期推出更強大的Mythos 5與Fable 5模型,OpenAI也發布了GPT-5.6,其中Anthropic最新模型的網路安全能力尤其受到關注。谷歌此次推出Flash Cyber,也是在試圖證明企業不一定需要動用最昂貴、最大的模型,就能完成大部分漏洞檢測與修復任務,從而降低AI安全工具的部署成本。Alphabet執行長皮查伊先前曾強調,企業若將大部分AI工作負載轉移至Gemini模型,每年可能節省超過10億美元。

谷歌近期持續強調Gemini模型的成本優勢,但從競爭態勢來看,去年Gemini 3系列發布時曾讓谷歌重回第一梯隊,甚至迫使OpenAI內部發出「紅色警報」,然而隨後Anthropic與OpenAI繼續推出更強模型,谷歌的旗艦產品卻出現延期。如今,谷歌的戰略明顯分層:Gemini 3.6 Flash負責效率,Flash-Lite負責規模,Flash Cyber負責垂直場景,而Gemini 3.5 Pro則承擔重新證明頂級模型能力的任務。更大的懸念在於Gemini 4。谷歌此次透露,Gemini 4已啟動「迄今最雄心勃勃的預訓練工作」,顯示谷歌正在一邊修補Gemini 3.

5 Pro的延期問題,一邊加速下一代旗艦模型的研發。對於Alphabet而言,真正的考驗已不只是能否發布更強的模型,而是能否同時解決模型能力追上對手、成本足夠低,以及AI模型能否真正轉化為搜尋、雲端運算與企業軟體業務的收入增長。從這三款新模型的發布來看,谷歌正將「更強模型」的競爭進一步轉向「更高性價比的AI基礎設施」競爭。但在Gemini 3.5 Pro正式亮相之前,市場恐怕仍會持續追問:谷歌能否再次拿出一個足以改變AI競爭格局的旗艦模型。

Related

相關文章

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

1 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

2 小時前

可靈AI核心技術骨幹王鑫濤被曝離職

快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

2 小時前

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了

2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。

2 小時前