全天候科技生成式AI

谷歌推出Gemini 3.6 Flash,3.5 Flash-LITE,以及3.5 Flash Cyber

2026年7月21日 23:19
谷歌推出Gemini 3.6 Flash,3.5 Flash-LITE,以及3.5 Flash Cyber

重點摘要

谷歌AI突然“開火”:三款Gemini模型齊發,最高降價近七成,旗艦3.5 Pro仍難產 李丹 發表於 2026年07月21日 15:19 摘要:Gemini 3.6 Flash主打代碼、知識工作和多模態任務,在減少輸出Token消耗的同時,價格也低於上一代;Gemini 3.5 Flash-Lite瞄準高吞吐、低延遲場景;Gemini 3.

站內 AI 整理稿

谷歌在美東時間7月21日宣布一次推出三款Gemini系列模型,分別是Gemini 3.6 Flash、Gemini 3.5 Flash-Lite以及專攻網路安全的Gemini 3.5 Flash Cyber。這波更新並非單純以更強模型取代舊版,而是把焦點轉向更便宜、更快、更適合大規模部署的AI智能體,回應企業客戶對推理成本與Token效率日益增加的重視。 Gemini 3.6 Flash被定位為「工作馬」模型,強化程式碼編寫、知識工作與多模態任務。根據谷歌公布的數據,相較於3.5 Flash,3.6 Flash在輸出Token消耗上減少約17%,同時完成多步驟工作流所需的推理步驟與工具調用次數也降低。這對需要長時間運行、反覆呼叫工具的AI智能體而言,整體任務的計算量有望縮減,而不只是單純按Token價格降價。價格方面,3.6 Flash的輸入價格為每百萬Token 1.5美元,輸出價格為每百萬Token 7.5美元,低於3.5 Flash原本的9美元輸出價。效能測試也顯示明顯進步:DeepSWE從37%拉升至49%,MLE Bench從49.7%升至63.9%,OSWorld-Verified從78.4%提升至83%,GDPval-AA v2則從1349分增至1421分。谷歌強調,3.6 Flash能減少不必要的程式碼修改與執行循環,產出更接近生產環境的高品質程式碼,這正是當前AI模型競爭從單純追求高分轉向「單位智能成本」的縮影。 第二款模型Gemini 3.5 Flash-Lite則瞄準高吞吐量、低延遲的規模化應用場景。谷歌將其定位為3.5系列中速度最快、成本效率最高的模型,特別適用於智慧搜尋、文件處理等大量重複性任務。根據Artificial Analysis的數據,Flash-Lite的輸出速度達到每秒350個Token,定價更是大幅下探:輸入每百萬Token 0.30美元,輸出每百萬Token 2.50美元。這讓開發者可以用更便宜的模型處理海量請求,而不必讓昂貴的旗艦模型負擔所有工作。測試成績方面,Flash-Lite在Terminal-Bench 2.1從31%提升至54%,GDM-MRCR v2從60.1%升至72.2%,GDPval-AA v2則從642分躍升至1140分。更值得注意的是,谷歌指出Flash-Lite在SWE-Bench Pro與OSWorld-Verified等測試中甚至超越了高一階的Gemini 3 Flash,反映出未來AI應用可能由多個不同成本、不同能力的模型協同運作,而非單一超級模型包辦所有任務。 第三款模型Gemini 3.5 Flash Cyber最具戰略意義,專為發現、驗證與修復程式碼安全漏洞而設計,並與谷歌的CodeMender程式碼安全智能體搭配使用。在CodeMender體系中,多個Flash Cyber智能體可協同工作,產出綜合安全報告。谷歌表示,Flash Cyber的目標是在低於大型模型的每Token成本下,實現具競爭力的網路安全能力。隨著AI生成程式碼的速度越來越快,企業面臨安全審查跟不上生產速度的困境,這類自動化安全工具需求快速升溫。谷歌將Flash Cyber與CodeMender結合,試圖打造低成本、可規模化的自動化防禦系統。由於網路安全AI具有雙重用途屬性,Flash Cyber初期僅透過有限訪問試點向政府與受信任合作夥伴提供,不直接全面開放。 儘管谷歌一口氣推出三款新模型,但市場最期待的旗艦模型Gemini 3.5 Pro仍然缺席。該模型原定於今年6月發布,目前仍處於與合作夥伴測試階段。路透社引述知情人士說法指出,Gemini 3.5 Pro延期的關鍵原因在於內部測試中,尤其程式碼任務的表現未達預期。程式碼能力正是當前企業AI市場成長最快、商業價值最高的應用場景之一,這也解釋了為何谷歌在旗艦缺陣的情況下,選擇繼續加碼Flash系列,以迅速覆蓋開發者與企業客戶,同時透過更低價格擴大Gemini模型的實際調用量。 在競爭格局上,谷歌正面臨Anthropic與OpenAI的壓力。Anthropic近期推出更強大的Mythos 5與Fable 5模型,OpenAI也發布了GPT-5.6,其中Anthropic最新模型的網路安全能力尤其受到關注。谷歌此次推出Flash Cyber,也是在試圖證明企業不一定需要動用最昂貴、最大的模型,就能完成大部分漏洞檢測與修復任務,從而降低AI安全工具的部署成本。 Alphabet執行長皮查伊先前曾強調,企業若將大部分AI工作負載轉移至Gemini模型,每年可能節省超過10億美元。谷歌近期持續強調Gemini模型的成本優勢,但從競爭態勢來看,去年Gemini 3系列發布時曾讓谷歌重回第一梯隊,甚至迫使OpenAI內部發出「紅色警報」,然而隨後Anthropic與OpenAI繼續推出更強模型,谷歌的旗艦產品卻出現延期。如今,谷歌的戰略明顯分層:Gemini 3.6 Flash負責效率,Flash-Lite負責規模,Flash Cyber負責垂直場景,而Gemini 3.5 Pro則承擔重新證明頂級模型能力的任務。 更大的懸念在於Gemini 4。谷歌此次透露,Gemini 4已啟動「迄今最雄心勃勃的預訓練工作」,顯示谷歌正在一邊修補Gemini 3.5 Pro的延期問題,一邊加速下一代旗艦模型的研發。對於Alphabet而言,真正的考驗已不只是能否發布更強的模型,而是能否同時解決模型能力追上對手、成本足夠低,以及AI模型能否真正轉化為搜尋、雲端運算與企業軟體業務的收入增長。從這三款新模型的發布來看,谷歌正將「更強模型」的競爭進一步轉向「更高性價比的AI基礎設施」競爭。但在Gemini 3.5 Pro正式亮相之前,市場恐怕仍會持續追問:谷歌能否再次拿出一個足以改變AI競爭格局的旗艦模型。

Related

相關文章

Google要把AI大模型「刻」進芯片裡

Google正推動將大型AI模型直接固化在晶片硬體層級,以減少對外部記憶體與頻寬的依賴。此技術若成真,可大幅降低推論階段的延遲與功耗,對大規模部署生成式AI服務極具戰略意義。

剛剛

AI獨角獸創始人最新判斷:90%企業AI場景,已經不需要最強模型

AI獨角獸Glean創辦人指出,目前超過九成企業AI應用場景不需使用最強模型,開源模型已能滿足多數需求。企業導入AI的真正瓶頸在於上下文工程,而非模型能力,模型商品化將使價值轉向應用層。應用公司應深入客戶核心工作流程,不必過度擔心模型廠商直接競爭。

剛剛

WAIC觀點:最快兩年,迎來機器人“ChatGPT時刻”

在2026世界人工智能大會上,具身智能企業聚焦機器人真實場景落地,業界認為最快兩年內將迎來機器人「ChatGPT時刻」。然而,訓練世界模型仍面臨數據、表徵與閉環三大挑戰,各企業在數據來源與模型架構上各有不同策略。

36 分鐘前
鈦媒體生成式AI

印奇的手機,階躍星辰的賭局

根據鈦媒體的報導,印奇的手機業務與階躍星辰的賭局成為近期科技圈的討論焦點。印奇作為曠視科技的創始人,其跨足手機領域的動作引發市場關注;而階躍星辰則被報導描述為在一場AI技術的賭局中下注。報導聚焦於兩者之間的戰略關聯與市場風險,但目前僅能從標題中窺見其核心方向,具體的產品細節、合作夥伴及定價策略等資訊尚未完整揭露。

36 分鐘前

在下一個模型發佈之前

賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機。

1 小時前