新模靠邊站,谷歌Gemini 4要來了,公司史上最大煉模啟動

重點摘要
新模靠邊站,谷歌Gemini 4要來了,公司史上最大煉模啟動智東西·2026年07月22日 15:09Gemini 3. 智東西7月22日消息,今天凌晨,谷歌發佈Gemini 3. 5 Flash-Lite和Gemini 3. 5 Flash Cyber三款模型,重點提升Agent工作流所需的Token效率、響應速度和運行可靠性。 5 Flash-Lite和Gemini 3.
谷歌今日凌晨正式發表新一代Gemini 3.5系列模型,一次推出Gemini 3.5 Flash-Lite與Gemini 3.5 Flash Cyber兩款產品,同步將焦點對準Agent工作流程所需的效率與穩定性。這波更新並非單純追求參數規模或問答表現,而是針對企業與開發者實際部署AI代理時最在意的Token成本、回應速度與運行可靠度進行強化,意圖在日益激烈的AI競賽中,以更務實的角度切入商業應用場景。其中,Gemini 3.
5 Flash定位為多模態任務與程式開發的主力模型,在第三方評測機構Artificial Analysis發布的Intelligence Index(智力指數)中,其任務Token消耗量相較前一代3.5 Flash減少17%,顯示在維持相近智慧水準的前提下,模型處理相同任務所需消耗的計算資源顯著下降。更值得注意的是,在DeepSWE這項針對軟體工程代理能力的測試中,Gemini 3.5 Flash的輸出Token消耗最多可減少約65%,代表開發者在執行複雜程式碼生成或除錯任務時,能以更低的成本獲得相同甚至更佳的結果,這對長期依賴大型語言模型進行自動化開發的團隊而言,無疑是一項重大利好。
另一款備受關注的產品是Gemini 3.5 Flash-Lite,主打低延遲與高吞吐量特性,其生成速度達到每秒350個輸出Token,在即時互動或大量資料處理的Agent工作流中,能有效縮短回應等待時間,提升整體作業效率。據谷歌官方說法,這款輕量級模型在Agent工作流程中的表現,相較於前一代的Flash-Lite模型有相當程度的提升,特別是在需要頻繁呼叫工具、串接多步驟任務的場景中,其穩定度與反應速度都更符合實際營運需求。從技術演進的角度來看,這次更新反映出谷歌對AI代理市場的深刻理解與戰略布局。
過去幾年,大型語言模型的競賽重點多在於模型規模與基準測試分數,但隨著應用場景逐漸從單純的對話問答轉向複雜任務執行,開發者與企業用戶真正面臨的痛點已經轉移到成本控制與效率最佳化。Gemini 3.5系列針對Token消耗進行最佳化,正是回應了這項市場需求,讓AI代理不再只是實驗室中的展示品,而是能真正落地到生產環境中的實用工具。值得注意的是,此次推出的兩款模型在命名上延續了「Flash」系列一貫的輕量、快速定位,但功能上卻更進一步貼近企業級應用。Gemini 3.
5 Flash Cyber的名稱中「Cyber」一詞,暗示其可能強化了與網路安全或數位基礎設施相關的任務能力,雖然谷歌並未在發布聲明中詳細說明這款模型的特殊應用場景,但從命名邏輯與當前市場對AI安全防護的需求來看,這款模型很可能針對資安監控、威脅偵測或自動化防禦系統等領域進行了特別調校,為企業提供更可靠的AI守護機制。從產業角度觀察,谷歌此次發布的時機點也相當耐人尋味。當前AI市場正處於競爭白熱化階段,OpenAI、Meta、Anthropic等業者紛紛推出新一代模型,各家在效能與成本之間尋找平衡點。
谷歌選擇在此時強化Gemini系列的Agent能力,顯然是希望藉由降低Token消耗與提升回應速度這兩大優勢,吸引更多開發者投身其生態系。尤其對於新創團隊與中小型企業而言,模型使用成本往往是能否導入AI的關鍵門檻,Gemini 3.5系列在成本效益上的突破,可望成為打開市場的關鍵鑰匙。此外,這次模型更新也凸顯出Agent工作流已成為AI產業下一階段的核心戰場。所謂Agent工作流,指的是讓AI模型具備自主規劃、工具調用與多步驟任務執行的能力,進而模擬人類處理複雜事務的流程。
谷歌此次特別強調兩款模型在Token效率與回應速度上的表現,正是為了讓AI代理在實際運行時能更流暢、更省錢,這對推動AI從「回答問題」邁向「完成任務」的關鍵轉變具有重要意義。從數據面來看,Gemini 3.5 Flash-Lite的每秒350個輸出Token生成速度,在目前市場同級產品中已屬前段班表現。這意味著在處理大量文字生成、資料摘要或客服自動回覆等場景時,模型能以近乎即時的速度產出內容,大幅縮短用戶等待時間。而Gemini 3.
5 Flash在DeepSWE測試中輸出Token消耗減少65%的成就,則直接回應了軟體開發領域對AI輔助工具成本敏感的痛點,讓AI程式設計助手能更普及地融入日常開發流程。谷歌這次的發布雖然沒有伴隨大型旗艦模型的震撼登場,但卻以更貼近實際應用的方式,展現了其對AI市場需求的細膩觀察。在企業用戶日益重視投資報酬率的當下,單純追求模型「聰明」已不足以滿足市場需求,如何在有限預算下發揮最大效能,才是企業導入AI時最關心的課題。Gemini 3.5系列的推出,正是谷歌針對這項需求給出的具體解答。展望未來,隨著Gemini 3.
5系列正式上線,開發者將能透過Google AI Studio或Vertex AI等平台取用這些新模型,並應用於各種Agent開發專案中。可以預期的是,這波更新將帶動更多企業級AI應用的誕生,進一步加速AI代理在各行各業的滲透速度。而谷歌能否藉此在與對手的競爭中拉開差距,後續市場反應將是關鍵觀察指標。
Related
相關文章

曝字節訓10億參數大模型,或超Mythos 5,張一鳴、梁汝波先後發聲
字節跳動正在訓練一個參數量高達10萬億的AI模型,規模可能超越Anthropic的Mythos 5。創辦人張一鳴在內部會議中強調編程的關鍵地位,並反對模型蒸餾,認為這只能複製而非超越對手。字節跳動在AI領域持續加大投入,同時在產品端與訓練端採取雙線進攻策略。

AI 需求擠爆雲計算,消息稱 AWS 要求工程師關閉閒置服務器減少資源浪費
因AI需求導致算力緊缺,亞馬遜AWS要求工程師關閉閒置的EC2實例,以減少資源浪費。數據顯示約65%的EC2實例在30天內平均CPU利用率低於20%,AWS因此升級計算優化器自動標記低使用率虛擬機。此外,AWS過去一年新增3.8吉瓦電力容量,仍難以應對GPU雲端實例的龐大需求。

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌
六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

DeepSeek重啟融資,三年市值對齊騰訊?
DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

可靈AI核心技術骨幹王鑫濤被曝離職
快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了
2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。