智東西模型更新

新模靠邊站,谷歌Gemini 4要來了!公司史上最大煉模啟動

2026年7月22日 01:48

重點摘要

智東西 編譯 | 楊京麗 編輯 | 李水青 智東西7月22日消息,今天凌晨,谷歌發佈Gemini 3.6 Flash、Gemini 3.5 Flash-Lite和Gemini 3.5 Flash Cyber三款模型,重點提升Agent工作流所需的Token效率、響應速度和運行可靠性。 ▲谷歌發佈Gemini 3.6 Flash、Gemini 3.5 Flash-Lite和Gemini 3.

站內 AI 整理稿

谷歌在台灣時間7月22日凌晨發布了一系列全新模型,包括Gemini 3.5 Flash-Lite、Gemini 3.5 Flash Cyber,以及一款專為特定任務設計的Gemini 3.6 Flash。這三款模型的核心目標是針對Agent工作流程進行深度優化,重點提升Token效率、響應速度與運行可靠性,為開發者與企業用戶提供更強大的AI工具。Gemini 3.6 Flash主要鎖定程式編寫、知識密集型工作與多模態任務。

根據第三方評測機構Artificial Analysis公布的Intelligence Index(智力指數),這款模型在執行任務時,Token消耗量相較於前一代的Gemini 3.5 Flash減少了約17%。在DeepSWE測試中,輸出Token的消耗量甚至最多可降低約65%,顯示其在資源利用效率上有顯著進步。對於需要大量推理與程式碼生成的應用場景,這項改進能有效降低運算成本並提升回應速度。另一款模型Gemini 3.5 Flash-Lite則主打低延遲與高吞吐量。它的生成速度可達每秒350個輸出Token,在處理Agent工作流時,相較於前代的Flash-Lite模型,效能也有明顯提升。

這使得該模型非常適合需要即時互動與大量併發請求的應用,例如客服機器人、即時數據分析或是自動化流程中的快速決策。至於Gemini 3.5 Flash Cyber,則是一款專為網路安全領域設計的模型。它的主要功能是自動發現與修復系統中的安全漏洞。當這款模型與CodeMender代碼安全Agent搭配使用時,其表現已達到當前前沿模型的競爭水準,能夠與Mythos 5、GPT-5等頂尖模型在安全檢測任務中一較高下。這對於企業應對日益複雜的資安威脅,提供了一條更自動化、更即時的防護路徑。這三款新模型的發布,標誌著谷歌在AI模型發展上持續推進,尤其是針對Agent工作流的專門最佳化。

Agent工作流指的是讓AI模型能夠自主執行多步驟任務,例如自動撰寫程式碼、修復錯誤、回應查詢,甚至主動發現系統漏洞。過去這類任務往往需要大量的Token消耗與較長的處理時間,而谷歌此次推出的模型正是為了克服這些瓶頸,讓AI在實際應用中更有效率、更可靠。值得注意的是,Gemini 3.6 Flash的命名跳脫了原本的「3.5」系列,顯示谷歌可能正在為下一階段的重大更新鋪路。業界普遍預期,谷歌正在研發的下一代旗艦模型Gemini 4,將是公司史上規模最大的煉模計畫。

雖然目前官方尚未公布Gemini 4的具體細節,但從此次發布的模型專注於效率與特定任務來看,可以推測谷歌正在累積關鍵技術,為後續的超大規模模型奠定基礎。在競爭激烈的AI領域,谷歌的對手如OpenAI、Anthropic等公司也持續推出新模型,各自在速度、成本、多模態能力等方面展開競賽。谷歌此次選擇從Agent工作流切入,著重於降低Token消耗與提升實用性,可能是為了在企業級應用市場中佔據優勢。對於開發者與企業而言,更低的運算成本與更快的反應速度,意味著AI可以更廣泛地嵌入日常業務流程,而不僅止於實驗階段。此外,Gemini 3.

5 Flash Cyber的推出,也反映出AI在資安領域的應用潛力正快速擴張。傳統的漏洞掃描與修復往往需要大量人力與時間,而具備自動化能力的AI模型,可以大幅縮短從發現漏洞到修補完成的週期。這對於金融、醫療、政府等高度重視安全的行業,無疑是一項重要的技術進展。總體而言,谷歌此次發布的三款新模型,雖然並非震撼市場的旗艦產品,但在效率與專門化上的精進,顯示出該公司正以務實的態度推進AI落地。隨著Gemini 4的傳聞逐漸升溫,這些新模型或許只是前奏,真正的重頭戲還在前方。業界將密切關注谷歌下一步的動作,以及這些技術如何最終整合到下一代模型中,為使用者帶來更強大的AI體驗。

Related

相關文章

拆解“AI辦公入口戰”底層:怎麼做才能成為最終贏家?

字節、阿里、騰訊等大廠正透過組織調整與產品整合,全力爭奪AI辦公入口,關鍵在於模型、場景、生態與商業體系的全面競爭。這場戰爭的核心是透過AI產品實現Token經濟的商業閉環,並以「效果」為標準,透過自有體系與外部生態滿足企業用戶的真實需求。最終贏家需兼顧模型能力、場景積累與生態建設,才能在AI生產力時代站穩腳步。

2 小時前

千人聯機世界模型“RhOS-World: Khora”正式發佈

RhOS.ai與Ophilus.AI共同發布了千人聯機世界模型「RhOS-World: Khora」,該模型能讓多達1024個智能體在共享的3D空間中即時互動,且無需傳統物理引擎。其核心技術「STBoard(時空黑板)」架構,透過統一的物理狀態管理,解決了多視角一致性的難題,並大幅降低了擴展智能體數量的運算成本。

2 小時前
Hugging Face Blog模型更新

TutorMoments:AI 家教何時該出手,何時該放手?

今日我們推出 TutorMoments 預覽版,這是一個評估框架,旨在衡量尖端大型語言模型能否掌握教育中最難的平衡:何時介入協助學生,何時退後讓學生自行努力。TutorMoments 基於真實的一對一數學輔導課程,透過重播方式進行評估。經驗豐富的數學教師會檢視從美國收集的對話記錄。

3 小時前