IT之家生成式AI

消息稱谷歌旗艦 AI 模型 Gemini 3.5 Pro 已延期數月,技術表現未達目標

2026年7月17日 07:57
消息稱谷歌旗艦 AI 模型 Gemini 3.5 Pro 已延期數月,技術表現未達目標

重點摘要

谷歌旗艦AI模型Gemini 3.5 Pro已延期數月,主因是編程能力未達內部目標。內部員工不滿進度,擔心落後於Anthropic與OpenAI等競爭對手。此外,谷歌內部協調與安全政策也在拖慢模型推出時程。

站內 AI 整理稿

根據彭博社報導,谷歌旗下最頂尖的旗艦 AI 模型 Gemini 3.5 Pro 已延遲推出長達數月,主要原因在於公司希望進一步提升該模型的整體性能,特別是在程式碼編寫方面的表現尚未達到內部預期。這項消息由多位知情人士於今日(7月17日)對外透露,引發業界關注。這款被視為谷歌在人工智慧領域最強武器的模型,原訂時程早已過去,但至今仍未正式對外發布。內部知情人士指出,延遲的原因不僅是技術瓶頸,更牽涉到公司內部複雜的組織協調問題。谷歌在推出任何模型之前,必須先整合旗下龐大的產品生態系,包括搜尋引擎、地圖服務、YouTube 等,如何將 AI 能力無縫接入這些服務,成為拖慢進度的關鍵因素之一。

十名現任及前任員工向媒體表示,長期的延宕已經在工程師、AI 研究人員與管理層之間引發明顯不滿。外部競爭壓力持續升高,Anthropic 與 OpenAI 接連推出性能超越 Gemini 系列的新模型,使得部分員工擔憂谷歌正在失去在 AI 市場的領先地位,尤其在新一代模型的能力競賽中,差距可能越拉越大。在技術層面,編程能力是此次延遲的核心痛點。據了解,上個月下旬谷歌曾更換 Gemini 的部分訓練數據,試圖藉此改善模型的程式碼生成與理解能力,但測試結果依然不如預期。與此同時,OpenAI 與 Meta 近期發布的新模型在 AI 輔助編程方面展現出更強的實力,進一步凸顯了谷歌現有產品的劣勢。

針對外界質疑,谷歌發言人回應表示,公司目前正與美國政府就模型能力與 AI 行業安全標準進行討論,並強調政府已加強對各家最先進模型的審查。「我們正迅速推出多種模型,同時維持對客戶而言很高的成本效益。目前我們正與合作夥伴測試 Gemini 3.5 Pro、升級版 Flash 以及其他模型,並與美國政府就模型測試及更廣泛的監管框架進行富有成效的溝通。」

內部派系鬥爭也成為阻礙進展的另一大因素。兩名前員工透露,谷歌聯合創始人謝爾蓋·布林等人主張加快 AI 編程產品的開發腳步,試圖搶佔市場先機;然而公司內部不同團隊之間爭奪主導權的情況相當嚴重,導致決策與執行進度遲遲無法推展。包括 Google Cloud、DeepMind 與安卓團隊在內的多個部門,都在開發針對程式設計師的 AI 編程工具,部分消費者產品團隊也涉入其中,資源與權責無法有效統合。此外,谷歌內部還存在一批立場較為保守的工程師,他們認為重要的程式碼必須完全由人類編寫,才能達到谷歌一貫的高標準。

這種觀念在 AI 技術推廣初期更加明顯,公司甚至一度限制員工使用 Gemini 來編寫或分析軟體,主要擔心內部專有程式碼可能流入模型訓練資料中。雖然後續政策有所放寬,但早期的限制已經壓縮了工程師嘗試 AI 輔助開發的空間。為了減少內部的混亂,谷歌正逐步進行組織調整。首席 AI 架構師科雷·卡武克丘奧盧目前正與主要工程團隊合作,試圖統一公司內部的 AI 編程工具。今年早些時候,谷歌也在 DeepMind 內部成立了一個專門負責 AI 編程的團隊,由研究工程師塞巴斯蒂安·博若帶領。

即使公司已要求工程師使用 AI 生成程式碼,內部對於算力的競爭依然十分激烈,工程師在實際使用這些工具時經常面臨容量不足的問題。從技術優勢來看,部分 AI 研究人員指出,Gemini 最大的獨特之處在於能夠調用谷歌搜尋引擎的龐大數據,這是其他競爭對手難以匹敵的資源。然而,Anthropic 與 OpenAI 已經在基礎模型能力上佔據領先位置。谷歌方面則認為,在處理圖像與影片等多模態輸入,以及開發能夠模擬物理環境的 AI 世界模型等領域,仍保有其他優勢。不過,人才流失的隱憂也持續浮現。

前員工表示,部分研究人員對谷歌在 AI 競賽中的表現感到不滿,已經離職並轉往 Anthropic 或其他頂尖 AI 實驗室。值得注意的是,谷歌內部只允許部分團隊使用競爭對手 Anthropic 的 Claude 模型,且使用權限已經進一步收緊,僅限於從事前沿研究與其他高優先級項目的團隊才能接觸,凸顯出公司內部對於使用外部工具的複雜心態。

Related

相關文章

六巨頭定AI插件新標準,撞臉Claude,Anthropic沒上桌

六大科技巨頭(AWS、Anysphere、GitHub、微軟、OpenAI、Vercel)聯合發布AI智能體插件統一開放規範Agent Plugins 1.0.0,旨在統一插件打包格式,減少開發者重複勞動。該規範的結構與Anthropic的Claude Code插件系統高度相似,但Anthropic並未參與制定,而是繼續經營自己的封閉生態。

1 小時前
鈦媒體生成式AI

DeepSeek重啟融資,三年市值對齊騰訊?

DeepSeek重啟第二輪融資,以5000億元人民幣估值尋求籌集80億美元,但網傳一份由小型醫藥私募發起的專項基金募資材料引發網友質疑,後經DeepSeek員工證實部分數據屬實。該公司近期宣布API大幅漲價,可能打破其以低價換規模的估值邏輯,面臨客戶流失風險。市場關注其能否從「價格屠夫」轉型為價值提供商,以及三年內市值能否對齊騰訊等巨頭。

2 小時前

可靈AI核心技術骨幹王鑫濤被曝離職

快手可靈AI核心技術骨幹王鑫濤被曝離職,去向未知,快手官方與本人均未回應。王鑫濤是圖像與視頻生成領域知名開源項目主要作者,被視為可靈從0到1的關鍵推手。其離職發生在可靈完成獨立融資、估值180億美元的關鍵階段,可能影響研發進度與競爭優勢。

2 小時前

AI短劇、漫劇、戀綜、電影、藝人都有了,AI觀眾也不遠了

2026年AI影視內容全面爆發,從短劇、長劇到電影、綜藝,AI製作的作品大量湧現,衛視也開始播出AI短劇。AI演員如方桃子迅速走紅,商業變現能力驚人,廣告報價甚至超過許多真人網紅。AI短劇市場規模已突破220億元,用戶超過6億,但同時也引發了對真人演員就業和內容品質的擔憂。

2 小時前