谷歌正在開發新款芯片,Gemini架構直接寫入硅片,效率最高提升10倍

重點摘要
谷歌开发新一代AI芯片Frozen v2 Gemini架构直接写入硅片 推理效率最高提升10倍 据科技媒体The Information报道,谷歌正在开发一款专为其Gemini AI模型量身定制的新型服务器芯片,代号“Frozen v2”。该芯片将Gemini模型的底层架构直接固化于硅片之中,旨在大幅提升AI推理效率。知情人士透露,其单位功耗可处理的token数量有望达到现有自研芯片的6至10倍,最早或于2028年投入部署。受此消息提振,谷歌股价本周一盘初一度上涨3.7%。
谷歌开发新一代AI芯片Frozen v2 Gemini架构直接写入硅片 推理效率最高提升10倍
据科技媒体The Information报道,谷歌正在开发一款专为其Gemini AI模型量身定制的新型服务器芯片,代号“Frozen v2”。该芯片将Gemini模型的底层架构直接固化于硅片之中,旨在大幅提升AI推理效率。知情人士透露,其单位功耗可处理的token数量有望达到现有自研芯片的6至10倍,最早或于2028年投入部署。受此消息提振,谷歌股价本周一盘初一度上涨3.7%。 这一项目的直接驱动力来自谷歌内部日益严峻的AI算力短缺问题。两位直接知情人士向The Information表示,算力瓶颈已引发内部资源矛盾,甚至迫使谷歌云拒绝部分外部客户的合作请求。Frozen v2通过将部分Gemini模型的决策逻辑预先嵌入芯片,减少运行时所需的计算步骤与数据搬运量,从而在提升响应速度的同时降低单位算力功耗。 Frozen v2的核心设计理念在于将Gemini模型的底层架构“永久刻入”芯片硅基,使其在处理推理请求时无需像通用芯片那样进行大量实时决策。报道指出,以每单位功耗可处理的token数量衡量,该芯片的效率预计达到谷歌现有最新一代自研AI芯片(TPU)的6至10倍。这一对比鲜明的逻辑背后,是谷歌现有张量处理器(TPU)与英伟达GPU类似的通用架构——它们需兼容多种AI模型,运行特定模型时必须处理大量动态决策过程。Frozen v2通过预先固化部分决策换取更高运行效率,但代价是通用性的明显降低。 在固化程度的选择上,谷歌正评估应将多少信息锁定于芯片之中,以求在灵活性与效率之间取得平衡。知情人士表示,Frozen v2仅能兼容与设计时所采用相同底层架构的Gemini后续版本,但芯片支持模型权重的更新——即决定模型如何响应问题的参数设置可根据版本演变而调整。这意味着谷歌实际上是在押注自身将长期沿用当前的Gemini模型架构,但保留了参数层面的迭代空间。 项目前身是谷歌DeepMind首席科学家Jeff Dean主导的“原版Frozen”方案。该方案一度计划将模型权重本身直接烧录进芯片,但由于芯片仅能服务于某一特定版本Gemini,生命周期过短,该方案已被搁置。Frozen v2在此基础上做出关键调整,转向“弹性固化”思路——固化模型架构而非具体权重,从而在保留大部分效率优势的同时延长芯片使用周期。 从行业参照来看,加拿大芯片初创公司Taalas采用了类似的将特定AI模型硬编码入芯片的设计理念,目前已从Quiet Capital、富达等投资方融资超过2亿美元。而SambaNova、d-Matrix以及OpenAI、微软等公司也在开发各自面向推理的芯片,但技术路径与谷歌有所不同。英伟达则在去年12月斥资200亿美元与推理芯片初创公司Groq达成技术授权协议,以强化自身在推理市场的布局。 谷歌明确将Frozen v2定位为TPU产品线之外的新分支,而非对其现有人工智能芯片体系的替代。TPU与英伟达GPU同属通用AI芯片,可兼容多种模型;Frozen v2则专为Gemini打造,两条产品线将并行发展。谷歌目前尚无将Frozen v2大规模扩产至与TPU相当体量的计划。 知情人士指出,相对有限的部署规模使得谷歌可以在项目后期再引入外部设计与制造合作伙伴,无需像重大产品发布那样提前大规模统筹。此外,谷歌也在一定程度上将这一代产品视为工程试验——为工程师积累开发更高专用化芯片的经验,尤其是在AI模型架构逐渐趋于稳定的背景下。 谷歌现有的自研芯片战略已初见成效。今年,谷歌发布了第八代TPU(TPU v8),并开始将其直接向云计算客户销售,向英伟达的主导地位发起挑战。据悉,谷歌已与Meta签署了价值数十亿美元的TPU租用协议,并正积极争取其他云服务提供商客户。自主研发芯片已经帮助谷歌以更低成本运行Gemini模型;Frozen v2若成功,则有望进一步放大这一成本优势。 谷歌发言人在一份声明中表示,公司团队“持续研究和探索新创新,以为用户和客户提供最高性能与效率”,并补充称“并非每个项目都会进入量产,但这种严格的探索是我们全栈方法的核心”。 综合来看,Frozen v2代表了谷歌在AI推理芯片领域的一次大胆架构押注——通过牺牲部分通用性换取极致效率,将模型架构直接写入硅片。随着AI模型架构逐步收敛,类似的专用化芯片设计思路可能在行业内获得更广泛采用。而谷歌若能在2028年前后成功部署这款芯片,将有望在控制运营成本的同时巩固其在生成式AI领域的竞争优势。
Related
相關文章

在下一個模型發佈之前
賬號設置我的關注我的收藏申請的報道退出登錄登錄搜索36氪Auto數字時氪未來消費智能湧現未來城市啟動Power on36氪出海36氪研究院潮生TIDE36氪企服點評36氪財經職場bonus36碳後浪研究所暗湧Waves硬氪氪睿研究院媒體品牌企業號企服點評36Kr研究院36Kr創新諮詢企業服務核心服務城市之窗政府服務創投發佈LP源計劃VClubVClub投資機。

WAIC重磅成果|上海儀電智算牽頭成立“智算系統架構聯盟”併發布《超節點系統架構規範》
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.

WAIC重磅成果|智愛賽思全面升級併發布科研專屬Token Plan
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.

中國銀行將推長城 BOC-AI 信用卡,每月消費達標有機會領取智譜、MiniMax 等 Token 權益
首頁 > 智能時代>人工智能 中國銀行將推長城 BOC-AI 信用卡,每月消費達標有機會領取智譜、MiniMax 等 Token 權益 2026/7/21 17:28:06 來源:IT之家 作者:潞源 責編:潞源 評論: IT之家 7 月 21 日消息,中國銀行上週(7 月 17 日)宣佈,長城 BOC-AI 信用卡即將上線。

WAIC重磅成果|儀電智算雲在國家人工智能應用中試基地建設中展現全棧服務能力
< img id="wx_img" src="https://www.qbitai.com/wp-content/uploads/imgs/qbitai-logo-1.

千問進蘋果,大模型開始「隱身」
千問進蘋果,大模型開始「隱身」市值榜2026.07.21 17:14 · 來自北京全文4172字00:00 / 12:18一場關於“默認”的戰爭。文 | 市值榜,作者 | 賈樂樂 ,編輯 | 嘉辛2026年7月8日,蘋果技術開發(上海)有限公司申報的“Apple智能”完成生成式人工智能服務備案。7月15日,網信中國公佈7款手機端側生成式人工智能服務備案信息,“Apple智能”正式在列。