谷歌正着手研发一款专为gemini ai模型深度优化的新型服务器芯片,将模型核心架构直接固化于硬件层面,从而显著提升ai推理性能与能效比。
据科技媒体The Information周一披露,这款内部代号为“Frozen v2”的芯片,其推理效率预计可达当前谷歌自研AI芯片的6至10倍,最早或于2028年正式上线部署。
两位直接了解项目进展的消息人士向该媒体证实,推动该项目加速落地的关键动因,是谷歌内部日益加剧的AI算力供需失衡——该问题已引发跨部门资源争端,并导致谷歌云不得不婉拒部分外部客户的合作邀约。Frozen v2通过在芯片中预置Gemini模型的部分决策逻辑,大幅削减运行时的动态计算开销与内存数据搬运量,进而加快响应速度、降低单次推理能耗。
谷歌发言人回应称,公司团队“持续开展前沿技术探索与创新实践,致力于为用户及合作伙伴提供极致性能与能效体验”,并强调:“并非所有研究项目都会走向量产,但这种高强度、全栈式的探索,正是我们技术演进的核心路径。”
受此消息影响,谷歌股价周一盘中最高上涨3.7%,收盘报涨1.52%。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

01
专用推理芯片:一场以效率为导向的架构押注
Frozen v2的设计哲学,是将Gemini模型的基础结构永久嵌入硅基电路之中,使其在执行推理任务时摆脱通用芯片依赖实时调度与动态判断的限制。
报道指出,若以单位功耗所能处理的token数量为衡量标准,该芯片的能效表现预计将达谷歌最新一代自研AI芯片的6至10倍。
这一思路明显区别于主流通用AI芯片路线。目前谷歌主力使用的张量处理器(TPU)与英伟达GPU均采用高度灵活的架构设计,旨在适配各类AI模型,因此在运行特定模型时需承担大量冗余的运行时决策开销。Frozen v2则通过提前固化关键逻辑路径,在牺牲部分通用性的同时换取更高吞吐与更低延迟。
谷歌正谨慎权衡“固化程度”——即究竟将多少模型结构锁定于芯片内,以在长期兼容性与即时性能之间寻求最优解。知情人士透露,Frozen v2仅支持与原始设计所依据的相同底层架构的Gemini迭代版本,换言之,谷歌实质上是在押注自身未来多年将持续沿用当前Gemini模型范式。不过,芯片仍保留对模型权重(即决定输出行为的核心参数)进行在线更新的能力。
02
演进脉络:从“全硬编码”迈向“架构级固化”
Frozen系列并非凭空而生。
用于在用户想通过浏览器自动化与 Google Gemini 或 ChatGPT 交互时。触发短语包括“ask Gemini”“ask ChatGPT”“ask GPT”“让...”。
报道称,其技术源头可追溯至由谷歌DeepMind首席科学家Jeff Dean早期主导的初代“Frozen”方案,该方案曾计划将模型权重本身直接写入芯片只读存储器(ROM)。但由于此举会导致芯片仅适用于单一模型版本、生命周期极短且升级成本高昂,该方向最终被终止。
Frozen v2在此基础上转向更具可持续性的“弹性固化”策略——固定模型架构而非具体权重,在保障推理效率跃升的同时,延长芯片服役周期并增强版本兼容能力。
放眼全球AI芯片赛道,类似思路已有先行者。加拿大初创企业Taalas即采用将特定AI模型逻辑硬编码进芯片的设计范式,目前已获Quiet Capital、富达等机构超2亿美元融资。与此同时,SambaNova、d-Matrix以及OpenAI与微软联合推进的相关项目亦在布局推理专用芯片,但技术实现路径各有侧重。英伟达则于去年12月宣布斥资200亿美元与推理芯片新锐Groq达成深度技术授权合作,意在强化其在AI推理领域的生态控制力。
03
战略定位:TPU生态的补充支点,而非替代方案
谷歌明确将Frozen v2定义为TPU产品体系之外的全新技术分支,而非对其现有自研芯片架构的推倒重来。TPU与英伟达GPU同属通用型AI加速器,面向多模型兼容场景;Frozen v2则聚焦Gemini专属优化,二者将长期共存、协同演进。
目前谷歌并无将Frozen v2量产规模扩展至与TPU同等级别的规划。
知情人士指出,受限于相对小批量的初期部署目标,谷歌可在项目后期再引入外部芯片设计与制造伙伴,无需像大规模商用产品那样前置投入巨额资源统筹供应链。此外,本代Frozen v2也被视为一项关键技术验证——旨在帮助工程师积累面向高度定制化AI芯片的研发经验,尤其在当前大模型架构日趋收敛、稳定的大趋势下。
谷歌自研芯片战略已逐步显现成效。
今年,公司正式发布第八代TPU,并首次面向云计算客户开放直销通道,向英伟达在AI训练市场的主导地位发起系统性挑战。谷歌已与Meta签署金额达数十亿美元的TPU租赁协议,同时正积极拓展其他云服务商客户。消息人士表示,自主芯片的规模化应用,已使谷歌大幅压缩Gemini模型的运营成本——倘若Frozen v2如期落地并实现预期性能,这一成本优势有望进一步扩大。
本文来自微信公众号“华尔街见闻Max”,作者:卜淑情,36氪经授权发布。










