谷歌正在开发新款芯片,Gemini架构直接写入硅片,效率最高提升10倍

云伟大大_8421

云伟大大_8421

2026-07-21

617人浏览

原创

谷歌正着手研发一款专为gemini ai模型深度优化的新型服务器芯片,将模型核心架构直接固化于硬件层面,从而显著提升ai推理性能与能效比。

据科技媒体The Information周一披露,这款内部代号为“Frozen v2”的芯片,其推理效率预计可达当前谷歌自研AI芯片的6至10倍,最早或于2028年正式上线部署。

两位直接了解项目进展的消息人士向该媒体证实,推动该项目加速落地的关键动因,是谷歌内部日益加剧的AI算力供需失衡——该问题已引发跨部门资源争端,并导致谷歌云不得不婉拒部分外部客户的合作邀约。Frozen v2通过在芯片中预置Gemini模型的部分决策逻辑,大幅削减运行时的动态计算开销与内存数据搬运量,进而加快响应速度、降低单次推理能耗。

谷歌发言人回应称,公司团队“持续开展前沿技术探索与创新实践,致力于为用户及合作伙伴提供极致性能与能效体验”,并强调:“并非所有研究项目都会走向量产,但这种高强度、全栈式的探索,正是我们技术演进的核心路径。”

受此消息影响,谷歌股价周一盘中最高上涨3.7%,收盘报涨1.52%。

☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜

谷歌正在开发新款芯片,Gemini架构直接写入硅片,效率最高提升10倍

01

专用推理芯片:一场以效率为导向的架构押注

Frozen v2的设计哲学,是将Gemini模型的基础结构永久嵌入硅基电路之中,使其在执行推理任务时摆脱通用芯片依赖实时调度与动态判断的限制。

报道指出,若以单位功耗所能处理的token数量为衡量标准,该芯片的能效表现预计将达谷歌最新一代自研AI芯片的6至10倍。

这一思路明显区别于主流通用AI芯片路线。目前谷歌主力使用的张量处理器(TPU)与英伟达GPU均采用高度灵活的架构设计,旨在适配各类AI模型,因此在运行特定模型时需承担大量冗余的运行时决策开销。Frozen v2则通过提前固化关键逻辑路径,在牺牲部分通用性的同时换取更高吞吐与更低延迟。

谷歌正谨慎权衡“固化程度”——即究竟将多少模型结构锁定于芯片内,以在长期兼容性与即时性能之间寻求最优解。知情人士透露,Frozen v2仅支持与原始设计所依据的相同底层架构的Gemini迭代版本,换言之,谷歌实质上是在押注自身未来多年将持续沿用当前Gemini模型范式。不过,芯片仍保留对模型权重(即决定输出行为的核心参数)进行在线更新的能力。

02

演进脉络:从“全硬编码”迈向“架构级固化”

Frozen系列并非凭空而生。

Ask Gemini/ChatGPT
Ask Gemini/ChatGPT

用于在用户想通过浏览器自动化与 Google Gemini 或 ChatGPT 交互时。触发短语包括“ask Gemini”“ask ChatGPT”“ask GPT”“让...”。

下载

报道称,其技术源头可追溯至由谷歌DeepMind首席科学家Jeff Dean早期主导的初代“Frozen”方案,该方案曾计划将模型权重本身直接写入芯片只读存储器(ROM)。但由于此举会导致芯片仅适用于单一模型版本、生命周期极短且升级成本高昂,该方向最终被终止。

Frozen v2在此基础上转向更具可持续性的“弹性固化”策略——固定模型架构而非具体权重,在保障推理效率跃升的同时,延长芯片服役周期并增强版本兼容能力。

放眼全球AI芯片赛道,类似思路已有先行者。加拿大初创企业Taalas即采用将特定AI模型逻辑硬编码进芯片的设计范式,目前已获Quiet Capital、富达等机构超2亿美元融资。与此同时,SambaNova、d-Matrix以及OpenAI与微软联合推进的相关项目亦在布局推理专用芯片,但技术实现路径各有侧重。英伟达则于去年12月宣布斥资200亿美元与推理芯片新锐Groq达成深度技术授权合作,意在强化其在AI推理领域的生态控制力。

03

战略定位:TPU生态的补充支点,而非替代方案

谷歌明确将Frozen v2定义为TPU产品体系之外的全新技术分支,而非对其现有自研芯片架构的推倒重来。TPU与英伟达GPU同属通用型AI加速器,面向多模型兼容场景;Frozen v2则聚焦Gemini专属优化,二者将长期共存、协同演进。

目前谷歌并无将Frozen v2量产规模扩展至与TPU同等级别的规划。

知情人士指出,受限于相对小批量的初期部署目标,谷歌可在项目后期再引入外部芯片设计与制造伙伴,无需像大规模商用产品那样前置投入巨额资源统筹供应链。此外,本代Frozen v2也被视为一项关键技术验证——旨在帮助工程师积累面向高度定制化AI芯片的研发经验,尤其在当前大模型架构日趋收敛、稳定的大趋势下。

谷歌自研芯片战略已逐步显现成效。

今年,公司正式发布第八代TPU,并首次面向云计算客户开放直销通道,向英伟达在AI训练市场的主导地位发起系统性挑战。谷歌已与Meta签署金额达数十亿美元的TPU租赁协议,同时正积极拓展其他云服务商客户。消息人士表示,自主芯片的规模化应用,已使谷歌大幅压缩Gemini模型的运营成本——倘若Frozen v2如期落地并实现预期性能,这一成本优势有望进一步扩大。

本文来自微信公众号“华尔街见闻Max”,作者:卜淑情,36氪经授权发布。

谷歌浏览器
谷歌浏览器

谷歌浏览器Google Chrome是一款可让您更快速、轻松且安全地使用网络的浏览器。Google Chrome的设计超级简洁,使用起来得心应手。这里提供了谷歌浏览器纯净安装包,有需要的小伙伴快来保存下载体验吧!

下载

相关标签:

谷歌 gemini

本站声明:本文内容由网友自发贡献,版权归原作者所有,本站不承担相应法律责任。如您发现有涉嫌抄袭侵权的内容,请联系admin@php.cn

相关专题

更多
Gemini网页版零基础入门:5分钟上手Gemini聊天指南
Gemini网页版零基础入门:5分钟上手Gemini聊天指南

本专题专为零基础用户打造,5分钟快速掌握Gemini网页版核心用法。从账号登录到界面布局,详解如何发起对话、优化提示词及利用多模态功能。通过实战案例,教你高效获取信息、创作内容与分析数据。无论学习还是工作,轻松开启AI辅助新时代,让Gemini成为你的得力智能助手。

2026.03.18

15457

10

如何写出高效Gemini提示:Chain of Thought实用教程
如何写出高效Gemini提示:Chain of Thought实用教程

本专题详解如何利用“思维链”(Chain of Thought)技巧激发 Gemini 模型的深度推理能力。通过引导模型将复杂问题拆解为逐步推导的逻辑链条,显著提升其在数学计算、代码生成及逻辑分析任务中的准确率。文章提供实用提示模板与对比案例,助您掌握结构化提问方法,从简单指令升级为高效交互,轻松获取更精准、可解释的智能回答。

2026.03.23

37

10

Gemini多模态实战:图片PDF视频输入完整处理指南
Gemini多模态实战:图片PDF视频输入完整处理指南

本指南全面解析 Gemini 多模态实战,涵盖图片、PDF 及视频的高效处理流程。从上传技巧到提示词设计,教您如何提取文档关键信息、分析图表数据及解读视频内容。通过真实案例演示,助您掌握跨模态交互核心技能,轻松构建智能文档分析与多媒体理解应用,释放 AI 潜能。

2026.03.23

77

10

Gemini提示工程进阶:Few-shot与角色扮演优化方法
Gemini提示工程进阶:Few-shot与角色扮演优化方法

本进阶指南深入解析 Few-shot 学习与角色扮演在 Gemini 提示工程中的核心应用。通过精选示例引导模型模仿特定风格,结合角色设定规范输出语气与逻辑,显著提升复杂任务的处理精度。文章提供实用模板与调优策略,助您打造个性化 AI 助手,实现从通用回答到专业级交互的质的飞跃。

2026.03.23

76

10

Google AI Studio使用教程:从模板到自定义Prompt实战
Google AI Studio使用教程:从模板到自定义Prompt实战

本教程手把手教您掌握 Google AI Studio,从快速调用官方模板到深度自定义 Prompt 实战。内容涵盖界面导航、参数调优及版本管理,助您灵活构建专属 AI 应用。通过真实案例演示,让您轻松实现从创意构思到原型部署的全流程,高效释放 Gemini 模型潜能,打造智能化解决方案。

2026.03.23

101

12

Gemini API快速上手:Python调用generateContent完整指南
Gemini API快速上手:Python调用generateContent完整指南

本指南详解如何使用 Python 快速调用 Gemini API 的 generateContent 方法。从环境配置、密钥管理到核心代码实现,逐步演示文本生成、多模态输入及流式响应处理。包含完整示例与错误排查技巧,助开发者轻松集成 Gemini 强大能力,构建高效智能应用,开启 AI 开发新篇章。

2026.03.23

90

11

如何实现Gemini函数调用:Tool Use与外部工具集成教程
如何实现Gemini函数调用:Tool Use与外部工具集成教程

本教程深入解析 Gemini 函数调用机制,详解 Tool Use 配置与外部工具集成流程。从定义函数架构到处理动态参数,手把手教您连接数据库、搜索 API 及自定义服务。通过实战案例,展示如何让 AI 自主规划并执行复杂任务,突破纯文本限制,构建具备真实行动力的智能代理系统。

2026.03.23

165

11

Gemini结构化输出JSON模式:API稳定提取数据实战
Gemini结构化输出JSON模式:API稳定提取数据实战

本实战指南详解如何利用 Gemini API 的 JSON 模式实现结构化数据提取。通过配置响应格式约束,确保模型输出严格符合预定义 Schema,彻底解决解析错误难题。内容涵盖字段定义、类型校验及异常处理,助您在信息抽取、数据清洗等场景中构建高稳定性管道,轻松将非结构化文本转化为可靠的应用数据。

2026.03.23

91

13

Gemini上下文缓存功能:如何大幅降低长对话成本指南
Gemini上下文缓存功能:如何大幅降低长对话成本指南

本指南深入解析 Gemini 上下文缓存(Context Caching)功能,助您大幅降低长对话与大规模文档处理成本。通过复用高频输入的嵌入表示,避免重复计算令牌,显著减少延迟与费用。内容涵盖缓存创建、管理及最佳实践,特别适合多轮对话、知识库问答等场景,让您在保持高性能的同时,实现极具性价比的 AI 应用部署。

2026.03.23

55

8

热门下载

更多
网站特效
/
网站源码
/
网站素材
/
前端模板

精品课程

更多
相关推荐
/
热门推荐
/
最新课程
550W粉丝大佬手把手从零学JavaScript
550W粉丝大佬手把手从零学JavaScript

共1课时 | 0.4万人学习

极客学院Android开发视频教程
极客学院Android开发视频教程

共345课时 | 132.8万人学习