7月22日消息,google正在开发一款代号为“frozen v2”的专用服务器芯片,目标是将gemini大模型的结构设计直接“刻写”进硬件电路中,从而显著提升ai推理性能。据参与项目的内部工程师透露,该芯片在能效方面有望达到当前tpu的6至10倍,计划于2028年正式投入使用。
此举意在缓解日益严峻的算力瓶颈问题。Alphabet首席执行官Sundar Pichai此前已公开表示,算力供给不足正拖累云服务业务的增长与收入表现。Frozen v2通过将模型的架构(而非具体参数权重)固化于芯片,既保留了部分适配能力,又大幅削减了推理过程中因频繁数据搬运所产生的功耗。
需要强调的是,这款芯片并非TPU的升级或替代方案,而是面向Gemini推理任务独立推进的专用项目,且仅限Google内部部署使用。这也反映出Google对Transformer架构长期稳定性的高度认可,并开始在硬件层面对特定AI模型展开深度定制化探索。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜












