6月4日讯,谷歌日前正式推出gemma 4 12b——一款面向消费级笔记本电脑优化的多模态智能体模型。该模型精准卡位在轻量级e4b与高性能26b moe之间,不仅显著降低内存占用,更成为该系列中首个原生支持音频输入的中等规模模型。
Gemma 4 12B的关键技术突破在于其首创的无编码器统一架构。视觉与音频信号不再依赖传统独立编码器进行预处理,而是直接接入大语言模型的主干网络,从而大幅削减系统延迟与显存消耗。在主流基准测试中,其推理性能已逼近26B模型水平,且仅需16GB VRAM或统一内存即可实现本地稳定运行。同时,模型集成多Token预测(MTP)草稿机制,进一步加快响应效率。
目前,Gemma 4 12B已依据Apache 2.0协议完全开源,预训练权重与指令微调权重均已在Hugging Face和Kaggle平台开放下载。模型全面适配llama.cpp、MLX等主流推理框架,并同步上线官方技能库(Skills Repository),致力于加速先进AI能力在边缘设备端的规模化部署与商业化应用。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜












