6月11日,谷歌官方宣布正式推出实验性开源模型diffusiongemma。该模型基于文本扩散架构构建,在专用gpu上运行时,文本生成速度相较传统自回归式大语言模型最高可提升4倍。
DiffusionGemma是一款参数量达26B的混合专家(MoE)模型,推理过程中仅需激活3.8B参数;经量化处理后,可在配备18GB显存的消费级显卡上顺利部署。其技术亮点在于支持双向注意力机制,并能并行生成整段文本,从而在本地低并发场景下显著缓解延迟问题,特别适配代码补全、行内编辑等对响应实时性要求较高的交互任务。
谷歌指出,DiffusionGemma现阶段属于实验性研究项目,整体生成质量尚未达到标准版Gemma 4的水平,生产环境仍推荐使用Gemma 4。目前,该模型权重已依据Apache 2.0许可证在Hugging Face平台开源,并已兼容vLLM、Transformers等主流推理框架。
☞☞☞AI 智能聊天, 问答助手, AI 智能搜索, 多模态理解力帮你轻松跨越从0到1的创作门槛☜☜☜












