Token导航 LogoToken导航TokenDH.com

谷歌发布DiffusionGemma模型,文本生成速度提升4倍

更新时间 2026-06-11来源 品玩正文 348字阅读约 2分钟1 张图片

品玩6月11日讯,据谷歌官方消息, 谷歌正式发布实验性开源模型DiffusionGemma,该模型采用文本扩散架构,在专用GPU上的文本生成速度较传统自回归大语言模型最高提升4倍。

DiffusionGemma为26B参数的混合专家(MoE)模型,推理时仅激活3.8B参数,量化后可在18GB显存的消费级显卡上运行。其核心优势在于支持双向注意力与并行生成整块文本,在本地低并发场景下能有效突破延迟瓶颈,适用于行内编辑、代码补全等实时交互工作流。

谷歌强调,DiffusionGemma目前定位为实验性研究模型,整体输出质量低于标准Gemma 4,生产环境仍建议使用后者。该模型权重已通过Apache 2.0许可证在Hugging Face开源,并获得了vLLM、Transformers等主流推理框架的支持。

资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多