Token导航 LogoToken导航TokenDH.com

谷歌发布最新Gemma 4 系列多模态模型

更新时间 2026-06-04来源 品玩正文 431字阅读约 2分钟1 张图片

品玩6月4日讯,谷歌近日正式发布Gemma 4 12B,这是一款专为消费级笔记本电脑设计的多模态智能体模型。该模型填补了轻量级E4B与高性能26B MoE之间的生态位,在大幅缩减内存占用的同时,成为系列首个支持原生音频输入的中等规模模型。

Gemma 4 12B的核心突破在于采用了创新的无编码器统一架构。视觉与音频信号无需经过传统独立编码器转换,而是直接注入大语言模型主干网络,从而显著降低系统延迟与显存开销。在标准基准测试中,其推理能力已接近26B模型,且仅需16GB VRAM或统一内存即可在本地流畅运行。此外,模型内置的多Token预测(MTP)草稿器进一步提升了响应速度。

目前,Gemma 4 12B已通过Apache 2.0协议全面开源,预训练及指令微调权重均可从Hugging Face和Kaggle下载。模型已兼容llama.cpp、MLX等主流开发工具,并同步发布了官方技能库(Skills Repository),旨在推动先进AI技术在边缘设备上的普及与商业化落地。

资讯来源:由AI资讯编辑整理自互联网公开内容,版权归原作者所有,未经许可,不得转载。

继续浏览更多资讯

返回资讯目录

相关资讯

更多