Google DeepMind·· 2026-06-09精选AI 评分77
Google DeepMind 发布 Gemma 4 12B:无编码器的统一多模态模型
Introducing Gemma 4 12B: a unified, encoder-free multimodal model
AI 导读
Google DeepMind 发布 Gemma 4 12B,采用无编码器的统一多模态架构,视觉和音频输入直接进入 LLM backbone,支持原生音频输入。
推荐理由
原文给出了架构细节、内存门槛和许可证等可验证事实,读者可据此评估本地部署多模态模型的可行性。
来源:Google DeepMind · deepmind.google