跳到正文
原文
Google DeepMind·· 2026-06-09精选AI 评分77

Google DeepMind 发布 Gemma 4 12B:无编码器的统一多模态模型

Introducing Gemma 4 12B: a unified, encoder-free multimodal model

AI 导读

Google DeepMind 发布 Gemma 4 12B,采用无编码器的统一多模态架构,视觉和音频输入直接进入 LLM backbone,支持原生音频输入。

推荐理由

原文给出了架构细节、内存门槛和许可证等可验证事实,读者可据此评估本地部署多模态模型的可行性。

来源:Google DeepMind · deepmind.google