Hugging Face Blog·· 2025-04-11AI 评分53
BSC-LT 发布 Visual Salamandra 7B 多模态模型,支持图像与视频理解
Visual Salamandra: Pushing the Boundaries of Multimodal Understanding
AI 导读
巴塞罗那超级计算中心语言技术实验室发布 Visual Salamandra,基于 Salamandra Instructed 7B,集成 SigLIP-So400m 视觉编码器、2 层 MLP 投影层和 late-fusion 技术,可处理单图、多图、视频和纯文本输入。
来源:Hugging Face Blog · huggingface.co