跳到正文
原文
Hugging Face Blog·· 2025-04-11AI 评分53

BSC-LT 发布 Visual Salamandra 7B 多模态模型,支持图像与视频理解

Visual Salamandra: Pushing the Boundaries of Multimodal Understanding

AI 导读

巴塞罗那超级计算中心语言技术实验室发布 Visual Salamandra,基于 Salamandra Instructed 7B,集成 SigLIP-So400m 视觉编码器、2 层 MLP 投影层和 late-fusion 技术,可处理单图、多图、视频和纯文本输入。

来源:Hugging Face Blog · huggingface.co