跳到正文
原文
Google Research·· 2025-12-04AI 评分37

Google 发布 Massive Sound Embedding Benchmark(MSEB):面向听觉智能的新基准

From Waveforms to Wisdom: The New Benchmark for Auditory Intelligence

AI 导读

Google Research 发布声音嵌入基准 MSEB,已在 NeurIPS 2025 上展示。该基准统一评估检索、推理、分类、转写、分割、聚类、重排序、重构 8 项听觉能力,核心数据集 SVQ 包含 177,352 条口语查询,覆盖 26 个地区和 17 种语言,已在 Hugging Face 开源。初始实验显示,现有声音表示远非通用,全部 8 项任务仍存在较大性能提升空间。

来源:Google Research · research.google