跳到正文
原文
Hugging Face Blog·· 2021-11-15AI 评分34

用 🤗 Transformers 微调 XLS-R(Wav2Vec2)实现低资源语音识别

Fine-Tune XLSR-Wav2Vec2 for low-resource ASR with 🤗 Transformers

AI 导读

这篇 Hugging Face 教程讲解如何用 CTC 微调 Wav2Vec2-XLS-R-300M 做低资源 ASR。XLS-R 于 2021 年 11 月发布,用约 50 万小时、128 种语言的音频做自监督预训练,提供 300M 至 2B 参数的 checkpoint。教程以仅约 4 小时验证数据的 Common Voice 土耳其语数据集为示例,并用词错误率(WER)评估微调后的模型。

来源:Hugging Face Blog · huggingface.co