Hugging Face Blog·· 2021-11-15AI 评分34
用 🤗 Transformers 微调 XLS-R(Wav2Vec2)实现低资源语音识别
Fine-Tune XLSR-Wav2Vec2 for low-resource ASR with 🤗 Transformers
AI 导读
这篇 Hugging Face 教程讲解如何用 CTC 微调 Wav2Vec2-XLS-R-300M 做低资源 ASR。XLS-R 于 2021 年 11 月发布,用约 50 万小时、128 种语言的音频做自监督预训练,提供 300M 至 2B 参数的 checkpoint。教程以仅约 4 小时验证数据的 Common Voice 土耳其语数据集为示例,并用词错误率(WER)评估微调后的模型。
来源:Hugging Face Blog · huggingface.co