wav2vec2-large-xlsr-53-portuguese jonatasgrosman
- 类型
- model
- 任务
- automatic-speech-recognition
- 框架
- transformers
- 下载量
- 5,005,961
- 点赞
- 55
- 访问
- public
- 文件
- 0
标签
- 语音识别
- 自动语音识别
- 语音
- 音频数据处理
- transformers
- PyTorch
- 微调
- 多语言
摘要
该模型在Common Voice葡萄牙语数据集上对facebook/wav2vec2-large-xlsr-53进行微调,用于自动语音识别(ASR)。模型支持16kHz采样的语音输入,可直接输出葡语转写文本,并可选结合语言模型提升识别精度(测试WER约11.31%)。适用于葡萄牙语语音转文字、字幕生成等场景。
README
--- language: pt license: apache-2.0 datasets: - common_voice - mozilla-foundation/common_voice_6_0 metrics: - wer - cer tags: - audio - automatic-speech-recognition - hf-asr-leaderboard - mozilla-foundation/common_voice_6_0 - pt - robust-speech-event - speech - xlsr-fine-tuning-week model-index: -…