wav2vec2-large-xlsr-53-japanese jonatasgrosman

类型
model
任务
automatic-speech-recognition
框架
transformers
下载量
5,871,565
点赞
62
访问
public
文件
0

标签

  • 语音识别
  • 自动语音识别
  • 语音
  • transformers
  • NLP
  • 深度学习
  • PyTorch
  • 多语言

摘要

该模型是在日语数据上微调的 wav2vec2-large-xlsr-53,用于将16kHz日语语音转录为文本,属于自动语音识别(CTC)任务。它在 Common Voice 6.1、CSS10 和 JSUT 数据集上训练,可直接通过 transformers 或 HuggingSound 库调用。适用于日语语音转写场景,测试 WER/CER 分别为 81.80% 和 20.16%。

README

--- language: ja datasets: - common_voice metrics: - wer - cer tags: - audio - automatic-speech-recognition - speech - xlsr-fine-tuning-week license: apache-2.0 model-index: - name: XLSR Wav2Vec2 Japanese by Jonatas Grosman results: - task: name: Speech Recognition type: automatic-speech-recognitio…

查看完整页面 · 查看原文