speaker-diarization-community-1 pyannote

类型
model
任务
automatic-speech-recognition
框架
pyannote-audio
下载量
5,607,397
点赞
1,029
访问
gated
文件
0

标签

  • 说话人分离
  • 语音识别
  • 自动语音识别
  • 音频数据处理
  • 语音
  • PyTorch
  • 深度学习

摘要

该模型用于说话人分离(Speaker Diarization),能自动识别并标注一段音频中"谁在什么时间说话",将语音按不同说话人切分并打上标签。基于 pyannote-audio 框架,属于社区版(community)模型,适用于会议记录转写、访谈分析、多说话人语音场景下的前置处理,常与自动语音识别配合使用。

查看完整页面 · 查看原文