speaker-diarization-3.1 pyannote

类型
model
任务
automatic-speech-recognition
框架
pyannote-audio
下载量
9,385,573
点赞
3,071
访问
gated
文件
0

标签

  • 说话人分离
  • 语音识别
  • 音频数据处理
  • 语音
  • 深度学习
  • PyTorch
  • 自动语音识别

摘要

pyannote/speaker-diarization-3.1 是一个说话人分离(Speaker Diarization)模型,能够自动识别音频中谁在何时说话,将连续语音按不同说话人进行分段和标注。该模型在语音识别流程中作为前置环节,解决会议、访谈、电话录音等多种说话人场景下的归属判定问题。适用于转录、会议记录、多说话人语音分析等场景。

查看完整页面 · 查看原文