speaker-diarization-3.1 pyannote
- 类型
- model
- 任务
- automatic-speech-recognition
- 框架
- pyannote-audio
- 下载量
- 9,385,573
- 点赞
- 3,071
- 访问
- gated
- 文件
- 0
标签
- 说话人分离
- 语音识别
- 音频数据处理
- 语音
- 深度学习
- PyTorch
- 自动语音识别
摘要
pyannote/speaker-diarization-3.1 是一个说话人分离(Speaker Diarization)模型,能够自动识别音频中谁在何时说话,将连续语音按不同说话人进行分段和标注。该模型在语音识别流程中作为前置环节,解决会议、访谈、电话录音等多种说话人场景下的归属判定问题。适用于转录、会议记录、多说话人语音分析等场景。