speaker-diarization-3.1 pyannote

種別
model
タスク
automatic-speech-recognition
フレームワーク
pyannote-audio
ダウンロード
9,385,573
いいね
3,071
アクセス
gated
ファイル
0

タグ

  • 音声認識
  • 話者分離
  • 音声処理
  • 機械学習
  • 推論
  • pyannote

概要

音声から「誰がいつ話したか」を自動的に判別する話者ダイアライゼーション(話者分離)モデルです。音声認識の前処理として、複数話者の会議・インタビュー・ポッドキャストなどを話者ごとに分割する用途に適しています。pyannote-audio フレームワーク上で動作し、高い精度で話者の区別とタイムスタンプ付与を行います。

查看完整页面 · 查看原文