XTTS-v2 coqui

유형
model
태스크
text-to-speech
프레임워크
coqui
다운로드
8,759,330
좋아요
3,731
접근
public
파일
0

태그

  • 음성 합성
  • 텍스트-투-오디오
  • 다국어
  • 음성 복제
  • 생성형AI
  • 오디오 생성

요약

XTTS-v2는 단 6초의 오디오 클립만으로 목소리를 복제해 다양한 언어로 음성을 생성하는 다국어 TTS 모델입니다. 짧은 샘플로 음성 클로닝이 가능해 대량의 학습 데이터가 필요 없으며, 감정·스타일 전이 및 교차 언어 복제를 지원합니다. 17개 언어와 24kHz 샘플링을 제공하여 실시간 음성 챗봇, 콘텐츠 제작, 접근성 서비스 등에 활용할 수 있습니다.

README

--- license: other license_name: coqui-public-model-license license_link: https://coqui.ai/cpml library_name: coqui pipeline_tag: text-to-speech widget: - text: "Once when I was six years old I saw a magnificent picture" --- # ⓍTTS ⓍTTS는 단 6초의 오디오 클립만으로 다양한 언어로 음성을 복제할 수 있는 음성 생성 모델입니다. 수많은 시간에 걸친 …

查看完整页面 · 查看原文