XTTS-v2 coqui
- 유형
- model
- 태스크
- text-to-speech
- 프레임워크
- coqui
- 다운로드
- 8,759,330
- 좋아요
- 3,731
- 접근
- public
- 파일
- 0
태그
- 음성 합성
- 텍스트-투-오디오
- 다국어
- 음성 복제
- 생성형AI
- 오디오 생성
요약
XTTS-v2는 단 6초의 오디오 클립만으로 목소리를 복제해 다양한 언어로 음성을 생성하는 다국어 TTS 모델입니다. 짧은 샘플로 음성 클로닝이 가능해 대량의 학습 데이터가 필요 없으며, 감정·스타일 전이 및 교차 언어 복제를 지원합니다. 17개 언어와 24kHz 샘플링을 제공하여 실시간 음성 챗봇, 콘텐츠 제작, 접근성 서비스 등에 활용할 수 있습니다.
README
--- license: other license_name: coqui-public-model-license license_link: https://coqui.ai/cpml library_name: coqui pipeline_tag: text-to-speech widget: - text: "Once when I was six years old I saw a magnificent picture" --- # ⓍTTS ⓍTTS는 단 6초의 오디오 클립만으로 다양한 언어로 음성을 복제할 수 있는 음성 생성 모델입니다. 수많은 시간에 걸친 …