정보 채터박스
Chatterbox is an open-source, zero-shot voice cloning model with MIT licensed code and weights. On TextToSpeechAI it powers every cloned voice: upload 6 to 60 seconds of clear audio and Chatterbox reproduces that voice in any of the languages listed on the voice cloning page, with no training step.
주요 기능
제로 샷 음성 복제
6초에서 60초의 오디오에서 음성을 복제합니다. 훈련 실행이 필요하지 않습니다.
언어간 번역
영어 샘플에서 클론하고 클론 페이지의 15개 언어 중 하나로 음성을 생성합니다.
측정된 스피커 유사성
우리의 테스트에서 Chatterbox는 우리가 평가한 다른 라이센스 클론 엔진보다 참조 스피커와 더 가까이 일치했습니다.
상업적으로 라이센스된
코드와 모델 무게 모두 MIT 라이선스.
사용 사례
사용 방법 채터박스
-
1
무료 계정 만들기
무료 스타터 크레딧을 받으려면 TextToSpeechAI에 가입하십시오.
-
2
참조 클립 업로드
음성 복제 페이지를 열고 복제할 권리가 있는 음성에서 6~60초의 명확한 음성을 업로드하십시오.
-
3
텍스트와 언어를 입력하십시오.
말할 텍스트를 입력하고 지원되는 15개의 출력 언어 중 하나를 선택합니다.
-
4
연설을 생성합니다
TextToSpeechAI는 GPU 서버에서 Chatterbox를 사용하여 클론된 음성의 텍스트를 렌더링합니다.
-
5
API 다운로드 또는 사용
완성된 오디오를 다운로드하거나 TextToSpeechAI REST API를 통해 생성을 자동화합니다.
채터박스 API
TextToSpeechAI REST API를 사용하여 프로그래밍 방식으로 음성을 생성합니다.
curl -X POST "https://api.texttospeechai.com/v1/generate/" \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"text": "이건 짧은 녹음에서 만들어진 제 복제 목소리입니다.",
"voice": "en_US-kristin-medium"
}'
자주 묻는 질문
Technical Specs
- Generation Speed Moderate
- Output Quality Very Good
- Voice Cloning Supported
- Languages 15
- GPU VRAM 4-8GB
- Credits/1000 chars 5