情報 チャターボックス
Chatterbox is an open-source, zero-shot voice cloning model with MIT licensed code and weights. On TextToSpeechAI it powers every cloned voice: upload 6 to 60 seconds of clear audio and Chatterbox reproduces that voice in any of the languages listed on the voice cloning page, with no training step.
主要な特徴
ゼロショット音声クローン
6 秒から 60 秒の音声をクローンします。訓練は必要ありません。
交叉語
英語サンプルからクローンし、クローンページの15言語のいずれかで音声を生成します。
測定された話者類似度
また,Chatterboxは,他のライセンスのクローンエンジンよりも,参照スピーカーとより密接に一致した。
商用ライセンス
コードとモデル重量の両方に対してMITライセンスを持っている。
ユースケース
使い方 チャターボックス
-
1
無料アカウントを作成
無料のクレジットを 受け取るために TextToSpeechAI に登録してください
-
2
参照クリップをアップロード
声のクローンページを開き、クローンする権利がある声から 6秒から60秒の明瞭な話をアップロードしてください。
-
3
テキストと言語を入力
話すテキストを入力し、15 のサポートされている出力言語のうちの一つを選択します。
-
4
音声を生成
TextToSpeechAIはクローン音声のテキストを チャッターボックスでGPUサーバ上で 再現します
-
5
API をダウンロードまたは使用
完成したオーディオをダウンロードするか、TextToSpeechAI REST APIを通して自動生成する。
チャターボックス API
Generate speech programmatically using the TextToSpeechAI REST API.
curl -X POST "https://api.texttospeechai.com/v1/generate/" \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"text": "これは私のクローンの声です 短い録音から作られた",
"voice": "en_US-kristin-medium"
}'
よくある質問
Technical Specs
- Generation Speed Moderate
- Output Quality Very Good
- Voice Cloning Supported
- Languages 15
- GPU VRAM 4-8GB
- Credits/1000 chars 5