Chatterbox
PremiumDie Stimme Klonen Engine hinter TextToSpeechAI geklonte Stimmen
Über Chatterbox
Chatterbox ist ein Open-Source-, Null-Shot-Gespräche-Klonmodell mit MIT lizenziertem Code und Gewichten. Auf TextToSpeechAI macht es jede geklonte Stimme: Upload 6 bis 60 Sekunden klare Audio und Chatterbox reproduziert diese Stimme in einer der auf der Voice-Klonseite aufgeführten Sprachen, ohne Trainingsschritt.
Hauptmerkmale
Null-schnelle Stimme Klonen
Klonen Sie eine Stimme von 6 bis 60 Sekunden Audio. Es wird kein Trainingslauf benötigt.
Querschnittsthemen
Klonen Sie aus einem englischen Sample und erzeugen Sie Sprache in einer der 15 Sprachen auf der Klonseite.
Vergleich der gemessenen Sprecher
In unseren eigenen Tests passte Chatterbox dem Referenzlautsprecher näher als die anderen lizenzierten Klonmotoren, die wir bewerteten.
Kommerziell lizenziert
MIT-Lizenz für Code- und Modellgewichte.
Anwendungsfälle
Wie man verwendet Chatterbox
-
1
Erstellen Sie ein kostenloses Konto
Melden Sie sich für TextToSpeechAI um kostenlose Starter-Credits zu erhalten.
-
2
Einen Referenzclip hochladen
Öffnen Sie die Stimme Klonen Seite und laden Sie 6 bis 60 Sekunden klare Sprache von der Stimme, die Sie haben das Recht zu klonen.
-
3
Geben Sie Ihren Text und Ihre Sprache ein
Geben Sie den Text ein, der sprechen soll, und wählen Sie eine der 15 unterstützten Ausgabesprachen aus.
-
4
Erzeugen der Rede
TextToSpeechAI gibt den Text in der geklonten Stimme mit Chatterbox auf unseren GPU-Servern wieder.
-
5
API herunterladen oder verwenden
Laden Sie die fertige Audio-Version herunter oder automatisieren Sie die Generation über die API TextToSpeechAI REST.
Chatterbox API
Sprachprogrammatik mit der TextToSpeechAI REST API generieren.
curl -X POST "https://api.texttospeechai.com/v1/generate/" \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"text": "Das ist meine geklonte Stimme, die aus einer kurzen Aufnahme erstellt wurde.",
"voice": "en_US-kristin-medium"
}'
Häufig gestellte Fragen
Technical Specs
- Generation Speed Moderate
- Output Quality Very Good
- Voice Cloning Supported
- Languages 15
- GPU VRAM 4-8GB
- Credits/1000 chars 5