Chatterbox

Premium

Null-Schüsse-Stimme mit ausdrucksstarker Sprache in 23 Sprachen

Fast Geschwindigkeit
Very Good Qualität
Nein Klonen
23 Sprachen

Über Chatterbox

Chatterbox ist ein leistungsstarkes TTS-Modell von Resemble AI. Es führt Null-Schuß-Stimme Klonen von nur wenigen Sekunden Referenz-Audio, Unterstützung 23 Sprachen mit natürlichen Ausdruck. Chatterbox enthält paralinguistische Tags für die Zugabe von natürlichen Klängen wie Lachen und Husten generierte Sprache.

Hauptmerkmale

Null-schnelle Stimme Klonen

Klonen Sie jede Stimme aus ein paar Sekunden Audio - kein Training erforderlich.

23 Sprachen

Von Arabisch bis Chinesisch, die die meisten wichtigen Weltsprachen abdecken.

Ausdrucks-Tags

Fügen Sie [lachen], [knöchern] für natürliche paralinguistische Klänge hinzu.

Schnelle Schlussfolgerung

Sub-200ms Latenz mit der Turbo-Variante für Echtzeit-Anwendungen.

Anwendungsfälle

Stimmenklonen für die Erstellung von Inhalten Mehrsprachige Sprachanwendungen Charakter Stimme Design für Spiele Personalisierte Sprachassistenten

Wie man verwendet Chatterbox

  1. 1

    Registrieren oder öffnen Sie die Demo

    Erstellen Sie ein kostenloses TextToSpeechAI Konto, um 200 Starter-Credits zu beanspruchen, oder verwenden Sie die on-page-Demo, um Chatterbox zu versuchen, ohne sich anzumelden.

  2. 2

    Chatterbox auswählen und einen Referenzclip hinzufügen

    Wählen Sie die Chatterbox-Engine und laden Sie dann einen kurzen (ein paar Sekunden) Audioclip der Stimme hoch, die Sie klonen möchten. Chatterbox Null-Schuss klont es sofort - kein Training erforderlich.

  3. 3

    Geben Sie Ihren Text mit optionalen Tags ein

    Geben Sie den Text ein oder fügen Sie ihn ein, um in einer der 23 unterstützten Sprachen zu sprechen, und lassen Sie [lachen], [müde] oder [schnüffeln] Tags ein, wo immer Sie natürliche paralinguistische Klänge wollen.

  4. 4

    Erzeugen der Rede

    Klicken Sie auf Generieren und TextToSpeechAI macht Ihren Text in der geklonten Chatterbox-Stimme auf gehostete GPU-Infrastruktur, Ausgaben 25 Credits pro 1.000 Zeichen.

  5. 5

    API herunterladen oder verwenden

    Laden Sie die fertige Audiodatei herunter oder automatisieren Sie die Generierung über die TextToSpeechAI REST API unter api.texttospeechai.com mit Ihrem Konto-Token.

Chatterbox API

Sprachprogrammatik mit der TextToSpeechAI REST API generieren.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "Chatterbox kann Ihre Stimme aus nur wenigen Sekunden Audio klonen und in 23 Sprachen sprechen.",
    "voice": "en_US-lessac-medium"
  }'

Häufig gestellte Fragen

Chatterbox ist ein Null-Schuß-Gespräche-Klonen-Text-Sprach-Modell von Resemble KI. Es kann jede Stimme aus nur wenigen Sekunden Referenz-Audio replizieren und natürliche, ausdrucksstarke Sprache in 23 Sprachen erzeugen, alles ohne ein Per-Stimme-Training.

Ja, Chatterbox ist voll MIT lizenziert - sowohl den Code als auch die Modellgewichte - so dass Sie es frei in kommerziellen Produkten verwenden können. Generierte Audio enthält ein optionales neuronales Wasserzeichen, das deaktiviert werden kann, und es gibt keine Nutzungsgebühren.

Sie bieten einen kurzen Referenzclip einer beliebigen Stimme (ein paar Sekunden reicht aus) und Chatterbox extrahiert die Klangfarbe und den Stil einer Stimme in eine Lautsprechereinbettung. Sie erzeugt dann brandneue Sprache in dieser Stimme ohne Feineinstellung oder Trainingsschritt, was "Null-Shot" bedeutet.

Chatterbox liest spezielle Inline Tags in Ihrem Text, um natürliche nicht-verbale Klänge hinzuzufügen: [lachen] fügt Lachen ein, [knöchern] fügt einen Husten ein, und [knöcheln] fügt ein weiches Guckeln ein. Stellen Sie einfach ein Tag, wo Sie den Sound wollen, zum Beispiel "Das ist lustig [lachen] aber ernsthaft...".

Geben Sie das Tag direkt in Ihrem Eingabetext an der Stelle ein, wo der Klang auftreten soll, umgeben von dem Rest Ihres Satzes. Chatterbox rendert den paralinguistischen Klang in der geklonten Stimme und mischt ihn in die umgebende Sprache, so dass es spontan klingt, anstatt eingespleckt.

Chatterbox unterstützt 23 Sprachen, darunter Arabisch, Dänisch, Deutsch, Griechisch, Englisch, Spanisch, Finnisch, Französisch, Hebräisch, Hindi, Italienisch, Japanisch, Koreanisch, Malaiisch, Niederländisch, Norwegisch, Polnisch, Portugiesisch, Russisch, Schwedisch, Swahili, Türkisch und Chinesisch. Eine einzige geklonte Stimme kann über diese Sprachen sprechen.

Chatterbox erzeugt schnell Sprachausgabe auf einer GPU, und die Turbo-Variante erreicht Sub-200ms Latenz für Echtzeit-Konversationsnutzung. Qualität ist sehr gut, mit natürlichen Prosodie und treue Stimmwiedergabe von selbst kurzen Referenzclips.

Chatterbox benötigt je nach Variante ca. 4-8GB VRAM, das Turbo-Modell läuft bequem in ca. 4GB. Auf TextToSpeechAI benötigen Sie keine lokalen GPU - Generationsläufe auf unserer gehosteten Infrastruktur.

Chatterbox ist eine Premium-Tier-Engine, die 25 Credits pro 1.000 Zeichen kostet. Neue Konten erhalten 200 kostenlose Credits, um das Klonen von Stimmen zu versuchen, und Sie geben nur Credits auf den Text aus, den Sie tatsächlich generieren.

Beide unterstützen das Null-Schuß-Gesangsklonen, Chatterbox deckt jedoch weit mehr Sprachen (23 vs. 2) ab und fügt expressive paralinguistische Tags hinzu. F5-TTS kann etwas natürlichere englische Prosody herausschneiden, also wählen Sie Chatterbox für mehrsprachiges Klonen und ausdrucksstarke Sounds und F5-TTS für englisches Treuen.

Beide bieten hochwertiges Stimmenklonen. Chatterbox unterstützt 23 Sprachen und inline-expressive Tags, während OpenVoice fügt Ton-Stil-Steuerelemente (freundlich, traurig, wütend, und mehr), dass Chatterbox fehlt. Wählen Sie Chatterbox für breite Sprachabdeckung und OpenVoice, wenn Sie explizite emotionale Ton-Styling benötigen.

Ja. Melden Sie sich für ein kostenloses TextToSpeechAI-Konto an, um 200 Starter-Credits zu erhalten, oder nutzen Sie die on-page-Demo, um Chatterbox ohne Anmeldung zu hören. Laden Sie einen kurzen Referenzclip hoch, geben Sie Ihren Text ein und erzeugen Sie eine geklonte Stimme in Sekunden.

Technical Specs

  • Generation Speed Fast
  • Output Quality Very Good
  • Voice Cloning Supported
  • Languages 23
  • GPU VRAM 4-8GB
  • Credits/1000 chars 25

Try Chatterbox Now

Generate your first audio free. No credit card required.

Start Free