Offene Stimme

Ultra

Sofortige Stimm-Klonung mit Granular Tone Control

Moderate Geschwindigkeit
Very Good Qualität
Nein Klonen
10 Sprachen

Über Offene Stimme

OpenVoice ist ein vielseitiges Instant-Stimme-Klonmodell, das feinkörnige Kontrolle über den Sprachstil ermöglicht. Im Gegensatz zu anderen Klonmodellen trennt OpenVoice die Sprachidentität vom Sprechstil, sodass Sie eine geklonte Stimme nehmen und verschiedene Töne anwenden können - fröhlich, traurig, wütend, aufgeregt oder flüstern - ohne neue Referenz-Audio.

Hauptmerkmale

Sofortiges Klonen

Klonen Sie jede Stimme aus nur wenigen Sekunden Audio.

Tonsteuerung

Fröhliche, traurige, wütende, aufgeregte oder flüsternde Töne anwenden.

Stilübertragung

Trennen Sie Sprachidentität von sprechenden Stil für Flexibilität.

Querschnittsthemen

Verwenden Sie geklonte Stimmen in verschiedenen Sprachen.

Schnelle Verarbeitung

Effiziente Schlussfolgerung für schnelle Sprachgenerierung.

Quelle öffnen

MIT lizenziert für kommerzielle Anwendungen.

Anwendungsfälle

Emotionaler Inhalt Zeichenanimation Interaktive Spiele Hörbuch-Erzählung Marketing-Videos Virtuelle Assistenten

Wie man verwendet Offene Stimme

  1. 1

    Melde dich kostenlos an oder probiere die Demo aus

    Erstellen Sie ein kostenloses TextToSpeechAI-Konto, um Starter-Gutschriften zu erhalten, oder verwenden Sie die on-page-Demo, um OpenVoice vor dem Commit zu hören.

  2. 2

    Wählen Sie OpenVoice und laden Sie einen Referenzclip hoch

    Wählen Sie die OpenVoice-Engine und laden Sie dann ein paar Sekunden saubere Referenz-Audio, um sofort die Zielstimme zu klonen. OpenVoice erfasst die Lautsprecheridentität, so dass Sie es über jeden Text und Ton wiederverwenden können.

  3. 3

    Geben Sie Ihren Text ein

    Geben Sie das Skript ein oder fügen Sie es in die geklonte Stimme ein. OpenVoice unterstützt rund 10 Sprachen und die linguale Bereitstellung, sodass Sie in einer anderen Sprache als dem Referenzclip schreiben können.

  4. 4

    Wählen Sie einen Tonstil und erzeugen

    Wählen Sie eine der neun OpenVoice-Styles - Standard, freundlich, fröhlich, aufgeregt, traurig, wütend, erschreckt, schreien oder flüstern - dann erzeugen. Die gleiche geklonte Stimme wird mit dieser emotionalen Lieferung sprechen.

  5. 5

    API herunterladen oder verwenden

    Laden Sie Ihr Audio als MP3, WAV oder OGG herunter oder automatisieren Sie die Generation über die TextToSpeechAI API, indem Sie Ihre geklonte Stimme und Tonart in jeder Anfrage übergeben.

Offene Stimme API

Sprachprogrammatik mit der TextToSpeechAI REST API generieren.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "OpenVoice kann in jedem Ton sprechen \u002D fröhlich, traurig oder sogar flüstern.",
    "voice": "en_US-lessac-medium"
  }'

Häufig gestellte Fragen

OpenVoice ist ein fortschrittliches Text-zu-Sprechen- und Stimm-Klonmodell, das die Sprachidentität von der Sprechweise einzigartig trennt. So können Sie eine Stimme klonen und dann verschiedene emotionale Töne anwenden, ohne dass für jede Emotion ein neues Referenz-Audio benötigt wird. Es ist für ausdrucksstarke, kontrollierbare Sprachgenerationen gebaut.

Ja, OpenVoice führt sofortiges Stimmenklonen aus nur wenigen Sekunden Referenz-Audio durch - kein Trainingslauf erforderlich. Sobald eine Stimme erfasst ist, kann OpenVoice diese Identität über jeden beliebigen Text und jeden Tonstil wiederverwenden, den Sie wählen.

OpenVoice verwendet eine zweistufige Architektur, die die Sprachsynthese von der Tonkonvertierung trennt. Nach dem Klonen einer Stimme können Sie jede der 9 Tonarten - Standard, freundlich, fröhlich, aufgeregt, traurig, wütend, erschreckt, schreiend oder flüsternd - anwenden und die gleiche geklonte Stimme spricht unterschiedlich auf der Grundlage Ihres gewählten Tons ohne Wiederaufnahme.

OpenVoice unterstützt neun Sprachstile: Standard, freundlich, fröhlich, aufgeregt, traurig, wütend, erschreckt, schreiend und flüsternd. Jeder Stil formt die emotionale Ausstrahlung und bewahrt dabei die geklonte Lautsprecheridentität und gibt Ihnen eine feinkörnige Kontrolle darüber, wie eine Zeile gelesen wird.

OpenVoice ist Open Source unter der permissiven MIT-Lizenz, so dass es für kommerzielle Nutzung kostenlos ist. Wie bei jedem Klonmodell, stellen Sie sicher, dass Sie die richtigen Rechte an jeder Stimme haben, die Sie für kommerzielle Projekte klonen.

OpenVoice unterstützt rund 10 Sprachen, darunter Englisch, Chinesisch, Japanisch, Koreanisch und mehrere europäische Sprachen. Es bietet auch cross-linguale Klonen, so dass Sie eine Stimme in einer Sprache klonen und sie natürlich in einer anderen sprechen lassen können.

OpenVoice hat eine moderate Generationsgeschwindigkeit, die typischerweise einen Satz in 2-4 Sekunden auf einer GPU darstellt. Die Ausgabequalität ist sehr gut, mit klarer Sprachwiedergabe und Tonübertragung, die die Lautsprecheridentität intakt hält und gleichzeitig eine überzeugende Veränderung der emotionalen Leistung bewirkt.

OpenVoice benötigt normalerweise 6-8GB VRAM, abhängig von Batchgröße und Tonkonversionslast. Es läuft bequem auf Mittel- bis oberen Mittel-Bereich GPUs, und auf TextToSpeechAI wird all dies auf unseren Servern behandelt, so dass Sie keine lokale Hardware benötigen.

OpenVoice ist ein Ultra-Tier-Engine, Preis von 50 Credits pro 1000 Zeichen. Die Ultra-Tier spiegelt seine fortschrittliche Tonsteuerung und die zusätzliche Berechnung für die Kloning plus Stil-Umwandlung Pipeline erforderlich.

OpenVoice ist einzigartig für seine Ton-und Stilsteuerung: Sie können eine geklonte Stimme nehmen und wieder als fröhlich, traurig, wütend oder Flüstern. F5-TTS ist schneller und ist unsere Standard-Klon-Engine für natürliche, neutrale Sprache. Wählen Sie OpenVoice, wenn Sie emotionale Stilsteuerung benötigen, und F5-TTS, wenn Sie den schnellsten natürlichen Klon wollen.

Erstellen Sie eine geklonte Stimme, indem Sie Referenz-Audio hochladen, dann geben Sie einen Tonstil in Ihrer API-Anfrage an. Die API wendet Ihren gewählten emotionalen Ton automatisch auf die geklonte Stimme an und gibt das Audio im MP3, WAV oder OGG-Format zurück.

Ja. Melden Sie sich für ein kostenloses TextToSpeechAI Konto an, um Starter-Credits zu erhalten und versuchen Sie OpenVoice Klonen und Tonsteuerung, oder verwenden Sie die on-page Demo zuerst. Es gibt keine lokale Einrichtung - Hochladen eines Referenzclips, wählen Sie einen Ton, und erzeugen Sie im Browser.

Technical Specs

  • Generation Speed Moderate
  • Output Quality Very Good
  • Voice Cloning Supported
  • Languages 10
  • GPU VRAM 3-6GB
  • Credits/1000 chars 50

Try Offene Stimme Now

Generate your first audio free. No credit card required.

Start Free