VIERTEL
StandardSchnelles Ende-zu-Ende-TTS mit natürlicher Sprache
Über VIERTEL
VITS (Variational Inference with adversarial Learning for End-to-End Text-to-Speech) ist ein schnelles, durchgängig neuronales TTS-Modell, das eine natürliche Sprache erzeugt. Es kombiniert Variations-Autoencoder mit adversarialen Trainings für effiziente Synthese. VITS ist hervorragend für die Batch-Verarbeitung und Anwendungen, die sowohl Qualität als auch Geschwindigkeit erfordern.
Hauptmerkmale
Schnelle Synthese
End-to-End-Architektur für schnelle Spracherzeugung.
Batch-Verarbeitung
Mehrere Texte effizient gleichzeitig verarbeiten.
Natürliche Sprache
VAE+GAN Training erzeugt natürliche Prosodie und Rhythmus.
Mehrsprachiger Redner
Ein Modell unterstützt mehrere Lautsprecherstimmen.
Effizient
Geringer Speicherfußabdruck mit guter Leistung.
Quelle öffnen
MIT lizenziert für jeden Anwendungsfall.
Anwendungsfälle
VIERTEL Voices
View All 109LJSpeech (English Female)
ENVCTK Speaker 225 (English Female)
ENVCTK Speaker 226 (English Male)
ENVCTK Speaker 227 (English Male)
ENVCTK Speaker 228 (English Female)
ENVCTK Speaker 229
ENVCTK Speaker 230
ENVCTK Speaker 231
ENVCTK Speaker 232
ENVCTK Speaker 233
ENVCTK Speaker 234
ENVCTK Speaker 236
ENWie man verwendet VIERTEL
-
1
Melde dich kostenlos an oder probiere die Demo aus
Erstellen Sie ein kostenloses TextToSpeechAI-Konto, um Starter-Credits zu erhalten, oder nutzen Sie die on-page-Demo, um VITS vor der Anmeldung zu hören.
-
2
Wählen Sie eine VITS-Stimme oder einen Lautsprecher
Durchsuchen Sie die Sprachbibliothek und wählen Sie eine mit dem VITS-Abzeichen markierte Stimme. Mit der Mehrsprechen-VITS-Bibliothek, einschließlich des VCTK-Lautsprecher-Sets, können Sie aus vielen verschiedenen Stimmen auswählen.
-
3
Geben Sie Ihren Text ein
Geben Sie den gewünschten Text in den Editor ein oder fügen Sie ihn ein. VITS verarbeitet lange Passagen gut und ist ideal für Batch- und High-Volume-Inhalte.
-
4
Erzeugen des Audios
Klicken Sie auf erzeugen, um Sprache mit VITS zu synthetisieren. Da VITS sehr schnell und Standard-Tier (10 Credits pro 1000 Zeichen) ist, Ergebnisse schnell zu niedrigen Kosten zurück.
-
5
API herunterladen oder verwenden
Laden Sie das fertige Audio als MP3, WAV oder OGG herunter oder rufen Sie die gleiche VITS-Stimme über die TextToSpeechAI REST API auf, um die Erzeugung in Ihrer eigenen Anwendung zu automatisieren.
VIERTEL API
Sprachprogrammatik mit der TextToSpeechAI REST API generieren.
curl -X POST "https://api.texttospeechai.com/v1/generate/" \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"text": "VITS liefert schnelle, natürliche Sprachausgabe für Anwendungen mit hohem Volumen.",
"voice": "vits-ljspeech"
}'
Häufig gestellte Fragen
Technical Specs
- Generation Speed Very Fast
- Output Quality Good
- Voice Cloning Not Supported
- Languages 10
- GPU VRAM 1-2GB
- Credits/1000 chars 10