StyleTTS 2
UltraLe niveau humain de texte à parole avec transfert de style
À propos StyleTTS 2
StyleTTS 2 réalise une synthèse texte-à-discours au niveau humain par diffusion de style et formation contradictoire. Il génère un discours très naturel qui rivalise avec les enregistrements humains réels. StyleTTS 2 représente l'état de la qualité et de la naturalité TTS.
Caractéristiques principales
Qualité au niveau humain
Produit la parole indistinctible à partir des enregistrements humains dans des tests aveugles.
Style expressif
Modèles parlant style donc la livraison varie naturellement avec le texte.
Prosodie naturelle
Rythme parfait, stress et intonation avec modélisation basée sur la diffusion.
Voix studio
Choisissez parmi les voix de style TTS 2 prêtes à l'emploi dans la bibliothèque vocale.
Inférence rapide
Plus rapide que les modèles autorégressifs tout en maintenant la qualité.
Source ouverte
MIT sous licence avec plein droit d'utilisation commerciale.
Cas d'utilisation
StyleTTS 2 Voices
View All 6StyleTTS2 Default
ENStyleTTS2 Expressive
ENStyleTTS2 Fast
ENStyleTTS2 Natural
ENStyleTTS2 Neutral
ENStyleTTS2 Quality
ENComment utiliser StyleTTS 2
-
1
Inscrivez-vous gratuitement
Créez un compte gratuit TextToSpeechAI pour obtenir des crédits de démarrage.
-
2
Choisissez le moteur StyleTTS2
Sélectionnez une voix StyleTTS2 dans la bibliothèque vocale.
-
3
Saisissez votre texte
Coller ou taper le script que vous voulez narrer. StyleTTS2 excelle en anglais et livre la prosodie naturelle, le stress et l'intonation sur de longs passages.
-
4
Générer l'audio
Cliquez sur générer et TextToSpeechAI rend votre audio StyleTTS2 sur GPU. Ultra-tier StyleTTS2 coûte 50 crédits par 1000 caractères.
-
5
Télécharger ou utiliser l'API
Téléchargez l'audio de StyleTTS2 fini en MP3, WAV ou OGG, ou appelez l'API TextToSpeechAI avec votre voix StyleTTS2 pour automatiser la génération.
StyleTTS 2 API
Générer la parole en utilisant l'API TextToSpeechAI REST.
curl -X POST "https://api.texttospeechai.com/v1/generate/" \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"text": "StyleTTS 2 produit des paroles si naturelles, il rivalise avec les enregistrements humains professionnels.",
"voice": "styletts2-default"
}'
Foire aux questions
Technical Specs
- Generation Speed Moderate
- Output Quality Excellent
- Voice Cloning Not Supported
- Languages 1
- GPU VRAM 4-6GB
- Credits/1000 chars 50