StyleTTS 2
UltraTexto a voz a nivel humano con transferencia de estilo
Acerca de StyleTTS 2
StyleTTS 2 logra síntesis de texto a voz a nivel humano a través de la difusión de estilos y la formación contradictoria. Puede transferir estilos de habla desde audio de referencia, mientras que genera un habla altamente natural que rivaliza con grabaciones humanas reales. StyleTTS 2 representa el estado de la técnica en la calidad y naturalidad TTS.
Características principales
Calidad a nivel humano
Produce el habla indistinguible de grabaciones humanas en pruebas ciegas.
Transferencia de estilo
Transfiera el estilo de habla de cualquier muestra de audio de referencia.
Prosodia natural
Ritmo perfecto, estrés y entonación con modelado basado en la difusión.
Clonación de voz
Voces clonadas con una precisión y naturalidad excepcionales.
Inferencia rápida
Más rápido que los modelos autorregresivos mientras se mantiene la calidad.
Código abierto
MIT licenciado con derechos de uso comercial completo.
Casos de uso
StyleTTS 2 Voices
View All 6StyleTTS2 Default
ENStyleTTS2 Expressive
ENStyleTTS2 Fast
ENStyleTTS2 Natural
ENStyleTTS2 Neutral
ENStyleTTS2 Quality
ENCómo usar StyleTTS 2
-
1
Inscríbete gratis o ejecuta la demo
Cree una cuenta TextToSpeechAI gratis para obtener créditos de inicio, o utilice la demo de la página de inicio para escuchar StyleTTS2 sin iniciar sesión.
-
2
Elija el motor StyleTTS2
Seleccione una voz StyleTTS2 de la biblioteca de voz. Para clonar una voz, cargue un clip de referencia de 10-30 segundos y StyleTTS2 transferirá su estilo.
-
3
Introduzca su texto
Pegue o escriba el guión que desee narrado. StyleTTS2 sobresale en inglés y ofrece prosodia natural, estrés y entonación a través de largos pasajes.
-
4
Generar el audio
Haga clic en generar y TextToSpeechAI renderiza su audio StyleTTS2 en GPU. Estilo de ultra-tierTTS2 cuesta 50 créditos por 1000 caracteres.
-
5
Descargue o utilice la API
Descargue el audio acabado de StyleTTS2 como MP3, WAV u OGG, o llame a la API TextToSpeechAI con su voz StyleTTS2 para automatizar la generación.
StyleTTS 2 API
Generar voz programáticamente usando la API TextToSpeechAI REST.
curl -X POST "https://api.texttospeechai.com/v1/generate/" \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"text": "StyleTTS 2 produce un discurso tan natural, que rivaliza con grabaciones humanas profesionales.",
"voice": "styletts2-default"
}'
Preguntas frecuentes
Technical Specs
- Generation Speed Moderate
- Output Quality Excellent
- Voice Cloning Supported
- Languages 1
- GPU VRAM 4-6GB
- Credits/1000 chars 50