За Стилтс 2
StyleTTS 2 постига синтез на човешкото ниво на текст-то-спеч чрез разпространение на стила и сраждане. Тя генерира високо естествена реч, която съперничи реални човешки записи. StyleTTS 2 представлява най-модерното качество и естественост на TTS.
Ключови характеристики
Качество на човешкото ниво
Произвежда реч неразграничаема от човешките записи в сляпо тестове.
Изразяващ стил
Модели говорещ стил така доставката варира естествено с текста.
Естествена прозодия
Перфектен ритъм, стрес и интонация с дифузионно моделиране.
Студио гласове
Изберете от готов стилTTS 2 гласа в гласовата библиотека.
Бързо изследване
По-бързо от автоматично регресивни модели, като поддържа качеството.
Отваряне на източник
МИТ лицензирани с права за пълно ползване на търговските продукти.
Случаи на употреба
Стилтс 2 Voices
View All 6StyleTTS2 Default
ENStyleTTS2 Expressive
ENStyleTTS2 Fast
ENStyleTTS2 Natural
ENStyleTTS2 Neutral
ENStyleTTS2 Quality
ENКак да използвате Стилтс 2
-
1
Запишете се безплатно
Създаване на безплатен TextToSpeechAI профил за да получите стартер кредити.
-
2
Избор на двигателя на StyleTTS2
Изберете глас на StyleTTS2 от гласовата библиотека.
-
3
Въведете вашия текст
Вмъкнете или напишете скрипта, който искате нарирано. StyleTTS2 е изящна на английски и осигурява естествена прозида, стрес, и интонация в продължение на дълги пасажи.
-
4
Създаване на звука
Кликнете върху генериране и TextToSpeechAI прави вашия StyleTTS2 аудио на GPU. Ultra-tier StyleTTS2 струва 50 кредита на 1000 символа.
-
5
Изтеглете или използвайте API
Изтеглете завършения styleTTS2 звук като MP3, WAV или OGG, или се обадите на TextToSpeechAI API с вашия стилTTS2 глас за автоматизиране на поколението.
Стилтс 2 АПИ
Генериране на речна програма с помощта на TextToSpeechAI REST API.
curl -X POST "https://api.texttospeechai.com/v1/generate/" \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"text": "StyleTTS 2 произвежда речта толкова естествена, че съперства професионални човешки записи.",
"voice": "styletts2-default"
}'
Често задавани въпроси
Technical Specs
- Generation Speed Moderate
- Output Quality Excellent
- Voice Cloning Not Supported
- Languages 1
- GPU VRAM 4-6GB
- Credits/1000 chars 50