Стилтс 2

Ultra

Текст- наговор с стил

Moderate Скорост
Excellent Качество
Не. Клониране
1 Езици

За Стилтс 2

StyleTTS 2 постига синтез на човешкото ниво на текст-то-спеч чрез разпространение на стила и сраждане. Тя генерира високо естествена реч, която съперничи реални човешки записи. StyleTTS 2 представлява най-модерното качество и естественост на TTS.

Ключови характеристики

Качество на човешкото ниво

Произвежда реч неразграничаема от човешките записи в сляпо тестове.

Изразяващ стил

Модели говорещ стил така доставката варира естествено с текста.

Естествена прозодия

Перфектен ритъм, стрес и интонация с дифузионно моделиране.

Студио гласове

Изберете от готов стилTTS 2 гласа в гласовата библиотека.

Бързо изследване

По-бързо от автоматично регресивни модели, като поддържа качеството.

Отваряне на източник

МИТ лицензирани с права за пълно ползване на търговските продукти.

Случаи на употреба

Премиум аудиокниги Професионални режисери Производство на филм и телевизия Реклама с висок край Производство на подкаст Гласово действие

Стилтс 2 Voices

View All 6
StyleTTS2 Default
EN
StyleTTS2 Expressive
EN
StyleTTS2 Fast
EN
StyleTTS2 Natural
EN
StyleTTS2 Neutral
EN
StyleTTS2 Quality
EN

Как да използвате Стилтс 2

  1. 1

    Запишете се безплатно

    Създаване на безплатен TextToSpeechAI профил за да получите стартер кредити.

  2. 2

    Избор на двигателя на StyleTTS2

    Изберете глас на StyleTTS2 от гласовата библиотека.

  3. 3

    Въведете вашия текст

    Вмъкнете или напишете скрипта, който искате нарирано. StyleTTS2 е изящна на английски и осигурява естествена прозида, стрес, и интонация в продължение на дълги пасажи.

  4. 4

    Създаване на звука

    Кликнете върху генериране и TextToSpeechAI прави вашия StyleTTS2 аудио на GPU. Ultra-tier StyleTTS2 струва 50 кредита на 1000 символа.

  5. 5

    Изтеглете или използвайте API

    Изтеглете завършения styleTTS2 звук като MP3, WAV или OGG, или се обадите на TextToSpeechAI API с вашия стилTTS2 глас за автоматизиране на поколението.

Стилтс 2 АПИ

Генериране на речна програма с помощта на TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "StyleTTS 2 произвежда речта толкова естествена, че съперства професионални човешки записи.",
    "voice": "styletts2-default"
  }'

Често задавани въпроси

StyleTTS2 е най-модерният модел за текст-то-спеч, който постига синтез на човешко ниво на реч. Тя използва дифузия на стил и сравняващо обучение за да произведе реч, която е практически неразграничаема от реални човешки записи в тестове за сляпо слушане. Можете да опитате StyleTTS2 безплатно на TextToSpeechAI.

StyleTTS2 произвежда най-високото качество на TTS аудио на TextToSpeechAI. В официални оценки тя достигна рейтинги на човешко ниво на тестове на MOS (Менното мнение резултат) с слушателите често не могат да го различават от истински човешки говорител. Той седи в нашия Ултра ниво до Tortoise поради тази причина.

Не и на TextToSpeechAI. Тук гласовете на StyleTTS2 са гласове, направени от библиотеката. За клониране на гласа използвайте инструмента за клониране на гласа, който работи Chatterbox.

Да. StyleTTS2 е освободен по лиценза на MIT, който позволява пълно търговско използване без авторски права. Това го прави безопасен за аудиокниги, реклами, филми и други професионални проекти на StyleTTS2, където правата са важни.

StyleTTS2 поддържа предимно английски, тъй като моделът е обучен по английски набори данни. За други езици използвайте гласове на Piper или Bark или клониран глас.

StyleTTS2 има умерена генерационна скорост. Тя е много по-бърза от автоматично регресивни модели като Tortoise, но по-бавна от леки двигатели като Piper. Поради премиум качество и изчисления разходи, StyleTTS2 е ценена в нашия Ultra низходящ модел, отколкото като реално време.

StyleTTS2 изисква приблизително 4-6GB VRAM за изчисляване. Той е по-паметно ефективен от Bark или Tortoise при производство на по-високо качество на изход. На TextToSpeechAI всички StyleTTS2 процеси на процеси на нашите GPU, така че не се нуждаете от хардуер от собствена хардуера.

StyleTTS2 е ултра-тиер модел и струва 50 кредита на 1000 символа на TextToSpeechAI. Този премиум ценообразуване отразява качеството на човека и необходимите ресурси на GPU. За сравнение, стандартните модели като VITS струват 10 кредита на 1000 символа и Payper разходи 1 кредит на 1000 символа.

И двете са Ultra null (50 кредити на 1000 символа) и английски. StyleTTS2 е много по-бързо, докато Tortoise може да звучи малко по-естествено на дълги пасажи. Изберете StyleTTS2 когато имате нужда от много клипове и Tortoise, когато времето не е ограничено.

StyleTTS2 генерира висококачествено аудио на 24kHz. През TextToSpeechAI можете да изтеглите резултата като MP3, WAV или OGGG, и ние използваме висококачествено кодиране, така че изключителното качество StyleTTS2 се запазва в крайния файл.

Да. StyleTTS2 поддържа регулиране на скоростта на говорене, и всеки глас в библиотеката има собствена доставка, така че изборът на различен глас променя прозидата.

Изберете глас на StyleTTS2 от нашата библиотека, след което препратете този глас в вашите API искания. TextToSpeechAI управлява всички процеси на GPU и връща адрес за изтегляне с премиум StyleTTS2 аудио.

Technical Specs

  • Generation Speed Moderate
  • Output Quality Excellent
  • Voice Cloning Not Supported
  • Languages 1
  • GPU VRAM 4-6GB
  • Credits/1000 chars 50

Try Стилтс 2 Now

Generate your first audio free. No credit card required.

Start Free