ВИТС

Standard

Тез, бүткүл текстти табигый үн менен которуу

Very Fast Жылдамдык
Good _Качество
Жок Клондоо
1 Тилдер

Маалымат ВИТС

-to-end neural TTS model that generates natural-sounding speech. It combines variational autoencoders with adversarial learning for efficient synthesis. VITS is excellent for batch processing and applications requiring high-speed, high-performance, and high-quality synthesis. It combines variational autoencoders with adversarial learning for

Ачкыч өзгөчөлүктөрү

Жылдам синтез

Жылдам сүйлөмдү түзүү үчүн бүткүл архитектура.

Партиялык иштетүү

Бир эле учурда бир нече текстти натыйжалуу иштетүү.

Табигый үн

VAE+GAN тренинги табигый прозодия жана ритми менен камсыз кылат.

Бир нече үн чыгаргыч

Бир моделдин бир нече сүйлөмдөрү колдоого алынат.

Эффективдүү

Жакшы иштөө менен аз эсти талап кылуу.

Ачык булак

MIT лицензиясы ар кандай колдонуу үчүн.

Колдонуу мисалдары

Аудио генератор Электрондук окуу платформалары Маалымат окурмандар Автоматтык кабарлоо IVR системалары Көп үндүү мазмун

ВИТС Voices

View All 109
LJSpeech (English Female)
EN
VCTK Speaker 225 (English Female)
EN
VCTK Speaker 226 (English Male)
EN
VCTK Speaker 227 (English Male)
EN
VCTK Speaker 228 (English Female)
EN
VCTK Speaker 229
EN
VCTK Speaker 230
EN
VCTK Speaker 231
EN
VCTK Speaker 232
EN
VCTK Speaker 233
EN
VCTK Speaker 234
EN
VCTK Speaker 236
EN

Колдонуу ВИТС

  1. 1

    Акысыз катталуу

    Starter кредиттерин алуу үчүн акысыз TextToSpeechAI эсебин түзүү.

  2. 2

    VITS үн же динамикти тандоо

    Слушайте аудиокниги и выбирайте голос, обозначенный VITS-багсом. Многоголосная библиотека VITS, включая VCTK-диктор, позволяет выбрать из множества различных голосов.

  3. 3

    Текстти киргизиңиз

    Текст, который вы хотите услышать, введите в редактор или поместите туда. VITS хорошо справляется с длинными отрывкамидеально подходит для пакетного и большого объема контента.

  4. 4

    Аудио түзүү

    VITS менен сүйлөмдү синтездөө үчүн "Жаңылоо" баскычын чыкылдатыңыз. VITS өтө тез жана стандарттык деңгээлде (1000 символго 10 кредит), натыйжалар тез жана арзан кайтарылат.

  5. 5

    API жүктөп алуу же колдонуу

    Окулган аудиону MP3, WAV же OGG түрүндө жүктөп алыңыз, же ошол эле VITS үнүнө TextToSpeechAI REST API аркылуу чалып, өз тиркемеңизде генерациялоону автоматташтырыңыз.

ВИТС API

TextToSpeechAI REST API'ни колдонуп программалык түрдө сүйлөмдү түзүү.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "VITS тез жана табигый сүйлөмдү көп көлөмдөгү тиркемелерге берет.",
    "voice": "vits-ljspeech"
  }'

Кайра-кайра берилүүчү суроолор

VITS (Variation Inference with adversarial learning for end-to-end Text-to-Speech) - бул варианттык автокоддоону жана GAN машыгуусун бириктирген, бүткүл текстти сүйлөмгө айландыруучу нейрондук модель. Ал бир жолу табигый үн менен сүйлөмдү жаратат, бул аны тез жана натыйжалуу кылат. VITSти TextToSpeechAIде акысыз сынап көрүңүз.

Ооба, VITS MIT лицензиясы менен ачык булак, ошондуктан ал чектөөсүз толук коммерциялык колдонууну колдойт. Ал коммерциялык продуктуларда жана кызматтарда кеңири колдонулат. TextToSpeechAIде VITS 1000 символ үчүн 10 кредитке бааланат, Стандарттык деңгээлде.

TextToSpeechAI кеңири көп сүйлөмдүү VITS китепканасын сунуштайт, анын ичинде VCTK үн топтомун, анда ондогон ар кандай англис сүйлөмдөрү бар. Бир VITS модели бир нече сүйлөмдү камтыйт, ошондуктан сиз бир нече үндөн тандап, кыймылдаткычты алмаштырбайсыз.

VITS үндөрү TextToSpeechAI'де англис тилинде, LJSpeech жана VCTK үн чыгаргычтарынын топторунан алынган. Башка тилдер үчүн, Piper же Bark үндөрү колдонулат.

VITS абдан тез, сөздөрдү чыныгы убакытта же GPUда тез генерациялайт. Анын бүткүл архитектурасы башка моделдердин бир нече иштетүү баскычтарын жокко чыгарат, ошондуктан VITS пакеттик жана чоң көлөмдөгү синтездөөгө ылайыктуу.

Жок, VITS үн клондоону колдобойт. Ал алдын-ала даярдалган көп сүйлөгөн моделдерди колдонот, ал эми максаттуу үндү үлгүдөн көчүрбөйт. Сөздү клондоо үчүн, "Сөздү клондоо" аспабын колдонуп, Chatterbox программасын иштетиңиз.

VITS табигый прозодия жана ритми менен жакшы сапаттагы аудиону жаратат. StyleTTS 2 же Tortoise деңгээлинде эмес, бирок ылдамдыгы үчүн, айрыкча пакеттик иштетүү үчүн, сапаты абдан жакшы.

VITS эсти үнөмдүү колдонот, адаттагыдай эле бир нече ГБ VRAM (4 ГБга жакын) керектелет. Ал колдонуучулардын графикалык процессорлорунда ыңгайлуу иштей алат, ал эми TextToSpeechAIде бардык рендерлөө биздин серверлерде болот, ошондуктан сизге эч кандай аппараттык жабдык керек эмес.

VITS and Piper are both fast, MIT-licensed engines on TextToSpeechAI. Piper is the lightest option and costs 1 credit per 1,000 characters, while VITS (10 credits per 1,000 characters) offers a large multi-speaker library (including VCTK) with slightly more natural prosody. Neither supports voice cloning.

VITS - бул стандарттык деңгээлдеги машина, 1000 символ үчүн 10 кредит. Бирок Piper, 1000 символ үчүн 1 кредит, үнөмдүү.

VITS 22050 Гц ылдамдыкта аудиону жаратат. TextToSpeechAI аркылуу MP3, WAV же OGG форматтарын талап кыла аласыз, автоматтык түрдө конвертациялоо сиз үчүн иштелип чыгат.

Бесплатные стартовые кредиты получить на TextToSpeechAI.com, затем выбрать VITS голос, ввести текст и генерировать аудио. Вы также можете получить доступ к VITS через наш REST API после регистрации.

Technical Specs

  • Generation Speed Very Fast
  • Output Quality Good
  • Voice Cloning Not Supported
  • Languages 1
  • GPU VRAM 1-2GB
  • Credits/1000 chars 10

Try ВИТС Now

Generate your first audio free. No credit card required.

Start Free