ВИДЦИ
StandardБърз край до край ТТС с естествено слово
За ВИДЦИ
VITS (Вariacional Inference с adversarial learning for end-to-end Text-to-Speak) е бързо, крайно-конечно неврален TTS модел, който генерира естествено-звукова реч. Тя съчетава вариационни автокодери с адверсариално обучение за ефикасен синтез. VITS е отлично за партидна обработка и приложения, изискващи както качество, така и скорост.
Ключови характеристики
Бърза синтезация
Край на край архитектура за бързото построяване на речта.
Пакетна обработка
Ефективно обработване на няколко текстове едновременно.
Естествена реч
VAE+GAN обучението произвежда естествена прозодия и ритъм.
Многоговорител
Един модел поддържа няколко гласове.
Ефективно
Нисък отпечатък от памет с добро изпълнение.
Отваряне на източник
MIT лицензиран за всяка употреба.
Случаи на употреба
ВИДЦИ Voices
View All 109LJSpeech (English Female)
ENVCTK Speaker 225 (English Female)
ENVCTK Speaker 226 (English Male)
ENVCTK Speaker 227 (English Male)
ENVCTK Speaker 228 (English Female)
ENVCTK Speaker 229
ENVCTK Speaker 230
ENVCTK Speaker 231
ENVCTK Speaker 232
ENVCTK Speaker 233
ENVCTK Speaker 234
ENVCTK Speaker 236
ENКак да използвате ВИДЦИ
-
1
Запишете се безплатно или опитайте демото
Създавайте безплатен акаунт TextToSpeechAI за да получите стартер кредити, или използвайте демото на страницата, за да чуете VITS преди да се регистрира.
-
2
Изберете глас или говорител на VITS
Преглед на гласовата библиотека и изберете глас, маркиран с значката VITS. Библиотеката с многоизказватели VITS, включително настройката на VCTK, ви позволява да изберете от много различни гласове.
-
3
Въведете вашия текст
Въведете или вметнете текста, който искате да се говори в редактора. VITS се справя добре с дълги пасажи и е идеален за партидно и високо обемно съдържание.
-
4
Създаване на звука
Кликнете върху генериране, за да синтезирате речта с VITS. Тъй като VITS е много бързо и стандартно-тир (10 кредита на 1000 символа), резултатите се връщат бързо с ниска цена.
-
5
Изтеглете или използвайте API
Изтеглете завършения звук като MP3, WAV или OGG, или се обадите на същия VITS глас чрез TextToSpeechAI REST API, за да автоматизирате поколението си в собствената програма.
ВИДЦИ АПИ
Генериране на речна програма с помощта на TextToSpeechAI REST API.
curl -X POST "https://api.texttospeechai.com/v1/generate/" \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"text": "VITS осигурява бързо, естествено говорене за високообемни приложения.",
"voice": "vits-ljspeech"
}'
Често задавани въпроси
Technical Specs
- Generation Speed Very Fast
- Output Quality Good
- Voice Cloning Not Supported
- Languages 10
- GPU VRAM 1-2GB
- Credits/1000 chars 10