VITS

Standard

Təbii səslə sürətli son-son TTS

Very Fast Sür'ət
Good Keyfiyyət
_Yox _Klonla
1 Dillər

Bağlan VITS

-efficient, and low-cost TTS model that generates natural-sounding speech. It is a

Xüsusiyyətlər

Sür'ətli sintez

End-to-end arxitekturası sürətli söz istehsalı üçün.

Bağlan

Birdən çox mətni effektiv şəkildə işlədin.

Təbii Sənəd

VAE + GAN təlim təbii prosodiya və ritm istehsal edir.

Çoxlu səsləndirici

Bir model bir çox səsləndirici səsləri dəstəkləyir.

Əlavə Et

Düzgün performansla aşağı yaddaş istifadəsi.

Açıq mənbə

Hər hansı bir istifadə üçün MIT lisenziyalıdır.

İstifadəçi

Audio Yaradıcılığı E-öyrənmə platforması Xəbər oxuyucusu Avtomatik bildirişlər IVR Sistemləri Yüksək səsli

VITS Voices

View All 109
LJSpeech (English Female)
EN
VCTK Speaker 225 (English Female)
EN
VCTK Speaker 226 (English Male)
EN
VCTK Speaker 227 (English Male)
EN
VCTK Speaker 228 (English Female)
EN
VCTK Speaker 229
EN
VCTK Speaker 230
EN
VCTK Speaker 231
EN
VCTK Speaker 232
EN
VCTK Speaker 233
EN
VCTK Speaker 234
EN
VCTK Speaker 236
EN

İstifadəsi VITS

  1. 1

    Qeydiyyatdan keç

    Başlanğıc kreditləri almaq üçün pulsuz TextToSpeechAI hesabını yaradın.

  2. 2

    VITS səsi ya da səsləndiricisi seçin

    Səs kitabxanasını gəz və VITS simvolu ilə işarə edilmiş səsi seçin. VCTK səsləndiriciləri də daxil olmaqla çoxlu səsləndirici VITS kitabxanası bir çox fərqli səslərdən seçməyinizə imkan verir.

  3. 3

    Mətnini daxil et

    Diqqət çəkmək istədiyiniz mətni redaktora daxil edin ya da yapışdırın. VITS uzun hissələri yaxşı idarə edir və paket və böyük həcmli məzmun üçün idealdır.

  4. 4

    Audionu yarat

    VITS ilə sintez etmək üçün "Yarat" düyməsini basın. VITS çox sürətli və Standart səviyyəli olduğundan (1000 xarakter üçün 10 kredit), nəticələr tez və ucuz olaraq geri gəlir.

  5. 5

    API yüklə və ya istifadə et

    Sonuncu səsi MP3, WAV, ya da OGG olaraq yükləyin, ya da eyni VITS səsini TextToSpeechAI REST API vasitəsilə çağırın öz tətbiqinizdə avtomatlaşdırılmış istehsal etmək üçün.

VITS API

TextToSpeechAI REST API-ni istifadə edərək proqramlaşdırılmış səsi yarada bilərsiniz.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "VITS yüksək həcmli tətbiqlər üçün sürətli, təbii danışığı təmin edir.",
    "voice": "vits-ljspeech"
  }'

Tez-tez Sorulan Sual

VITS (Variasiyalı İnferans ilə Mübarizəli Öyrənmə üçün Sondan Sona Mətndən Söhbətə) variasiyalı avtokodlayıcı ilə mübarizəli GAN təlimlərini birləşdirən sondan sona neyron TTS modelidir. O, tək bir keçiddə təbii səsli sözləri yaradır, bu da onu sürətli və effektiv edir. VITS-i TextToSpeechAI-də pulsuz sınaya bilərsiniz.

Bəli, VITS MIT lisenziyası altında açıq mənbədir, buna görə də məhdudiyyətsiz ticarət istifadəsini dəstəkləyir. Ticarət məhsulları və xidmətlərində geniş istifadə olunur. TextToSpeechAI-də VITS Standart səviyyədə 1000 xarakter üçün 10 kreditə başa gəlir.

TextToSpeechAI VCTK səsləri də daxil olmaqla çoxlu fərqli İngilis səsləri olan böyük bir çoxlu səsli VITS kitabxanası təklif edir. Bir VITS modeli bir çox səsli səsləri qəbul edə bilər, buna görə də siz motoru dəyişmədən bir çox fərqli səslərdən birini seçə bilərsiniz.

TextToSpeechAI-də VITS səsləri ingiliscədir, LJSpeech və VCTK səsləndirici dəstələrindən alınmışdır. Digər dillər üçün Piper və ya Bark səslərini istifadə edin.

VITS çox sürətlidir, real vaxtda və ya GPU-da daha sürətli səsi yarada bilir. Onun son-son mimarisi digər modellərin çoxlu işləmə mərhələlərini aradan qaldırır, bu səbəbdən VITS paket və yüksək həcmli sintez üçün yaxşı uyğundur.

Xeyr, VITS səs klonlamasını dəstəkləmir. O, məqsəd səsini nümunədən kopyalamaq əvəzinə əvvəlcədən öyrədilmiş çoxlu səsləndirici modellərini istifadə edir. Səs klonlaması üçün, Chatterbox-u işə salan Klon səs alətini istifadə edin.

VITS təbii prosodi və ritmlə yaxşı keyfiyyətli səs istehsal edir. StyleTTS 2 və ya Tortoise səviyyəsində olmasa da, sürəti üçün yaxşı keyfiyyət təklif edir, xüsusilə də paket işləmə üçün.

VITS yaddaş səmərəlidir, adətən yalnız bir neçə GB VRAM (təxminən 4GB) tələb edir. İstehsalçı GPU-larda rahat işləyir, TextToSpeechAI-də bütün renderləmə serverlərimizdə baş verir, buna görə də heç bir hardvera ehtiyacınız yoxdur.

VITS və Piper hər ikisi TextToSpeechAI üzərində MIT-licensiyalı sürətli mühərriklərdir. Piper ən yüngül seçimdir və 1000 xarakter üçün 1 kreditə başa gəlir, VITS (1000 xarakter üçün 10 kredit) isə daha təbii prozodiya ilə böyük bir çox səsləndirici kitabxanası təklif edir (VCTK daxildir). Heç biri səs klonlaşdırmasını dəstəkləmir.

VITS standart səviyyəli motordur, 1000 xarakter üçün 10 kreditə başa gəlir. Yalnız Piper, 1000 xarakter üçün 1 kreditə başa gəlir, daha az xərc çəkir.

VITS 22050Hz-də səsi yerli olaraq yaradır. TextToSpeechAI vasitəsilə MP3, WAV, ya da OGG formatlarını istəyərək, avtomatik çevirməni sizin üçün idarə edə bilərsiniz.

Pulsuz kreditlər almaq üçün TextToSpeechAI saytına qeyd olun, sonra VITS səsini seçin, mətni daxil edin və səsi yarada bilərsiniz. VITS-ə qeyd olunduqdan sonra REST API vasitəsilə də daxil ola bilərsiniz.

Technical Specs

  • Generation Speed Very Fast
  • Output Quality Good
  • Voice Cloning Not Supported
  • Languages 1
  • GPU VRAM 1-2GB
  • Credits/1000 chars 10

Try VITS Now

Generate your first audio free. No credit card required.

Start Free