VITS

Standard

Təbii səslə sürətli son-son TTS

Very Fast Sür'ət
Good Keyfiyyət
_Yox _Klonla
10 Dillər

Bağlan VITS

-efficient, and low-cost TTS model that generates natural-sounding speech. It is a

Xüsusiyyətlər

Sür'ətli sintez

End-to-end arxitekturası sürətli söz istehsalı üçün.

Bağlan

Birdən çox mətni effektiv şəkildə işlədin.

Təbii Sənəd

VAE + GAN təlim təbii prosodiya və ritm istehsal edir.

Çoxlu səsləndirici

Bir model bir çox səsləndirici səsləri dəstəkləyir.

Əlavə Et

Düzgün performansla aşağı yaddaş istifadəsi.

Açıq mənbə

Hər hansı bir istifadə üçün MIT lisenziyalıdır.

İstifadəçi

Audio Yaradıcılığı E-öyrənmə platforması Xəbər oxuyucusu Avtomatik bildirişlər IVR Sistemləri Yüksək səsli

VITS Voices

View All 109
LJSpeech (English Female)
EN
VCTK Speaker 225 (English Female)
EN
VCTK Speaker 226 (English Male)
EN
VCTK Speaker 227 (English Male)
EN
VCTK Speaker 228 (English Female)
EN
VCTK Speaker 229
EN
VCTK Speaker 230
EN
VCTK Speaker 231
EN
VCTK Speaker 232
EN
VCTK Speaker 233
EN
VCTK Speaker 234
EN
VCTK Speaker 236
EN

İstifadəsi VITS

  1. 1

    Pulsuz qeyd olun ya da demonu sınayın

    Starter kreditləri almaq üçün pulsuz TextToSpeechAI hesabını yaradın, ya da qeydiyyatdan keçmədən əvvəl VITS-i dinləmək üçün səhifədəki demodan istifadə edin.

  2. 2

    VITS səsi ya da səsləndiricisi seçin

    Səs kitabxanasını gəz və VITS simvolu ilə işarə edilmiş səsi seçin. VCTK səsləndiriciləri də daxil olmaqla çoxlu səsləndirici VITS kitabxanası bir çox fərqli səslərdən seçməyinizə imkan verir.

  3. 3

    Mətnini daxil et

    Diqqət çəkmək istədiyiniz mətni redaktora daxil edin ya da yapışdırın. VITS uzun hissələri yaxşı idarə edir və paket və böyük həcmli məzmun üçün idealdır.

  4. 4

    Audionu yarat

    VITS ilə sintez etmək üçün "Yarat" düyməsini basın. VITS çox sürətli və Standart səviyyəli olduğundan (1000 xarakter üçün 10 kredit), nəticələr tez və ucuz olaraq geri gəlir.

  5. 5

    API yüklə və ya istifadə et

    Sonuncu səsi MP3, WAV, ya da OGG olaraq yükləyin, ya da eyni VITS səsini TextToSpeechAI REST API vasitəsilə çağırın öz tətbiqinizdə avtomatlaşdırılmış istehsal etmək üçün.

VITS API

TextToSpeechAI REST API-ni istifadə edərək proqramlaşdırılmış səsi yarada bilərsiniz.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "VITS yüksək həcmli tətbiqlər üçün sürətli, təbii danışığı təmin edir.",
    "voice": "vits-ljspeech"
  }'

Tez-tez Sorulan Sual

VITS (Variasiyalı İnferans ilə Mübarizəli Öyrənmə üçün Sondan Sona Mətndən Söhbətə) variasiyalı avtokodlayıcı ilə mübarizəli GAN təlimlərini birləşdirən sondan sona neyron TTS modelidir. O, tək bir keçiddə təbii səsli sözləri yaradır, bu da onu sürətli və effektiv edir. VITS-i TextToSpeechAI-də pulsuz sınaya bilərsiniz.

Bəli, VITS MIT lisenziyası altında açıq mənbədir, buna görə də məhdudiyyətsiz ticarət istifadəsini dəstəkləyir. Ticarət məhsulları və xidmətlərində geniş istifadə olunur. TextToSpeechAI-də VITS Standart səviyyədə 1000 xarakter üçün 10 kreditə başa gəlir.

TextToSpeechAI VCTK səsləri də daxil olmaqla çoxlu fərqli İngilis səsləri olan böyük bir çoxlu səsli VITS kitabxanası təklif edir. Bir VITS modeli bir çox səsli səsləri qəbul edə bilər, buna görə də siz motoru dəyişmədən bir çox fərqli səslərdən birini seçə bilərsiniz.

VITS dəstəkləməsi öyrənilmiş modelə bağlıdır. Ən çox yayılmış VITS modelləri ingilis, çin, yapon, koreya, alman, fransız və digər əsas dilləri əhatə edir, VCTK məlumat toplusundan çox-sözlü ingilis əhatə ilə.

VITS çox sürətlidir, real vaxtda və ya GPU-da daha sürətli səsi yarada bilir. Onun son-son mimarisi digər modellərin çoxlu işləmə mərhələlərini aradan qaldırır, bu səbəbdən VITS paket və yüksək həcmli sintez üçün yaxşı uyğundur.

Xeyr, VITS səs klonlamasını dəstəkləmir. O, məqsəd səsini nümunədən kopyalamaq əvəzinə əvvəlcədən öyrədilmiş çoxlu səsləndirici modellərini istifadə edir. TextToSpeechAI-də səs klonlama üçün, bunun əvəzinə F5-TTS ya da GPT-SoVITS istifadə edin.

VITS təbii prosodi və ritmlə yaxşı keyfiyyətli səs istehsal edir. StyleTTS 2 və ya Tortoise səviyyəsində olmasa da, sürəti üçün yaxşı keyfiyyət təklif edir, xüsusilə də paket işləmə üçün.

VITS yaddaş səmərəlidir, adətən yalnız bir neçə GB VRAM (təxminən 4GB) tələb edir. İstehsalçı GPU-larda rahat işləyir, TextToSpeechAI-də bütün renderləmə serverlərimizdə baş verir, buna görə də heç bir hardvera ehtiyacınız yoxdur.

VITS və Piper TextToSpeechAI-də hər ikisi də sürətli, MIT-licensiyalı Standart-tərkibli mühərriklərdir. Piper ən yüngül və sürətli seçimdir, VITS isə daha təbii prozodiya ilə böyük çoxlu səsləndirici kitabxanası təklif edir (VCTK daxildir). Heç biri səs klonlaşdırmasını dəstəkləmir.

VITS 1000 rəmz üçün 10 kredit dəyərində olan Standart səviyyəli mühərrikdir. VITS modelinin səmərəli və sürətli təbiətinə görə bu bizim ən aşağı qiymətli səviyyəmizdir.

VITS 22050Hz-də səsi yerli olaraq yaradır. TextToSpeechAI vasitəsilə MP3, WAV, ya da OGG formatlarını istəyərək, avtomatik çevirməni sizin üçün idarə edə bilərsiniz.

Pulsuz kreditlər almaq üçün TextToSpeechAI-ə qeyd olun, sonra VITS səsini seçin, mətninizi daxil edin və səsi yarada bilərsiniz. Hesab yaratmazdan əvvəl VITS-i dinləmək üçün demo istifadə edə bilərsiniz və qeyd olunduqdan sonra VITS-ə REST API vasitəsilə daxil ola bilərsiniz.

Technical Specs

  • Generation Speed Very Fast
  • Output Quality Good
  • Voice Cloning Not Supported
  • Languages 10
  • GPU VRAM 1-2GB
  • Credits/1000 chars 10

Try VITS Now

Generate your first audio free. No credit card required.

Start Free