ቪቲስ

Standard

የመጨረሻ-ወደ-መጨረሻ TTS በነጭ ተናጋሪ

Very Fast ፍጥነት
Good ጥራት
አይሆንም መተላለፊያ
1 ቋንቋዎች

ስለ ቪቲስ

-to-end neural TTS model that generates natural-sounding speech. It combines variational autoencoders with adversarial learning for efficient synthesis. VITS is excellent for batch processing and applications requiring high-to-end neural TTS model that generates natural-sounding speech. It combines variational autoencoders with adversarial learning for efficient synthesis. VITS is excellent for batch processing and applications requiring

የዋና ባህሪያት

የፍጥነት ማጣመር

የፍጥነት ንግግር ማምጣት

የባች ሂደት

በአንድ ጊዜ ብዙ ጽሑፎችን በፍጥነት ይፍጠሩ

የቋንቋ አማራጭ

VAE+GAN ስልጠና ተፈጥሯዊ የፕሮሶዲ እና የሪትሚን ትርጓሜን ያመጣል፡፡

ብዙ-ተናጋሪ

አንድ ሞዴል ብዙ ተናጋሪ ድምጾችን ይደግፋል

ፋይል

ጥሩ ውጤት ያለው ዝቅተኛ የማስታወሻ ፋይል

የይዘት ማውጫ

MIT ለሁሉም ጥቅም ወቅት ፈቃድ

ጥቅም

የድምፅ ፍሰት የኤሌክትሮኒክ መማር መድረኮች ዜና አሳታሚዎች አውቶማቲክ የIVR ስርዓቶች የከፍተኛ መጠን ይዘት

ቪቲስ Voices

View All 109
LJSpeech (English Female)
EN
VCTK Speaker 225 (English Female)
EN
VCTK Speaker 226 (English Male)
EN
VCTK Speaker 227 (English Male)
EN
VCTK Speaker 228 (English Female)
EN
VCTK Speaker 229
EN
VCTK Speaker 230
EN
VCTK Speaker 231
EN
VCTK Speaker 232
EN
VCTK Speaker 233
EN
VCTK Speaker 234
EN
VCTK Speaker 236
EN

እንዴት እንደሚጠቀሙ ቪቲስ

  1. 1

    ነጻ

    ነጻ TextToSpeechAI መለያ ለመፍጠር መጀመሪያ ተቀማጭ ገንዘብ ማግኘት.

  2. 2

    VITS ድምፅ ወይም ተናጋሪ ይምረጡ

    የድምፅ መጽሐፍት ማተሚያውን አሳይ እና በቪቲኤስ ባንዲራ የተቀመጠውን ድምፅ ይምረጡ። የቪቲኤስ መጻሕፍት ማተሚያው በቪሲቲኬ ተናጋሪ ሰሌዳ ውስጥ ከብዙ የተለዩ ድምጾች ውስጥ ይምረጡ።

  3. 3

    ጽሑፉን አስገባ

    ጽሑፉን በኢሚዲየር ውስጥ ለመናገር ፈልጉት? ጻፉ ወይም አስቀምጡት. VITS ረጅም ክፍሎችን በደንብ ይይዛል እና ለባች እና ከፍተኛ መጠን ያለው ይዘት ተስማሚ ነው.

  4. 4

    የድምፅ ፋይል

    በቪቲኤስ (VITS) ቋንቋን ለማቀናጀት ይጫኑ። ቪቲኤስ በጣም ፈጣንና ስታንዳርድ-ደረጃ (10 ክሬዲቶች በ1000 አርእስቶች ላይ) ስለሆነ፣ ውጤቶች በጥቂት ወጪ በፍጥነት ይመለሳሉ።

  5. 5

    መተግበሪያውን ይጫኑ

    የተጠናቀቀውን ድምፅ እንደ MP3, WAV ወይም OGG ያውርዱ፣ ወይም በራስዎ ፕሮግራም ውስጥ ማመቻቸትን ለማመቻቸት በ TextToSpeechAI REST API ውስጥ ተመሳሳይ VITS ድምፅን ጠራ

ቪቲስ መተላለፊያ

የTextToSpeechAI REST APIን በመጠቀም ፕሮግራም በመፍጠር ንግግርን ይፈጥሩ

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "VITS ለከፍተኛ መጠን ፕሮግራሞች ፈጣን, ተፈጥሯዊ ንግግር ይሰጣል.",
    "voice": "vits-ljspeech"
  }'

ብዙ ጊዜ የሚጠየቁ ጥያቄዎች

VITS (የማሻሻያ ግምገማ ጋር ተቃራኒ መማር ለ መጨረሻ-ወደ-መጨረሻ ጽሑፍ-ወደ-ንግግር) ነው መጨረሻ-ወደ-መጨረሻ ነርቭ TTS ሞዴል ጋር ተቃራኒ GAN ስልጠና ማሻሻያ autoencoder ያገናኛል. በአንድ መውጣት ውስጥ ተፈጥሯዊ-ድምፅ ንግግር ይፈጥራል, ይህም ፈጣን እና ውጤታማ ያደርገዋል. VITS ነጻ TextToSpeechAI ላይ መሞከር ይችላሉ.

አዎ, VITS በ MIT ፈቃድ ስር የከፈተ ምንጭ ነው, ስለዚህ ያለማቋረጥ የሙሉ የቢዝነስ ጥቅም ይደግፋል. በቢዝነስ ምርቶች እና አገልግሎቶች ውስጥ በስፋት ይጠቀማል. በ TextToSpeechAI ላይ, VITS በ 1000 አንቀጾች በ 1000 ፊደላት በ ስታንዳርድ ደረጃ ላይ 10 ክሬዲት ይከፍላል.

TextToSpeechAI በርካታ የብዙ-ተናጋሪ VITS መዝገብ ቤትን ያቀርባል፣ በውስጡም በርካታ የልዩ የንግድ ቋንቋ ተናጋሪዎችን ያካተተ የ VCTK ድምፅ ሰሌዳ። አንድ VITS ሞዴል ብዙ ተናጋሪዎችን ሊቀበል ይችላል፣ ስለዚህ መሳሪያዎችን ሳይቀይሩ ከብዙ የተለያዩ ድምጾች ውስጥ መምረጥ ይችላሉ።

የቪቲኤስ ድምጾች በ TextToSpeechAI ላይ አማርኛ ናቸው፣ ከ LJSpeech እና VCTK ተናጋሪ ሰሌዳዎች የተወሰዱ ናቸው። ለሌሎች ቋንቋዎች፣ የፒፐር ወይም የባርክ ድምጾችን ይጠቀሙ።

VITS በጣም ፈጣን ነው, ንግግር በወቅቱ ወይም በ GPU ላይ ፈጣን ነው. የመጨረሻ-ወደ-መጨረሻው አርክቴክቸር የሌሎች ሞዴሎችን ብዙ ማቀነባበሪያ ደረጃዎችን ይከላከላል, ይህም VITS ለባች እና ከፍተኛ መጠን ያለው ስብስብ በጣም ተስማሚ ነው.

አይደለም፣ VITS የድምፅ ቅጥያ አይደግፍም፤ ከምሳሌው የድምፅ ዓላማን ከመለጠፍ ይልቅ የቀድሞውን የተማረ የብዙ-ተናጋሪ ሞዴሎችን ይጠቀማል። የድምፅ ቅጥያ ለመስጠት የድምፅ ቅጥያ መሣሪያን ይጠቀሙ፣ ይህም ቻተርቦክስን ይጀምራል።

VITS በታሪክ ውስጥ የተመዘገበው የድምፅ ጥራት ያለው የድምፅ ፋይል ነው. በ StyleTTS 2 ወይም Tortoise ደረጃ ላይ ባለመሆኑም ለፍጥነት እና ለባች ፕሮሰሲንግ ልዩ የሆነ ጥራት ያለው ፋይል ነው.

VITS በሜሞሪ ላይ ውጤታማ ነው፣ በዋነኝነት የVRAM (4GB) ጥቂት GB ብቻ ያስፈልጋል። በደንበኛ GPUs ላይ በደስታ ይሰራል። በ TextToSpeechAI ላይ ሁሉም ሪንደር በሰርቨሮቻችን ላይ ይሠራሉ ስለዚህ የራስዎን ማንኛውንም ሃርድዌር አያስፈልግዎትም ፡፡

VITS እና Piper ሁለቱም ፈጣን ናቸው, MIT-የተፈቀደ ማሽን ላይ TextToSpeechAI. Piper ነው ቀላል ምርጫ እና ዋጋ 1 ክሬዲት በ 1,000 አርእስቶች, VITS (10 ክሬዲት በ 1,000 አርእስቶች) በኩል ትልቅ ብዙ-ተናጋሪ መጽሐፍት (VCTK ጨምሮ) ጋር ትንሽ የበለጠ ተፈጥሯዊ prosody ይሰጣል. ሁለቱም የድምፅ ክሎኒንግ አይደግፍም.

VITS የሥርዓት-ደረጃ ማሽን ነው, በ 1000 አንቀጾች 10 ክሬዲቶች ዋጋ. Piper ብቻ, በ 1000 አንቀጾች 1 ክሬዲት, ያነሰ ዋጋ አለው.

VITS ድምፅ በ 22050Hz በትክክል ይፈጥራል. በ TextToSpeechAI ውስጥ MP3, WAV, ወይም OGG ቅርጸቶች መጠየቅ ይችላሉ, በራስ-ሰር ለውጥ ለእርስዎ የተስተናገደ.

ነጻ የመጀመርያ ክሬዲቶችን ለመቀበል በ TextToSpeechAI ላይ ይመዝገቡ፣ ከዚያም VITS ድምፅን ይምረጡ፣ ጽሑፍዎን ያስገቡ፣ እና ድምፅን ያመጡ። VITS ን በ REST API ዎቻችን ውስጥ መመዝገብ ይችላሉ።

Technical Specs

  • Generation Speed Very Fast
  • Output Quality Good
  • Voice Cloning Not Supported
  • Languages 1
  • GPU VRAM 1-2GB
  • Credits/1000 chars 10

Try ቪቲስ Now

Generate your first audio free. No credit card required.

Start Free