ቪቲስ

Standard

የመጨረሻ-ወደ-መጨረሻ TTS በነጭ ተናጋሪ

Very Fast ፍጥነት
Good ጥራት
አይሆንም መተላለፊያ
10 ቋንቋዎች

ስለ ቪቲስ

-to-end neural TTS model that generates natural-sounding speech. It combines variational autoencoders with adversarial learning for efficient synthesis. VITS is excellent for batch processing and applications requiring high-to-end neural TTS model that generates natural-sounding speech. It combines variational autoencoders with adversarial learning for efficient synthesis. VITS is excellent for batch processing and applications requiring

የዋና ባህሪያት

የፍጥነት ማጣመር

የፍጥነት ንግግር ማምጣት

የባች ሂደት

በአንድ ጊዜ ብዙ ጽሑፎችን በፍጥነት ይፍጠሩ

የቋንቋ አማራጭ

VAE+GAN ስልጠና ተፈጥሯዊ የፕሮሶዲ እና የሪትሚን ትርጓሜን ያመጣል፡፡

ብዙ-ተናጋሪ

አንድ ሞዴል ብዙ ተናጋሪ ድምጾችን ይደግፋል

ፋይል

ጥሩ ውጤት ያለው ዝቅተኛ የማስታወሻ ፋይል

የይዘት ማውጫ

MIT ለሁሉም ጥቅም ወቅት ፈቃድ

ጥቅም

የድምፅ ፍሰት የኤሌክትሮኒክ መማር መድረኮች ዜና አሳታሚዎች አውቶማቲክ የIVR ስርዓቶች የከፍተኛ መጠን ይዘት

ቪቲስ Voices

View All 109
LJSpeech (English Female)
EN
VCTK Speaker 225 (English Female)
EN
VCTK Speaker 226 (English Male)
EN
VCTK Speaker 227 (English Male)
EN
VCTK Speaker 228 (English Female)
EN
VCTK Speaker 229
EN
VCTK Speaker 230
EN
VCTK Speaker 231
EN
VCTK Speaker 232
EN
VCTK Speaker 233
EN
VCTK Speaker 234
EN
VCTK Speaker 236
EN

እንዴት እንደሚጠቀሙ ቪቲስ

  1. 1

    ነጻ ምዝገባ ወይም ዲሞን ይሞክሩ

    ነጻ TextToSpeechAI መለያ ለመፍጠር መጀመርያ ክሬዲቶች ለማግኘት, ወይም VITS ከመመዝገብዎ በፊት ለመስማት በገጽ ላይ ዲሞን ይጠቀሙ.

  2. 2

    VITS ድምፅ ወይም ተናጋሪ ይምረጡ

    የድምፅ መጽሐፍት ማተሚያውን አሳይ እና በቪቲኤስ ባንዲራ የተቀመጠውን ድምፅ ይምረጡ። የቪቲኤስ መጻሕፍት ማተሚያው በቪሲቲኬ ተናጋሪ ሰሌዳ ውስጥ ከብዙ የተለዩ ድምጾች ውስጥ ይምረጡ።

  3. 3

    ጽሑፉን አስገባ

    ጽሑፉን በኢሚዲየር ውስጥ ለመናገር ፈልጉት? ጻፉ ወይም አስቀምጡት. VITS ረጅም ክፍሎችን በደንብ ይይዛል እና ለባች እና ከፍተኛ መጠን ያለው ይዘት ተስማሚ ነው.

  4. 4

    የድምፅ ፋይል

    በቪቲኤስ (VITS) ቋንቋን ለማቀናጀት ይጫኑ። ቪቲኤስ በጣም ፈጣንና ስታንዳርድ-ደረጃ (10 ክሬዲቶች በ1000 አርእስቶች ላይ) ስለሆነ፣ ውጤቶች በጥቂት ወጪ በፍጥነት ይመለሳሉ።

  5. 5

    መተግበሪያውን ይጫኑ

    የተጠናቀቀውን ድምፅ እንደ MP3, WAV ወይም OGG ያውርዱ፣ ወይም በራስዎ ፕሮግራም ውስጥ ማመቻቸትን ለማመቻቸት በ TextToSpeechAI REST API ውስጥ ተመሳሳይ VITS ድምፅን ጠራ

ቪቲስ መተላለፊያ

የTextToSpeechAI REST APIን በመጠቀም ፕሮግራም በመፍጠር ንግግርን ይፈጥሩ

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "VITS ለከፍተኛ መጠን ፕሮግራሞች ፈጣን, ተፈጥሯዊ ንግግር ይሰጣል.",
    "voice": "vits-ljspeech"
  }'

ብዙ ጊዜ የሚጠየቁ ጥያቄዎች

VITS (የማሻሻያ ግምገማ ጋር ተቃራኒ መማር ለ መጨረሻ-ወደ-መጨረሻ ጽሑፍ-ወደ-ንግግር) ነው መጨረሻ-ወደ-መጨረሻ ነርቭ TTS ሞዴል ጋር ተቃራኒ GAN ስልጠና ማሻሻያ autoencoder ያገናኛል. በአንድ መውጣት ውስጥ ተፈጥሯዊ-ድምፅ ንግግር ይፈጥራል, ይህም ፈጣን እና ውጤታማ ያደርገዋል. VITS ነጻ TextToSpeechAI ላይ መሞከር ይችላሉ.

አዎ, VITS በ MIT ፈቃድ ስር የከፈተ ምንጭ ነው, ስለዚህ ያለማቋረጥ የሙሉ የቢዝነስ ጥቅም ይደግፋል. በቢዝነስ ምርቶች እና አገልግሎቶች ውስጥ በስፋት ይጠቀማል. በ TextToSpeechAI ላይ, VITS በ 1000 አንቀጾች በ 1000 ፊደላት በ ስታንዳርድ ደረጃ ላይ 10 ክሬዲት ይከፍላል.

TextToSpeechAI በርካታ የብዙ-ተናጋሪ VITS መዝገብ ቤትን ያቀርባል፣ በውስጡም በርካታ የልዩ የንግድ ቋንቋ ተናጋሪዎችን ያካተተ የ VCTK ድምፅ ሰሌዳ። አንድ VITS ሞዴል ብዙ ተናጋሪዎችን ሊቀበል ይችላል፣ ስለዚህ መሳሪያዎችን ሳይቀይሩ ከብዙ የተለያዩ ድምጾች ውስጥ መምረጥ ይችላሉ።

VITS ድጋፍ በ የተማረ ሞዴል ላይ የተመሠረተ ነው. የተለመዱ VITS ሞዴሎች እንግሊዝኛ, ቻይንኛ, ጃፓንኛ, ኮሪያኛ, ጀርመን, ፈረንሳይኛ, እና ሌሎች ዋና ቋንቋዎች, ከ VCTK ፋይል ብዛት ጋር ተናጋሪ እንግሊዝኛ መከታተል.

VITS በጣም ፈጣን ነው, ንግግር በወቅቱ ወይም በ GPU ላይ ፈጣን ነው. የመጨረሻ-ወደ-መጨረሻው አርክቴክቸር የሌሎች ሞዴሎችን ብዙ ማቀነባበሪያ ደረጃዎችን ይከላከላል, ይህም VITS ለባች እና ከፍተኛ መጠን ያለው ስብስብ በጣም ተስማሚ ነው.

አይደለም፤ VITS የድምፅ ቅጥያ አይደግፍም፤ ከምሳሌው የድምፅ ዓላማን ከመለጠፍ ይልቅ የቀድሞውን የተማረ የብዙ-ተናጋሪ ሞዴሎችን ይጠቀማል፤ በTextToSpeechAI ላይ የድምፅ ቅጥያ ለመስጠት F5-TTS ወይም GPT-SoVITS ይጠቀሙ

VITS በታሪክ ውስጥ የተመዘገበው የድምፅ ጥራት ያለው የድምፅ ፋይል ነው. በ StyleTTS 2 ወይም Tortoise ደረጃ ላይ ባለመሆኑም ለፍጥነት እና ለባች ፕሮሰሲንግ ልዩ የሆነ ጥራት ያለው ፋይል ነው.

VITS በሜሞሪ ላይ ውጤታማ ነው፣ በዋነኝነት የVRAM (4GB) ጥቂት GB ብቻ ያስፈልጋል። በደንበኛ GPUs ላይ በደስታ ይሰራል። በ TextToSpeechAI ላይ ሁሉም ሪንደር በሰርቨሮቻችን ላይ ይሠራሉ ስለዚህ የራስዎን ማንኛውንም ሃርድዌር አያስፈልግዎትም ፡፡

VITS እና Piper ሁለቱም ፈጣን ናቸው, MIT-የተጠበቀ ስታንዳርድ-ደረጃ መሳሪያዎች በ TextToSpeechAI ላይ. Piper ነው ቀላል እና ፈጣን ምርጫ, VITS በማድረግ ትልቅ ብዙ-ተናጋሪ መዝገብ ቤት (VCTK ጨምሮ) ጋር ትንሽ የበለጠ ተፈጥሯዊ prosody. ምንም የድምፅ ክሎኒንግ አይደግፍም.

VITS የደንበኛ-ደረጃ ማሽን ነው, በ 1000 አንቀጾች 10 ክሬዲቶች ዋጋ. ይህ የ VITS ሞዴል ውጤታማ, ፈጣን ባህሪ ስላለው ይህ የኛ ዝቅተኛ ዋጋ ደረጃ ነው.

VITS ድምፅ በ 22050Hz በትክክል ይፈጥራል. በ TextToSpeechAI ውስጥ MP3, WAV, ወይም OGG ቅርጸቶች መጠየቅ ይችላሉ, በራስ-ሰር ለውጥ ለእርስዎ የተስተናገደ.

ነጻ የመጀመርያ ክሬዲቶችን ለመቀበል በ TextToSpeechAI ላይ ይመዝገቡ፣ ከዚያም የ VITS ድምፅን ይምረጡ፣ ጽሑፍዎን ያስገቡ፣ እና ድምፅን ያመነጩ። VITSን ከመፍጠርዎ በፊት ለመስማት ዲሞውንም መጠቀም ይችላሉ፣ እና VITSን በ REST API ውስጥ በመግባት መመዝገብ ይችላሉ።

Technical Specs

  • Generation Speed Very Fast
  • Output Quality Good
  • Voice Cloning Not Supported
  • Languages 10
  • GPU VRAM 1-2GB
  • Credits/1000 chars 10

Try ቪቲስ Now

Generate your first audio free. No credit card required.

Start Free