ແບບ TTS 2

Ultra

ຂໍ້ຄວາມ​ໄປ​ສູ່​ການ​ເວົ້າ​ໃນ​ລະດັບ​ມະນຸດ​ດ້ວຍ​ການ​ໂອນ​ແບບName

Moderate ໄວ
Excellent ຄຸນນະພາບ
​ບໍ່​ໄດ້​ ​ក្លូន
1 ພາສາ

ກ່ຽວ​ກັບ ແບບ TTS 2

. StyleTTS 2 is the first TTS system to use the

ຄຸນ​ສົມບັດ​ຫຼັກ

ຄຸນ​ນະ​ພາບ​ລະດັບ​ມະນຸດ

ຜະລິດ​ສຽງ​ທີ່​ບໍ່​ສາມາດ​ແຍກ​ອອກ​ຈາກ​ການ​ບັນທຶກ​ຂອງ​ຄົນ​ໃນ​ການ​ທົດລອງ​ທີ່​ບັງ​ເອີນ.

ແບບ​ທີ່​ສະແດງ​ອອກ

ແບບຟອມເວົ້າແບບດັ່ງນັ້ນການສົ່ງອອກແຕກຕ່າງກັນຢ່າງເປັນທໍາມະຊາດກັບຂໍ້ຄວາມ.

ສຽງ​ທຳມະຊາດ

ສຽງດົນຕີ, ແຮງດັນ, ແລະ ສຽງດັງທີ່ສົມບູນແບບ ດ້ວຍແບບແບບທີ່ອີງໃສ່ການແຜ່ກະຈາຍ.

ສຽງ​ໃນ​ຫ້ອງ​ບັນທຶກ

ເລືອກ​ຈາກ​ສຽງ StyleTTS2ທີ່​ໄດ້​ເຮັດ​ແລ້ວ​ໃນ​ປື້ມ​ບັນທຶກ​ສຽງ

​ການ​ຄິດໄລ່​ໄວ

ໄວກວ່າແບບຈໍາລອງ autoregressive ໃນຂະນະທີ່ຮັກສາຄຸນນະພາບ.

ແຫຼ່ງ​ເປີດ

MIT ອະນຸຍາດໃຫ້ໃຊ້ກັບສິດທິການໃຊ້ທຸລະກິດເຕັມ.

ກໍລະນີ​ໃຊ້

ອ່ານ​ປື້ມ​ສຽງ​ Premium ສຽງ​ເວົ້າ​ທີ່​ຊ່ຽວຊານ ການຜະລິດ​ຮູບເງົາ ແລະ ໂທລະພາບ ການໂຄສະນາ​ທີ່​ສູງ​ສຸດ ຜະລິດ​ Podcast ສຽງ​ທີ່​ໃຊ້​ໄດ້

ແບບ TTS 2 Voices

View All 6
StyleTTS2 Default
EN
StyleTTS2 Expressive
EN
StyleTTS2 Fast
EN
StyleTTS2 Natural
EN
StyleTTS2 Neutral
EN
StyleTTS2 Quality
EN

ວິທີການ​ໃຊ້ ແບບ TTS 2

  1. 1

    ລົງທະບຽນຟຣີ

    ສ້າງບັນຊີ TextToSpeechAI ຟຣີເພື່ອໄດ້ຮັບ credits ເລີ່ມຕົ້ນ.

  2. 2

    ເລືອກ​ເຄື່ອງຈັກ StyleTTS2

    ເລືອກ​ສຽງ StyleTTS2 ຈາກ​ປື້ມ​ບັນທຶກ​ສຽງ

  3. 3

    បញ្ចូល​ຂໍ້ຄວາມ​ຂອງ​ທ່ານ

    ປ້າຍ ຫຼື ພິມ​ສະຄິບ​ທີ່​ທ່ານ​ຕ້ອງການ​ໃຫ້​ເວົ້າ​ອອກ​ມາ & # 160; ។ StyleTTS2 ດີ​ທີ່​ສຸດ​ໃນ​ພາສາ​ອັງກິດ ແລະ ສົ່ງ​ການ​ເວົ້າ​ແບບ​ທຳມະຊາດ, ແຮງ​ກົດ ແລະ ສຽງ​ຜ່ານ​ຂໍ້​ຄວາມ​ຍາວໆ & # 160; ។

  4. 4

    ສ້າງ​ສຽງ

    ກົດສ້າງແລະ TextToSpeechAI ສະແດງສຽງ StyleTTS2 ຂອງທ່ານໃນ GPU. ລະດັບສູງ StyleTTS2 ຄ່າໃຊ້ຈ່າຍ 50 ສິນເຊື່ອຕໍ່ 1000 ຕົວອັກສອນ.

  5. 5

    ດາວໂຫລດ ຫຼື ໃຊ້ API

    ດາວໂຫລດ StyleTTS2 ສຽງສໍາເລັດເປັນ MP3, WAV, ຫຼື OGG, ຫຼືໂທ TextToSpeechAI API ກັບສຽງ StyleTTS2 ຂອງທ່ານເພື່ອສ້າງອັດຕະໂນມັດ.

ແບບ TTS 2 API

ສ້າງການເວົ້າໂດຍໃຊ້ໂປຣແກຣມໂດຍໃຊ້ TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "StyleTTS2ຜະລິດ​ການ​ເວົ້າ​ທີ່​ເປັນ​ທໍາມະຊາດ, ມັນ​ແຂ່ງ​ຂັນ​ກັບ​ການ​ບັນທຶກ​ຂອງ​ຄົນ​ທີ່​ມີ​ຄວາມ​ຊ່ຽວຊານ.",
    "voice": "styletts2-default"
  }'

ຄໍາຖາມທີ່ຖາມເລື້ອຍໆ

StyleTTS2 ແມ່ນ​ແບບ​ແບບ​ຂໍ້​ຄວາມ​ໄປ​ຫາ​ການ​ເວົ້າ​ທີ່​ທັນ​ສະໄໝ​ທີ່​ສາມາດ​ບັນລຸ​ການ​ປະສົມ​ສຽງ​ໃນ​ລະດັບ​ມະນຸດ​ໄດ້. ມັນ​ໃຊ້​ການ​ແຜ່​ກະຈາຍ​ແບບ ແລະ ການ​ຝຶກ​ອົບຮົມ​ເພື່ອ​ຜະລິດ​ການ​ເວົ້າ​ທີ່​ບໍ່​ສາມາດ​ແຍກ​ອອກ​ຈາກ​ການ​ບັນທຶກ​ຂອງ​ມະນຸດ​ທີ່​ຈິງ​ໃນ​ການ​ທົດສອບ​ການ​ຟັງ​ທີ່​ບັງ​ເອີນ​ໄດ້. ທ່ານ​ສາມາດ​ທົດລອງ​ໃຊ້ StyleTTS2 ຟຣີ​ຢູ່​ທີ່ TextToSpeechAI.

StyleTTS2 ຜະລິດສຽງ TTS ທີ່ມີຄຸນນະພາບສູງທີ່ສຸດທີ່ໃຊ້ໄດ້ກັບ TextToSpeechAI. ໃນການທົດສອບແບບທາງການມັນໄດ້ບັນລຸການຕີລາຄາລະດັບມະນຸດໃນການທົດສອບ MOS (Mean Opinion Score), ເຊິ່ງຜູ້ຟັງບໍ່ສາມາດແຍກມັນຈາກຜູ້ເວົ້າມະນຸດທີ່ແທ້ຈິງ. ມັນຕັ້ງຢູ່ໃນລະດັບ Ultra ຂອງພວກເຮົາພ້ອມກັບ Tortoise ສຳ ລັບເຫດຜົນນັ້ນ.

Not on TextToSpeechAI. StyleTTS2 voices here are ready-made voices from the library. For voice cloning, use the Clone Voice tool, which runs Chatterbox.

ແມ່ນແລ້ວ. StyleTTS2 ຖືກປ່ອຍອອກມາພາຍໃຕ້ໃບອະນຸຍາດ MIT ທີ່ອະນຸຍາດໃຫ້ໃຊ້ໃນການຄ້າຢ່າງເຕັມທີ່ໂດຍບໍ່ຕ້ອງເສຍຄ່າລິຂະສິດ. ເຮັດໃຫ້ມັນປອດໄພ ສຳ ລັບປື້ມສຽງ, ການໂຄສະນາ, ຮູບເງົາ, ແລະ ໂຄງການ StyleTTS2 ອື່ນໆທີ່ຜູ້ຊ່ຽວຊານອື່ນໆທີ່ສິດກ່ຽວຂ້ອງ.

StyleTTS2 ສະໜັບສະໜູນ​ພາສາ​ອັງກິດ​ເປັນ​ຕົ້ນຕໍ, ຍ້ອນ​ວ່າ​ແບບ​ແບບ​ໄດ້​ຖືກ​ຝຶກ​ອົບຮົມ​ໃນ​ກຸ່ມ​ຂໍ້ມູນ​ພາສາ​ອັງກິດ. ສຳ​ລັບ​ພາສາ​ອື່ນໆ, ໃຊ້​ສຽງ Piper ຫຼື Bark ຫຼື ສຽງ​ທີ່​ໄດ້​ກັ່ນຕອງ​ໄວ້.

StyleTTS2 ມີ ໄວ ຜະລິດ ຢ່າງ ພໍສົມຄວນ. ມັນ ໄວ ກວ່າ ຫຼາຍ ກ່ວາ ແບບ ແບບ auto-regressive ເຊັ່ນ Tortoise ແຕ່ ຊ້າກວ່າ ເຄື່ອງຈັກ ນ້ ຳ ໜັກ ເບົາ ເຊັ່ນ Piper. ຍ້ອນ ຄຸນ ນະ ພາບ ສູງ ແລະ ຄ່າ ຄິດໄລ່, StyleTTS2 ແມ່ນ ລາຄາ ໃນ ຊັ້ນ Ultra ຂອງພວກເຮົາ ແທນທີ່ຈະ ເປັນ ແບບ ເວລາ ຈິງ.

StyleTTS2 ຕ້ອງການ VRAM ປະມານ 4-6GB ເພື່ອການຄິດໄລ່. ມັນມີປະສິດທິພາບໃນການເກັບຂໍ້ມູນຫຼາຍກ່ວາ Bark ຫຼື Tortoise ໃນຂະນະທີ່ຜະລິດຜົນໄດ້ຮັບທີ່ມີຄຸນນະພາບສູງກວ່າ. ຢູ່ໃນ TextToSpeechAI ການປຸງແຕ່ງ StyleTTS2 ທັງຫມົດແລ່ນຢູ່ໃນ GPUs ຂອງພວກເຮົາ, ສະນັ້ນທ່ານບໍ່ຕ້ອງການຮາດແວໃດໆຂອງຕົວທ່ານເອງ.

StyleTTS2 ແມ່ນແບບ Ultra-tier ແລະຄ່າໃຊ້ຈ່າຍ 50 ຄະແນນຕໍ່ 1000 ຕົວອັກສອນກ່ຽວກັບ TextToSpeechAI. ວ່າລາຄາປະກັນໄພສະແດງໃຫ້ເຫັນຄຸນນະພາບລະດັບມະນຸດແລະຊັບພະຍາກອນ GPU ທີ່ຕ້ອງການ. ໂດຍກົງ, ແບບມາດຕະຖານເຊັ່ນ VITS ຄ່າໃຊ້ຈ່າຍ 10 ຄະແນນຕໍ່ 1000 ຕົວອັກສອນແລະ Piper ຄ່າໃຊ້ຈ່າຍ 1 ຄະແນນຕໍ່ 1,000 ຕົວອັກສອນ.

ສອງແມ່ນ Ultra tier (50 credits ຕໍ່ 1000 ຕົວອັກສອນ) ແລະພາສາອັງກິດ. StyleTTS2 ແມ່ນໄວຫຼາຍຫຼາຍ, ໃນຂະນະທີ່ Tortoise ສາມາດຟັງໄດ້ເລັກນ້ອຍຫຼາຍຂຶ້ນທໍາມະຊາດໃນ passages ຍາວ. ເລືອກ StyleTTS2 ເມື່ອທ່ານຕ້ອງການຫຼາຍ clip ແລະ Tortoise ເມື່ອເວລາແມ່ນບໍ່ຈໍາກັດ.

StyleTTS2 ຜະລິດສຽງທີ່ມີຄຸນນະພາບສູງທີ່ 24kHz. ຜ່ານ TextToSpeechAI ທ່ານສາມາດດາວໂຫລດຜົນໄດ້ຮັບເປັນ MP3, WAV, ຫຼື OGG, ແລະພວກເຮົາໃຊ້ການເຂົ້າລະຫັດທີ່ມີຄຸນນະພາບສູງດັ່ງນັ້ນຄຸນນະພາບ StyleTTS2 ພິເສດແມ່ນຖືກຮັກສາໄວ້ໃນເອກະສານສຸດທ້າຍ.

ຍອມຮັບ. StyleTTS2 ສະໜັບສະໜູນ​ການ​ປັບ​ອັດຕາ​ການ​ເວົ້າ, ແລະ ສຽງ​ແຕ່ລະສຽງ​ໃນ​ຫໍສະໝຸດ​ມີ​ການ​ສົ່ງ​ອອກ​ຂອງ​ຕົນ​ເອງ, ສະນັ້ນ​ການ​ເລືອກ​ສຽງ​ທີ່​ແຕກຕ່າງ​ຈະ​ປ່ຽນ​ການ​ເວົ້າ​ຂອງ​ມັນ.

ເລືອກສຽງ StyleTTS2 ຈາກຫໍສະໝຸດຂອງພວກເຮົາ, ຈາກນັ້ນອ້າງອີງສຽງນັ້ນໃນຄໍາຮ້ອງຂໍ API ຂອງທ່ານ. TextToSpeechAI ຈັດການການປຸງແຕ່ງ GPU ທັງຫມົດແລະສົ່ງຄືນ URL ໃນການດາວໂຫລດກັບສຽງ StyleTTS2 ທີ່ມີຄ່າຂອງທ່ານ.

Technical Specs

  • Generation Speed Moderate
  • Output Quality Excellent
  • Voice Cloning Not Supported
  • Languages 1
  • GPU VRAM 4-6GB
  • Credits/1000 chars 50

Try ແບບ TTS 2 Now

Generate your first audio free. No credit card required.

Start Free