பாணிTTS 2

Ultra

பாணி மாற்றத்துடன் மனித- நிலை உரை- இருந்து- பேச்சுName

Moderate வேகம்
Excellent தரம்
இல்லை மாதிரியாக்கம்
1 மொழிகள்

& பற்றி பாணிTTS 2

. StyleTTS 2 is the first TTS system to use the

முக்கியமான அம்சங்கள்

மனித-மட்ட தரம்

கண்காணிப்பு சோதனைகளில் மனித பதிவுகளை விட வேறுபடாத பேச்சை உருவாக்குகிறது.

வெளிப்படுத்தும் பாணி

மாடல்கள் பேசும் வடிவம் எனவே விநியோகம் இயற்கையாகவே உரை மாற்றுகிறது.

இயற்கையான வரிவடிவம்

முழுமையான ரிதம், அழுத்தம், மற்றும் பரவுதல்-ஆதாரம் மாதிரியுடன் இசை.

ஸ்டுடியோ ஒலிகள்

குரல் நூலகத்தில் உள்ள திறந்த வடிவம்TTS2குரல்களை தேர்ந்தெடு.

வேகமான முடிவு

திறன்களை பாதுகாக்கும் போது autoregressive மாதிரிகளை விட வேகமாக.

திறந்த மூலங்கள்

MIT முழு வணிக பயன்பாட்டு உரிமைகளுடன் லைசென்ஸ் பெற்றது.

பயன்பாட்டு வழக்கங்கள்

பிரீமியம் ஒலி நூல்கள் தொழில்முறை குரல் மேலாண்மை திரைப்படம் மற்றும் தொலைக்காட்சி தயாரிப்பு உயர்தர விளம்பரங்கள் ப்ளூடூத் தயாரிப்பு குரல் நடிப்பாளர்

பாணிTTS 2 Voices

View All 6
StyleTTS2 Default
EN
StyleTTS2 Expressive
EN
StyleTTS2 Fast
EN
StyleTTS2 Natural
EN
StyleTTS2 Neutral
EN
StyleTTS2 Quality
EN

பயன்படுத்துவது எப்படி பாணிTTS 2

  1. 1

    பதிவு செய்யவும்

    ஒரு இலவச TextToSpeechAI கணக்கை உருவாக்கவும், துவக்க கடன்களை பெற.

  2. 2

    StyleTTS2 இயந்திரத்தை தேர்ந்தெடு

    குரல் நூலகத்திலிருந்து StyleTTS2 குரலை தேர்ந்தெடு.

  3. 3

    உரை உள்ளிடவும்

    நீங்கள் சொல்ல விரும்பும் எழுத்துருவை ஒட்டு அல்லது தட்டச்சு செய்க. StyleTTS2 ஆங்கிலத்தில் சிறந்து விளங்குகிறது மற்றும் இயற்கையான குரல், அழுத்தம் மற்றும் நீண்ட பகுதிகளில் குரல் கொடுக்கும்.

  4. 4

    ஒலியை உருவாக்கு

    உருவாக்க க்ளிக் செய்யவும் TextToSpeechAI உங்கள் StyleTTS2 ஒலியை GPU யில் காட்டும். மிக உயர்ந்த நிலை StyleTTS2 1000 எழுத்துக்களுக்கு 50 கிரெடிட் செலவாகும்.

  5. 5

    API ஐ பதிவிறக்கவும் அல்லது பயன்படுத்தவும்

    முடிந்த StyleTTS2 ஒலியை MP3, WAV, அல்லது OGG ஆக பதிவிறக்கவும், அல்லது TextToSpeechAI API ஐ உங்கள் StyleTTS2 குரலுடன் அழைக்கவும் தானாகவே உருவாக்கவும்.

பாணிTTS 2 API

TextToSpeechAI REST API ஐப் பயன்படுத்தி மென்பொருள் மூலம் பேசி உருவாக்கவும்.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "StyleTTS2என்பது இயற்கையான உரையாடலை உருவாக்குகிறது, இது தொழில்முறை மனித பதிவுகளை எதிர்கொள்கிறது.",
    "voice": "styletts2-default"
  }'

அடிக்கடி கேட்கப்படும் கேள்விகள்

StyleTTS2 என்பது மனித- நிலை பேச்சு சேர்க்கையை அடையக்கூடிய ஒரு புதிய உரை- இருந்து- பேச்சு மாதிரியாகும். இது பேச்சு உருவாக்க வடிவம் பரவுதல் மற்றும் எதிர்ப்பு பயிற்சியை பயன்படுத்துகிறது, இது உண்மையான மனித பதிவுகளைக் காட்டிலும் கண்காணிப்பு கேட்கும் சோதனைகளில் வேறுபடாத பேச்சை உருவாக்குகிறது. StyleTTS2 ஐ TextToSpeechAI இல் இலவசமாக முயற்சி செய்யலாம்.

StyleTTS2 TextToSpeechAI இல் கிடைக்கும் மிக உயர்ந்த தரமான TTS ஒலியை உருவாக்குகிறது. இது மனித நிலை மதிப்பீடுகளை MOS (நடுநிலை கருத்து மதிப்பெண்) சோதனைகளில் அடைந்தது, கேட்பவர்கள் உண்மையான மனித ஒலியிலிருந்து அதை வேறுபடுத்த முடியவில்லை. அது நம்முடைய Ultra தரத்தில் Tortoise உடன் அமர்ந்துள்ளது.

TextToSpeechAI இல் இல்லை. StyleTTS2 குரல்கள் இங்கே நூலகத்திலிருந்து தயாரிக்கப்பட்ட குரல்கள். குரல் ஒத்தமைக்க, Clone Voice கருவியை பயன்படுத்தவும், இது Chatterbox ஐ இயக்குகிறது.

ஆம். StyleTTS2 MIT உரிமத்தின் கீழ் வெளியிடப்பட்டுள்ளது, இது முழுமையான வணிக பயன்பாட்டை ரோயீஸ் இல்லாமல் அனுமதிக்கிறது. இது ஒலி புத்தகங்கள், விளம்பரங்கள், திரைப்படங்கள் மற்றும் உரிமைகள் முக்கியமான மற்ற தொழில்முறை StyleTTS2 திட்டங்களுக்கு பாதுகாப்பாக உள்ளது.

StyleTTS2 ஆங்கிலத்திற்கு முதன்மை ஆதரவு அளிக்கிறது, ஏனெனில் இந்த மாதிரி ஆங்கில தரவுத்தளங்களில் பயிற்சி அளிக்கப்பட்டது. மற்ற மொழிகளுக்கு, Piper அல்லது Bark குரல்களை பயன்படுத்தவும், அல்லது ஒரு மாதிரி குரல்.

StyleTTS2 க்கு நடுத்தர உற்பத்தி வேகம் உள்ளது. இது Tortoise போன்ற தானாக திரும்பும் மாதிரிகளை விட வேகமாக உள்ளது ஆனால் Piper போன்ற இலகுவான இயந்திரங்களை விட மெதுவாக உள்ளது. அதன் உயர்ந்த தரம் மற்றும் கணக்கீட்டு செலவு காரணமாக, StyleTTS2 க்கு உண்மையான நேர மாதிரியை விட எங்கள் அல்ட்ரா தரத்தில் விலை நிர்ணயிக்கப்படுகிறது.

StyleTTS2 க்கு 4-6GB VRAM தேவைப்படுகிறது. இது Bark அல்லது Tortoise க்கு விட நினைவக திறன் அதிகம் கொண்டது, மேலும் அதிக தரமான வெளியீட்டை உருவாக்குகிறது. TextToSpeechAI ல் அனைத்து StyleTTS2 செயல்பாடுகளும் GPU களில் இயங்குகின்றன, எனவே உங்களுக்கு உங்கள் சொந்த வன்பொருள் தேவையில்லை.

StyleTTS2 ஒரு அல்ட்ரா- தரம் மாதிரி மற்றும் TextToSpeechAI இல் 1000 எழுத்துக்களுக்கு 50 கிரெடிட் செலவாகும். அந்த பிரீமியம் விலை மனித- மட்ட தரம் மற்றும் GPU வளங்கள் தேவைப்படும். ஒப்பீட்டளவில், VITS போன்ற நிலையான மாதிரிகள் 1000 எழுத்துக்களுக்கு 10 கிரெடிட் செலவாகும் மற்றும் Piper 1000 எழுத்துக்களுக்கு 1 கிரெடிட் செலவாகும்.

இரண்டும் அல்ட்ரா தரம் (1000 எழுத்துக்களுக்கு 50 கிரெடிட்) மற்றும் ஆங்கிலம். StyleTTS2 மிகவும் வேகமானது, ஆனால் Tortoise நீண்ட பகுதிகளில் சிறிதளவு இயற்கையாக ஒலிக்கலாம். நீங்கள் பல கிளிப்கள் தேவைப்படும் போது StyleTTS2 தேர்ந்தெடுக்கவும் மற்றும் Tortoise நேரம் கட்டுப்பாடு இல்லை என்றால்.

StyleTTS2 24kHz ல் உயர்தர ஒலியை உருவாக்குகிறது. TextToSpeechAI மூலம் MP3, WAV, அல்லது OGG ஆக முடிவுகளை பதிவிறக்கலாம், மேலும் உயர்தர குறியாக்கத்தை பயன்படுத்துகிறோம் எனவே StyleTTS2 தரம் முடிந்த கோப்பில் பாதுகாக்கப்படுகிறது.

ஆம். StyleTTS2 பேசும்- விகித மாற்றங்களை ஆதரிக்கிறது, மற்றும் நூலகத்தில் ஒவ்வொரு குரலும் அதன் சொந்த வழங்கல் உள்ளது, எனவே வேறு குரலை தேர்ந்தெடுப்பது புரொசோடி மாற்றுகிறது.

நமது நூலகத்திலிருந்து StyleTTS2 குரலை தேர்ந்தெடு, பின்னர் உங்கள் API கோரிக்கைகளில் அந்த குரலை குறிப்பிடவும். TextToSpeechAI அனைத்து GPU செயல்பாட்டையும் கையாளும் மற்றும் உங்கள் பிரீமியம் StyleTTS2 ஒலியுடன் ஒரு பதிவிறக்க URL ஐ திரும்ப வழங்கும்.

Technical Specs

  • Generation Speed Moderate
  • Output Quality Excellent
  • Voice Cloning Not Supported
  • Languages 1
  • GPU VRAM 4-6GB
  • Credits/1000 chars 50

Try பாணிTTS 2 Now

Generate your first audio free. No credit card required.

Start Free