பாணிTTS 2
Ultraபாணி மாற்றத்துடன் மனித- நிலை உரை- இருந்து- பேச்சுName
& பற்றி பாணிTTS 2
. StyleTTS 2 is the first TTS system to use the
முக்கியமான அம்சங்கள்
மனித-மட்ட தரம்
கண்காணிப்பு சோதனைகளில் மனித பதிவுகளை விட வேறுபடாத பேச்சை உருவாக்குகிறது.
வெளிப்படுத்தும் பாணி
மாடல்கள் பேசும் வடிவம் எனவே விநியோகம் இயற்கையாகவே உரை மாற்றுகிறது.
இயற்கையான வரிவடிவம்
முழுமையான ரிதம், அழுத்தம், மற்றும் பரவுதல்-ஆதாரம் மாதிரியுடன் இசை.
ஸ்டுடியோ ஒலிகள்
குரல் நூலகத்தில் உள்ள திறந்த வடிவம்TTS2குரல்களை தேர்ந்தெடு.
வேகமான முடிவு
திறன்களை பாதுகாக்கும் போது autoregressive மாதிரிகளை விட வேகமாக.
திறந்த மூலங்கள்
MIT முழு வணிக பயன்பாட்டு உரிமைகளுடன் லைசென்ஸ் பெற்றது.
பயன்பாட்டு வழக்கங்கள்
பாணிTTS 2 Voices
View All 6StyleTTS2 Default
ENStyleTTS2 Expressive
ENStyleTTS2 Fast
ENStyleTTS2 Natural
ENStyleTTS2 Neutral
ENStyleTTS2 Quality
ENபயன்படுத்துவது எப்படி பாணிTTS 2
-
1
பதிவு செய்யவும்
ஒரு இலவச TextToSpeechAI கணக்கை உருவாக்கவும், துவக்க கடன்களை பெற.
-
2
StyleTTS2 இயந்திரத்தை தேர்ந்தெடு
குரல் நூலகத்திலிருந்து StyleTTS2 குரலை தேர்ந்தெடு.
-
3
உரை உள்ளிடவும்
நீங்கள் சொல்ல விரும்பும் எழுத்துருவை ஒட்டு அல்லது தட்டச்சு செய்க. StyleTTS2 ஆங்கிலத்தில் சிறந்து விளங்குகிறது மற்றும் இயற்கையான குரல், அழுத்தம் மற்றும் நீண்ட பகுதிகளில் குரல் கொடுக்கும்.
-
4
ஒலியை உருவாக்கு
உருவாக்க க்ளிக் செய்யவும் TextToSpeechAI உங்கள் StyleTTS2 ஒலியை GPU யில் காட்டும். மிக உயர்ந்த நிலை StyleTTS2 1000 எழுத்துக்களுக்கு 50 கிரெடிட் செலவாகும்.
-
5
API ஐ பதிவிறக்கவும் அல்லது பயன்படுத்தவும்
முடிந்த StyleTTS2 ஒலியை MP3, WAV, அல்லது OGG ஆக பதிவிறக்கவும், அல்லது TextToSpeechAI API ஐ உங்கள் StyleTTS2 குரலுடன் அழைக்கவும் தானாகவே உருவாக்கவும்.
பாணிTTS 2 API
TextToSpeechAI REST API ஐப் பயன்படுத்தி மென்பொருள் மூலம் பேசி உருவாக்கவும்.
curl -X POST "https://api.texttospeechai.com/v1/generate/" \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"text": "StyleTTS2என்பது இயற்கையான உரையாடலை உருவாக்குகிறது, இது தொழில்முறை மனித பதிவுகளை எதிர்கொள்கிறது.",
"voice": "styletts2-default"
}'
அடிக்கடி கேட்கப்படும் கேள்விகள்
Technical Specs
- Generation Speed Moderate
- Output Quality Excellent
- Voice Cloning Not Supported
- Languages 1
- GPU VRAM 4-6GB
- Credits/1000 chars 50