در مورد سبک TTS ۲
s. StyleTTS 2 is a
ویژگیهای کلیدی
کیفیت سطح انسانی
این روش در آزمایشهای کور، صدایی تولید میکند که از صدای انسان قابل تشخیص نیست.
انتقال سبک
انتقال سبک گفتار از هر نمونهٔ مرجع صوتی.
نظم طبیعی
ریتم کامل، استرس و نت با مدلسازی مبتنی بر انتشار.
شبیهسازی صدا
صداها رو با دقت و ظرافت فوق العاده کپی کن
استنتاج سریع
سرعت بالاتر از مدلهای خودبازگشتی با حفظ کیفیت.
منبع باز
این نرمافزار با مجوز MIT و با تمام حقوق تجاری منتشر شدهاست.
موارد استفاده
سبک TTS ۲ Voices
View All 6StyleTTS2 Default
ENStyleTTS2 Expressive
ENStyleTTS2 Fast
ENStyleTTS2 Natural
ENStyleTTS2 Neutral
ENStyleTTS2 Quality
ENچطور استفاده شود سبک TTS ۲
-
1
ثبت نام رایگان یا اجرا کردن نمایش
Create a free TextToSpeechAI account to get starter credits, or use the homepage demo to hear StyleTTS2 without signing in.
-
2
برگزیدن موتور StyleTTS2
انتخاب یک صدای StyleTTS2 از کتابخانه صداها. برای شبیهسازی یک صدا ، یک کلیپ مرجع ۱۰- ۳۰ ثانیهای را بارگذاری کنید و StyleTTS2 سبک آن را انتقال میدهد.
-
3
وارد کردن متن
متنی را که میخواهید گوینده باشد ، تایپ یا چسبانید. StyleTTS2 در انگلیسی عالی است و در گذرگاههای طولانی ، نظم طبیعی ، تأکید و نت را ارائه میدهد.
-
4
تولید صدا
Click generate and TextToSpeechAI renders your StyleTTS2 audio on GPU. Ultra-tier StyleTTS2 costs 50 credits per 1000 characters.
-
5
دانلود یا استفاده از API
فایل صوتی StyleTTS2 را به صورت MP3، WAV یا OGG دانلود کنید یا API TextToSpeechAI را با صدای StyleTTS2 خود برای تولید خودکار صدا فراخوانی کنید.
سبک TTS ۲ API
این برنامه با استفاده از TextToSpeechAI REST API تولید میشود.
curl -X POST "https://api.texttospeechai.com/v1/generate/" \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"text": "StyleTTS2 صدایی طبیعی تولید میکند که با ضبط حرفهای انسان رقابت میکند.",
"voice": "styletts2-default"
}'
پرسشهای متداول
Technical Specs
- Generation Speed Moderate
- Output Quality Excellent
- Voice Cloning Supported
- Languages 1
- GPU VRAM 4-6GB
- Credits/1000 chars 50