الشكل 2
Ultraتحويل النص إلى كلمة على المستوى البشري مع نقل الأسلوب
حول الشكل 2
s. StyleTTS 2 is a
السمات الرئيسية
النوعية على المستوى البشري
ينتج صوتاً لا يمكن تمييزه عن التسجيلات البشرية في الاختبارات العمياء.
نقل الأسلوب
نقل أسلوب الكلام من أي عينة سمعية مرجعية.
الصوت الطبيعي
الإيقاع المثالي، والتوتر، والنغمة مع النمذجة القائمة على الانتشار.
استنساخ الصوت
استنساخ الأصوات بدقة و طبيعية استثنائية
الاستدلال السريع
أسرع من النماذج ذاتية التراجع مع الحفاظ على الجودة.
المصدر المفتوح
ترخيص من معهد ماساتشوستس للتكنولوجيا بحقوق الاستخدام التجاري الكاملة.
حالات الاستخدام
الشكل 2 Voices
View All 6StyleTTS2 Default
ENStyleTTS2 Expressive
ENStyleTTS2 Fast
ENStyleTTS2 Natural
ENStyleTTS2 Neutral
ENStyleTTS2 Quality
ENكيف تستخدم الشكل 2
-
1
انضم مجانا أو ابدأ العرض
إنشاء حساب مجاني TextToSpeechAI للحصول على ائتمانات البدء، أو استخدام الصفحة الرئيسية للاستماع إلى StyleTTS2 دون التسجيل.
-
2
اختار محرك StyleTTS2
اختار صوت StyleTTS2 من مكتبة الأصوات. لاستنساخ صوت، قم بتحميل مقطع مرجعي لمدة 10-30 ثانية وسوف يقوم StyleTTS2 بنقل أسلوبه.
-
3
أدخل نصك
لصق أو كتابة النص الذي تريد أن يقال. StyleTTS2 يتفوق في اللغة الإنجليزية ويقدم الصوت الطبيعي، والتشديد، والنبرة عبر المقاطع الطويلة.
-
4
توليد الصوت
انقر على إنشاء و TextToSpeechAI يعرض صوت StyleTTS2 الخاص بك على GPU.
-
5
تنزيل أو استخدام API
تحميل الصوت StyleTTS2 النهائي كMP3، WAV، أو OGG، أو استدعاء TextToSpeechAI API مع صوتك StyleTTS2 لجعل توليد آلي.
الشكل 2 ألف - استعراض البرنامج
توليد الكلام البرمجي باستخدام TextToSpeechAI REST API.
curl -X POST "https://api.texttospeechai.com/v1/generate/" \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"text": "StyleTTS 2 ينتج كلمته طبيعية جدا، انها تنافس التسجيلات البشرية المهنية.",
"voice": "styletts2-default"
}'
الأسئلة المتكررة
Technical Specs
- Generation Speed Moderate
- Output Quality Excellent
- Voice Cloning Supported
- Languages 1
- GPU VRAM 4-6GB
- Credits/1000 chars 50