يوم
Ultraتحويل النصوص إلى لغة مباشرة موجه نحو الحوار مع استنساخ الصوت والأصوات غير اللفظية
حول يوم
ing the most accurate text-to-speech results for the most complex texts. Dia is a 1.6B parameter text-to-speech model that is designed to generate natural conversational speech with support for nonverbal sounds like laughter, sighs, and coughs. It excels at generating the most accurate text-to-speech results for the most complex texts. Dia is a 1.6B parameter text-to-speech model that
السمات الرئيسية
جيل الحوار
توليد محادثات طبيعية متعددة المتحدثين بأصوات مختلفة وتناوب.
الأصوات غير اللفظية
تضاف عبارة [ضحك]، [انتفاخ]، [سعال]، (تنفس) للتعبير الطبيعي عن التعبيرات الشبه اللغوية.
استنساخ الصوت
استنساخ أي صوت من 5-10 ثوان من السمع المرجعي للكلام الشخصي.
محادثة طبيعية
البارامترات 1.6B تنتج صوت طبيعي جدا في المحادثة ونغمة.
حالات الاستخدام
كيف تستخدم يوم
-
1
انضم مجانا أو افتح العرض
إنشاء حساب مجاني TextToSpeechAI للمطالبة ببدء ائتمانات، أو فتح العرض التجريبي بدون التسجيل لتجربة حوار ديانا على الفور.
-
2
انتقِ محرك Dia
في لوحة التحكم لترجمة النصوص إلى صوت، اختر Dia من قائمة المحركات. Dia هو نموذج ذو طبقة فائقة موجهة نحو الحوار مع دعم متعدد المتحدثين واستنساخ الصوت.
-
3
كتابة نص حوار مع علامات
ضع محادثتك باستخدام [S1] و [S2] لتحديد كل دور للمتحدث، وأسقط علامات غير لفظية مثل [ضحك]، [انتفاخ]، [سعال]، أو (تنفس) حيث تريد ردود فعل طبيعية.
-
4
توليد الصوت
انقر على إنشاء لإرسال نص ديّا الخاص بك إلى وحدات المعالجة الرسومية المستضافة لدينا. تعرض ديّا حوار المتحدثين مع التناوب وعلاماتك غير اللفظية في ملف صوتيّ واحد.
-
5
تنزيل أو استدعاء البرنامج المساعد
تحميل الحوار المنتهي في الشكل الذي اخترته، أو أتمتة ذلك عن طريق نشر نفس [S1] / [S2] النص إلى TextToSpeechAI API مع رمز حسابك.
يوم ألف - استعراض البرنامج
توليد الكلام البرمجي باستخدام TextToSpeechAI REST API.
curl -X POST "https://api.texttospeechai.com/v1/generate/" \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"text": "مرحباً كيف حالك اليوم؟ [ضحك] [س2] أنا بخير، شكراً على سؤالك",
"voice": "en_US-lessac-medium"
}'
الأسئلة المتكررة
Technical Specs
- Generation Speed Medium
- Output Quality Excellent
- Voice Cloning Supported
- Languages 1
- GPU VRAM 10GB
- Credits/1000 chars 50