صوت - صوت

Premium

توليد صوت يصف النص

Moderate السرعة
Very Good النوعية
لا الاستنساخ
1 اللغات

حول صوت - صوت

voices based on the text descriptions you provide. The voices are then used to generate the text-to-speech model. The voices are then used to generate the text-to-speech model. The voices are then used to generate the text-to-speech model. The text-to-speech model is used to generate the voices based on the text descriptions you provide. The voices are then used to generate the text-to-speech model

السمات الرئيسية

النصوص

توليد الأصوات من خلال وصف الخصائص المرغوبة.

السيطرة الإبداعية

حدد السن، والجنس، والنطق، والسرعة، وأسلوب الكلام.

الأصوات الفريدة

إنشاء أصوات لا توجد في المكتبات السابقة الصنع.

الناتج الطبيعي

ينتج جودة عالية، صوت طبيعي الكلام.

فعالة

الاستدلال السريع لتوليد الصوت الموصوف.

المصدر المفتوح

أباشي 2.0 مرخص للاستخدام التجاري.

حالات الاستخدام

تصميم الصوت مشاريع إبداعية النموذج الأولي تطوير الألعاب شخصيات الكتب السمعية إنشاء صوت مخصص

صوت - صوت Voices

View All 10
American Female
EN
American Male
EN
British Female
EN
British Male
EN
Calm Voice
EN
Cheerful Voice
EN
Conversational Voice
EN
Female Narrator
EN
Male Narrator
EN
Professional Voice
EN

كيف تستخدم صوت - صوت

  1. 1

    تسجيل مجاني أو تجربة العرض

    إنشاء حساب مجاني TextToSpeechAI ل 200 ائتمانات البدء، أو فتح العرض التجريبي لتجربة Parler-TTS فورا دون التسجيل.

  2. 2

    انقر على Parler-TTS وكتب وصفاً صوتياً

    اختار بارلر-TTS كمحرك لك، ثم اكتب وصفاً صوتياً نصياً واضحاً مثل "تتحدث امرأة شابة بوضوح بلكنة أمريكية". وضمن عمرك، وجنسك، ولغتك، وسرعة كلمتك، ومزاجك لتكوين الصوت.

  3. 3

    أدخل النص الذي تريد التحدث عنه

    كتابة أو لصق النص الذي تريد أن يقال. Parler- TTS يقدم هذا النص في الصوت المحدد من وصفك، لذلك إبقاء الوصف والنص في نفس اللغة (الإنجليزية تعمل أفضل).

  4. 4

    توليد الخطاب

    انقر على إنشاء لإرسال العمل إلى خلفية وحدة المعالجة المركزية لدينا. (بارلر-TTS) يقوم بتوليف صوت طبيعي يطابق صوتك الموصوف، ويتم دفعه في المستوى الأعلى من 25 رصيدا لكل 1000 كلمة.

  5. 5

    تنزيل أو استدعاء البرنامج المساعد

    تحميل الصوت النهائي كMP3، WAV، أو OGG، أو توليد آلي من خلال TextToSpeechAI API عن طريق نقل نصك ووصف الصوت المخزن في كل طلب.

صوت - صوت ألف - استعراض البرنامج

توليد الكلام البرمجي باستخدام TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "تتحدث امرأة شابة سعيدة بلكنة أمريكية",
    "voice": "parler-female_american"
  }'

الأسئلة المتكررة

إن بارلر-TTS هو نموذج لتحويل النص إلى كلمة ينتج الأصوات من أوصاف النصوص. وبدلاً من اختيار الأصوات المعدة مسبقاً، يمكنك وصف ما تريده: "امرأة هادئة وناضجة ذات لهجة أسترالية تتكلم بوتيرة معتدلة".

على TextToSpeechAI، نحن ندفع 25 رصيد لكل 1000 حرف (الدرجة العليا) لقدراتها الفريدة لتوليد الصوت.

يدعم Parler-TTS اللغة الإنجليزية في المقام الأول، وتعمل الأوصاف الصوتية بشكل أفضل في اللغة الإنجليزية، على الرغم من أن النموذج يمكن أن يتعامل مع لهجات إنجليزية مختلفة (أمريكية، بريطانية، أسترالية، إلخ).

وصف خصائص الصوت بشكل طبيعي: "تتحدث امرأة شابة بوضوح بلكنة بريطانية" أو "يتحدث رجل مسن ذو صوت عميق ببطء وعناية". تضمن السن، والجنس، والنطق، والسرعة، والمزاج.

يتميز برنامج بارلر-TTS بسرعة توليد معتدلة، عادة 2-5 ثوان لكل جملة على وحدة المعالجة المركزية، ويضيف معالجة وصف الصوت الحد الأدنى من التكاليف العامة مقارنة بتوليد الكلام الفعلي.

لا، يقوم Parler-TTS بإنشاء الأصوات من الأوصاف بدلاً من استنساخ الأصوات الموجودة. لاستنساخ الأصوات، استخدم StyleTTS2، F5-TTS، OpenVoice، أو Tortoise.

يحتاج Parler-TTS إلى 4-8 جيجا بايت من ذاكرة العرض التناظري حسب حجم النموذج. تعمل النسخة الصغيرة بـ 4 جيجا بايت، بينما يستفيد النموذج الكامل من 8 جيجا بايت للأداء الأمثل.

نعم، برامجية Parler-TTS مرخصة من قبل Apache 2.0 وتدعم الاستخدام التجاري. وبما أن الأصوات يتم توليدها من الأوصاف، فلا توجد أي مخاوف بشأن ملكية الأصوات.

تضمن وصفك الصوتي في طلب API مع نصك. API معالجة الوصف وتوليد الكلام المطابقة. يمكنك حفظ الأوصاف المفضلة لإعادة الاستخدام.

ينتج برنامج Parler-TTS صوتاً جيداً جداً، طبيعياً الصوت مع صوت يناسب صوتك الموصوف. وهو يخرج WAV بشكل طبيعي، وعلى TextToSpeechAI يمكنك تحميله كMP3، WAV، أو OGG مع التحويل الآلي.

كل منهما محرك تعبيري مفتوح المصدر، ولكنهما يختلفان في التحكم. يسمح لك برنامج بارلر-TTS بتوجيه الصوت من خلال وصف نصي واضح (العمر، والنبرة، والسرعة، والمزاج)، في حين يضيف برنامج بارك إشارات غير لفظية مثل [الضحك] والموسيقى. اختار برنامج بارلر-TTS عندما تريد صوتاً محدداً موصوفاً، وبرنامج بارك عندما تريد تسليماً عاطفياً عفوياً.

نعم، يمكنك التسجيل لحساب مجاني على TextToSpeechAI للحصول على 200 رصيد بدء، أو استخدام العرض الإيضاحي للاستماع إلى Parler-TTS بدون حساب، وهذا يكفي لاختبار العديد من الوصف الصوتي قبل اختيار حزمة رصيد.

Technical Specs

  • Generation Speed Moderate
  • Output Quality Very Good
  • Voice Cloning Not Supported
  • Languages 1
  • GPU VRAM 4-8GB
  • Credits/1000 chars 25

Try صوت - صوت Now

Generate your first audio free. No credit card required.

Start Free