صندوق الدردشة

Premium

استنساخ الصوت بدون تسجيل مع كلمـة تعبيرية بـ 23 لغة

Fast السرعة
Very Good النوعية
نعم الاستنساخ
23 اللغات

حول صندوق الدردشة

[Translation temporarily unavailable. Please try again.]

السمات الرئيسية

استنساخ الصوت

استنساخ أي صوت من بضعة ثوان من الصوت - لا يلزم التدريب.

23 لغة

من العربية إلى الصينية، وتغطي معظم لغات العالم الرئيسية.

علامات تعبيرية

أضف [ضحك]، [سعال]، [ضحك] للأصوات الطبيعية الشبه اللغوية.

الاستدلال السريع

فترات تأخير تقل عن 200 دقيقة مع متغير توربو لتطبيقات الوقت الحقيقي.

حالات الاستخدام

استنساخ الصوت من أجل إنشاء المحتوى التطبيقات الصوتية المتعددة اللغات تصميم صوت الشخصيات للألعاب مساعدون صويون شخصيون

كيف تستخدم صندوق الدردشة

  1. 1

    تسجيل أو فتح العرض

    إنشاء حساب مجاني TextToSpeechAI للمطالبة 200 ائتمانات البدء، أو استخدام على الصفحة العرض التجريبي لتجربة Chatterbox دون التسجيل.

  2. 2

    انقر على Chatterbox وإضافة مقطع مرجعي

    اختار محرك Chatterbox، ثم تحميل مقطع صوت قصير (بضعة ثوان) من الصوت الذي تريد استنساخ. Chatterbox zero-shot يستنسخها فورا - لا يحتاج إلى تدريب.

  3. 3

    أدخل نصك مع علامات اختيارية

    كتابة أو لصق النص للتحدث بأي من اللغات الـ 23 المدعومة، وإسقاط [ضحك]، [سعال]، أو [ضحك] علامات حيثما تريد أصوات طبيعية شبه لغوية.

  4. 4

    توليد الخطاب

    انقر على إنشاء وTextToSpeechAI يعرض نصك في صوت Chatterbox المستنسخ على البنية التحتية المستضافة لمعالج الرسوميات، بإنفاق 25 رصيد لكل 1000 رمز.

  5. 5

    تنزيل أو استخدام API

    تنزيل الملف الصوتي المنتهي، أو أتمتة الإنتاج من خلال REST API TextToSpeechAI على api.texttospeechai.com باستخدام رمز حسابك.

صندوق الدردشة ألف - استعراض البرنامج

توليد الكلام البرمجي باستخدام TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "يمكن لـ Chatterbox أن يستنسخ صوتك من مجرد بضعة ثوان من الصوت ويتحدث بـ 23 لغة.",
    "voice": "en_US-lessac-medium"
  }'

الأسئلة المتكررة

إن شاتربوكس هو نموذج نص إلى كلمة من ريزمبلي آي من استنساخ الصوت من الصفر. وهو قادر على تكرار أي صوت من بضعة ثوان فقط من الصوت المرجعي وتوليد كلمة طبيعية وتعبيرية في 23 لغة، كل ذلك من دون أي تدريب على كل صوت.

نعم، تشاتربوكس مرخص بالكامل من قبل معهد ماساتشوستس للتكنولوجيا - كل من الشفرة وأوزان النموذج - لذلك يمكنك استخدامه بحرية في المنتجات التجارية. ويتضمن الصوت المولد علامة مائية عصبية اختيارية يمكن تعطيلها، ولا توجد أي حقوق استخدام.

إنك تقدم مقطع مرجعي قصير لأي صوت (بضعة ثوان كافية) وتشاتربوكس يستخرج نغمة ذلك الصوت وأسلوبه في متحدث مدمج. ثم يولد حديثا جديدا تماما في ذلك الصوت دون أي ضبط أو تدريب، وهذا هو ما يعنيه "الطلقة الصفرية".

يقوم Chatterbox بقراءة علامات خاصة في النص لإضافة أصوات طبيعية غير لفظية: [الضحك] يدخل الضحك، [السعال] يدخل السعال، و [الضحك] يدخل ضحكاً خفيفاً. فقط وضع علامة حيث تريد الصوت، على سبيل المثال "هذا مضحك [الضحك] ولكن بجدية...".

لقد وجدت خدمة Chatterbox طريقة بسيطة لإنشاء صوت مستنسخ. فكل ما عليك هو كتابة العلامة مباشرة داخل نص المدخل في المكان الذي ينبغي أن يحدث فيه الصوت، محاطاً ببقية جملتك. وتعمل Chatterbox على تمثيل الصوت الشبه اللغوي في الصوت المستنسخ، وخلطه مع الكلام المحيط حتى يبدو عفوياً بدلاً من أن يكون متشابكاً.

يدعم برنامج شاتربوكس 23 لغة، بما في ذلك العربية، والدنماركية، والألمانية، واليونانية، والإنجليزية، والإسبانية، والفنلندية، والفرنسية، والعبرية، والهندسية، والإيطالية، واليابانية، والكورية، والمالايية، والهولندية، والنرويجية، والبولندية، والبرتغالية، والروسية، والسويدية، والسواحيلية، والتركية، والصينية. ويمكن لصوت مستنسخ واحد أن يتكلم عبر هذه اللغات.

إن برنامج Chatterbox ينتج الكلام بسرعة على وحدة المعالجة المركزية، ويبلغ متغير توربو تأخيراً أقل من 200 دقيقة لاستخدام المحادثات في الوقت الحقيقي. والجودة جيدة للغاية، مع الصوت الطبيعي وإعادة إنتاج الصوت الصادق حتى من المقاطع المرجعية القصيرة.

تحتاج Chatterbox إلى حوالي 4-8 جيجا بايت من ذاكرة VRAM اعتمادا على المتغير، مع نموذج توربو يعمل بكل راحة في حوالي 4 جيجا بايت. على TextToSpeechAI لا تحتاج إلى أي وحدة معالجة رسومية محلية - الجيل يعمل على البنية التحتية المستضافة.

إن شاتربوكس محرك من المستوى الأعلى قيمة، ويتكلف 25 نقطة لكل 1000 حرف. وتحصل الحسابات الجديدة على 200 نقطة مجانية لمحاولة استنساخ الصوت، ولا تنفق النقاط إلا على النص الذي تنتجه فعليا.

كل منهما يدعم استنساخ الصوت من دون طلقة، ولكن Chatterbox يغطى لغات أكثر بكثير (23 مقابل 2) ويضيف علامات تعبيرية. F5-TTS يمكن أن تضع جانبا قليلا أكثر طبيعية الإنجليزية، لذا اختر Chatterbox للاستنساخ المتعدد اللغات والأصوات التعبيرية، و F5-TTS للانجليزية فقط.

يدعم برنامج Chatterbox 23 لغة وعلامات تعبيرية داخلية، بينما يقوم برنامج OpenVoice بإضافة ضوابط نمط الصوت (الودي، الحزين، الغاضب، وأكثر) التي يفتقر إليها برنامج Chatterbox. اختار برنامج Chatterbox لتغطية لغة واسعة، وبرنامج OpenVoice عندما تحتاج إلى نمط صوت عاطفي واضح.

نعم، انضم إلى حساب مجاني على TextToSpeechAI لتلقي 200 رصيد بدء، أو استخدم العرض على الصفحة للاستماع إلى Chatterbox دون التسجيل. قم بتحميل مقطع مرجعي قصير، وكتابة نصك، وإنشاء صوت مستنسخ في ثوان.

Technical Specs

  • Generation Speed Fast
  • Output Quality Very Good
  • Voice Cloning Supported
  • Languages 23
  • GPU VRAM 4-8GB
  • Credits/1000 chars 25

Try صندوق الدردشة Now

Generate your first audio free. No credit card required.

Start Free