صندوق الدردشة

Premium

The voice cloning engine behind TextToSpeechAI cloned voices

Moderate السرعة
Very Good النوعية
نعم الاستنساخ
15 اللغات

حول صندوق الدردشة

Chatterbox is an open-source, zero-shot voice cloning model with MIT licensed code and weights. On TextToSpeechAI it powers every cloned voice: upload 6 to 60 seconds of clear audio and Chatterbox reproduces that voice in any of the languages listed on the voice cloning page, with no training step.

السمات الرئيسية

استنساخ الصوت

نسخ صوت من 6 إلى 60 ثانية من الصوت. لا يحتاج إلى التدريب.

عبر اللغات

استنساخ من عينة لغة إنجليزية وتوليد كلمة بأي من اللغات الـ 15 على صفحة الاستنساخ.

قياس تشابه المتحدثين

في اختباراتنا الخاصة، توافقت شاتربوكس مع المتحدث المرجعي بشكل أوثق من محركات الاستنساخ المرخصة الأخرى التي قمنا بتقييمها.

مرخصة تجاريا

ترخيص MIT لكل من الشفرة والنموذج وزن.

حالات الاستخدام

استنساخ الصوت من أجل إنشاء المحتوى السرد المتعدد اللغات بصوت واحد أصوات الشخصيات للألعاب الأصوات الشخصية والعلامة التجارية

كيف تستخدم صندوق الدردشة

  1. 1

    إنشاء حساب مجاني

    تسجيل ل TextToSpeechAI للحصول على أرصدة البدء المجانية.

  2. 2

    تحميل مقطع مرجعي

    افتح صفحة استنساخ الصوت و قم بتحميل 6 إلى 60 ثانية من الكلام الواضح من الصوت الذي لديك الحق في استنساخه.

  3. 3

    أدخل نصك ولغتك

    يكتب النص للتحدث واختيار واحدة من 15 لغة الخرج المدعومة.

  4. 4

    توليد الخطاب

    TextToSpeechAI يقوم بعرض النص في الصوت المستنسخ مع Chatterbox على خوادمنا GPU.

  5. 5

    تنزيل أو استخدام API

    تحميل الصوت المنتهي، أو أتمتة الإنتاج من خلال TextToSpeechAI REST API.

صندوق الدردشة ألف - استعراض البرنامج

توليد الكلام البرمجي باستخدام TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "هذا هو صوتي المستنسخ، الذي تم إنشاؤه من تسجيل قصير.",
    "voice": "en_US-kristin-medium"
  }'

الأسئلة المتكررة

Chatterbox هو نموذج مفتوح المصدر لتحويل النص إلى كلمة يستنسخ صوتًا من تسجيل مرجعي قصير دون أي تدريب على كل صوت. TextToSpeechAI يستخدمه لكل صوت مستنسخ.

نعم، كل من شفرة (تشاتربوكس) ونموذج وزنها يصدر تحت ترخيص (MIT) لا تزال بحاجة إلى حق استخدام الصوت الذي تستنسخه

تحميل ما بين 6 و 60 ثانية من الكلام الواضح من متحدث واحد. التسجيل الهادئ بدون موسيقى أو أصوات الخلفية يعطي أقرب مطابقة.

يمكن للصوت المستنسخ أن يتكلم 15 لغة مدرجة في صفحة استنساخ الصوت: الإنجليزية، الإسبانية، الفرنسية، الألمانية، الإيطالية، البرتغالية، البولندية، الروسية، الهولندية، التركية، اليابانية، الكورية، الصينية، العربية، الهندية. ويمكن أن يكون المقطع المرجعي بلغة مختلفة عن النص الذي أنتجته.

يتم عرض الكلام المستنسخ على خوادم وحدة المعالجة المركزية الخاصة بنا، وعادة ما يستغرق حوالي دقيقة لمقطع قصير، لأن الصوت المرجعي يتم معالجته مرة أخرى لكل جيل. وتستغرق النصوص الأطول وقتا أطول.

إن إنشاء صوت مستنسخ مجاني. ويتم فرض رسوم على توليد الكلام بهذا الصوت حسب الشخصية، مثل أي صوت آخر، وتحصل الحسابات الجديدة على أرصدة بدء مجانية لتجربته.

نعم، أنشئ صوتاً مستنسخاً من خلال واجهة REST API على الموقع api.texttospeechai.com مع رمز حسابك، ثم أشير إليه في طلبات توليد الصوت.

Technical Specs

  • Generation Speed Moderate
  • Output Quality Very Good
  • Voice Cloning Supported
  • Languages 15
  • GPU VRAM 4-8GB
  • Credits/1000 chars 5

Try صندوق الدردشة Now

Generate your first audio free. No credit card required.

Start Free