صوت رائع

Premium

استنساخ صوتي متعدد اللغات بدون تسجيل مع دعم التدفق

Fast السرعة
Very Good النوعية
نعم الاستنساخ
5 اللغات

حول صوت رائع

[Translation temporarily unavailable. Please try again.]

السمات الرئيسية

استنساخ الصوت

استنساخ أي صوت من 3-10 ثوان من السمعي المرجعي مع الصدق العالي.

تعدد اللغات

يدعم الصينية، والانكليزية، واليابانية، والكورية، والكانتونية مع التوليف عبر اللغات.

دعم البث

طريقة تدفق منخفضة التأخير للتطبيقات الزمنية الحقيقية والنظم التفاعلية.

الصوت الطبيعي

وينتج نمذجة الصوت المتقدمة كلمـة طبيعية الصوت مع النبرة المناسبة.

حالات الاستخدام

إنشاء المحتوى المتعدد اللغات مساعدون صويون في الوقت الحقيقي الترجمة الشفوية المتعددة اللغات التطبيقات الصوتية الشخصية

كيف تستخدم صوت رائع

  1. 1

    التسجيل والمطالبة بائتمانات مجانية

    إنشاء حساب مجاني TextToSpeechAI للمطالبة ببدء ائتمانات، أو تجربة العرض الأول. لا GPU أو CosyVoice2 محلية تثبيت مطلوب - كل شيء يعمل على بنية تحتية.

  2. 2

    اختر CosyVoice2 و أضف مقطع مرجعي

    اختار CosyVoice2 كمحركك، ثم قم بتحميل تسجيل مرجعي نظيف لمدة 3-10 ثوان للصوت الذي تريد استنساخه. سوف يستخرج CosyVoice2 خصائص المتحدث لاستنساخ متعدد اللغات من الصفر.

  3. 3

    أدخل نصك بأي لغة مدعومة

    يكتب أو يصطف النص الخاص بك بالصينية أو الإنجليزية أو اليابانية أو الكورية أو الكانتونية. ويدعم برنامج CosyVoice2 التركيب عبر اللغات، بحيث يمكن للصوت المستنسخ أن يتكلم لغة مختلفة عن المقطع المرجعي.

  4. 4

    توليد الخطاب

    ويتم توليف الكلام الطبيعي المتعدد اللغات في الصوت المستنسخ، عادة في غضون ثوان بالنسبة للنص القصير، باستخدام برنامج CosyVoice2. وتكلف خدمة المستوى الأعلى 25 نقطة لكل 000 1 حرف.

  5. 5

    تنزيل أو استخدام API

    تحميل الصوت المنتهي كMP3 أو WAV من تاريخك، أو أتمتة CosyVoice2 استنساخ الصوت على نطاق واسع من خلال TextToSpeechAI REST API.

صوت رائع ألف - استعراض البرنامج

توليد الكلام البرمجي باستخدام TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "وتوفر خدمة CosyVoice2 كلمـة طبيعية متعددة اللغات مع قدرة على استنساخ الصوت بدون تسجيل.",
    "voice": "en_US-lessac-medium"
  }'

الأسئلة المتكررة

CosyVoice2 هو نموذج للجيل القادم من النص إلى الكلام واستنساخ الصوت من FunAudioLLM (Alibaba). وهو يدعم استنساخ الصوت من الصفر من مجرد بضعة ثوان من الصوت المرجعي ويمكنه أن يقوم بتوليف الكلام الطبيعي باللغات الصينية والإنجليزية واليابانية والكوريه والكانتون. على TextToSpeechAI يمكنك تشغيل CosyVoice2 في المتصفح بدون أي تثبيت محلي.

نعم، CosyVoice2 مرخص بالكامل من قبل Apache 2.0 - كل من الشفرة وأوزان النموذج. وهذا يجعلها آمنة للاستخدام في المنتجات التجارية، والمحتوى المدفوع الأجر، وعمل العميل دون رسوم الترخيص أو القيود غير التجارية.

يدعم برنامج كوسي فويس 2 خمس لغات: الصينية (الماندرين)، والإنجليزية، واليابانية، والكوريه، والكانتوني. كما يتعامل مع التوليف عبر اللغات، بحيث يمكنك استنساخ صوت من تسجيل في لغة واحدة وتوليد الكلام في لغة أخرى.

يوفر 3-10 ثوان من الصوت المرجعي النظيف للمتحدث المستهدف. CosyVoice2 يستخرج خصائص المتحدث باستخدام نهج كمي قياسي محدود، ثم يولد حديثا جديدا في ذلك الصوت المستنسخ عبر أي من لغاته المدعومة. لا يلزم تدريب النموذج أو ضبط دقيق.

إن برنامج CosyVoice2 هو أحد نماذج الاستنساخ المتعدد اللغات الأقوى، حيث يحافظ على هوية المتحدث حتى عند توليد الكلام بلغة مختلفة عن المقطع المرجعي. وهو ينتج نغمة طبيعية ونغمة، مما يجعله مناسبا للترجمة عبر اللغات والمحتوى المحلي.

نعم، CosyVoice2 هو نموذج سريع ويتضمن طريقة تدفق تنتج صوتاً بفترة تأخير منخفضة، مما يجعله مناسباً للمساعدين الصوتيين والتطبيقات التفاعلية، ويتم على TextToSpeechAI جيلاً في الثانية بالنسبة للنص القصير.

يتطلب CosyVoice2 حوالي 4-6GB من VRAM لنموذج 0.5B البارامترات، لذلك وحدة المعالجة المركزية مع 6GB أو أكثر موصى بها عند الاستضافة الذاتية. على TextToSpeechAI النموذج يعمل على البنية التحتية وحدة المعالجة المركزية، لذلك لا تحتاج إلى أي معدات الخاصة بك.

إن برنامج CosyVoice2 هو نموذج من المستويات العالية ويبلغ ثمنه 25 نقطة لكل 1000 حرف من النص. ويحصل كل حساب جديد على نقاط بدء مجانية، لذا يمكنك تجربة نسخة صوتية من برنامج CosyVoice2 قبل أن تقرر الاشتراك في خطة مدفوعة.

كلاهما محركات استنساخ صوت عالية الجودة. GPT-SoVITS غالبا ما تصل إلى أعلى تشابه خام لصوت هدف واحد، في حين أن CosyVoice2 أقوى من أجل الاستنساخ متعدد اللغات و عبر اللغات وتضيف طريقة تدفق منخفضة التأخير. اختار CosyVoice2 عندما تحتاج إلى صوت مستنسخ واحد للتحدث بلغات عديدة.

ويدعم برنامج CosyVoice2 لغات أكثر (5 مقابل 2) ويضيف تدفقاً للاستخدام في الوقت الحقيقي، في حين أن برنامج F5-TTS يمكن أن يكون أسرع قليلاً لأعباء العمل باللغة الإنجليزية فقط.

TextToSpeechAI يسمح لك بتصدير أجيال CosyVoice2 في أشكال شائعة مثل MP3 و WAV. يمكنك تنزيل الملف مباشرة من صفحة تاريخك أو استرجاعه برمجياً من خلال TextToSpeechAI API.

نعم، يمكنك اختبار CosyVoice2 مع العرض المجاني واعتمادات البدء المجانية على TextToSpeechAI دون تثبيت أي شيء. فقط انضم، تحميل مقطع مرجعي قصير، كتابة نصك في أي لغة مدعومة، وإنشاء.

Technical Specs

  • Generation Speed Fast
  • Output Quality Very Good
  • Voice Cloning Supported
  • Languages 5
  • GPU VRAM 4-6GB
  • Credits/1000 chars 25

Try صوت رائع Now

Generate your first audio free. No credit card required.

Start Free