أوبن فويس

Ultra

استنساخ الصوت الفوري مع التحكم في النغمة الحبيبية

Moderate السرعة
Very Good النوعية
نعم الاستنساخ
10 اللغات

حول أوبن فويس

of the voice and apply it to the speaking style. OpenVoice is a versatile instant voice cloning model that allows fine-grained control over speaking style, allowing you to take a look at the voice and apply it to the speaking style. OpenVoice is a versatile instant voice cloning model that allows fine-grained control over speaking style, allowing you to take a look at the

السمات الرئيسية

الاستنساخ الفوري

استنساخ أي صوت من مجرد بضعة ثوان من الصوت.

التحكم في الصوت

تطبيق نغمات سعيدة، حزينة، غاضبة، متحمسة، أو تهمس.

نقل الأسلوب

فصل الهوية الصوتية عن أسلوب الكلام من أجل المرونة.

عبر اللغات

استخدام الأصوات المستنسخة عبر اللغات المختلفة.

التجهيز السريع

الاستدلال الكفء لتوليد الصوت السريع.

المصدر المفتوح

ترخيص من معهد ماساتشوستس للتكنولوجيا للتطبيقات التجارية.

حالات الاستخدام

المحتوى العاطفي حركة الشخصيات ألعاب تفاعلية سرد الكتب السمعية أشرطة الفيديو التسويقية مساعدون افتراضيون

كيف تستخدم أوبن فويس

  1. 1

    تسجيل مجاني أو تجربة العرض

    إنشاء حساب مجاني TextToSpeechAI للحصول على ائتمانات البدء، أو استخدام العرض على الصفحة للاستماع إلى OpenVoice قبل التعهد. لا GPU محلية أو التثبيت مطلوب - كل شيء يعمل على خوادمنا.

  2. 2

    اختار OpenVoice وتحميل مقطع مرجعي

    انقر على محرك OpenVoice، ثم قم بتحميل بضعة ثوان من الصوت المرجعي النظيف لاستنساخ الصوت المستهدف على الفور. وتسجل OpenVoice هوية المتكلم بحيث يمكنك إعادة استخدامها عبر أي نص أو نغمة.

  3. 3

    أدخل نصك

    كتابة أو لصق النص الذي تريد أن يقال في الصوت المستنسخ. OpenVoice يدعم حوالي 10 لغات وتسليم متعدد اللغات، لذلك يمكنك الكتابة بلغة مختلفة عن المقطع المرجعي.

  4. 4

    اختار أسلوب نغمة و صنع

    ان افضل طريقة لعمل ذلك هي ان تختار احد اساليب الصوت التسعة في اوبن فويس وهي الافتراضية او الودية او السعيدة او المتحمسة او الحزينة او الغاضبة او المرعبة او الصرخة او الهمس ومن ثم تقوم بعمل الصوت المستنسخ نفسه والذي سوف يتكلم بنفس الصوت العاطفي.

  5. 5

    تنزيل أو استخدام API

    تحميل الصوت الخاص بك كMP3، WAV، أو OGG، أو توليد آلي من خلال TextToSpeechAI API عن طريق نقل الصوت المستنسخ وأسلوب النغمة في كل طلب.

أوبن فويس ألف - استعراض البرنامج

توليد الكلام البرمجي باستخدام TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "يمكن أن يتحدث OpenVoice بأي نغمة \u002D سعيد، حزين، أو حتى الهمس.",
    "voice": "en_US-lessac-medium"
  }'

الأسئلة المتكررة

OpenVoice هو نموذج متقدم لتحويل النص إلى كلمة واستنساخ الصوت يفصل بشكل فريد الهوية الصوتية عن أسلوب الكلام. وهذا يسمح لك باستنساخ صوت ثم تطبيق نغمات عاطفية مختلفة دون الحاجة إلى مرجع صوتي جديد لكل مشاعر. وهو مصمم لتوليد كلمة تعبيرية قابلة للتحكم.

نعم، تقوم أوبن فويس باستنساخ الصوت فوراً من مجرد بضعة ثوانٍ من الصوت المرجعي - لا يلزم أي تدريب. بمجرد تسجيل الصوت، يمكن لأوبن فويس إعادة استخدام تلك الهوية عبر أي نص وأي نمط صوت تختار.

يعتمد أوبن فويس على بنية من مرحلتين تفصل تركيب الكلام الأساسي عن تحويل الصوت. وبعد استنساخ الصوت، يمكنك تطبيق أي من أساليب الصوت التسعة - الافتراضية، الودية، السعيدة، المتحمسة، الحزينة، الغاضبة، المرعبة، الصاخبة، أو الهمس - ويتحدث نفس الصوت المستنسخ بشكل مختلف بناءً على الصوت الذي اخترته دون إعادة التسجيل.

يدعم أوبن فويس تسعة أنماط للحديث: الافتراضي، والودود، والسعيد، والمثير، والحزين، والغاضب، والمخيف، والصراخ، والتهمس. ويعيد كل نمط تشكيل التسليم العاطفي في حين يحافظ على هوية المتحدث المستنسخة، مما يعطيك تحكماً دقيقاً في كيفية قراءة السطر.

إن برنامج أوبن فويس مفتوح المصدر بموجب ترخيص معهد ماساتشوستس للتكنولوجيا، لذا فهو مجاني للاستخدام التجاري. وكما هي الحال مع أي نموذج استنساخ، فتأكد من امتلاكك للحقوق المناسبة لأي صوت تستنسخه للمشاريع التجارية.

يدعم برنامج أوبن فويس حوالي عشر لغات، بما في ذلك الإنجليزية والصينية واليابانية والكورية والعديد من اللغات الأوروبية. كما يقدم نسخة متعددة اللغات، بحيث يمكنك نسخ صوت في لغة واحدة وجعله يتكلم بصورة طبيعية في لغة أخرى.

إن أوبن فويس لديها سرعة توليد معتدلة، وعادة ما تقوم بتمثيل جملة في 2-4 ثوان على وحدة المعالجة المركزية. وجودة المخرج جيدة للغاية، مع إعادة إنتاج الصوت الواضح ونقل النغمة الذي يحافظ على هوية المتحدث سليمة في حين يغير بشكل مقنع التسليم العاطفي.

يتطلب OpenVoice عادة 6-8 جيجا بايت من ذاكرة VRAM اعتمادا على حجم الدفعة وحمل تحويل الصوت. وهو يعمل بصورة مريحة على النطاق المتوسط إلى النطاق المتوسط الأعلى من وحدات المعالجة الرسومية، وعلى TextToSpeechAI كل هذا يتم التعامل معها على خواديمنا لذا لا تحتاج إلى أي معدات محلية.

إن أوبن فويس محرك ذو طبقة فوقية، وسعره 50 نقطة لكل 1000 حرف. ويعكس طبقة فوقية التحكم المتقدم في النغمة والحساب الإضافي اللازم للاستنساخ بالإضافة إلى أنابيب تحويل الأسلوب.

إن OpenVoice فريد من نوعه من حيث التحكم في النبرة والأسلوب: يمكنك أخذ صوت مستنسخ واحد وإعادة تقديمه كصوت سعيد، أو حزين، أو غاضب، أو مهمس. و F5-TTS أسرع، وهو محرك الاستنساخ الافتراضي لدينا للكلام الطبيعي والمحايد. اختار OpenVoice عندما تحتاج إلى التحكم في الأسلوب العاطفي، و F5-TTS عندما تريد أسرع نسخة طبيعية.

إنشاء صوت مستنسخ من خلال تحميل الصوت المرجعي، ثم تحديد نمط نغمة في طلب API الخاص بك. API تطبق نغمة عاطفية مختارة على الصوت المستنسخ تلقائيا ويرجع الصوت في MP3، WAV، أو OGG.

نعم. تسجيل لحساب مجاني TextToSpeechAI لتلقي ائتمانات البدء وتجريب OpenVoice استنساخ والتحكم في الصوت، أو استخدام على الصفحة العرض الأول. لا يوجد هناك أي إعداد محلي - تحميل مقطع مرجعي، واختيار صوت، وإنشاء في المتصفح.

Technical Specs

  • Generation Speed Moderate
  • Output Quality Very Good
  • Voice Cloning Supported
  • Languages 10
  • GPU VRAM 3-6GB
  • Credits/1000 chars 50

Try أوبن فويس Now

Generate your first audio free. No credit card required.

Start Free