القشرة

Premium

كلمة تعبيرية للذكاء الاصطناعي مع المشاعر والتأثيرات الصوتية

Slow السرعة
Very Good النوعية
لا الاستنساخ
13 اللغات

حول القشرة

-text audio. Bark is a

السمات الرئيسية

التعبير العاطفي

تحدث مع الضحك، التهكم، التنفس، والمشاعر الحقيقية.

مؤشرات العاطفة

استخدم [ضحك]، [انتفاخ]، حروف كبيرة للتأكيد، و... للتردد.

تعدد اللغات

يدعم 13+ لغات مع اللهجات الطبيعية والنطق.

الموسيقى والمؤثرات

يمكنه توليد موسيقى بسيطة وأصوات بيئية.

المتحدثين

عدة أصوات متكلمين مدربين مسبقاً بأساليب مختلفة.

المصدر المفتوح

ترخيص من معهد ماساتشوستس للتكنولوجيا بحقوق الاستخدام التجاري الكاملة.

حالات الاستخدام

حوار الشخصية المحتوى المتحرك سرد الكتب السمعية التمثيل الصوتي مشاريع إبداعية مساعدون تعبيريون

القشرة Voices

View All 130
Bark Chinese Speaker 0
ZH
Bark Chinese Speaker 1
ZH
Bark Chinese Speaker 2
ZH
Bark Chinese Speaker 3
ZH
Bark Chinese Speaker 4
ZH
Bark Chinese Speaker 5
ZH
Bark Chinese Speaker 6
ZH
Bark Chinese Speaker 7
ZH
Bark Chinese Speaker 8
ZH
Bark Chinese Speaker 9
ZH
Bark English Speaker 0
EN
Bark English Speaker 1
EN

كيف تستخدم القشرة

  1. 1

    تسجيل مجاني وفتح العرض

    إنشاء حساب مجاني TextToSpeechAI للمطالبة ببدء الائتمانات، أو استخدام العرض التجريبي بدون التسجيل لتجربة Bark على الفور. الائتمانات المجانية كافية لإنتاج العديد من مقاطع Bark التعبيرية قبل أن تقوم بالترقية.

  2. 2

    اختار صوتاً

    افتح مكتبة الصوت وانتخب متحدث صوت يرقة مسبق الصنع يطابق النغمة التي تريد. صوت يرقة يسجل على أنه المستوى الأعلى (25 نقطة لكل 1000 كلمة) ويتم ضبطها للرواية العاطفية، أسلوب الشخصيات.

  3. 3

    أدخل نصاً مع علامات العواطف

    اكتب نصك و ادمج علامات مشاعر اللقمة في السطر: [ضحك] للضحك، [ضحك] للشهيق، [هسهس] للشهيق،... للتوقف، و CAPS للتأكيد. على سبيل المثال: "أوه يا إلهي! [ضحك] هذا مدهش... لا أستطيع تصديقه!"

  4. 4

    توليد الصوت

    انقر على توليد و يجعل الصوت النص الخاص بك إلى حديث تعبيري ، تحويل كل علامة إلى الصوت المطابق. البناء أبطأ من المحركات الخفيفة بسبب نموذج المحول الصوت ل بارك ، لذلك السماح ببضعة ثوان إضافية لكل جملة.

  5. 5

    تنزيل أو استخدام API

    يمكنك الحصول على نتائج مسبقة، ثم تنزيلها في شكل MP3، أو WAV، أو OGG. ولجعل عملية البلع آلية في تطبيقك الخاص، استدع API TextToSpeechAI بصوت البلع ونفس النص الغنى بالعلامات لاستعادة الصوت التعبيري.

القشرة ألف - استعراض البرنامج

توليد الكلام البرمجي باستخدام TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "هذا مدهش أنا أحب كيف يبدو هذا التعبير",
    "voice": "bark-zh_0"
  }'

الأسئلة المتكررة

بارك هو نموذج تحويل النص إلى صوت يعتمد على المحول، والذي أنشأته شركة سونو. وعلى عكس أنظمة تحويل النص إلى صوت التقليدية، ينتج بارك لغة تعبيرية للغاية مع مشاعر طبيعية، والضحك، والتأنيث، وغيرها من الأصوات غير اللفظية. ويمكنه حتى توليد الموسيقى والتأثيرات الصوتية.

نعم، بارك مفتوح المصدر تحت ترخيص معهد ماساتشوستس للتكنولوجيا، مما يسمح بالاستخدام التجاري المجاني. على TextToSpeechAI، نحن ندفع 25 رصيد لكل 1000 كلمة بسبب موارد وحدة المعالجة المركزية الكبيرة المطلوبة للتوليد.

يدعم برك 13+ لغات بما في ذلك الإنجليزية، الألمانية، الإسبانية، الفرنسية، الهندية، الإيطالية، اليابانية، الكورية، البولندية، البرتغالية، الروسية، التركية، والصينية. كل لغة لها نطق طبيعي ولهجات.

يعد Bark أبطأ من معظم محركات TTS بسبب بنيته التحويلية ذاتية التراجع. تستغرق الجملة النموذجية 5-15 ثانية لتوليد على وحدة المعالجة المركزية. والمقايضات هي بشكل ملحوظ أكثر تعبيرا وخروج طبيعي.

يقدم برك فقط استنساخ صوت محدود من خلال "النداءات الدلالية" وتحديدات المتحدث المسبقة، لذلك لا يمكن أن يستنسخ بشكل موثوق صوتًا تعسفيًا من عينة. إذا كان استنساخ الصوت الكامل هو هدفك، استخدم F5-TTS، StyleTTS2، OpenVoice، أو Tortoise بدلاً من ذلك، كلها متاحة على TextToSpeechAI.

يقوم Bark بقراءة العلامات الموجودة في السطر والموضوعة مباشرة في نصك وتحويلها إلى أصوات متطابقة. استخدم [ضحك] للضحك، [ضحك] للشهيق، [هباء] للهباء،... للتردد أو التوقف، و CAPS للتأكيد. مثال: "أوه يا إلهي! [ضحك] هذا مدهش... لا أستطيع تصديقه!"

وبعيداً عن الكلام البسيط، يستطيع برك إنتاج أصوات غير لفظية مثل الضحك، والانتعاش، والتنفس، وتطهير الحلق، والضجر، بالإضافة إلى الموسيقى البسيطة والتأثيرات البيئية. ويتم إطلاق هذه الأصوات باستخدام علامات مثل [ضحك]، [انتعاش]، و[ضخ] المدمجة في النص، وهو ما يجعل برك يشعر بأنه أكثر تعبيراً من تقنية الترجمة التلقائية للكلمات القياسية.

ينتج بارك صوت جيد جدا مع التعبير الطبيعي الذي يتنافس مع الكلام البشري للمحتوى العاطفي. 24 كيلوهرتز الخرج يبدو مهنيا، على الرغم من أن جودة الكلام النقي أقل قليلا من StyleTTS2.

يحتاج Bark إلى 8-12 جيجا بايت من ذاكرة VRAM اعتمادا على حجم النموذج. النموذج الكامل يحتاج إلى ~12 جيجا بايت، بينما تعمل المتغيرات الأصغر حجما بـ 8 جيجا بايت.

نعم، برك مرخص من قبل معهد ماساتشوستس للتكنولوجيا، مما يسمح بالاستخدام التجاري غير المقيد بدون رسوم ترخيص. يمكنك استخدام برك في المنتجات، الخدمات، والتطبيقات بحرية. على TextToSpeechAI يمكنك تجربة برك مجانا باستخدام ائتمانات التسجيل الخاصة بك قبل دفع المزيد.

يتميز بارك في التعبير عن كلمة المتحدث الواحد مع علامات المشاعر مثل [ضحك] و [تنفس]، بينما ديّا تم بناؤه للحوار متعدد المتحدثين مع [S1] / [S2] تحولات والإشارات غير اللفظية. اختار بارك للرواية العاطفية وصوت الشخصيات، وديّا للمحادثات ذهاباً وإياباً. كلاهما متاح على TextToSpeechAI.

يتميز Bark بقدرته الفريدة على توليد حديث تعبيري حقيقي مع مشاعر وأصوات غير لفظية. وهو أبطأ من محركات أخرى ولكنه ينتج نتائج أكثر إنسانية للمحتوى الإبداعي. للتخليق الأسرع، استخدم Piper. لاستنساخ الصوت، استخدم F5-TTS أو OpenVoice.

Technical Specs

  • Generation Speed Slow
  • Output Quality Very Good
  • Voice Cloning Not Supported
  • Languages 13
  • GPU VRAM 8-12GB
  • Credits/1000 chars 25

Try القشرة Now

Generate your first audio free. No credit card required.

Start Free