سلحفاة TTS

Ultra

جودة صوت عالية جداً مع طبيعية لا مثيل لها

Very Slow السرعة
Exceptional النوعية
لا الاستنساخ
1 اللغات

حول سلحفاة TTS

s available. Tortoise TTS is a

السمات الرئيسية

نوعية عالية جدا

أكثر صوت طبيعي TTS الناتج المتاح.

أصوات الشخصيات

اختار من أصوات Tortoise الجاهزة في مكتبة الأصوات.

الصوت الطبيعي

يسجل أنماط الكلام الدقيقة والعبارات الدقيقة.

عرض سريع

تم عرض المقاطع بمعدل سرعة محدد بحيث تنتهي المقاطع في وقت معقول.

عمق عاطفي

ينتج كلمة مع صدى عاطفي حقيقي.

المصدر المفتوح

Apache 2.0 مرخص مع حقوق الاستخدام التجاري.

حالات الاستخدام

كتب سمعية عالية الجودة إنتاج الأفلام سرد وثائقي صوتيات مهنية مشاريع المحفوظات المحتوى الرفيع المستوى

سلحفاة TTS Voices

View All 18
Tortoise Angie
EN
Tortoise Deniro
EN
Tortoise Freeman
EN
Tortoise Geralt
EN
Tortoise Halle
EN
Tortoise Jlaw
EN
Tortoise Lj
EN
Tortoise Mol
EN
Tortoise Myself
EN
Tortoise Pat
EN
Tortoise Pat2
EN
Tortoise Snakes
EN

كيف تستخدم سلحفاة TTS

  1. 1

    انضم مجانا

    إنشاء حساب مجاني TextToSpeechAI للحصول على أرصدة البدء. Tortoise هو محرك Ultra-tier (50 أرصدة لكل 1000 كلمة)، لذلك الأرصدة المجانية هي مثالية لاختبار قصير أول.

  2. 2

    اختار صوت

    اختار أحد أصوات Tortoise المدمجة من متصفح الصوت.

  3. 3

    أدخل نصك

    كتابة أو لصق النص الذي تريد أن يقال. لأن Tortoise بطيء، ابدأ بمقطع قصير للتأكد من الصوت والنبرة قبل إرسال فصل كامل من الكتاب السمعي أو النص الطويل.

  4. 4

    توليد

    انقر على إنشاء و كن صبوراً. يمكن أن يستغرق Tortoise من 30 ثانية إلى عدة دقائق لكل مقطع.

  5. 5

    تنزيل أو استخدام API

    عندما ينتهي التوليد، قم بتنزيل الصوت الخاص بك كMP3، WAV، أو OGG، أو أحضره من تاريخك. لتشغيل وظائف Tortoise آلياً، استدع API TextToSpeechAI وسمحوا بفترات تأخير أطول، لأن Tortoise يعرض ببطء.

سلحفاة TTS ألف - استعراض البرنامج

توليد الكلام البرمجي باستخدام TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "وترتوييز يستغرق وقته، ولكن النتائج تستحق الانتظار.",
    "voice": "tortoise-angie"
  }'

الأسئلة المتكررة

إن تورتوز TTS هو نموذج ذاتي التراجع لتحويل النص إلى كلمة، أنشأه جيمس بيكر، ويضع جودة الصوت فوق كل شيء آخر. وهو يجمع بين نمذجة اللغة القائمة على المحول وفك التشفير الانتشاري لتوليد كلمة ذات طبيعية لا مثيل لها، وعمق عاطفي، وصوتية شبيهة بالإنسان. ويعتبر على نطاق واسع واحداً من أكثر محركات تحويل النص إلى كلمة واقعية ومفتوحة المصدر المتاحة.

نعم، برنامج تورتوز لترجمة النصوص هو مفتوح المصدر تحت ترخيص أباشي 2.0، الذي يسمح بالاستخدام التجاري، والتعديل، وإعادة التوزيع. على TextToSpeechAI، يقع تورتوز في المستوى الأعلى عند 50 نقطة لكل 1000 كلمة بسبب متطلباته الحسابية الثقيلة وجودة الخروجات الاستثنائية.

إن تورتوز بطيء بحكم تصميمه: فهو يولد العديد من المقاطع المرشحة بشكل رجعي ذاتي ثم يقوم بتنقيح أفضلها بنموذج الانتشار وخطوة إعادة الترتيب CLVP. وهذا النوع من أنابيب الجودة الأولى يعني أن مقطع واحد يمكن أن يستغرق من 30 ثانية إلى عدة دقائق اعتمادًا على طول النص والجودة المحددة مسبقًا. والمقايضات هي أن تورتوز ينتج بعض الكلام الأكثر طبيعية من أي محرك لتحويل النص إلى صوت.

ليس على TextToSpeechAI اليوم. النموذج المصدر المفتوح لديه قيم مسبقة التي مبادلة السرعة للجودة؛ نحن نعرض مع إعداد موجه للسرعة بحيث المقطع ينتهي في وقت معقول.

لا على TextToSpeechAI. أصوات Tortoise هنا هي أصوات جاهزة من المكتبة. لاستنساخ الصوت، استخدم أداة Clone Voice، التي تشغل Chatterbox.

تم تدريب تورتوز في المقام الأول على مجموعات بيانات الكلام الإنجليزية، لذلك اللغة الإنجليزية هي حيث تكون نوعيته أقوى. بالنسبة للغات الأخرى، استخدم أصوات بايبر أو بارك، أو صوت مستنسخ.

ينتج نظام Tortoise صوتاً استثنائياً، وغالباً ما لا يمكن تمييزه عن الصوت البشري. وهو يلتقط التنفس، والتردد، والنبرة، والصدى العاطفي الحقيقي الذي تفتقده النماذج الأخف وزناً. وهذا هو السبب في أنه يظل مفضلاً للكتب السمعية العالية الجودة، والرواية السينمائية، والعمل العالي الجودة في مجال الصوت حيث الواقعية هي الأهم.

يحتاج تورتوز عادة إلى 12-24 جيجا بايت من ذاكرة VRAM اعتمادا على الإعدادات وحجم المجموعة، لذلك يوصى باستخدام وحدات معالجة رسومية عالية المستوى مثل RTX 3090، 4090، أو A100 للاستخدام المحلي. الاستدلال على وحدة المعالجة المركزية ممكن تقنيا ولكنه بطيئ للغاية. على TextToSpeechAI، يعمل النموذج على بنية وحدة المعالجة المركزية الخاصة بنا، لذلك لا تحتاج إلى أي معدات خاصة بك.

من خلال TextToSpeechAI يمكنك أن تطلب MP3، WAV، أو OGG، ونحن نقوم بتحويل الترميز مع الترميز المحافظ على الجودة حتى يمكنك الحفاظ على تفاصيل النموذج الدقيقة في أي شكل يحتاجه مشروعك.

يقع تورتوز في مستوى التسعير Ultra عند 50 نقطة لكل 1000 كلمة، مما يعكس وقت وحدة المعالجة المركزية التي يستهلكها أنابيب الجودة الأولى. تحصل الحسابات الجديدة على نقطة بدء مجانية، لذا يمكنك اختبار تورتوز قبل التعهد. يشمل مستوى Ultra أيضاً StyleTTS2.

كلاهما محركات من الطبقة العليا، ولكنهما يتاجران بشكل مختلف. يبلغ Tortoise TTS القمة المطلقة من الطبيعة والعمق العاطفي ولكنه بعيد عن أبطأ المحرك. StyleTTS2 يقدم جودة قريبة من Tortoise مع توليد أسرع بكثير، مما يجعله الخيار الأفضل عندما تحتاج إلى العديد من المقاطع أو إعادة سريعة. اختار Tortoise عندما تكون الجودة غير قابلة للتفاوض والوقت ليس قيداً.

نعم. انضم إلى TextToSpeechAI للحصول على رصيد بدء مجاني، ثم اختر صوت تورتوز لإنتاج مقطع بدون تثبيت أي شيء. لأن تورتوز بطيء، ابدأ بجملة قصيرة قبل تشغيل مهام أطول.

Technical Specs

  • Generation Speed Very Slow
  • Output Quality Exceptional
  • Voice Cloning Not Supported
  • Languages 1
  • GPU VRAM 12-24GB
  • Credits/1000 chars 50

Try سلحفاة TTS Now

Generate your first audio free. No credit card required.

Start Free