سلحفاة TTS

Ultra

جودة صوت عالية جداً مع طبيعية لا مثيل لها

Very Slow السرعة
Exceptional النوعية
نعم الاستنساخ
1 اللغات

حول سلحفاة TTS

s available. Tortoise TTS is a

السمات الرئيسية

نوعية عالية جدا

أكثر صوت طبيعي TTS الناتج المتاح.

استنساخ الصوت

استنسخ الأصوات مع صدق استثنائية والفوارق.

الصوت الطبيعي

يسجل أنماط الكلام الدقيقة والعبارات الدقيقة.

الجودة

اختار من ultra_fast إلى high_quality processing.

عمق عاطفي

ينتج كلمة مع صدى عاطفي حقيقي.

المصدر المفتوح

Apache 2.0 مرخص مع حقوق الاستخدام التجاري.

حالات الاستخدام

كتب سمعية عالية الجودة إنتاج الأفلام سرد وثائقي صوتيات مهنية مشاريع المحفوظات المحتوى الرفيع المستوى

سلحفاة TTS Voices

View All 18
Tortoise Angie
EN
Tortoise Deniro
EN
Tortoise Freeman
EN
Tortoise Geralt
EN
Tortoise Halle
EN
Tortoise Jlaw
EN
Tortoise Lj
EN
Tortoise Mol
EN
Tortoise Myself
EN
Tortoise Pat
EN
Tortoise Pat2
EN
Tortoise Snakes
EN

كيف تستخدم سلحفاة TTS

  1. 1

    تسجيل أو تجربة العرض التجريبي المجاني

    أنشئ حساباً مجانياً على TextToSpeechAI للحصول على ائتمانات بدء، أو استخدم عرض الصفحة الرئيسية لتجربة Tortoise دون التسجيل. Tortoise هو محرك Ultra-tier (50 ائتمانا لكل 1000 كلمة)، لذا فإن الائتمانات المجانية مثالية لاختبار قصير أولي.

  2. 2

    اختار Tortoise وإضافة صوت اختياري للاستنساخ

    اختار صوت تورتوز من متصفح الصوت. لاستنساخ شخص معين، قم بتحميل مقطع مرجعي (من الأفضل عدة عينات نظيفة 5-10 ثانية) وسيقوم تورتوز بإعادة إنتاج ذلك الصوت بجودة عالية. وإلا اختر أحد أصوات تورتوز المدمجة.

  3. 3

    أدخل نصك

    كتابة أو لصق النص الذي تريد أن يقال. لأن Tortoise بطيء، ابدأ بمقطع قصير للتأكد من الصوت والنبرة قبل إرسال فصل كامل من الكتاب السمعي أو النص الطويل.

  4. 4

    اختار نوعية مسبقة التحديد وتولد

    اختار جودة Tortoise مسبقة الصنع: ultra_fast للاختبارات السريعة، سريع لتوازن سرعة / جودة جيدة (مقترح افتراضي)، معيارية، أو high_quality للواقعية القصوى. ثم انقر على توليد وكون صبوراً - Tortoise يمكن أن يستغرق من 30 ثانية إلى عدة دقائق لكل مقطع، خاصة عند المستويات العالية مسبقة الصنع.

  5. 5

    تنزيل أو استخدام API

    عندما ينتهي التوليد، قم بتنزيل الصوت الخاص بك كMP3، WAV، أو OGG، أو أحضره من تاريخك. لتشغيل وظائف Tortoise آلياً، استدع API TextToSpeechAI ونقل الجودة المحددة مسبقاً التي اخترتها - تذكر السماح بفترات تأخير أطول لأن Tortoise يعرض ببطء.

سلحفاة TTS ألف - استعراض البرنامج

توليد الكلام البرمجي باستخدام TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "وترتوييز يستغرق وقته، ولكن النتائج تستحق الانتظار.",
    "voice": "tortoise-angie"
  }'

الأسئلة المتكررة

إن تورتوز TTS هو نموذج ذاتي التراجع لتحويل النص إلى كلمة، أنشأه جيمس بيكر، ويضع جودة الصوت فوق كل شيء آخر. وهو يجمع بين نمذجة اللغة القائمة على المحول وفك التشفير الانتشاري لتوليد كلمة ذات طبيعية لا مثيل لها، وعمق عاطفي، وصوتية شبيهة بالإنسان. ويعتبر على نطاق واسع واحداً من أكثر محركات تحويل النص إلى كلمة واقعية ومفتوحة المصدر المتاحة.

نعم، برنامج تورتوز لترجمة النصوص هو مفتوح المصدر تحت ترخيص أباشي 2.0، الذي يسمح بالاستخدام التجاري، والتعديل، وإعادة التوزيع. على TextToSpeechAI، يقع تورتوز في المستوى الأعلى عند 50 نقطة لكل 1000 كلمة بسبب متطلباته الحسابية الثقيلة وجودة الخروجات الاستثنائية.

إن تورتوز بطيء بحكم تصميمه: فهو يولد العديد من المقاطع المرشحة بشكل رجعي ذاتي ثم يقوم بتنقيح أفضلها بنموذج الانتشار وخطوة إعادة الترتيب CLVP. وهذا النوع من أنابيب الجودة الأولى يعني أن مقطع واحد يمكن أن يستغرق من 30 ثانية إلى عدة دقائق اعتمادًا على طول النص والجودة المحددة مسبقًا. والمقايضات هي أن تورتوز ينتج بعض الكلام الأكثر طبيعية من أي محرك لتحويل النص إلى صوت.

يقدم تورتوز أربعة إعدادات مسبقة التي تقوم بمبادلة السرعة بالجودة: ultra_fast (~10x أسرع، جيد للاختبار)، fast (~4x أسرع، الإنتاج الافتراضي)، standard (متوازن)، high_quality (أقصى جودة، أبطأ). الإعدادات المسبقة الأعلى تعطي عينات من مرشحين أكثر وتعمل على خطوات نشر أكثر قبل اختيار أفضل نتيجة. على TextToSpeechAI يمكنك اختيار إعداد مسبق قبل توليد.

نعم، يدعم برنامج تورتوز TTS استنساخ الصوت بأمانة استثنائية. توفر بعض المقاطع المرجعية القصيرة من الصوت المستهدف (من الأمثل 3-10 عينات من 5-10 ثانية لكل منها)، ويستخرج تورتوز نغمة المتحدث، اللون، وتيرة، وتعبيرات دقيقة دقيقة. إنه واحد من أكثر محركات استنساخ الصفر-الطلقة دقة، على الرغم من أن الاستنساخ يضاف إلى وقت التوليد الطويل بالفعل.

تم تدريب تورتوز في المقام الأول على مجموعات بيانات الكلام الإنجليزية، لذلك فإن اللغة الإنجليزية هي حيث تكون نوعيته أقوى. بالنسبة للمشاريع المتعددة اللغات التي تحتاج إلى واقعية مماثلة، انظر إلى F5-TTS أو CosyVoice2 على TextToSpeechAI، والتي تدعم لغات أكثر بينما لا تزال توفر استنساخ الصوت.

ينتج نظام Tortoise صوتاً استثنائياً، وغالباً ما لا يمكن تمييزه عن الصوت البشري. وهو يلتقط التنفس، والتردد، والنبرة، والصدى العاطفي الحقيقي الذي تفتقده النماذج الأخف وزناً. وهذا هو السبب في أنه يظل مفضلاً للكتب السمعية العالية الجودة، والرواية السينمائية، والعمل العالي الجودة في مجال الصوت حيث الواقعية هي الأهم.

يحتاج تورتوز عادة إلى 12-24 جيجا بايت من ذاكرة VRAM اعتمادا على الجودة المسبقة وحجم الدفعة، لذلك يوصى باستخدام وحدات المعالجة المركزية عالية المستوى مثل RTX 3090، 4090، أو A100 للاستخدام المحلي. الاستدلال على وحدة المعالجة المركزية ممكن تقنيا ولكنه بطيئ للغاية. على TextToSpeechAI، يعمل النموذج على بنية وحدة المعالجة المركزية الخاصة بنا، لذلك لا تحتاج إلى أي معدات خاصة بك.

من خلال TextToSpeechAI يمكنك أن تطلب MP3، WAV، أو OGG، ونحن نقوم بتحويل الترميز مع الترميز المحافظ على الجودة حتى يمكنك الحفاظ على تفاصيل النموذج الدقيقة في أي شكل يحتاجه مشروعك.

يقع تورتوز في مستوى التسعير Ultra عند 50 نقطة لكل 1000 كلمة، مما يعكس وقت وحدة المعالجة المركزية التي يستهلكها أنابيب الجودة الأولى. وتحصل الحسابات الجديدة على ائتمانات بدء مجانية، لذا يمكنك اختبار تورتوز قبل التعهد. ويغطي مستوى Ultra أيضاً StyleTTS2، OpenVoice، Dia، وZonos.

كلاهما محركات من الطبقة العليا، ولكنهما يتاجران بشكل مختلف. يبلغ Tortoise TTS القمة المطلقة من الطبيعة والعمق العاطفي ولكنه بعيد عن أبطأ المحرك. StyleTTS2 يقدم جودة قريبة من Tortoise مع توليد أسرع بكثير، مما يجعله الخيار الأفضل عندما تحتاج إلى العديد من المقاطع أو إعادة سريعة. اختار Tortoise عندما تكون الجودة غير قابلة للتفاوض والوقت ليس قيداً.

نعم. تسجيل على TextToSpeechAI لتلقي مكافآت البدء المجانية، أو استخدام العرض على الصفحة الرئيسية، واختيار صوت Tortoise لإنشاء مقطع دون تثبيت أي شيء. لأن Tortoise بطيء، ابدأ بجملة قصيرة و "سريع" الوضع المسبق لرؤية الجودة قبل تشغيل الأعمال الأطول.

Technical Specs

  • Generation Speed Very Slow
  • Output Quality Exceptional
  • Voice Cloning Supported
  • Languages 1
  • GPU VRAM 12-24GB
  • Credits/1000 chars 50

Try سلحفاة TTS Now

Generate your first audio free. No credit card required.

Start Free