كوكورو

Standard

سريع، خفيف الوزن، TTS مع نوعية طبيعية

Very Fast السرعة
Good النوعية
لا الاستنساخ
9 اللغات

حول كوكورو

[Translation temporarily unavailable. Please try again.]

السمات الرئيسية

الخفيفة جدا

82M بارامترات، ~300MB حجم النموذج. يعمل على CPU مع الحد الأدنى من الموارد.

شبه آني

يولد الكلام أسرع من سرعة التشغيل، حتى بدون تسارع GPU.

تعدد اللغات

يدعم اللغات الإنكليزية والفرنسية والإسبانية والهندية واليابانية والصينية والإيطالية والبرتغالية والكورية.

مزج الصوت

خلط صوتين معاً لإنشاء مجموعات صوتية فريدة.

حالات الاستخدام

الروبوتات الدردشة في الوقت الحقيقي والمساعدون الافتراضيون تحويل النصوص إلى صوت بالبث الحي نشر التطبيقات الطرفية والتطبيقات المتنقلة تجهيز دفعات كبيرة

كيف تستخدم كوكورو

  1. 1

    تسجيل مجاني أو تجربة العرض

    إنشاء حساب مجاني TextToSpeechAI للحصول على 200 ائتمانات البدء، أو استخدام العرض التجريبي دون التسجيل للاستماع إلى كوكورو فورا. المستوى القياسي يعني كوكورو فقط تكلفة 10 ائتمانات لكل 1000 كلمة.

  2. 2

    إختار صوت كوكورو

    افتح متصفح الصوت وانتخب صوت كوكورو في لغتك المستهدفة (9 مدعومة، من الإنجليزية إلى اليابانية والكوريه). يمكنك أيضا استخدام مزج صوت كوكورو لخلط صوتين في تركيبة شخصية.

  3. 3

    أدخل نصك

    يقوم كوكورو بمعالجة المقاطع الطويلة بكفاءة بفضل محركه الخفيف 82M-parameter، الذي يعمل في الوقت الحقيقي تقريباً.

  4. 4

    تعديل السرعة و توليد

    حدد سرعة التشغيل لتتناسب مع حالة استخدامك، ثم انقر على توليد. كوكورو يعرض الصوت أسرع من الوقت الحقيقي، لذلك كلمتك جاهزة على الفور تقريبا.

  5. 5

    تنزيل أو استخدام API

    تنزيل الصوت النهائي كMP3 أو WAV، أو توليد آلي من خلال REST API TextToSpeechAI على api.texttospeechai.com لعملية دفعة وحملة العمل في الوقت الحقيقي.

كوكورو ألف - استعراض البرنامج

توليد الكلام البرمجي باستخدام TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "يقدم كوكورو حديثاً طبيعياً بسرعة وكفاءة لا تصدق.",
    "voice": "en_US-lessac-medium"
  }'

الأسئلة المتكررة

إن كوكورو هو نموذج خفيف للغاية لتحويل النص إلى كلمة لا يحتوي إلا على 82 مليون بارامترات. وعلى الرغم من حجمه الصغير، فإنه ينتج كلمة طبيعية عبر لغات متعددة بسرعة قريبة من الزمن الحقيقي، حتى على المعالج المركزي.

نعم، كوكورو مرخصة بالكامل من قبل أباشي 2.0 - كل من الشفرة والنموذج، ويمكن استخدامها بحرية في التطبيقات التجارية بدون قيود.

يدعم كوكورو الإنجليزية (الأمريكية والبريطانية)، والفرنسية، والإسبانية، والهندسية، واليابانية، والصينية، والإيطالية، والبرتغالية، والكورية.

كوكورو هو واحد من أسرع نماذج TTS المتاحة، وهو يولد الكلام أسرع من سرعة التشغيل في الوقت الحقيقي حتى على وحدة المعالجة المركزية، مما يجعله مثاليا للتطبيقات التفاعلية.

لا، كوكورو لا يدعم استنساخ الصوت. إنه يستخدم مكتبة صوتية مختارة مع قدرات مزج الصوت. لاستنساخ الصوت، استخدم F5-TTS، Chatterbox، StyleTTS2، OpenVoice، أو Tortoise.

يمكن لكوكورو أن يخلط صوتين معاً لإنشاء تركيبات فريدة. وهذا يسمح لك بإنشاء خصائص صوتية مخصصة دون استنساخ الصوت التقليدي.

وكلاهما نموذجان سريعا وخفيف الوزن، لدى كوكورو بنية أكثر حداثة وتدعم المزج الصوتي، بينما لدى بايبرز مكتبة صوتية أكبر، وكلاهما ممتازان لتطبيقات الوقت الحقيقي.

صممت كوكورو للعمل على وحدة المعالجة المركزية وتتطلب الحد الأدنى من الموارد - حوالي 300 ميغابايت. لا يحتاج إلى وحدة المعالجة الرسومية، على الرغم من أن تسريع وحدة المعالجة الرسومية مدعوم لمعالجة أسرع.

نعم، لقد تم تطوير كوكورو بالفعل. فهو يولد الكلام بسرعة أكبر من تشغيله حتى على وحدة المعالجة المركزية، مع تأخير منخفض للغاية، لذا فهو ملائم بشكل ممتاز لآلات الدردشة، والمساعدين الصوتيين، والبث المباشر. ويحافظ حجم بارامتره البالغ 82 ميجا بايت على استخدام الذاكرة ضئيلا، مما يجعله عملياً لنشر الحجم الكبير والطرفي.

يجعل مزج الصوت من الممكن مزج صوتين من صوت كوكورو معاً لإنشاء مزيج فريد من نوعه مع خصائص شخصية. إنه ليس استنساخ صوت تقليدي - لا يمكنك استنساخ شخص محدد من عينة - ولكنه يعطيك تنوعاً أكبر من مكتبة أصوات ثابتة. يمكنك تجربة المزج مباشرة في محرر TextToSpeechAI.

كلاهما سريع، ومحركات من الطبقة القياسية المتوافقة مع المعالج بدون استنساخ الصوت. كوكورو هو الأخف (حوالي 300 ميجابايت) ويدعم مزج الصوت عبر 9 لغات، بينما ميلو تي تي إس يركز على لهجات إنجليزية متعددة ومخرج متعدد اللغات في الوقت الحقيقي. اختار كوكورو لأصغر مساحة ومزج؛ اختار ميلو تي تي إس عندما تحتاج إلى لهجات محددة.

كوكورو هو محرك من المستوى القياسي، بتكلفة 10 ائتمانات لكل 1000 حرف - أقل مستوى على TextToSpeechAI. الحسابات الجديدة تحصل على 200 ائتمانات مجانية، لذلك يمكنك تجربة كوكورو دون دفع. هذا يجعله واحدا من أكثر الطرق فعالية من حيث التكلفة لتوليد حديث عالي الجودة على نطاق واسع.

Technical Specs

  • Generation Speed Very Fast
  • Output Quality Good
  • Voice Cloning Not Supported
  • Languages 9
  • GPU VRAM CPU OK
  • Credits/1000 chars 10

Try كوكورو Now

Generate your first audio free. No credit card required.

Start Free