أجهزة جيب TTS

Standard

استنساخ صوتي خفيف للغاية يعمل في الوقت الحقيقي على وحدة المعالجة المركزية

Very Fast السرعة
Good النوعية
نعم الاستنساخ
2 اللغات

حول أجهزة جيب TTS

Windows 10, 8.1, 8, 7, Vista, XP, 2000, 2003, 2008, 2010, 2013, 2016, 2019, 2020, 2021, 2022, 2023, 2024, 2025,

السمات الرئيسية

الخفيفة جدا

100M البارامترات - يجري في الوقت الحقيقي على وحدة المعالجة المركزية مع الحد الأدنى من الموارد.

استنساخ الصوت

استنساخ أي صوت من مجرد 5 ثوان من الصوت المرجعي، حتى على CPU.

الزمن الحقيقي على وحدة المعالجة المركزية

لا يحتاج إلى وحدة معالجة رسومية، يولد الكلام بسرعة الوقت الحقيقي على المعدات القياسية.

جاهز للاستخدام

صغير بما فيه الكفاية للأجهزة المحمولة، Raspberry Pi، والنظم المدمجة.

حالات الاستخدام

النشر الطرفي والمتنقل مساعدون صويون في الوقت الحقيقي على وحدة المعالجة المركزية الإنترنت والأجهزة المتكاملة استنساخ الصوت المنخفض الموارد

كيف تستخدم أجهزة جيب TTS

  1. 1

    تسجيل مجاني أو تجربة العرض

    إنشاء حساب مجاني TextToSpeechAI للحصول على ائتمانات البدء، أو استخدام العرض في الموقع للاستماع إلى Pocket TTS قبل التسجيل. لا GPU أو التركيب المحلي مطلوب.

  2. 2

    انقر على Pocket TTS وإضافة صوت لاستنساخ

    اختار Pocket TTS كمحركك، ثم قم بتحميل مقطع مرجعي قصير من حوالي 5 إلى 10 ثوان لاستنساخ ذلك الصوت. Pocket TTS يعمل بالكامل على المعالج، لذلك الاستنساخ سريع وخفيف.

  3. 3

    أدخل نصك

    1- يرجى كتابة أو لصق النص الإنكليزي أو الفرنسي الذي تريد أن يقال، ومراقب عدد الحروف، لأن برنامج Pocket TTS يحسب بالمعدل القياسي وهو 10 وحدات لكل 000 1 حرف.

  4. 4

    توليد الصوت

    انقر على إنشاء و Pocket TTS يقوم بتوليف نصك في الصوت المستنسخ بسرعة الوقت الحقيقي معظم المقاطع جاهزة في ثوان لأن النموذج صغير جدا و فعال من حيث المعالج

  5. 5

    تنزيل أو استخدام API

    تحميل الصوت المنتهي، أو أتمتة توليد من خلال REST API TextToSpeechAI في api.texttospeechai.com باستخدام رمز حسابك. API يعرض نفس Pocket TTS استنساخ وتركيب لتطبيقاتك الخاصة.

أجهزة جيب TTS ألف - استعراض البرنامج

توليد الكلام البرمجي باستخدام TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "Pocket TTS يقدم استنساخ الصوت الذي يعمل في الوقت الحقيقي، حتى على وحدة المعالجة المركزية.",
    "voice": "en_US-lessac-medium"
  }'

الأسئلة المتكررة

Pocket TTS هو نموذج خفيف للغاية لتحويل النص إلى صوت من Kyutai مع 100 مليون بارامترات فقط، وهو يعمل في الوقت الحقيقي على وحدة المعالجة المركزية ويدعم استنساخ الصوت من 5 ثوان من الصوت.

Pocket TTS مرخص تحت CC-BY-4.0، الذي يسمح بالاستخدام التجاري مع الإشارة إلى مصدره. يجب أن تذكر كيوتاي عند استخدامه في التطبيقات التجارية.

ويدعم برنامج Pocket TTS حاليا اللغتين الانكليزية والفرنسية، وقد يضاف المزيد من اللغات في الإصدارات المقبلة.

نعم، مع 100 مليون بارامترات فقط، يجري Pocket TTS بسرعة الوقت الحقيقي على معدات المعالجة المركزية العادية. لا GPU مطلوب، مما يجعله مثاليا لنشر الحافة والتطبيقات المحمولة.

كلاهما خفيف الوزن ويعمل جيدا على وحدة المعالجة المركزية. Pocket TTS يدعم بشكل فريد استنساخ الصوت (Kokoro لا يدعم). Kokoro يدعم لغات أكثر (9 مقابل 2). اختار Pocket TTS إذا كنت بحاجة إلى استنساخ صوت خفيف، Kokoro إذا كنت بحاجة إلى تغطية أكثر من اللغة.

توفر 5 ثوان من الصوت المرجعي. Pocket TTS يستخرج خصائص المتكلم ويمكن توليد حديث جديد في ذلك الصوت. تتحسن الجودة مع المراجع الأطول (حتى 10 ثوان).

نعم، على عكس معظم نماذج الاستنساخ التي تتطلب وحدة معالجة رسومات، فإن Pocket TTS يقوم باستنساخ الصوت من الصفر بالكامل على وحدة المعالجة المركزية بفضل مساحة 100 ميجا بارامتر صغيرة. ويمكنك استنساخ الصوت من مقطع قصير حتى على جهاز كمبيوتر محمول أو حاسوب ذو لوحة واحدة.

يصدر Pocket TTS تحت رخصة CC-BY-4.0، لذا يجب عليك أن تذكر كيوتاي كمبدع أصلي عند استخدامه أو إعادة توزيعه. إن ذكر بسيطة مثل "صوت تم توليده باستخدام Pocket TTS بواسطة Kyutai" يفي بالتراخيص للاستخدام التجاري وغير التجاري على حد سواء.

يقوم Pocket TTS بتوليد الكلام في الوقت الحقيقي أو أسرع على وحدة معالجة مركزية قياسية، دون الحاجة إلى وحدة معالجة رسومات. وهذا يجعله أحد أكثر المحركات استجابة لحالات الاستخدام المنخفضة التأخير مثل المساعدين الصوتية الحية والتوليد على الجهاز.

برامج Pocket TTS هي في مستوى التسعير القياسي، بتكلفة 10 أرصدة لكل 1000 حرف، وهذا يجعلها واحدة من أكثر خيارات استنساخ الصوت اقتصادية المتاحة على TextToSpeechAI.

كلاهما خفيف الوزن، ومحركات من المستوى القياسي، وسهلة الاستخدام. اختار Pocket TTS عندما تحتاج إلى استنساخ الصوت، لأن كوكورو لا يدعمه. اختار كوكورو عندما تحتاج إلى تغطية لغة أوسع ولا تحتاج إلى استنساخ صوت محدد.

نعم، تحصل الحسابات الجديدة التي يبلغ عددها TextToSpeechAI على ائتمانات بدء مجانية، ويسمح لك العرض التجريبي في الموقع بالاستماع إلى Pocket TTS قبل الالتزام. انضم مجاناً، وحمل مقطع مرجعي قصير، وتولد كلمة مستنسخة في ثوان.

Technical Specs

  • Generation Speed Very Fast
  • Output Quality Good
  • Voice Cloning Supported
  • Languages 2
  • GPU VRAM CPU OK
  • Credits/1000 chars 10

Try أجهزة جيب TTS Now

Generate your first audio free. No credit card required.

Start Free