جیبی TTS

Standard

شبیه‌سازی صدای فوق سبک که در زمان واقعی روی CPU اجرا می‌شود

Very Fast سرعت
Good کیفیت
آره شبیه‌سازی
2 زبانها

در مورد جیبی TTS

Windows 10, 8.1, 8, 7, Vista, XP, 2000, 2003, 2008, 2010, 2013, 2016, 2019, 2020, 2021, 2022, 2023, 2024, 2025,

ویژگیهای کلیدی

بسیار سبک

100M پارامترها - در زمان واقعی بر روی CPU با منابع کم اجرا می‌شود.

شبیه‌سازی صدا

هر صدایی را از پنج ثانیه صدای مرجع، حتی در CPU، کپی کنید.

زمان واقعی در CPU

GPU مورد نیاز نیست. گفتار را با سرعت زمان واقعی در سخت‌افزار استاندارد تولید می‌کند.

آماده برای لبه‌ها

به اندازه کافی کوچک برای دستگاه‌های موبایل، رایزنبری پای و سیستم‌های توکار.

موارد استفاده

انتشار Edge و Mobile کمک‌کننده‌های صدای زمان واقعی در CPU IoT و دستگاه‌های جاسازی شده شبیه‌سازی صدای کم‌مورد

چطور استفاده شود جیبی TTS

  1. 1

    ثبت نام رایگان یا آزمایش نمایش

    Create a free TextToSpeechAI account to receive starter credits, or use the on-site demo to hear Pocket TTS before signing up. No GPU or local install is needed.

  2. 2

    انتخاب Pocket TTS و افزودن یک صدا برای شبیه‌سازی

    Pocket TTS را به عنوان موتور خود انتخاب کنید ، سپس یک کلیپ مرجع کوتاه حدود ۵ تا ۱۰ ثانیه را برای شبیه‌سازی آن صدا بارگذاری کنید. Pocket TTS کاملاً بر روی CPU اجرا می‌شود ، بنابراین شبیه‌سازی سریع و سبک است.

  3. 3

    وارد کردن متن

    متن انگلیسی یا فرانسوی را که می‌خواهید به صورت گفتار بشنوید ، تایپ یا چسبانید. به تعداد کاراکترها توجه کنید ، زیرا Pocket TTS با نرخ استاندارد ۱۰ کرون در هر ۱۰۰۰ کاراکتر حساب می‌کند.

  4. 4

    تولید صدا

    کلیک کنید تا ایجاد شود و Pocket TTS متن شما را در صدای شبیه سازی شده با سرعت زمان واقعی ترکیب می‌کند. بیشتر کلیپ‌ها در ثانیه آماده می‌شوند زیرا مدل بسیار کوچک و CPU-efficient است.

  5. 5

    دانلود یا استفاده از API

    دانلود صدای نهایی، یا تولید خودکار از طریق TextToSpeechAI REST API در api.texttospeechai.com با استفاده از توکن حساب خود. API همان کپی Pocket TTS و سنتز را برای برنامه‌های خود نشان می‌دهد.

جیبی TTS API

این برنامه با استفاده از TextToSpeechAI REST API تولید می‌شود.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "Pocket TTS شبیه‌سازی صدا را ارائه می‌دهد که در زمان واقعی اجرا می‌شود، حتی در CPU.",
    "voice": "en_US-lessac-medium"
  }'

پرسشهای متداول

Pocket TTS یک مدل متن به گفتار فوق سبک از Kyutai با تنها ۱۰۰ میلیون پارامتر است. این در زمان واقعی بر روی CPU اجرا می‌شود و از شبیه‌سازی صدا از ۵ ثانیه صدا پشتیبانی می‌کند.

Pocket TTS تحت مجوز CC-BY-4.0 است که اجازه استفاده تجاری با ذکر منبع را می‌دهد. شما باید هنگام استفاده از آن در برنامه‌های تجاری به Kyutai اشاره کنید.

در حال حاضر Pocket TTS از انگلیسی و فرانسوی پشتیبانی می‌کند. زبان‌های بیشتری ممکن است در نسخه‌های آینده اضافه شوند.

بله! با پارامترهای تنها ۱۰۰M، Pocket TTS با سرعت زمان واقعی روی سخت‌افزار CPU استاندارد اجرا می‌شود. GPU مورد نیاز نیست، که آن را برای پیاده‌سازی Edge و برنامه‌های کاربردی موبایل ایده‌آل می‌کند.

هر دو سبک هستند و در CPU به خوبی اجرا می‌شوند. Pocket TTS منحصراً از شبیه‌سازی صدا پشتیبانی می‌کند (Kokoro نمی‌کند). Kokoro از زبان‌های بیشتری پشتیبانی می‌کند (۹ در مقابل ۲). اگر به شبیه‌سازی صدای سبک نیاز دارید ، Pocket TTS را انتخاب کنید ، اگر به پوشش زبان بیشتر نیاز دارید ، Kokoro را انتخاب کنید.

ارائه ۵ ثانیه از صدای مرجع. Pocket TTS ویژگی‌های سخنران را استخراج می‌کند و می‌تواند گفتار جدیدی را در آن صدا تولید کند. کیفیت با مرجع‌های طولانی‌تر بهبود می‌یابد (تا ۱۰ ثانیه).

بله. برخلاف بیشتر مدل‌های شبیه‌سازی که نیازمند یک GPU هستند، Pocket TTS شبیه‌سازی صدای صفر-شلیک را به‌طور کامل بر روی CPU انجام می‌دهد ، به لطف اثر کوچک پارامتر ۱۰۰M آن. حتی می‌توانید صدایی را از یک کلیپ کوتاه روی یک لپ‌تاپ یا کامپیوتر تک‌بورد شبیه‌سازی کنید.

Pocket TTS تحت CC-BY-4.0 منتشر شده‌است، بنابراین شما باید هنگام استفاده یا توزیع مجدد آن، به Kyutai به عنوان خالق اصلی اشاره کنید. یک اشاره ساده مانند "صدا تولید شده با Pocket TTS توسط Kyutai" مجوز استفاده تجاری و غیر تجاری را برآورده می‌کند.

Pocket TTS گفتار را در زمان واقعی یا سریعتر بر روی یک CPU استاندارد تولید می‌کند، بدون نیاز به GPU. این آن را یکی از پاسخگویترین موتورها برای موارد استفاده با تأخیر کم مانند کمک‌های صوتی زنده و تولید بر روی دستگاه می‌کند.

Pocket TTS is in the standard pricing tier, costing 10 credits per 1,000 characters. That makes it one of the most economical voice-cloning options available on TextToSpeechAI.

هر دو موتور سبک ، CPU- friendly ، استاندارد سطح هستند. هنگامی که نیاز به شبیه‌سازی صدا دارید ، Pocket TTS را انتخاب کنید ، زیرا Kokoro از آن پشتیبانی نمی‌کند. هنگامی که نیاز به پوشش زبان گسترده‌تر دارید و نیازی به شبیه‌سازی یک صدای خاص ندارید ، Kokoro را انتخاب کنید.

بله. حساب هاي جديد TextToSpeechAI اعتبار شروع مجاني مي گيرند و نمايشگاه مجازي اجازه مي دهد قبل از شروع به کار Pocket TTS را بشنويد. مجاني ثبت نام کنيد، يک کليپ مرجع کوتاه را بارگذاري کنيد و در چند ثانيه گفتار شبيه سازي شده اي توليد کنيد.

Technical Specs

  • Generation Speed Very Fast
  • Output Quality Good
  • Voice Cloning Supported
  • Languages 2
  • GPU VRAM CPU OK
  • Credits/1000 chars 10

Try جیبی TTS Now

Generate your first audio free. No credit card required.

Start Free