صوت

Standard

TTS سریع چند لهجه‌ای با نظم طبیعی

Very Fast سرعت
Good کیفیت
نه شبیه‌سازی
6 زبانها

در مورد صوت

, including Arabic, Chinese, Japanese, Korean, Portuguese, Spanish, Italian, Japanese, Portuguese, Russian, Spanish, Turkish,

ویژگیهای کلیدی

چند لهجه

زبان انگلیسی دارای لهجه‌های متعددی است: آمریکایی، بریتانیایی، هندی و استرالیایی.

CPU زمان واقعی

این روش برای پردازش‌های سریع بدون استفاده از CPU مناسب است.

زبان

از زبان‌های انگلیسی، اسپانیایی، فرانسوی، چینی، ژاپنی و کره‌ای پشتیبانی می‌کند.

کنترل سرعت

سرعت خروجی برای خروجی نهایی تنظیم می‌شود.

موارد استفاده

کاربردهای صدای چند لهجهName محل‌سازی محتوای بین‌المللی دستیارهای صوتی زمان واقعی تولید کتاب صوتی با تنوع لهجه

چطور استفاده شود صوت

  1. 1

    ثبت نام رایگان یا آزمایش نمایش

    Create a free TextToSpeechAI account to receive starter credits, or use the no-signup demo on the homepage to test MeloTTS instantly. Free credits are enough to evaluate several MeloTTS accents before you commit.

  2. 2

    برگزیدن یک لهجه و صدای MeloTTS

    باز کردن مرورگر صدا و فیلتر کردن به MeloTTS. لهجه ای را که با شنوندگان شما سازگار است ، مانند انگلیسی آمریکایی ، بریتانیایی ، هندی یا استرالیایی ، یا یک صدای بومی اسپانیایی ، فرانسوی ، چینی ، ژاپنی یا کره ای را انتخاب کنید.

  3. 3

    وارد کردن متن

    دست‌نوشته‌ای که می‌خواهید در جعبه متن صداگذاری شود را تایپ یا چسبانید. MeloTTS به طور خودکار صدای طبیعی را مدیریت می‌کند ، و می‌توانید سرعت گفتار را برای تنظیم دقیق سرعت برای لهجۀ انتخاب‌شده تنظیم کنید.

  4. 4

    تولید صدا

    کلیک کنید ایجاد کنید و MeloTTS گفتار شما را در زمان واقعی ترکیب می‌کند. چون به صورت کارآمد در CPU اجرا می‌شود ، نتایج حتی برای گذرگاه‌های طولانی سریعاً برمی‌گردد ، و هزینه کار ۱۰ کرون برای هر ۱۰۰۰ نویسه است.

  5. 5

    دانلود یا استفاده از API

    نتیجه را پخش کنید ، سپس پرونده صوتی را در قالب مورد علاقه خود از صفحه تاریخچه دانلود کنید. برای خودکارسازی MeloTTS در برنامه خود ، API REST TextToSpeechAI را در api.texttospeechai.com با استفاده از توکن API حساب خود فراخوانی کنید.

صوت API

این برنامه با استفاده از TextToSpeechAI REST API تولید می‌شود.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "زبان فارسی با گویش‌های گوناگون از سراسر جهان سخن می‌گوید.",
    "voice": "en_US-lessac-medium"
  }'

پرسشهای متداول

MeloTTS یک مدل سریع متن به گفتار از MyShell AI است که در سنتز گفتار چند لهجه تخصص دارد. این زبان از چندین زبان با چندین تنوع لهجه برای انگلیسی پشتیبانی می‌کند، تولید متن طبیعی در سرعت زمان واقعی.

بله. MeloTTS تحت مجوز MIT منتشر می‌شود ، که هم کد و هم وزن مدل را پوشش می‌دهد. می‌توانید آزادانه از آن در محصولات تجاری بدون نیاز به حق امتیاز یا ارجاع استفاده کنید.

MeloTTS از لهجه‌های انگلیسی آمریکایی، بریتانیایی، هندی و استرالیایی پشتیبانی می‌کند. همچنین شامل صداهای بومی اسپانیایی، فرانسوی، چینی، ژاپنی و کره‌ای است که آن را برای برنامه‌های کاربردی بین‌المللی مناسب می‌کند.

MeloTTS شش زبان را پوشش می‌دهد: انگلیسی، اسپانیایی، فرانسوی، چینی، ژاپنی و کره‌ای. صداهای انگلیسی لهجه‌های منطقه‌ای واقعی را بر زبان پایه اضافه می‌کنند، بنابراین یک مدل واحد بازارهای زیادی را مدیریت می‌کند.

بله. MeloTTS برای ترکیب زمان واقعی طراحی شده و حتی در CPU ، سریعتر از پخش ، گفتار تولید می‌کند. این باعث می‌شود که برای کمک‌کننده‌های صدای زنده ، چت‌بات‌ها و کاربردهای جریانی مناسب باشد.

MeloTTS صدای طبیعی و خوب با صدای واضح و لهجه‌های دقیق تولید می‌کند. سرعت و تنوع لهجه را بر روی اطمینان فوق‌العاده مدل‌های آهسته‌تر مانند StyleTTS2 یا Tortoise اولویت می‌دهد، بنابراین وقتی پاسخ‌دهی مهم‌ترین عامل است، ایده‌آل است.

No, MeloTTS does not clone voices. It uses a fixed set of preset speakers and accents. For voice cloning on TextToSpeechAI, use F5-TTS, Chatterbox, CosyVoice2, OpenVoice, StyleTTS2, or Tortoise instead.

GPU مورد نیاز نیست. MeloTTS به راحتی بر روی CPU با استفاده از حدود ۵۰۰ مگابایت حافظه اجرا می‌شود و در زمان واقعی باقی می‌ماند. یک GPU اختیاری است و فقط سرعت اضافی را اضافه می‌کند؛ اگر انتخاب کنید که از یک GPU استفاده کنید، حدود ۵۰۰ مگابایت VRAM کافی است.

MeloTTS is a standard-tier engine on TextToSpeechAI, billed at 10 credits per 1,000 characters. That is the lowest pricing tier, matching other lightweight CPU models like Piper, VITS, and Kokoro.

Both MeloTTS and Kokoro are fast, MIT/Apache-licensed CPU models at the standard credit tier. Choose MeloTTS when you need distinct English accents (American, British, Indian, Australian); choose Kokoro for its broad multilingual voice variety. Both are easy to A/B test on TextToSpeechAI.

MeloTTS در تنوع لهجه و پوشش چندزبانه برتری دارد ، در حالی که Piper بزرگترین کتابخانه صداهای پیش‌فرض را ارائه می‌دهد. هر دو سریع و CPU- capable در سطح استاندارد هستند ، بنابراین MeloTTS را برای پروژه‌های لهجه خاص و Piper را هنگامی که بیشترین انتخاب صداهای متمایز را می‌خواهید انتخاب کنید.

Yes. New TextToSpeechAI accounts include free starter credits, and there is a demo you can use without signing up. That is enough to test MeloTTS accents and voices before buying additional credits or subscribing.

Technical Specs

  • Generation Speed Very Fast
  • Output Quality Good
  • Voice Cloning Not Supported
  • Languages 6
  • GPU VRAM CPU OK
  • Credits/1000 chars 10

Try صوت Now

Generate your first audio free. No credit card required.

Start Free