پیپر TTS

Basic

متن به گفتار عصبی سریع و سبک

Very Fast سرعت
Good کیفیت
نه شبیه‌سازی
12 زبانها

در مورد پیپر TTS

ing the cloud. Piper is a

ویژگیهای کلیدی

ترکیب فوق سریع

این سیستم‌عامل در دستگاه‌های کوچکی مانند Raspberry Pi نیز قابل استفاده است.

بهینه‌سازی CPU

این سیستم به صورت مؤثر در CPU اجرا می‌شود و نیازی به سخت‌افزار گران‌قیمت GPU ندارد.

12 زبان اینجا

صداهای پیپر ما ۱۲ زبان را پوشش می‌دهند، هر کدام با تلفظ بومی.

عملیات خارج از خط

این کار بدون نیاز به اتصال به اینترنت انجام می‌شود.

حریم خصوصی اول

این سیستم برای اجرا در محل طراحی شده است، بنابراین نیازی به خدمات ابری ندارد، هنگامی که خودتان آن را میزبانی می‌کنید.

منبع باز

این نرم‌افزار تحت مجوز MIT و با توسعه فعال جامعه منتشر می‌شود.

موارد استفاده

دستیار خانه هوشمند کاربردهای دسترسی‌پذیری سیستم‌های تلفن IVR دستگاه‌های جاسازی‌شده نرم‌افزار آموزشیName کاربردهای برون‌خط

پیپر TTS Voices

View All 25
Bryce (US English)
EN_US
Bui (Icelandic)
IS_IS
Carlos (Spanish (Spain))
ES_ES
Cori (Balanced) (UK English)
EN_GB
Cori (UK English)
EN_GB
Erik (Swedish)
SV_SE
French MLS (French)
FR_FR
German MLS (German)
DE_DE
Iseke (Kazakh)
KK_KZ
Issai (Kazakh)
KK_KZ
John (US English)
EN_US
Kristin (US English)
EN_US

چطور استفاده شود پیپر TTS

  1. 1

    ثبت نام رایگان یا باز کردن نمایش

    یک حساب رایگان TextToSpeechAI ایجاد کنید تا اعتبارهای اولیه را دریافت کنید، یا از صفحه نمایش استفاده کنید تا پیپر را بلافاصله بدون ورود به سیستم امتحان کنید.

  2. 2

    انتخاب یک صدای پیپر

    کتابخانه صدا را باز کنید و با موتور پیپر فیلتر کنید، سپس صداها را در زبان و لهجه هدف خود پیش‌نمایش کنید تا صدای مناسب را پیدا کنید.

  3. 3

    وارد کردن یا چسباندن متن شما

    دست‌نوشته‌ای که می‌خواهید در جعبه متن خوانده شود را تایپ یا چسبانید. Piper نشانه گذاری و گذرگاه‌های طولانی را به خوبی مدیریت می‌کند ، بنابراین می‌توانید در پاراگرافهای کامل بگذارید.

  4. 4

    تنظیم سرعت و تولید

    سرعت گفتار را تنظیم کنید (تقریباً ۰٫۵x تا ۲٫۰x) تا با پروژه شما سازگار باشد، سپس روی Generate کلیک کنید تا Piper صدا را در ثانیه در CPU ترکیب کند.

  5. 5

    دانلود صدا یا فراخوانی API

    این نرم‌افزار می‌تواند فایل‌های صوتی را به صورت MP3، WAV یا OGG از صفحه نتایج دانلود کند یا با ارسال همان صدای پیپر به /v1/generate/ REST endpoint آن را خودکار کند.

پیپر TTS API

این برنامه با استفاده از TextToSpeechAI REST API تولید می‌شود.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "به پایپر خوش آمدید، یک موتور متن به گفتار عصبی سریع و سبک.",
    "voice": "en_US-bryce-medium"
  }'

پرسشهای متداول

پایپر یک موتور متن به گفتار عصبی سریع و سبک است که متن نوشته شده را به گفتار با صدای طبیعی تبدیل می‌کند. از مدلهای یادگیری عمیق مبتنی بر VITS استفاده می‌کند که برای استنتاج کارآمد پردازنده بهینه شده‌اند ، که پایپر را برای دستگاه‌های کناری ، ابزارهای غیرفعال و برنامه‌های کاربردی زمان واقعی ایده‌آل می‌کند. می‌توانید پایپر را به صورت رایگان در TextToSpeechAI مستقیماً در مرورگر خود امتحان کنید.

Yes, Piper is completely free and open-source under the MIT license, so you can use it for personal and commercial projects without licensing fees. On TextToSpeechAI you can try Piper free with your starter credits, and continued use costs just 1 credit per 1,000 characters.

بله، پایپر تحت مجوز MIT آزاد است که به‌طور صریح استفاده تجاری را اجازه می‌دهد. می‌توانید صدای تولید شده توسط پایپر را در محصولات تجاری، ویدئوها، برنامه‌ها و خدمات بدون پرداخت حق تکثیر یا اضافه کردن تخصیص ارسال کنید.

صداهای پیپر در TextToSpeechAI ۱۲ زبان را پوشش می‌دهد: انگلیسی آمریکایی و بریتانیایی، آلمانی، اسپانیایی، فرانسوی، ایتالیایی، هلندی، سوئدی، ایسلندی، قزاقی، نپالی و اوکراینی. ما فقط صداهای پیپر را ارائه می‌دهیم که داده‌های آموزشی آن‌ها اجازه استفاده تجاری را می‌دهد.

پایپر یکی از سریع‌ترین موتورهای TTS موجود است و به راحتی بر روی CPU اجرا می‌شود. می‌تواند در زمان واقعی حتی بر روی Raspberry Pi هم گفتار را ترکیب کند، بنابراین در TextToSpeechAI اکثر درخواست‌های پایپر صدا را در کمتر از یک ثانیه برمی‌گرداند.

نه ، Piper از شبیه‌سازی صدا پشتیبانی نمی‌کند. فقط از مدلهای صدای پیش‌آموزش‌شده خود استفاده می‌کند. برای شبیه‌سازی صدا ، از ابزار صدای شبیه‌سازی استفاده کنید ، که Chatterbox را اجرا می‌کند.

پایپر صدای واضح و با کیفیتی تولید می‌کند که برای دستیارهای صوتی، سیستم‌های IVR، گویندگی و ابزارهای دسترسی مناسب است.این به اندازه مدل‌های ارزان‌تر و ارزان‌تر نیست، اما نسبت سرعت به کیفیت آن برای بیشتر موارد استفاده روزانه عالی است.

GPU مورد نیاز نیست. Piper برای اجرا بر روی CPU طراحی شده و تنها چند صد مگابایت حافظه را مصرف می‌کند. به همین دلیل Piper برای سناریوهای غیرفعال و توکار که GPU اختصاصی در آن در دسترس نیست ، مناسب است.

بله، پایپر برای استنتاج محلی سریع ساخته شده و زمانی که مدل‌های صدای آن دانلود شوند، بدون نیاز به اتصال به اینترنت، کاملاً آفلاین اجرا می‌شود.

هر دو موتور سریع بدون شبیه‌سازی صدا هستند. Piper ۱۲ زبان را پوشش می‌دهد ، سبک‌ترین گزینه است و هزینه آن ۱ کرون در هر ۱۰۰۰ کاراکتر است ، در حالی که VITS مجموعه بزرگی از سخنرانان انگلیسی را با ۱۰ کرون در هر ۱۰۰۰ کاراکتر ارائه می‌دهد. Piper را برای زبانهای دیگر و VITS را برای تنوع در انگلیسی انتخاب کنید.

پیپر هزینهٔ ۱ کرید برای هر ۱۰۰۰ کاراکتر دارد، که کمترین قیمت در TextToSpeechAI است. حساب‌های جدید اعتبار اولیهٔ رایگان دریافت می‌کنند، بنابراین می‌توانید پیپر را بدون هزینه قبل از ثبت نام امتحان کنید.

یک صدای Piper را از کتابخانه صدا انتخاب کنید ، سپس سرگیجهٔ صدای آن را به نقطهٔ پایانی /v1/generate/ با نشانه API خود منتقل کنید. API REST صدا را بازسازی می‌کند و یک نشانی وب بارگیری را برمی‌گرداند ، و می‌توانید خروجی MP3 ، WAV یا OGG را درخواست کنید.

Technical Specs

  • Generation Speed Very Fast
  • Output Quality Good
  • Voice Cloning Not Supported
  • Languages 12
  • GPU VRAM 500MB
  • Credits/1000 chars 1

Try پیپر TTS Now

Generate your first audio free. No credit card required.

Start Free