جعبه گفتگو

Premium

موتور شبیه‌سازی صدا پشت صداهای شبیه‌سازی شده TextToSpeechAI

Moderate سرعت
Very Good کیفیت
آره شبیه‌سازی
15 زبانها

در مورد جعبه گفتگو

, and it's free to use. Chatterbox is a free, zero-shot voice cloning model that can be used to clone voices in any of the languages listed on the voice cloning page. TextToSpeechAI it powers every cloned voice: upload 6 to 60 seconds of clear audio and Chatterbox reproduces that voice, and it's free

ویژگیهای کلیدی

شبیه‌سازی صدای Zero-Shot

صدایی را از ۶ تا ۶۰ ثانیه صدا شبیه‌سازی کنید. نیازی به اجرای آموزشی نیست.

زبان‌شناسی

از یک نمونه انگلیسی کلون کنید و گفتار را در هر یک از ۱۵ زبان در صفحه کلون کردن تولید کنید.

شبیه سازی گوینده

در آزمایش‌های خودمان، چاترباکس با مرجع سخنران نزدیک‌تر از سایر موتورهای شبیه‌سازی مجوزدار که ارزیابی کردیم، مطابقت داشت.

مجوز تجاری

این روش برای کدهای رمز و کدهای رمزنگاری کاربرد دارد.

موارد استفاده

شبیه‌سازی صدا برای ایجاد محتوا گویندگی چندزبانه در یک صدا Character voices for games صداهای شخصی و برند

چطور استفاده شود جعبه گفتگو

  1. 1

    ایجاد حساب رایگان

    برای دریافت اعتبار رایگان برای شروع، برای TextToSpeechAI ثبت نام کنید.

  2. 2

    بارگذاری یک ویدئو مرجع

    صفحه شبیه‌سازی صدا را باز کنید و ۶ تا ۶۰ ثانیه از گفتار واضح از صدایی که حق شبیه‌سازی آن را دارید را آپلود کنید.

  3. 3

    وارد کردن متن و زبان شما

    متنی را که می‌خواهید بگویید تایپ کنید و یکی از ۱۵ زبان خروجی پشتیبانی شده را انتخاب کنید.

  4. 4

    تولید گفتار

    TextToSpeechAI متن را در صدای کلون شده با Chatterbox در سرورهای GPU ما نمایش می‌دهد.

  5. 5

    دانلود یا استفاده از API

    دانلود صدای نهایی، یا تولید خودکار از طریق TextToSpeechAI REST API.

جعبه گفتگو API

این برنامه با استفاده از TextToSpeechAI REST API تولید می‌شود.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "اين صداي شبيه سازي شده من هست که از يه ضبط کوتاه ساخته شده",
    "voice": "en_US-kristin-medium"
  }'

پرسشهای متداول

Chatterbox یک مدل متن به گفتار متن باز است که صدایی را از یک ضبط مرجع کوتاه بدون هیچ آموزشی برای هر صدا کپی می‌کند. TextToSpeechAI از آن برای هر صدای کپی شده استفاده می‌کند.

بله ، هم کد Chatterbox و هم وزن مدل آن تحت مجوز MIT منتشر شده است. شما هنوز نیاز به حق استفاده از صدایی دارید که شبیه سازی می‌کنید.

بین ۶ تا ۶۰ ثانیه از گفتار واضح از یک بلندگو را بارگذاری کنید. یک ضبط ساکت بدون موسیقی یا صداهای پس‌زمینه نزدیک‌ترین تطابق را می‌دهد.

یک صدای شبیه‌سازی شده می‌تواند ۱۵ زبان فهرست‌شده در صفحه شبیه‌سازی صدا را صحبت کند: انگلیسی ، اسپانیایی ، فرانسوی ، آلمانی ، ایتالیایی ، پرتغالی ، لهستانی ، روسی ، هلندی ، ترکی ، ژاپنی ، کره‌ای ، چینی ، عربی و هندی. کلیپ مرجع می‌تواند به زبان دیگری از متنی که تولید می‌کنید باشد.

گفتار شبیه سازی شده در سرورهای GPU ما نمایش داده می‌شود و معمولاً برای گذر کوتاه حدود یک دقیقه طول می‌کشد، زیرا صدای مرجع برای هر نسل دوباره پردازش می‌شود. متن‌های طولانی‌تر بیشتر طول می‌کشد.

ایجاد صدای شبیه سازی شده رایگان است. تولید گفتار با آن به ازای هر کاراکتر هزینه دارد، مانند هر صدای دیگر، و حساب‌های جدید برای امتحان کردن آن اعتبار آغازین رایگان دریافت می‌کنند.

بله، صداي شبيه سازي شده اي رو از طريق API REST در api.texttospeechai.com با توکن حسابت خلق کن، بعدش تو درخواست هاي توليد تو بهش اشاره کن.

Technical Specs

  • Generation Speed Moderate
  • Output Quality Very Good
  • Voice Cloning Supported
  • Languages 15
  • GPU VRAM 4-8GB
  • Credits/1000 chars 5

Try جعبه گفتگو Now

Generate your first audio free. No credit card required.

Start Free