ناحیه

Ultra

شبیه‌سازی صدای بیان‌شده با کنترل احساسات و سبک

Medium سرعت
Excellent کیفیت
آره شبیه‌سازی
5 زبانها

در مورد ناحیه

s. It supports voice cloning from 5-30 seconds of reference audio and can modulate the emotional tone of generated audios. It supports voice cloning from 5-30 seconds of reference audio and can modulate the emotional tone of generated audios. It supports voice cloning from 5-30 seconds of reference audio and can modulate the emotional tone of generated audios to create

ویژگیهای کلیدی

کنترل احساسات

احساسات کنترل شده عبارتند از: شادی، غم، خشم، ترس، تعجب، نفرت و خنثی.

شبیه‌سازی صدا

هر صدایی را از ۵ تا ۳۰ ثانیه صدای مرجع با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی با صدایی

سخنرانی

پارامترهای ۱٫۶B، سخنرانی بسیار بیانگر با انتقال احساسات ظریف را تولید می‌کنند.

چندزبانه

از زبان‌های انگلیسی، ژاپنی، چینی، فرانسوی و آلمانی پشتیبانی می‌کند.

موارد استفاده

ایجاد محتوای بیانی احساسی صداهای شخصیت بازی با احساسات قرائت کتاب صوتی با حالت تجربه‌های صدای تعاملی

چطور استفاده شود ناحیه

  1. 1

    ثبت نام یا باز کردن نمایش

    این نرم‌افزار برای استفاده از TextToSpeechAI حساب رایگان ایجاد کنید تا اعتبارات اولیه را دریافت کنید یا از demo بدون ثبت نام استفاده کنید تا زونوس را فوراً امتحان کنید.

  2. 2

    انتخاب موتور Zonos

    از گزینش‌کننده صدا و مدل Zonos را انتخاب کنید. برای شبیه‌سازی یک صدا، ۵ تا ۳۰ ثانیه از صدای مرجع تمیز را بارگذاری کنید تا Zonos بتواند با بلندگو تطابق پیدا کند.

  3. 3

    وارد کردن متن

    متنی که می‌خواهید به زبان انگلیسی خوانده شود را تایپ یا چسبانید. Zonos در زبان‌های انگلیسی، ژاپنی، چینی، فرانسوی و آلمانی کار می‌کند.

  4. 4

    احساسي رو انتخاب کن و توليد کن

    این هفت احساس عبارتند از: خشم، خشمگینی، خشم، خشمگینی، خشم، خشم.

  5. 5

    دانلود یا استفاده از API

    پخش و دانلود صدای نهایی، یا فراخوانی همان موتور زونوس به صورت برنامه‌نویسی از طریق REST API TextToSpeechAI برای جریان‌های کاری خودکار.

ناحیه API

این برنامه با استفاده از TextToSpeechAI REST API تولید می‌شود.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "ژانر داستانی با ژانرهای داستانی که با ژانرهای داستانی مرتبط هستند، تفاوت دارد.",
    "voice": "en_US-lessac-medium"
  }'

پرسشهای متداول

Zonos is a 1.6B parameter text-to-speech model from Zyphra. It specializes in expressive speech generation with fine-grained emotion control and high-fidelity voice cloning. On TextToSpeechAI it runs as an ultra-tier engine for the most nuanced, emotionally rich audio.

بله. زونوس تحت مجوز آپاچی ۲٫۰ برای کد و وزن مدل منتشر می‌شود، بنابراین می‌تواند به صورت آزاد در محصولات تجاری بدون هیچ محدودیتی غیر تجاری استفاده شود. این باعث می‌شود که برای برنامه‌های پرداختی، کار مشتری و محتوای پولساز ایمن باشد.

Zonos هفت حالت احساسی را که قبل از تولید انتخاب می‌کنید ، نشان می‌دهد — بی‌طرف ، خوشحال ، غمگین ، خشم ، ترس ، شگفت‌زده ، و نفرت — مدل ، تحویل آن را بر اساس احساس انتخاب شده ، تغییر طنین ، سرعت ، و نغمه ، شرط‌بندی می‌کند ، بنابراین جملهٔ مشابه می‌تواند شاد یا خشمگین به نظر برسد. این Zonos را برای صداهای شخصیت و گفتگوهایی که به یک حالت خاص نیاز دارند ، ایده‌آل می‌کند.

زونوس از هفت گزینه احساس پشتیبانی می‌کند: خنثی، خوشحالی، اندوه، خشم، ترس، تعجب و نفرت. شما برای تنظیم طنین احساسی کل کلیپ، در هر نسل یک گزینه را انتخاب می‌کنید.

بله. زونوس صدایی را از ۵۰ تا ۳۰ ثانیه صدای مرجع کپی می‌کند، ویژگی‌های سخنران را استخراج می‌کند و آنها را در گفتار جدید بازتولید می‌کند. شما می‌توانید کپی را با هر یک از هفت احساس ترکیب کنید تا صدای کپی شده خوشحال، عصبانی یا ترسیده به نظر برسد.

زونوس پنج زبان را پشتیبانی می‌کند: انگلیسی، ژاپنی، چینی، فرانسوی و آلمانی. کنترل احساسات و شبیه‌سازی صدا در تمام این زبان‌ها کار می‌کند.

زونوس به دلیل اندازه پارامترهای ۱٫۶ بیتی با سرعت متوسط اجرا می‌شود، با تبادل جریان خام برای خروجی عالی و بسیار بیانگر. کیفیت در میان بهترین‌ها برای گفتار احساسی و کلون شده است، بنابراین به جای تولید صوتی تولید نهایی به جای تولید انبوه در زمان واقعی مناسب است.

Zonos requires 8GB or more of VRAM for its 1.6B parameter model. A GPU with at least 10GB is recommended for comfortable operation when combining voice cloning with emotion control. On TextToSpeechAI all of this runs on our GPU backend, so you need no hardware of your own.

زونوس یک موتور فوق‌طبقه است که در هر ۱۰۰۰ کاراکتر ۵۰ کرید را دریافت می‌کند.طبقه فوق‌طبقه مدل بزرگ و احساسات پیشرفته و قابلیت‌های شبیه‌سازی را نشان می‌دهد، همانند StyleTTS2، Tortoise و OpenVoice.

هر دو ، با شبیه‌سازی صدا ، کنترل سبک و احساس را ارائه می‌دهند. Zonos هفت حالت احساس جداگانه و یک معماری مدرن ۱٫۶B را فراهم می‌کند ، در حالی که OpenVoice سبک‌های صدایی مانند دوستانه ، شاد ، و زمزمه کردن را با شبیه‌سازی فوری بسیار سریع ارائه می‌دهد. Zonos را انتخاب کنید هنگامی که می‌خواهید انتخاب احساس صریح و بیان حداکثری داشته باشید. OpenVoice را برای تغییر سبک تر و سریعتر صدا انتخاب کنید.

Bark نشانگرهای بیانی مانند [خنده] و [خندی] را اضافه می‌کند ، اما شبیه‌سازی محدودی را ارائه می‌دهد ، و Dia بر گفتگوی چندگوینده با صداهای غیر کلامی تمرکز می‌کند. Zonos بر انتخاب احساس صریح و شبیه‌سازی قوی تک‌صدای تمرکز می‌کند ، که به شما کنترل دقیقی بر روی حال و هوای هر کلیپ می‌دهد. موتوری را انتخاب کنید که با نیاز شما به برچسب‌های احساس ، چرخش گفتگو ، یا احساسات انتخاب‌پذیر مطابقت دارد.

بله. حساب هاي جديد TextToSpeechAI اعتبار شروع مجاني ميگيرند و نمايشگاه به شما اجازه ميده بدون ثبت نام نمونه صدا توليد کنيد. اين براي آزمايش کنترل احساسات زونوس و شبيه سازي صدا قبل از خريد اعتبارات اضافي کافيه.

Technical Specs

  • Generation Speed Medium
  • Output Quality Excellent
  • Voice Cloning Supported
  • Languages 5
  • GPU VRAM 8GB+
  • Credits/1000 chars 50

Try ناحیه Now

Generate your first audio free. No credit card required.

Start Free