لاک‌پشت TTS

Ultra

گفتار با کیفیت فوق‌العاده بالا و طبیعت بی‌نظیر

Very Slow سرعت
Exceptional کیفیت
نه شبیه‌سازی
1 زبانها

در مورد لاک‌پشت TTS

s available. Tortoise TTS is a

ویژگیهای کلیدی

کیفیت فوق‌بالا

این روش ارزان‌ترین روش تولید گراف‌های تصادفی است.

صداهای کاراکتر

از صداهای آماده Tortoise در کتابخانه صدا انتخاب کنید.

نظم طبیعی

این زبان از زبان‌های برنامه‌نویسی و زبان‌های برنامه‌نویسی میکرو استفاده می‌کند.

نمایش با سرعت تنظیم شده

با تنظیم سرعت‌محور رندر شده تا کلیپ‌ها در زمان معقولی به پایان برسند.

عمق احساسی

این اثر با نوعی رمانتیکیسم احساسی همراه است.

منبع باز

آپاچی ۲٫۰ با مجوز استفاده تجاری.

موارد استفاده

کتاب‌های صوتی Premium تولید فیلم نوشتارهای نوشتاری حرفه‌ای پروژه‌های بایگانی محتوای بالا

لاک‌پشت TTS Voices

View All 18
Tortoise Angie
EN
Tortoise Deniro
EN
Tortoise Freeman
EN
Tortoise Geralt
EN
Tortoise Halle
EN
Tortoise Jlaw
EN
Tortoise Lj
EN
Tortoise Mol
EN
Tortoise Myself
EN
Tortoise Pat
EN
Tortoise Pat2
EN
Tortoise Snakes
EN

چطور استفاده شود لاک‌پشت TTS

  1. 1

    ثبت نام مجانی

    برای دریافت اعتبارهای آغازین ، یک حساب TextToSpeechAI رایگان ایجاد کنید. Tortoise موتوری با سطح بالا است (۵۰ اعتبار در ۱۰۰۰ کاراکتر)، بنابراین اعتبارهای رایگان برای اولین آزمایش کوتاه عالی هستند.

  2. 2

    انتخاب یک صدای Tortoise

    یکی از صداهای Tortoise را از مرورگر صدا انتخاب کنید.

  3. 3

    وارد کردن متن

    متنی را که می‌خواهید خوانده شود را تایپ یا چسبانید. از آنجایی که Tortoise کند است، قبل از ارسال یک فصل کامل کتاب صوتی یا یک دست‌نوشتۀ طولانی، با یک گذر کوتاه برای تأیید صدا و طنین شروع کنید.

  4. 4

    تولید

    کلیک کنید تولید و صبور باشید. لاک‌پشت می‌تواند از ۳۰ ثانیه تا چند دقیقه برای هر کلیپ طول بکشد.

  5. 5

    دانلود یا استفاده از API

    هنگامی که تولید به پایان رسید، صدای خود را به صورت MP3 ، WAV یا OGG بارگیری کنید ، یا آن را از تاریخچه خود بگیرید. برای خودکارسازی کارهای Tortoise ، API TextToSpeechAI را فراخوانی کنید و زمانبندی‌های طولانی‌تری را اجازه دهید ، زیرا Tortoise به آهستگی نمایش می‌دهد.

لاک‌پشت TTS API

این برنامه با استفاده از TextToSpeechAI REST API تولید می‌شود.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "لاک‌پشت زمان ميبره، اما نتيجه ارزش صبر کردن رو داره.",
    "voice": "tortoise-angie"
  }'

پرسشهای متداول

Tortoise TTS یک مدل خودبازگشتی متن به گفتار است که توسط James Betker ایجاد شده است که کیفیت صدا را بالاتر از همه چیز دیگر اولویت می‌دهد. این مدل مدل‌سازی زبان مبتنی بر ترانسفر را با رمزگشایی پخش ترکیب می‌کند تا گفتاری با طبیعت بی‌نظیر، عمق احساسی و نظم انسانی تولید کند. به طور گسترده به عنوان یکی از واقعی‌ترین موتورهای TTS منبع باز موجود در نظر گرفته می‌شود.

بله. Tortoise TTS منبع باز است و تحت مجوز Apache 2.0 است که اجازه استفاده تجاری، تغییر و توزیع مجدد را می‌دهد. در TextToSpeechAI، Tortoise در سطح Ultra با ۵۰ کرید در هر ۱۰۰۰ کاراکتر به دلیل نیازهای سنگین محاسباتی و کیفیت خروجی فوق‌العاده قرار دارد.

لاک‌پشت به دلیل طراحی کند است: چندین کلیپ کاندید را به صورت خودبازگشتی تولید می‌کند و سپس بهترین را با یک مدل انتشار و یک مرحله رتبه‌بندی مجدد CLVP بهبود می‌بخشد. این خط لوله اول کیفیت به این معنی است که یک کلیپ تک می‌تواند از ۳۰ ثانیه تا چند دقیقه بستگی به طول متن و کیفیت پیش‌فرض طول بکشد. معامله این است که لاک‌پشت برخی از طبیعی‌ترین گفتار هر موتور TTS را تولید می‌کند.

امروزه در TextToSpeechAI اینطور نیست. مدل منبع باز پیش‌فرض‌هایی دارد که سرعت را با کیفیت عوض می‌کند؛ ما با تنظیمات سرعت‌محور رندر می‌کنیم تا کلیپ در زمان معقولی تمام شود.

نه در TextToSpeechAI. صداهای Tortoise در اینجا صداهای آماده از کتابخانه هستند. برای شبیه‌سازی صدا ، از ابزار صدای شبیه‌سازی استفاده کنید ، که Chatterbox را اجرا می‌کند.

Tortoise در ابتدا بر روی مجموعه داده‌های گفتار انگلیسی آموزش داده شد ، بنابراین انگلیسی قوی‌ترین کیفیت را دارد. برای زبان‌های دیگر ، از صداهای Piper یا Bark یا صدای شبیه سازی شده استفاده کنید.

لاک‌پشت صدای فوق‌العاده‌ای تولید می‌کند که اغلب قابل تشخیص از صدای انسان نیست. این صدا، نفس کشیدن، تردید، نت و انعکاس احساسی واقعی را که مدل‌های سبک‌تر از دست می‌دهند، ضبط می‌کند. به همین دلیل است که این دستگاه برای کتاب‌های صوتی، گویندگی فیلم و کارهای صداگذاری پیشرفته که در آن واقع‌گرایی اهمیت دارد، مورد علاقه باقی می‌ماند.

Tortoise typically requires 12-24GB of VRAM depending on settings and batch size, so high-end GPUs like the RTX 3090, 4090, or A100 are recommended for local use. CPU inference is technically possible but extremely slow. On TextToSpeechAI the model runs on our GPU infrastructure, so you do not need any hardware of your own.

Tortoise natively renders high-quality 24kHz WAV audio. Through TextToSpeechAI you can request MP3, WAV, or OGG, and we transcode with quality-preserving encoding so you keep the model's fine detail in whatever format your project needs.

Tortoise در سطح Ultra با قیمت ۵۰ کرید در هر ۱۰۰۰ کاراکتر است که بازتاب زمان مصرف شده توسط GPU در خط لوله کیفیت اول آن است. حساب‌های جدید اعتبارهای آغازین رایگان دریافت می‌کنند، بنابراین می‌توانید Tortoise را قبل از commit کردن امتحان کنید. سطح Ultra همچنین StyleTTS2 را پوشش می‌دهد.

هر دو موتورهای سطح فوق‌العاده هستند ، اما با یکدیگر متفاوت عمل می‌کنند. Tortoise TTS به قله مطلق طبیعی و عمق احساسی می‌رسد ، اما تا حد زیادی کندترین موتور است. StyleTTS2 کیفیت نزدیک به Tortoise را با تولید سریع‌تر ارائه می‌کند ، که آن را انتخاب بهتری می‌کند هنگامی که به کلیپ‌های زیادی یا چرخش سریع‌تر نیاز دارید. Tortoise را هنگامی انتخاب کنید که کیفیت قابل مذاکره نیست و زمان محدودیتی نیست.

بله. برای دریافت اعتبارهای آغازین رایگان در TextToSpeechAI ثبت نام کنید ، سپس برای تولید کلیپ بدون نصب هیچ چیز ، صدای Tortoise را انتخاب کنید. چون Tortoise کند است ، قبل از اجرای کارهای طولانی ، با یک جمله کوتاه شروع کنید.

Technical Specs

  • Generation Speed Very Slow
  • Output Quality Exceptional
  • Voice Cloning Not Supported
  • Languages 1
  • GPU VRAM 12-24GB
  • Credits/1000 chars 50

Try لاک‌پشت TTS Now

Generate your first audio free. No credit card required.

Start Free