Тортуз ТТС

Ultra

Ултра-висококачествено реч с несъвместима естественост

Very Slow Скорост
Exceptional Качество
Да. Клониране
1 Езици

За Тортуз ТТС

Tortoise TTS е автоматичен регресивен текстов-то-печ модел, който приоритетира качеството на звука над всичко друго. Използвайки комбинация от авторегресивни трансформатори и дифузионни модели, Tortoise генерира изключително естествена реч, която улавя фини нюанси на човешкия глас. Макар че по-бавно от други модели, Tortoise произвежда най-естественото изход ТТС на разположение.

Ключови характеристики

Ултра-високо качество

Най-естественото изход ТТС на разположение.

Гласово клониране

Клониране на гласове с изключителна вярност и нюанс.

Естествена прозодия

Заснема фини модели на говор и микро-израз.

Предположения на качеството

Изберете от ultra_frick до висококачествена обработка.

Емоционална дълбочина

Създава реч с истински емоционален резонанс.

Отваряне на източник

Апачи 2.0 лицензирани с търговски права за употреба.

Случаи на употреба

Премиум аудиокниги Производство на филми Документална разгласителна информация Професионални режисери Архивалови проекти Съдържание с висок край

Тортуз ТТС Voices

View All 18
Tortoise Angie
EN
Tortoise Deniro
EN
Tortoise Freeman
EN
Tortoise Geralt
EN
Tortoise Halle
EN
Tortoise Jlaw
EN
Tortoise Lj
EN
Tortoise Mol
EN
Tortoise Myself
EN
Tortoise Pat
EN
Tortoise Pat2
EN
Tortoise Snakes
EN

Как да използвате Тортуз ТТС

  1. 1

    Регистрирайте се или опитайте безплатно демо

    Създайте безплатен TextToSpeechAI акаунт за да получите стартер кредити, или да използвате домашната демо, за да опитате Tortoise без да се вписвате в. Tortoise е ултра-тие двигател (50 кредита на 1000 символа), така че безплатните кредити са идеални за първи къс тест.

  2. 2

    Изберете Tortoise и задължително добавяте глас към клониране

    Изберете тортозов глас от гласовия браузър. За да клонирате определен човек, качите референтен клип (идеално няколко чисти 5-10 секунди) и Tortoise ще възпроизведе този глас с висока верност. В противен случай изберете един от вградените Tortóze гласове.

  3. 3

    Въведете вашия текст

    Въведете или вметнете текста, който искате наратира. Тъй като Tortoise е бавен, започнете с кратък преход, за да потвърдите гласа и тона преди изпращане на пълна глава на аудиокнига или дълги скрипт.

  4. 4

    Изберете качествена настройка и генерирате

    Изберете предназначение за качество на Tortoise: ultra_frast за бързи тестове, бързо за добро скорост/качествеен баланс (рекомендовано по подразбиране), стандарт или висококачество за максимален реализъм. След това кликнете върху генериране и бъдете търпеливи - Tortoise може да отнеме от 30 секунди до няколко минути за клип, особено при по-високи настройки.

  5. 5

    Изтеглете или използвайте API

    Когато генерацията приключи, изтегли звука си като MP3, WAV или OGG, или го вземе от историята си. За да автоматизирате задачите на Tortoise, се обадите на TextToSpeechAI API и преминете избраната си преднастройка за качество - не забравяйте да позволявате по-дълго време, тъй като Tortoise извежда бавно.

Тортуз ТТС АПИ

Генериране на речна програма с помощта на TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "Тортоазата отнема време, но резултатите си струват да чакат.",
    "voice": "tortoise-angie"
  }'

Често задавани въпроси

Tortoise TTS е автоматичен регресивен текстов-то-спеч модел, създаден от Джеймс Беткър, който приоритети качеството на звука над всичко друго. Комбинира езикови модели на базата на трансформатор с дифузия декодиране за генериране на реч с несъвпадение на естественост, емоционална дълбочина и човешки прозоди. Той се счита за един от най-реалистичните двигатели на отворен източник на разположение TTS.

Да. Tortoise TTS е отворен източник по лиценза за послушни Apache 2.0, който позволява търговска употреба, модификация и преразпределение. На TextToSpeechAI, Tortoise седи в Ultra quare с 50 кредита на 1000 символа, поради неговите тежки изисквания за изчисляване и изключително качество на изхода.

Тортоазата е бавна по дизайна: генерира няколко кандидатски клипове автоматично регресивно и след това изчиства най-добрият с дифузионен модел и стъпка на преразпределение на КЛВП. Този първо качество тръба означава, че един клип може да отнеме от 30 секунди до няколко минути в зависимост от дължината на текста и качеството на настройки. Заемът е, че Tortoise произвежда някои от най-естествените думи на всеки TTS двигател.

Тортоаз предлага четири предпоставки, които търгуват скорост за качество: ultra_frash (~10x по-бързо, добро за тестване), бързо (~4x по-бързо, производствен стандарт (балансиран), и висококачествено (максимално качество, най-бавно). По-високо настройки проби повече кандидати и да се проведе повече дифузионни стъпки преди избор на най-добрия резултат. На TextToSpeechAI можете да изберете предпоставка преди генерирането.

Да, Tortoise TTS поддържа клонирането на гласа с изключителна верност. Предоставете няколко къси референтни клипчета на целевия глас (идеално 3-10 проби от 5-10 секунди всяка), и Tortoise улавя тимбрето на оратора, акцент, пацеиране и фини микро-изрази. Той е един от най-точните нула-изстрелни клониращи двигатели, въпреки че клонирането добавя към вече дългото поколение време.

Тортоаз е обучен предимно по английски език данни, така че английски е мястото, където качеството му е най-силно. За многоязични проекти, които се нуждаят от подобен реализъм, обмислят F5-TTS или CosyVoice2 на TextToSpeechAI, които подкрепят повече езици, докато все още предлагат клониране на глас.

Тортоазата произвежда изключителен, често неразграничен звук от човека. Тя заснема дишането, колебание, интонация и истински емоционален резонанс, който пропускат леките модели. Ето защо той остава любим за премиум аудиокниги, филмова нарация и висококачествена музикална работа, където реализмът е най-важен.

Тортоаз обикновено изисква 12-24GB VRAM в зависимост от качеството нанапред и партиден размер, така че високото GPU като RTX 3090, 4090 или A100 са препоръчани за местна употреба. Заключение на процесора е технически възможно, но изключително бавно. На TextToSpeechAI модела работи върху нашата GPU инфраструктура, така че не се нуждаете от хардуер от ваша собствена.

Тортоиз отначало прави висококачествено 24кHz WAV аудио. През TextToSpeechAI можете да поискате MP3, WAV или OGGG, и ние транскодираме с качествено-запазване кодиране, така че да запазите финния детайл на модела в какъвто и да е формат проектът ви се нуждае.

Tortoise е в ултра ценовия ступенят на 50 кредита на 1000 символа, отразявайки на GPU времето първо качество на консумацията на тръбопровода. Новите акаунтите получават безплатни стартер кредити, така че можете да тест Tortoise преди да се извърши. Ултра ступенят също обхваща StyleTTS2, OpenVoice, Dia, и Zonos.

И двете са ултра-тиер двигатели, но те се търгуват по-различно. Tortoise TTS достига абсолютния върха на естествеността и емоционалната дълбочина, но е далеч най-бавният двигател. StyleTTS2 осигурява близко-тортузово качество с много по-бързо поколение, което го прави по-добър избор, когато се нуждаете от много клипове или по-бързо обръщане. Изберете Tortoise, когато качеството не е преодолимо и времето не е ограничение.

Да. Регистрирайте се на TextToSpeechAI за да получите безплатни стартер кредити, или използвайте демото на домашната страница, и изберете Tortoise глас, за да генерирате клип, без да инсталирате нищо. Тъй като Tortoise е бавно, започвате с кратко изречение и "бързо" настройка, за да видите качеството преди да се продължат работа.

Technical Specs

  • Generation Speed Very Slow
  • Output Quality Exceptional
  • Voice Cloning Supported
  • Languages 1
  • GPU VRAM 12-24GB
  • Credits/1000 chars 50

Try Тортуз ТТС Now

Generate your first audio free. No credit card required.

Start Free