želvovité TTS

Ultra

Ultra-vysoká kvalita řeč s bezkonkurenční přirozenost

Very Slow Rychlost
Exceptional Kvalita
Ano. Klonování
1 Jazyky

O aplikaci želvovité TTS

Tortoise TTS je autoregresivní model text-to-speech, který upřednostňuje kvalitu zvuku především. Použitím kombinace autoregresivních transformátorů a difuzních modelů, Tortoise generuje extrémně přirozený projev, který zachycuje jemné nuance lidského hlasu. Zatímco pomalejší než jiné modely, Tortoise produkuje nejpřirozenější zvuk TTS výstup k dispozici.

Klíčové vlastnosti

Ultra vysoká kvalita

Nejpřirozenější zvuk TTS výstup k dispozici.

Hlasové klonování

Klonové hlasy s mimořádnou věrností a nuancí.

Přírodní prosoda

Zachytí jemné vzorce řeči a mikrovýrazy.

Přednastaveny kvality

Vyberte si z ultra_fast až vysoce kvalitního zpracování.

Emocionální hloubka

Generuje řeč s opravdovou emocionální rezonancí.

Otevřít zdroj

Apache 2.0 licencované s obchodními právy na užívání.

Pouzdra na použití

Premium audioknihy Filmová produkce Dokumentární podání Profesionální hlasové zprávy Archivalní projekty Obsah s vysokým obsahem

želvovité TTS Voices

View All 18
Tortoise Angie
EN
Tortoise Deniro
EN
Tortoise Freeman
EN
Tortoise Geralt
EN
Tortoise Halle
EN
Tortoise Jlaw
EN
Tortoise Lj
EN
Tortoise Mol
EN
Tortoise Myself
EN
Tortoise Pat
EN
Tortoise Pat2
EN
Tortoise Snakes
EN

Jak se používá želvovité TTS

  1. 1

    Zaregistrujte se nebo vyzkoušejte bezplatné demo

    Vytvořte zdarma TextToSpeechAI účet pro získání startovní kreditů, nebo použít homepage demo vyzkoušet Tortoise bez přihlášení. Tortoise je Ultra-tier motor (50 kreditů na 1000 znaků), takže volné kredity jsou ideální pro první krátký test.

  2. 2

    Vyberte želvu a volitelně přidejte hlas do klonu

    Vyberte želvový hlas z hlasového prohlížeče. Chcete-li klonovat konkrétní osobu, nahrát referenční klip (ideálně několik čistých 5-10 sekund) a Tortoise bude reprodukovat tento hlas s vysokou věrností. Jinak vybrat jeden ze zabudovaných želvových hlasů.

  3. 3

    Zadejte svůj text

    Zadejte nebo vložte text, který chcete vyprávět. Protože Tortoise je pomalý, začněte krátkou pasáží, abyste potvrdili hlas a tón před odesláním celé kapitoly audioknihy nebo dlouhého skriptu.

  4. 4

    Vyberte si přednastavit kvalitu a generovat

    Vyberte si přednastavenou kvalitu Tortoise: ultra_fast pro rychlé testy, rychle pro dobrou rychlost/kvalitní rovnováhu (doporučená výchozí hodnota), standard, nebo vysoce_kvalitní pro maximální realismus. Poté klikněte na generovat a být trpělivý - Tortoise může trvat od 30 sekund do několika minut na klip, zejména při vyšších předvolbách.

  5. 5

    Stáhnout nebo použít API

    Když generace skončí, stáhněte si zvuk jako MP3, WAV, nebo OGG, nebo přineste jej z vaší historie. Chcete-li automatizovat Tortoise pracovních míst, zavolejte TextToSpeechAI API a projít si vybrané kvality přednastavená - nezapomeňte povolit delší timeouty, protože Tortoise vykresluje pomalu.

želvovité TTS API

Generovat řeč programově pomocí TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "Želva si dává na čas, ale výsledky stojí za to čekat.",
    "voice": "tortoise-angie"
  }'

Často kladené otázky

Tortoise TTS je autoregresivní model text-to-speech vytvořený Jamesem Betkerem, který upřednostňuje kvalitu zvuku především. Kombinuje modelování jazyka na bázi transformátoru s difuze dekódováním pro generování řeči s nesrovnatelnou přirozeností, emocionální hloubkou a lidskou prosodou. Je široce považován za jeden z nejrealističtějších open-source TTS motorů k dispozici.

Ano. Tortoise TTS je otevřený zdroj pod licencí Apache 2.0, který umožňuje komerční použití, modifikaci a přerozdělování. Na TextToSpeechAI, Tortoise sedí v Ultra úrovni 50 kreditů na 1000 znaků, protože jeho těžké výpočetní požadavky a mimořádnou kvalitu výstupu.

Tortoise je pomalý designem: generuje několik kandidátských klipů autoregresivně a pak zdokonaluje ten nejlepší s difuzním modelem a CLVP re-ranking krokem. Tento kvalitní první potrubí znamená, že jeden klip může trvat od 30 sekund do několika minut v závislosti na délce textu a přednastavené kvality. Odměna je, že Tortoise produkuje některé z nejpřirozenějších projevů jakéhokoliv TTS motoru.

Tortoise nabízí čtyři přednastavená nastavení, která obchodují s kvalitou: ultra_fast (~10x rychleji, dobré pro testování), rychle (~4x rychleji, výchozí výrobní), standard (vyvážená) a vysokou_kvalitu (maximální kvalita, nejpomalejší). Vyšší přednastavení vzorek více kandidátů a spustit více difuzních kroků před výběrem nejlepšího výsledku. Na TextToSpeechAI si můžete vybrat přednastavený před generováním.

Ano, Tortoise TTS podporuje klonování hlasu s mimořádnou věrností. Poskytněte několik krátkých referenčních klipů cílového hlasu (ideálně 3-10 vzorků po 5-10 sekundách každý), a Tortoise zachytí reproduktorův timbre, přízvuk, pacifik a jemné mikro-výrazy. Je to jeden z nejpřesnějších nultých-shot klonovací motory, i když klonování přidává k již dlouhou generaci dobu.

Tortoise byl vyškolen především na anglických řečových souborů, takže angličtina je tam, kde je jeho kvalita nejsilnější. U vícejazyčných projektů, které potřebují podobný realismus, zvážit F5-TTS nebo CosyVoice2 na TextToSpeechAI, které podporují více jazyků a zároveň nabízejí hlasové klonování.

Tortoise produkuje výjimečné, často nerozeznatelné-od-lidské audio. Zachycuje dýchání, váhání, intonaci, a skutečnou emocionální rezonanci, že lehčí modely chybí. Proto zůstává oblíbeným pro prémiové audioknihy, film vyprávění, a high-end hlasové práce, kde je realismus prvořadý.

Tortoise obvykle vyžaduje 12-24GB VRAM v závislosti na kvalitě přednastavení a velikosti šarže, takže high-end GPU jako RTX 3090, 4090 nebo A100 jsou doporučeny pro místní použití. CPU inference je technicky možné, ale velmi pomalé. Na TextToSpeechAI model běží na naší GPU infrastruktury, takže nepotřebujete žádný vlastní hardware.

Tortoise nativním způsobem vykresluje kvalitní 24kHz WAV audio. Přes TextToSpeechAI můžete požádat MP3, WAV, nebo OGG, a my překódujeme s kvalitním-zachování kódování takže si udržujte jemné detaily modelu v jakémkoli formátu, který váš projekt potřebuje.

Tortoise je v Ultra cenové úrovni na 50 kreditů na 1000 znaků, odráží čas GPU jeho kvalita-první potrubí spotřebuje. Nové účty získat zdarma startovací úvěry, takže můžete test Tortoise před spáchání. Ultra úroveň také pokrývá StyleTTS2, OpenVoice, Dia, a Zonos.

Oba jsou Ultra-tier motory, ale obchodují jinak. Tortoise TTS dosahuje absolutní vrcholu přirozenosti a emocionální hloubky, ale je zdaleka nejpomalejší motor. StylTTS2 dodává téměř-Tortoise kvality s mnohem rychlejší generace, což je lepší volbou, když potřebujete mnoho klipů nebo rychlejší obrat. Vyberte Tortoise, když kvalita je non-vyjednávat a čas není omezení.

Ano. Zaregistrujte se na TextToSpeechAI získat zdarma startovací kredity, nebo použijte demo na domovské stránce, a vyberte želvový hlas generovat klip bez instalace cokoliv. Protože Tortoise je pomalý, začít s krátkou větou a "rychlý" přednastavený vidět kvalitu před spuštěním delších pracovních míst.

Technical Specs

  • Generation Speed Very Slow
  • Output Quality Exceptional
  • Voice Cloning Supported
  • Languages 1
  • GPU VRAM 12-24GB
  • Credits/1000 chars 50

Try želvovité TTS Now

Generate your first audio free. No credit card required.

Start Free