Kůra

Premium

Výrazná řeč umělých intelektuálů s emocemi a zvukovými efekty

Slow Rychlost
Very Good Kvalita
Ne. Klonování
13 Jazyky

O aplikaci Kůra

Bark je model založený na transformátoru, který dokáže vytvářet vysoce expresivní řeč s emocemi, smíchem, vzdechy a dalšími neverbálními zvuky. Na rozdíl od tradičního TTS, Bark rozumí kontextu a může vytvářet řeč, která zní skutečně expresně a lidsky-jako. Podporuje více jazyků a dokonce může vytvářet hudební a zvukové efekty.

Klíčové vlastnosti

Emocionální vyjádření

Vytvářejte řeč smíchem, vzdycháním, vzdechy a skutečnými emocemi.

Emoční značky

Použijte [smích], [povzdechne], CAPS pro důraz, a... pro váhání.

Vícejazyčné

Podporuje 13+ jazyky s přirozeným přízvukem a výslovností.

Hudba a efekty

Může vytvářet jednoduchou hudbu a zvuky životního prostředí.

Přednastavení reproduktorů

Několik předtrénovaných hlasových mluvčích s různými styly.

Otevřít zdroj

MIT licencované s plnou komerční využití práva.

Pouzdra na použití

Dialog o charakteru Animovaný obsah Audiobook Narrace Hra Hlasové hraní Kreativní projekty Expresivní asistenti

Kůra Voices

View All 130
Bark Chinese Speaker 0
ZH
Bark Chinese Speaker 1
ZH
Bark Chinese Speaker 2
ZH
Bark Chinese Speaker 3
ZH
Bark Chinese Speaker 4
ZH
Bark Chinese Speaker 5
ZH
Bark Chinese Speaker 6
ZH
Bark Chinese Speaker 7
ZH
Bark Chinese Speaker 8
ZH
Bark Chinese Speaker 9
ZH
Bark English Speaker 0
EN
Bark English Speaker 1
EN

Jak se používá Kůra

  1. 1

    Zaregistrujte se zdarma a otevřete demo

    Vytvořte zdarma TextToSpeechAI účet pro nárok na startovací kredity, nebo použijte demo no-signup vyzkoušet Bark hned. Bezplatné kredity jsou dost na to, aby generovat několik expresivní Bark klipy před upgrade.

  2. 2

    Vyber si hlas štěkotu.

    Otevřete hlasovou knihovnu a vyberte přednastavený reproduktor Bark, který odpovídá tónu, který chcete. Hlasy štěknutí jsou označeny jako prémiová úroveň (25 kreditů na 1000 znaků) a jsou naladěny na emocionální, charakter-styl vyprávění.

  3. 3

    Zadejte text s emocemi

    Napište svůj scénář a zadejte emoce Bark v řádku: [smích] pro smích, [povzdechne] pro vzdechy, [vzdechy] pro vzdechy,... pro pauzu, a CAPS pro důraz. Například: "Oh wow! [smích] To je úžasné... Nemůžu tomu uvěřit!"

  4. 4

    Generovat zvuk

    Klikněte na Generate a Bark překreslí váš text do expresivní řeči, přetáčí každou značku do odpovídající zvuk. Generace je pomalejší než lehké motory díky modelu Bark transformátoru, takže dovolte několik sekund navíc za větu.

  5. 5

    Stáhnout nebo použít API

    Prohlédněte si výsledek, pak jej stáhněte jako MP3, WAV, nebo OGG. Chcete-li automatizovat Bark ve své vlastní aplikaci, zavolejte TextToSpeechAI API s štěk hlasem a stejný text bohatý na značky, aby se vrátil expresivní zvuk.

Kůra API

Generovat řeč programově pomocí TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "To je úžasné, miluju, jak tohle zní.",
    "voice": "bark-zh_0"
  }'

Často kladené otázky

Bark je model založený na transformátoru, který vytvořil Suno. Na rozdíl od tradičních systémů TTS, Bark generuje vysoce expresivní řeč s přirozenými emocemi, smíchem, vzdychem a dalšími neverbálními zvuky. Dokonce může vytvářet hudební a zvukové efekty.

Ano, Bark je otevřený zdroj pod licencí MIT, což umožňuje bezplatné komerční využití. Na TextToSpeechAI, účtujeme 25 kreditů na 1000 znaků díky významným zdrojům GPU potřebným pro výrobu.

Bark podporuje 13+ jazyky včetně angličtiny, němčiny, španělštiny, francouzštiny, hindštiny, italštiny, japonštiny, korejštiny, polštiny, portugalštiny, ruštiny, turečtiny a čínštiny. Každý jazyk má přirozené výslovnosti a přízvuky.

Kůra je pomalejší než většina motorů TTS díky své autoregresivní architektuře transformátoru. Typická věta trvá 5-15 sekund, než se vytvoří na GPU. Odměna je výrazně expresnější a přirozený výstup.

Bark nabízí pouze omezené klonování hlasu prostřednictvím "semantických provokací" a přednastavení reproduktorů, takže nemůže spolehlivě klonovat libovolný hlas ze vzorku. Pokud je plný hlas klonování je vaším cílem, použijte F5-TTS, StyleTTS2, OpenVoice, nebo Tortoise místo toho, všechny dostupné na TextToSpeechAI.

Bark čte inline značky umístěné přímo ve vašem textu a mění je do odpovídajících zvuků. Použijte [smích] pro smích, [povzdechne] pro vzdechy, [vzdechy] pro vzdechy,... pro zaváhání nebo pauzu, a CAPS pro důraz. Příklad: "Oh wow! [smích] To je úžasné... Nemůžu tomu uvěřit!"

Kromě prosté řeči může Bark produkovat neverbální zvuky jako smích, vzdychy, vzdechy, koktání krku, plus jednoduchá hudba a vlivy na životní prostředí. Ty jsou spuštěny s markery jako [smích], [povzdechy], a [vzdechy] zapuštěné v textu, což je to, co dělá Bark cítit více expresivní než standardní TTS.

Bark produkuje velmi kvalitní zvuk s přirozenou expresivitou, která soupeří s lidskou řečí pro emocionální obsah. Výstup 24kHz zní profesionálně, i když čistá kvalita řeči je mírně pod Styletts2.

Bark vyžaduje 8-12GB VRAM v závislosti na velikosti modelu. Plný model potřebuje ~12GB, zatímco menší varianty pracují s 8GB. CPU inference je velmi pomalé a nedoporučuje se.

Ano, Bark je licencovaný MIT, což umožňuje neomezené komerční využití bez licenčních poplatků. Můžete použít Bark v produktech, službách a aplikacích zdarma. Na TextToSpeechAI můžete vyzkoušet Bark zdarma pomocí svých přihlašovacích kreditů před zaplacením více.

Bark vyniká v expresivní jednoslovné řeči s emočními znaky jako [smích] a [povzdechne], zatímco Dia je postavena pro multi-mluvící dialog s [S1]/[S2] zatáčky a nonverbal tágy. Vyberte si Bark pro emocionální vyprávění a charakterový hlas, a Dia pro back-a-forth konverzace. Oba jsou k dispozici na TextToSpeechAI.

Bark je jedinečný ve své schopnosti generovat skutečně expresivní řeč s emocemi a non-verbální zvuky. Je pomalejší než ostatní motory, ale produkuje více lidských-jako výsledky pro tvůrčí obsah. Pro rychlejší syntézu, použijte Piper. Pro klonování hlasu, použijte F5-TTS nebo OpenVoice.

Technical Specs

  • Generation Speed Slow
  • Output Quality Very Good
  • Voice Cloning Not Supported
  • Languages 13
  • GPU VRAM 8-12GB
  • Credits/1000 chars 25

Try Kůra Now

Generate your first audio free. No credit card required.

Start Free