Kéreg

Premium

Expresszív MI beszéd érzelmekkel és hanghatásokkal

Slow Sebesség
Very Good Minőség
Nem. Klónozás
13 Nyelvek

About Kéreg

Bark egy transzformer alapú szöveg-audio modell, amely nagyon kifejező beszéd érzelmekkel, nevetéssel, sóhajokkal és más nem verbális hangokkal. A hagyományos TTS-től eltérően Bark megérti a kontextust, és olyan beszédet tud készíteni, amely valóban kifejező és emberi jellegű. Több nyelven is tud beszélni, sőt zenei és hanghatásokat is generálhat.

Kulcsfontosságú jellemzők

Érzelmi kifejezés

Nevetéssel, sóhajokkal, zihálással és valódi érzelmekkel kell beszélni.

Érzelmi jelzők

Használd a [nevetés], [sóhajt], CAPS a hangsúly, és... habozás.

Többnyelvű

Támogatja a 13+ nyelvek természetes akcentussal és kiejtéssel.

Zenehatások

Egyszerű zenét és környezeti hangokat tud generálni.

Előkészületek

Több előre képzett hangzás, különböző stílusokkal.

Nyílt forrás

MIT engedélyezve teljes kereskedelmi használati jogokkal.

Esetek használata

Karakterpárbeszéd Animált tartalom Hangkönyv Narration Játékhangok fellépése Kreatív projektek Expressz asszisztensek

Kéreg Voices

View All 130
Bark Chinese Speaker 0
ZH
Bark Chinese Speaker 1
ZH
Bark Chinese Speaker 2
ZH
Bark Chinese Speaker 3
ZH
Bark Chinese Speaker 4
ZH
Bark Chinese Speaker 5
ZH
Bark Chinese Speaker 6
ZH
Bark Chinese Speaker 7
ZH
Bark Chinese Speaker 8
ZH
Bark Chinese Speaker 9
ZH
Bark English Speaker 0
EN
Bark English Speaker 1
EN

Hogyan kell alkalmazni? Kéreg

  1. 1

    Regisztrálj ingyen!

    Hozzon létre egy ingyenes TextToSpeechAI fiókot, hogy az indító krediteket követelje. Ingyenes hitelek elég ahhoz, hogy több expresszív Bark klipet hozzon létre, mielőtt frissít.

  2. 2

    Válasszon egy kéreg hangot

    Nyissa meg a hangkönyvtárat és válasszon egy Bark hangszórót, amely megfelel a kívánt hangnak. A bárk hangok a prémium szintként vannak jelölve (25 kredit 1000 karakterenként), és az érzelmi, karakter-stílusú narrációra hangolva.

  3. 3

    Érzelmi jelölőkkel ellátott szöveg megadása

    Írd be a forgatókönyvet és írd be a Bark érzelem jelzőket a sorba: [nevetés] a nevetésekért, [sóhajtozásokért, [zihálások] a felhangokért,... egy szünetért, és CAPS a hangsúlyért. Például: "Ó, hűha! [nevetés] Ez ámító... Nem hiszem el!"

  4. 4

    Hang generálása

    Kattintson a Generate and Bark teszi a szöveget kifejező beszéd, kapcsolva minden jelölő a megfelelő hangot. A Generation lassabb, mint a könnyű motorok miatt Bark transzformátor modell, így néhány extra másodpercet mondatonként.

  5. 5

    Az API letöltése vagy használata

    Előnézet az eredmény, majd töltse le MP3, WAV, vagy OGG. Automatizálja Bark a saját alkalmazás, hívja a TextToSpeechAI API egy Bark hang és ugyanaz a marker-gazdag szöveg, hogy visszaszerezze a expresszív audio.

Kéreg API

A beszéd programszerű generálása a TextToSpeechAI REST API használatával.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "Ez elképesztő, de imádom, hogy ez milyen kifejezően hangzik!",
    "voice": "bark-zh_0"
  }'

Gyakran ismételt kérdések

A Bark egy trafik alapú szöveg-audio modell, amit Suno készített. A hagyományos TTS rendszerektől eltérően Bark rendkívül kifejező beszédet generál természetes érzelmekkel, nevetéssel, sóhajtozással és más nem verbális hangokkal. Zene és hanghatásokat is generálhat.

Igen, a Bark nyílt forráskódú az MIT licenc alatt, amely lehetővé teszi az ingyenes kereskedelmi használatot. TextToSpeechAI-en 25 kreditet számolunk fel 1000 karakterenként a termeléshez szükséges jelentős GPU erőforrások miatt.

Bark támogatja 13 nyelven, beleértve az angol, német, spanyol, francia, hindi, olasz, japán, koreai, lengyel, portugál, orosz, török és kínai. Minden nyelv természetes kiejtéssel és akcentussal rendelkezik.

A kéreg lassabb, mint a legtöbb TTS motor miatt az autoregresszív transzformátor architektúrája. A tipikus mondat 5-15 másodperc alatt generálja a GPU. A kompromisszum jelentősen kifejezőbb és természetes kimenet.

Bark csak korlátozott hang klónozása "szemantikai promptek" és hangszórók előre beállított, így nem megbízható klónoz egy önkényes hangot a minta. Hang klónozáshoz használja a Clone Voice eszköz, amely fut Chatterbox.

Bark olvassa a szövegedben található sorjeleket, és a hangokat is egyező hangokká változtatja. Használd a nevetést, a sóhajokat, a zihálást, a habozást vagy szünetet, és a CAPS-t a hangsúlyra. Példa: "Ó, hűha! [nevetés] Ez ámító... Nem hiszem el!"

A sima beszéden túl a Bark olyan nem verbális hangokat tud létrehozni, mint a nevetés, a sóhajok, a torokmosás és a dadogás, valamint az egyszerű zene és a környezeti hatások. Ezek olyan markerek, mint a [nevetés], [sóhajt] és [zúg] a szövegbe ágyazva, amitől Bark kifejezőbbnek érzi magát, mint a standard TTS.

Bark nagyon jó minőségű hangot ad ki természetes kifejezőképességgel, amely az emberi beszédtel vetekszik az érzelmi tartalomért. A 24kHz kimenet professzionálisan hangzik, bár a tiszta beszéd minősége kissé alatta van a StyletTS2-nek.

A kéreg 8-12GB VRAM-ot igényel a modell méretétől függően. A teljes modellhez ~12GB-ra van szükség, míg a kisebb változatok 8GB-val működnek. A CPU-inferencia rendkívül lassú és nem ajánlott.

Igen, Bark MIT engedéllyel rendelkezik, amely korlátlan kereskedelmi használatot engedélyez licencdíjak nélkül. A Bark termékeket, szolgáltatásokat és alkalmazásokat szabadon használhatja. TextToSpeechAI-en a Bark ingyenes használata a regisztrációs kreditek, mielőtt többet fizetne.

Bark kiválóan beszél kifejező érzelmek markerek, mint [nevetés] és [sóhajt] 13 nyelven, míg StyletTS2 ad a legtisztább, legtermészetesebb angol narráció. Válassza Bark érzelmi és karakter hangok, és StyletTS2 a fényezett angol hangover.

Bark egyedülálló abban a képességében, hogy valóban kifejező beszédet hozzon létre érzelmekkel és nem verbális hangokkal. Lassabban, mint más motorok, de emberibb eredményeket hoz kreatív tartalmak számára. Gyorsabb szintézishez használja Pipert. Hang klónozáshoz használja a Clone Voice eszközt, amely a Chatterboxot futtatja.

Technical Specs

  • Generation Speed Slow
  • Output Quality Very Good
  • Voice Cloning Not Supported
  • Languages 13
  • GPU VRAM 8-12GB
  • Credits/1000 chars 25

Try Kéreg Now

Generate your first audio free. No credit card required.

Start Free