Kuori

Premium

Ilmeinen tekoälypuhe tunteilla ja äänitehosteilla

Slow Nopeus
Very Good Laatu
Ei ole tarpeen Kloonaus
13 Kielet

Tietoja Kuori

Bark on muuntajapohjainen teksti-audio-malli, joka voi tuottaa erittäin ilmaisuvoimaista puhetta tunteilla, naurulla, huokauksilla ja muilla ei-sanallisilla äänillä. Toisin kuin perinteinen TTS ymmärtää kontekstia ja voi tuottaa puhetta, joka kuulostaa aidosti ilmaisuvaltaiselta ja inhimilliseltä. Se tukee useita kieliä ja voi jopa tuottaa musiikkia ja äänitehosteita.

Tärkeimmät ominaisuudet

Tunteellinen ilmaisu

Luo puhetta nauramalla, huokailemalla, huokailemalla ja aidoilla tunteilla.

Tunteiden merkit

Käytä painotusta ja epäröintiä.

Monikielinen

Tukee 13+ kieltä luonnollisella korostuksella ja ääntämisellä.

Musiikki ja tehosteet

Voi tuottaa yksinkertaista musiikkia ja ympäristöääniä.

Puheenvuoron esiasetukset

Useita esikoulutettuja kaiuttimia eri tyyleillä.

Avaa lähdekoodi

MIT:n lisenssi täydellä kaupallisella käyttöoikeudella.

Käytä tapauksia

Luonnedialogi Animoitu sisältö Äänikirjan narratiivi Peliääni toimii Luovia projekteja Ilmaisimet avustajat

Kuori Voices

View All 130
Bark Chinese Speaker 0
ZH
Bark Chinese Speaker 1
ZH
Bark Chinese Speaker 2
ZH
Bark Chinese Speaker 3
ZH
Bark Chinese Speaker 4
ZH
Bark Chinese Speaker 5
ZH
Bark Chinese Speaker 6
ZH
Bark Chinese Speaker 7
ZH
Bark Chinese Speaker 8
ZH
Bark Chinese Speaker 9
ZH
Bark English Speaker 0
EN
Bark English Speaker 1
EN

Miten lääkettä käytetään Kuori

  1. 1

    Rekisteröidy ilmaiseksi ja avaa demo

    Luo ilmainen TextToSpeechAI-tili, jolla voit hakea aloituskomennuksesi tai käyttää ei-allekirjoittautumisdemoa Barkin kokeilemiseen heti. Ilmaiset kredit riittävät luomaan useita ilmeikkäitä Bark-leikkeitä ennen päivittämistä.

  2. 2

    Valitse Barkin ääni

    Avaa äänikirjasto ja valitse Bark-kaiutin, joka vastaa haluamaasi sävyä. Bark-äänet on merkitty premium-tasoksi (25 krediittiä tuhatta merkkiä kohti) ja viritetty tunnepitoiseen, hahmotyyppiseen kertomukseen.

  3. 3

    Kirjoita teksti tunnemerkeillä

    Kirjoita käsikirjoitus ja upota Barkin tunnemerkit riviin: [teurastus] nauruun, [huuteluun] huokailuun, [huuteluun],... taukoon ja CAPS painotukseen. Esimerkiksi: "Voi vau! [teurastus] Tämä on uskomatonta!

  4. 4

    Luo ääni

    Click Generate and Bark muuttaa tekstisi ilmaisunomaiseksi puheeksi, jolloin jokainen merkki muuttuu vastaavaksi ääneksi. Barkin muuntajan mallin ansiosta sukupolvi on hitaampi kuin kevyet moottorit, joten anna muutama lisäsekunti lausetta kohden.

  5. 5

    Lataa tai käytä API-rajapintaa

    Esikatsele tulos ja lataa se MP3-, WAV- tai OGG-puhelimella. Voit automatisoida Barkin omassa sovelluksessasi soittamalla TextToSpeechAI API:n Bark-äänellä ja samalla merkkirikkaalla tekstillä, jotta saat takaisin ilmeettömän äänen.

Kuori API

Luo puheohjelmallisesti TextToSpeechAI REST API:n avulla.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "Tämä kuulostaa todella ilmaisuvalta.",
    "voice": "bark-zh_0"
  }'

Usein kysyttyjä

Bark on Sunon kehittämä muuntajapohjainen teksti-audio-malli. Toisin kuin perinteiset TTS-järjestelmät, Bark tuottaa erittäin ilmaisukykyistä puhetta, jossa on luonnollisia tunteita, naurua, huokauksia ja muita ei-verbaaleja ääniä. Se voi jopa synnyttää musiikkia ja äänitehosteita.

Bark on MIT-lisenssin mukainen avoin lähdekoodi, joka mahdollistaa ilmaisen kaupallisen käytön. TextToSpeechAI:lla veloitamme 25 hyvitystä 1000 merkkiä kohti, koska tuotanto vaatii merkittäviä GPU-resursseja.

Bark tukee 13+ kieltä, mukaan lukien englanti, saksa, espanja, ranska, hindi, italia, japani, korea, puola, portugali, venäjä, turkki ja kiina. Jokaisella kielellä on luonnollinen ääntäminen ja korostus.

Bark on hitaampi kuin useimmat TTS-moottorit autoregressiivisen muuntajaarkkitehtuurin ansiosta. Tyypillinen lause kestää 5-15 sekuntia GPU:n tuottamiseen. Vaihtokauppa on huomattavasti ilmaisukykyisempi ja luonnollisempi.

Bark tarjoaa vain rajoitetun äänikloonauksen "semanttisten vihjeiden" ja kaiuttimen avulla, joten se ei voi luotettavasti kloonata mielivaltaista ääntä näytteestä. Jos täysäänenkloonaus on tavoitteesi, käytä F5-TTS:ää, Styletts2:ta, OpenVoicea tai Tortoisea, kaikki saatavilla TextToSpeechAI:lla.

Bark lukee tekstiisi suoraan sijoitettuja sisäänkirjautumismerkkejä ja muuttaa ne vastaaviksi ääniksi. Käytä [teurastus] nauruun, [hulku] huokailuun, [hulju] epäröintiin tai taukoon ja CAPS painotukseen. Esimerkki: "Voi vau! [teurastus] Tämä on hämmästyttävää... En voi uskoa sitä!"

Bark voi paitsi puhua myös tuottaa sanattomia ääniä, kuten naurua, huokauksia, ämmiä, kurkunpuhdistusliikkeitä ja änkytyksiä, myös yksinkertaisen musiikin ja ympäristövaikutusten. Nämä laukeavat merkkiaineilla, kuten [teurastuksella], [h" :lla] ja [h' : llä], jotka ovat tekstiin uponneet, mikä saa Barkin tuntemaan itsensä ilmeekkäämmäksi kuin tavallinen TTS.

Bark tuottaa erittäin laadukasta ääntä, joka on luonnollista ilmaisukykyä, joka kilpailee ihmisen puheen kanssa tunnesisällön suhteen. 24kHz-lähtö kuulostaa ammattimaiselta, vaikka puheen laatu on hieman Styletts2:n alapuolella.

Bark vaatii 8-12GB VRAM-muistia mallikoon mukaan. Täysi malli tarvitsee ~12GB:n, kun taas pienemmät versiot toimivat 8GB:n kanssa. CPU-päätelmä on erittäin hidas eikä sitä suositella.

Bark on kyllä MIT-lisenssin alainen, mikä mahdollistaa rajoittamattoman kaupallisen käytön ilman lisenssimaksuja. Barkin käyttö on vapaata tuotteissa, palveluissa ja sovelluksissa. TextToSpeechAI:lla voit kokeilla Bark Free -palvelua ilmoittautumisluottojen avulla ennen kuin maksat lisää.

Bark on erinomainen ilmaisemaan yksikielistä puhetta, jossa on tunnemerkkejä kuten [teurastus] ja [huljutus], kun taas Dia on rakennettu monikielistä vuoropuhelua varten [S1]/[S2]-käännösten ja sanattomien tviittien kanssa. Valitse Bark tunne- ja luonneäänen sekä Dia-käännöksen kanssa. Molemmat ovat saatavilla TextToSpeechAI:lla.

Bark on ainutlaatuinen siinä, että se pystyy tuottamaan aidosti ilmaisukykyistä puhetta tunteiden ja ei-sanallisten äänien avulla. Se on hitaampi kuin muut moottorit, mutta tuottaa ihmismäisempiä tuloksia luovaan sisältöön. Nopeampaan synteesiin käytä Piperia. Äänikloonaukseen käytä F5-TTS:ää tai OpenVoicea.

Technical Specs

  • Generation Speed Slow
  • Output Quality Very Good
  • Voice Cloning Not Supported
  • Languages 13
  • GPU VRAM 8-12GB
  • Credits/1000 chars 25

Try Kuori Now

Generate your first audio free. No credit card required.

Start Free