Kokoro

Standard

Lightning-nopea, kevyt TTS, luonnonlaatua

Very Fast Nopeus
Good Laatu
Ei ole tarpeen Kloonaus
9 Kielet

Tietoja Kokoro

Kokoro on erittäin kevyt 82M-parametri TTS-malli, joka tuottaa luonnolta kuulostavaa puhetta uskomattoman nopeasti. Se toimii lähes reaaliaikaisesti jopa suorittimella, mikä tekee siitä ihanteellisen sovelluksiin, joissa matala latenssi on kriittinen. Kokoro tukee useita kieliä ja tarjoaa äänensekoituskykyä.

Tärkeimmät ominaisuudet

Ultra-kevytpaino

82M-parametrit, ~300MB-mallin koko. Suorittaa prosessoria vähin resurssein.

Lähikuva reaaliaikaisesta

Puhe tuottaa nopeammin kuin toistonopeus, jopa ilman GPU-kiihdytystä.

Monikielisyys

Tukee englantia, ranskaa, espanjaa, hindiä, japania, kiinalaista, italiaa, portugalia ja koreaa.

Äänien sekoittuminen

Yhdistä kaksi ääntä yhteen ja luo ainutlaatuisia ääniyhdistelmiä.

Käytä tapauksia

Reaaliaikaiset chatbotit ja virtuaaliavustajat Suora lähetys tekstistä puheenaiheeseen Edge-käyttö ja mobiilisovellukset Suuri määrä eriä

Miten lääkettä käytetään Kokoro

  1. 1

    Rekisteröidy ilmaiseksi tai kokeile demoa

    Luo ilmainen TextToSpeechAI-tili, jolla saat 200 aloituspistettä, tai käytä tilausta vastaan -demoa kuullaksesi Kokoron välittömästi. Vakiotaso tarkoittaa, että Kokoro maksaa vain 10 krediittiä 1000 merkkiä kohti.

  2. 2

    Valitse Kokoro-ääni

    Avaa ääniselain ja valitse kohdekielelläsi Kokoro-ääni (9 tukittu, englanniksi japaniksi ja koreaksi). Voit myös käyttää Kokoro-ääntä yhdistelemään kahta ääntä mukautetun yhdistelmän.

  3. 3

    Anna teksti

    Kirjoita tai liitä muokkaimeen teksti, jonka haluat puhuttaa. Kokoro käsittelee pitkiä kappaleita tehokkaasti kevyen 82M-parametrinsa ansiosta, lähes reaaliaikaisen moottorinsa ansiosta.

  4. 4

    Säädä nopeutta ja luo

    Aseta soittonopeus käyttökoteloosi sopivaksi ja napsauta sitten Luo. Kokoro tekee äänen nopeammin kuin reaaliaikaisesti, joten puheesi on valmis lähes välittömästi.

  5. 5

    Lataa tai käytä API-rajapintaa

    Lataa valmis ääni MP3- tai WAV-levynä tai automatisoi sukupolven TextToSpeechAI REST API -puhelimen kautta api.texttospeeckai.com-palvelussa erä- ja reaaliaikaista työmäärää varten.

Kokoro API

Luo puheohjelmallisesti TextToSpeechAI REST API:n avulla.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "Kokoro pitää luonnollista puhetta uskomattoman nopeasti ja tehokkaasti.",
    "voice": "en_US-lessac-medium"
  }'

Usein kysyttyjä

Kokoro on erittäin kevyt tekstistä puheentoistoon -malli, jossa on vain 82 miljoonaa parametria. Pienestä koostaan huolimatta se tuottaa luonnonkieltä eri kielien välillä lähes reaaliaikaisesti jopa CPU:lla.

Kokoro on täysin Apache 2.0 -käyttöoikeudeton, sekä koodi- että mallipainot. Sitä voi käyttää vapaasti kaupallisissa sovelluksissa ilman rajoituksia.

Kokoro tukee englantia (Yhdysvallat ja Britannia), ranskalaisia, espanjalaisia, hindejä, japanilaisia, kiinalaisia, italialaisia, portugalilaisia ja koreankielisiä.

Kokoro on yksi nopeimmista TTS-malleista, joka tuottaa puheen nopeammin kuin reaaliaikainen toistonopeus jopa suorittimella, mikä tekee siitä ihanteellisen interaktiivisiin sovelluksiin.

Kokoro ei tue äänen kloonausta, vaan käyttää kuratoitua äänikirjastoa, jossa on äänensekoituskyky. Äänien kloonaukseen käytetään F5-TTS:ää, Chatterboxia, Styletts2:ta, OpenVoicea tai Tortoisea.

Kokoro voi yhdistää kaksi ääntä ja luoda ainutlaatuisia yhdistelmiä. Näin voit luoda omia äänenominaisuuksia ilman perinteistä äänen kloonausta.

Molemmat ovat nopeita ja kevyitä malleja. Kokorossa on modernimpi arkkitehtuuri ja se tukee äänen sekoittumista, kun taas Piperilla on suurempi äänikirjasto. Molemmat ovat erinomaisia reaaliaikaisiin sovelluksiin.

Kokoro on suunniteltu toimimaan CPU:lla ja vaatii minimaaliset resurssit - noin 300MB. GPU:ta ei tarvita, vaikka GPU:n kiihtyvyyttä tuetaan vielä nopeampaan käsittelyyn.

Kokoro tuottaa puheen nopeammin kuin toisto jopa suorittimella, joten se sopii erinomaisesti chatboteille, ääniavustajille ja live-suoratoistoon. Sen 82M-parametrin koko pitää muistin käytössä pienenä, mikä tekee siitä käytännöllisen suuren määrän ja reunan käyttöönotossa.

Äänien sekoittamisen avulla kaksi Kokoro-ääntä sekoittuu yhteen ja syntyy ainutlaatuinen yhdistelmä, jolla on omat ominaisuutensa. Se ei ole perinteinen äänikloonaus - näytettä ei voi kopioida tietyn henkilön kanssa - mutta se antaa enemmän vaihtelua kuin kiinteä äänikirjasto. TextToSpeechAI-editorissa voi kokeilla sekoituksia suoraan.

Molemmat ovat nopeita, CPU-ystävällisiä vakiomoottoreita ilman äänikloonaa. Kokoro on kevyin (noin 300MB) ja tukee äänen sekoittumista yhdeksällä kielellä, kun taas MeloTTS keskittyy useisiin englanninkielisiin aksentteihin ja reaaliaikaiseen monikieliseen lähtöön. Valitse Kokoro pienimmästä jalanjäljestä ja sekoituksesta; valitse MeloTTS, kun tarvitset erityisiä korostuksia.

Kokoro on vakiomoottori, joka maksaa 10 krediitiä 1000 merkkiä kohti, TextToSpeechAI merkin alin taso. Uusista tileistä saa 200 krediä, joten voit kokeilla Kokoroa maksamatta. Tämä tekee siitä kustannustehokkaimman tavan tuottaa korkeatasoista puhetta mittakaavassa.

Technical Specs

  • Generation Speed Very Fast
  • Output Quality Good
  • Voice Cloning Not Supported
  • Languages 9
  • GPU VRAM CPU OK
  • Credits/1000 chars 10

Try Kokoro Now

Generate your first audio free. No credit card required.

Start Free