KokoroCity in New York USA

Standard

Lightning-fast, lehké TTS s přírodní kvalitou

Very Fast Rychlost
Good Kvalita
Ne. Klonování
9 Jazyky

O aplikaci KokoroCity in New York USA

Kokoro je ultralehký 82M parametr TTS model, který poskytuje přirozený zvuk řeči neuvěřitelnou rychlostí. Běží téměř v reálném čase i na CPU, což je ideální pro aplikace, kde je nízká latence kritická. Kokoro podporuje více jazyků a nabízí hlasové míchací schopnosti.

Klíčové vlastnosti

Ultra-lehká hmotnost

82M parametry, velikost modelu ~300MB. Spouští procesor s minimálními zdroji.

Blízko reálného času

Generuje řeč rychleji než rychlost přehrávání, i bez zrychlení GPU.

Vícejazyčné

Podporuje angličtinu, francouzštinu, španělštinu, hindštinu, japonštinu, čínštinu, italštinu, portugalštinu a korejštinu.

Míchání hlasu

Smíchejte dva hlasy dohromady, abyste vytvořili jedinečné kombinace hlasu.

Pouzdra na použití

Chatboti a virtuální asistenti v reálném čase Živý streamovací text-to-speech Zavádění hran a mobilní aplikace Zpracování vysoce objemných šarží

Jak se používá KokoroCity in New York USA

  1. 1

    Zaregistrujte se zdarma nebo vyzkoušejte demo

    Vytvořte zdarma TextToSpeechAI účet získat 200 starter kreditů, nebo použijte demo no-signup slyšet Kokoro okamžitě. Standardní úroveň znamená Kokoro stojí pouze 10 kreditů na 1000 znaků.

  2. 2

    Vyberte si Kokoro hlas

    Otevřete hlasový prohlížeč a vyberte si hlas Kokoro ve vašem cílovém jazyce (9 podporovaný, od angličtiny po japonštinu a korejštinu). Můžete také použít Kokoro hlasové mixování pro mísení dvou hlasů do vlastní kombinace.

  3. 3

    Zadejte svůj text

    Zadejte nebo vložte text, který chcete mluvit do editoru. Kokoro efektivně zpracovává dlouhé pasáže díky lehkému 82M-parametru, v blízkosti motoru v reálném čase.

  4. 4

    Nastavte rychlost a generujte

    Nastavte rychlost přehrávání podle vašeho případu použití, pak klikněte na Generovat. Kokoro vykresluje zvuk rychleji než v reálném čase, takže váš projev je připraven téměř okamžitě.

  5. 5

    Stáhnout nebo použít API

    Stáhněte si hotový zvuk jako MP3 nebo WAV, nebo automatizujte generování přes TextToSpeechAI REST API na api.texttospeechai.com pro dávkové a real-time pracovní zatížení.

KokoroCity in New York USA API

Generovat řeč programově pomocí TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "Kokoro přináší přirozený projev s neuvěřitelnou rychlostí a účinností.",
    "voice": "en_US-lessac-medium"
  }'

Často kladené otázky

Kokoro je ultralehký model text-to-speech s 82 miliony parametrů. I přes svou malou velikost produkuje přirozený zvuk řeči napříč několika jazyky při rychlosti v reálném čase, a to i na CPU.

Ano, Kokoro má plně Apache 2.0 - jak kód, tak i hmotnost modelu. Lze jej volně používat v komerčních aplikacích bez omezení.

Kokoro podporuje angličtinu (USA a Britové), francouzštinu, španělštinu, hindštinu, japonštinu, čínštinu, italštinu, portugalštinu a korejštinu.

Kokoro je jedním z nejrychlejších modelů TTS, které jsou k dispozici. Vytváří řeč rychleji než rychlost přehrávání v reálném čase i na CPU, což je ideální pro interaktivní aplikace.

Ne, Kokoro nepodporuje klonování hlasu. Používá kurovanou hlasovou knihovnu s možností promíchání hlasu. Pro klonování hlasu použijte F5-TTS, Chatterbox, Styletts2, OpenVoice nebo Tortoise.

Kokoro může promíchat dva hlasy dohromady a vytvořit jedinečné kombinace. To vám umožní vytvářet vlastní hlasové charakteristiky bez tradičního klonování hlasu.

Oba jsou rychlé, lehké modely. Kokoro má moderní architekturu a podporuje hlasové mixování, zatímco Piper má větší hlasovou knihovnu. Obě jsou vynikající pro aplikace v reálném čase.

Kokoro je navržen tak, aby spustil procesor a vyžaduje minimální zdroje - přibližně 300MB. Není zapotřebí GPU, i když je podporováno zrychlení GPU pro ještě rychlejší zpracování.

Ano. Kokoro vytváří řeč rychleji než přehrávání i na CPU, s velmi nízkou latencí, takže je to vynikající vhodné pro chatboty, hlasové asistenty a živé streaming. Jeho 82M-parametr velikost udržuje paměť používat malé, takže je praktické pro vysoce objem a hrany nasazení.

Míchání hlasu umožňuje smíchat dva Kokoro hlasy dohromady vytvořit jedinečnou kombinaci s vlastními vlastnostmi. Není to tradiční klonování hlasu - nemůžete reprodukovat konkrétní osobu ze vzorku - ale dává vám to větší rozmanitost než pevná hlasová knihovna. Můžete experimentovat se směsmi přímo v editoru TextToSpeechAI.

Oba jsou rychlé, CPU-přátelské standardní motory bez hlasového klonování. Kokoro je nejlehčí (asi 300MB) a podporuje hlasové mísení v 9 jazycích, zatímco MeloTTS se zaměřuje na více anglických přízvuků a v reálném čase vícejazyčný výstup. Vyberte Kokoro pro nejmenší stopu a mísení; vyberte MeloTTS, pokud potřebujete konkrétní akcenty.

Kokoro je standardní motor, který stojí 10 kreditů na 1000 znaků - nejnižší úroveň na TextToSpeechAI. Nové účty získat 200 volných kreditů, takže můžete vyzkoušet Kokoro bez placení. To z něj dělá jeden z nejnákladnějších způsobů, jak generovat vysoce kvalitní řeč v měřítku.

Technical Specs

  • Generation Speed Very Fast
  • Output Quality Good
  • Voice Cloning Not Supported
  • Languages 9
  • GPU VRAM CPU OK
  • Credits/1000 chars 10

Try KokoroCity in New York USA Now

Generate your first audio free. No credit card required.

Start Free