OpenVoice

Ultra

Okamžité klonovanie hlasu s granulárnym ovládaním tónu

Moderate Rýchlosť
Very Good Kvalita
Áno Klonovanie
10 Jazyky

O nás OpenVoice

of the voice and apply it to the speaking style. OpenVoice is a versatile instant voice cloning model that allows fine-grained control over speaking style, allowing you to take a look at the voice and apply it to the speaking style. OpenVoice is a versatile instant voice cloning model that allows fine-grained control over speaking style, allowing you to take a look at the

Kľúčové vlastnosti produktu

Okamžité klonovanie

Klonovať akýkoľvek hlas z niekoľkých sekúnd zvuku.

Ovládanie tónu

Použite veselé, smutné, nahnevané, vzrušené alebo šepkajúce tóny.

Prenos štýlu

Oddeliť hlasovú identitu od štýlu hovorenia pre flexibilitu.

Cross-linguistic

Používajte klonované hlasy v rôznych jazykoch.

Rýchle spracovanie objednávok

Efektívne odvodenie pre rýchle generovanie hlasu.

Open source softvér

MIT licencovaný pre komerčné aplikácie.

Prípady použitia

Emocionálny obsah Animácia znakov Interaktívne hry pre deti Audiokniha Rozprávanie Marketingové videá a videá Virtuálni asistenti

Ako používať OpenVoice

  1. 1

    Zaregistrujte sa zdarma alebo vyskúšajte demo

    Vytvorte si bezplatný TextToSpeechAI účet a získajte kredity na začatie, alebo použite demo na stránke, aby ste si OpenVoice vypočuli predtým, ako sa zaviažete.Nie je potrebný žiadny lokálny GPU alebo inštalácia - všetko beží na našich serveroch.

  2. 2

    Vyberte OpenVoice a nahrajte referenčný klip

    Vyberte OpenVoice engine a nahrajte niekoľko sekúnd čistého referenčného zvuku, aby ste okamžite klonovali cieľový hlas.OpenVoice zachytáva identitu hovoriaceho, takže ju môžete znovu použiť v akomkoľvek texte a tóne.

  3. 3

    Zadajte svoj text

    Zadajte alebo prilepte skript, ktorý chcete hovoriť v klonovanom hlase.OpenVoice podporuje približne 10 jazykov a doručovanie v rôznych jazykoch, takže môžete písať v inom jazyku ako referenčný klip.

  4. 4

    Vyberte si štýl tónu a generovať

    Vyberte si jeden z deviatich štýlov tónu OpenVoice - predvolený, priateľský, veselý, vzrušený, smutný, nahnevaný, vystrašený, kričí alebo šepká - potom generovať.Rovnaký klonovaný hlas bude hovoriť s týmto emocionálnym dodávkou.

  5. 5

    Stiahnite si alebo použite API

    Stiahnite si zvuk ako MP3, WAV alebo OGG, alebo automatizujte generovanie cez TextToSpeechAI API odoslaním klonovaného hlasu a štýlu tónu v každej požiadavke.

OpenVoice API

Generujte reč programovo pomocou rozhrania REST API TextToSpeechAI.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "OpenVoice môže hovoriť v akomkoľvek tóne \u002D veselý, smutný, alebo dokonca šepkať.",
    "voice": "en_US-lessac-medium"
  }'

Často kladené otázky

OpenVoice je pokročilý model prevodu textu na reč a klonovania hlasu, ktorý jedinečne oddeľuje identitu hlasu od štýlu hovorenia. Umožňuje klonovať hlas a potom použiť rôzne emočné tóny bez potreby nového referenčného zvuku pre každú emóciu.

Áno, OpenVoice vykonáva okamžité klonovanie hlasu z niekoľkých sekúnd referenčného zvuku - nie je potrebné žiadne tréningové spustenie.Po zachytení hlasu môže OpenVoice znovu použiť túto identitu v akomkoľvek texte a akomkoľvek zvolenom štýle tónu.

OpenVoice používa dvojstupňovú architektúru, ktorá rozdeľuje základnú syntézu reči od konverzie tónov.Po klonovaní hlasu môžete použiť ktorýkoľvek z 9 štýlov tónov - predvolený, priateľský, veselý, vzrušený, smutný, nahnevaný, vystrašený, kričiaci alebo šepkajúci - a ten istý klonovaný hlas hovorí inak na základe zvoleného tónu bez opätovného nahrávania.

OpenVoice podporuje deväť štýlov reči: predvolený, priateľský, veselý, vzrušený, smutný, nahnevaný, vystrašený, kričiaci a šepkajúci.Každý štýl mení emocionálne dodanie pri zachovaní klonované reproduktor identity, dáva vám jemne zrnitú kontrolu nad tým, ako je riadok čítať.

OpenVoice je open source pod MIT licenciou, takže je voľne dostupný pre komerčné použitie.Ako pri každom klonovacom modeli, uistite sa, že máte správne práva na akýkoľvek hlas, ktorý klonujete pre komerčné projekty.

OpenVoice podporuje približne 10 jazykov vrátane angličtiny, čínštiny, japončiny, kórejčiny a niekoľkých európskych jazykov, ponúka tiež klonovanie medzi jazykmi, takže môžete klonovať hlas v jednom jazyku a nechať ho prirodzene hovoriť v inom.

OpenVoice má miernu rýchlosť generovania, typicky vykresľuje vetu za 2-4 sekundy na GPU.Kvalita výstupu je veľmi dobrá, s čistou reprodukciou hlasu a prenosom tónov, ktorý zachováva identitu hovoriaceho nedotknutú, zatiaľ čo presvedčivo mení emocionálne doručenie.

OpenVoice typicky vyžaduje 6-8GB VRAM v závislosti od veľkosti dávky a zaťaženia konverzie tónov.Beží pohodlne na strednej až vyššej strednej GPU, a na TextToSpeechAI všetko toto je spracované na našich serveroch, takže nepotrebujete žiadny lokálny hardvér.

OpenVoice je Ultra-tier engine, ktorý je cenovo dostupný za 50 kreditov za 1000 znakov.Ultra tier odráža pokročilé ovládanie tónu a extra výpočet potrebný pre klonovanie a konverziu štýlu.

OpenVoice je jedinečný pre jeho tón a štýl kontroly: môžete vziať jeden klonovaný hlas a znovu ho doručiť ako veselý, smutný, nahnevaný alebo šepkajúci. F5-TTS je rýchlejší a je náš predvolený klonovací motor pre prirodzenú, neutrálnu reč. Vyberte OpenVoice, ak potrebujete emočný štýl kontroly, a F5-TTS, ak chcete najrýchlejší prirodzený klon.

Vytvorte klonovaný hlas nahratím referenčného zvuku a potom v žiadosti API zadajte štýl tónu. API automaticky aplikuje zvolený emočný tón na klonovaný hlas a vráti zvuk vo formáte MP3, WAV alebo OGG. Vytvorte klonovaný hlas

Áno, zaregistrujte sa na bezplatný TextToSpeechAI účet, aby ste získali kredity a vyskúšali OpenVoice klonovanie a ovládanie tónu, alebo najprv použite demo na stránke. Neexistuje žiadne lokálne nastavenie - nahrajte referenčný klip, vyberte tón a generujte v prehliadači.

Technical Specs

  • Generation Speed Moderate
  • Output Quality Very Good
  • Voice Cloning Supported
  • Languages 10
  • GPU VRAM 3-6GB
  • Credits/1000 chars 50

Try OpenVoice Now

Generate your first audio free. No credit card required.

Start Free