Кокоро

Standard

Бърза светкавица, лека TTS с естествено качество

Very Fast Скорост
Good Качество
Не. Клониране
9 Езици

За Кокоро

Кокоро е ултра леко 82M параметър TTS модел, който осигурява естествено звукова реч с невероятна скорост. Тя работи близо до реално време дори и при CPU, което го прави идеален за приложения, където ниско латентност е критична. Kokoro поддържа няколко езици и предлага възможности за сливане на глас.

Ключови характеристики

Ултра- леко

82M параметри, ~300MB размер на модела. Изпълнява на процесора с минимални ресурси.

Близо до реално време

Генерира реч по-бързо от скоростта на възпроизвеждане, дори и без ускорение на GPU.

Многоезичен

Подкрепя английски, френски, испански, хинди, японски, китайски, италиански, португалски и корейски.

Гласово смесване

Смесвайте два гласа заедно, за да създадете уникални гласови комбинации.

Случаи на употреба

Реалновременни чатбот и виртуални асистентки Предаване на текст в живо Разпоредба на ръба и мобилни приложения Обработка на партидна партида с висок обем

Как да използвате Кокоро

  1. 1

    Запишете се безплатно или опитайте демото

    Създаване на безплатен TextToSpeechAI акаунт за да получите 200 стартер кредити, или да използвате без-регистъра демо за да чуете Kokoro веднага. Стандартният ниво означава Kokoro струва само 10 кредита на 1000 символа.

  2. 2

    Избери кокоро глас.

    Отворете браузъра на гласа и изберете глас на вашия език (9 подкрепени, от английски на японски и корейски). Също така можете да използвате глас Kokoro, за да смесвате два гласа в комбинация по поръчка.

  3. 3

    Въведете вашия текст

    Въведете или вметнете текста, който искате да говорите в редактора. Kokoro се справя с дълги пасажи ефикасно благодарение на лекия 82M-параметър, близо до реално време двигателя.

  4. 4

    Настройване на скоростта и генериране

    Настройте скоростта на възпроизвеждането, за да отговаря на вашия случай за използване, след което натиснете Генериране. Kokoro излъчва звук по-бързо от реалното време, така че речта ви е готова почти незабавно.

  5. 5

    Изтеглете или използвайте API

    Изтеглете завършения звук като MP3 или WAV, или автоматизирайте генерирането през TextToSpeechAI REST API в api.texttospeechai.com за партидни и реално време натоварване.

Кокоро АПИ

Генериране на речна програма с помощта на TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "Кокоро носи естествена реч с невероятна скорост и ефективност.",
    "voice": "en_US-lessac-medium"
  }'

Често задавани въпроси

Кокоро е ултра лек текст-то-спееч модел с само 82 милиона параметри. Въпреки малкия си размер, той произвежда естествено-звук-словен език с почти реално време скорост, дори и при процесор.

Да, Кокоро е напълно апачи 2.0 лицензирани - както код, така и моделни тежести. Тя може да се използва свободно в търговски приложения без ограничения.

Кокоро поддържа английски (USA и британски), френски, испански, хинди, японски, китайски, италиански, португалски и корейски.

Кокоро е един от най-бързите налични модели на TTS. Той генерира реч по-бързо от скоростта на възпроизвеждане в реално време дори при процесора, което го прави идеален за интерактивни приложения.

Не, Kokoro не подкрепя клониране на гласа. Използва курирана гласова библиотека с възможности за комбиниране на гласа. За клониране на гласа, използвайте F5-TTS, Chatterbox, StyleTTS2, OpenVoice или Tortoise.

Кокоро може да смеси два гласа заедно, за да създаде уникални комбинации. Това ви позволява да създадете обичайни гласови характеристики без традиционно клониране на гласа.

И двете са бързи, леки модели. Кокоро има по-модерна архитектура и поддържа гласова смесване, докато Piper има по-голяма гласова библиотека. И двете са отлични за реално време приложения.

Kokoro е предназначен да работи на CPU и изисква минимални ресурси - приблизително 300MB. Не е необходима GPU ускорение, въпреки че GPU е подкрепено за още по-бърза обработка.

Да. Кокоро генерира реч по-бързо от възпроизвеждането дори и на процесора, с много ниска латентност, така че е отлично подходящ за чатботи, гласови асистентки и живо струмиране. Нейният размер 82M-параметър поддържа паметта използват малки, което го прави практично за високо обем и ръб на разположение.

Гласовото смесване ви позволява да смесите два гласа Kokoro заедно, за да създадете уникална комбинация с свои характеристики. Това не е традиционно клониране на гласа - не можете да възпроизведете определен човек от проба - но ви дава повече разнообразие от фиксирана гласова библиотека. Можете да експериментирате с смеси директно в TextToSpeechAI редактор.

И двете са бързи, приятни за процесор стандартен клониране двигатели без гласова клонация. Kokoro е най-лекият (около 300MB) и поддържа гласовото сливане на 9 езика, докато MeloTTS се фокусира върху много английски акценти и в реално време многоязични изходи. Изберете Kokoro за най-малкия отпечатък и смесване; изберете MelotTS, когато имате нужда от конкретни акценти.

Кокоро е стандартен двигател, който струва 10 кредита на 1000 символа - най-ниския клас на TextToSpeechAI. Новите сметки получават 200 безплатни кредита, така че можете да опитате Kokoro без плащане. Това го прави един от най-скъпо-ефективните начини да генерира висококачествено говорене в мащаба.

Technical Specs

  • Generation Speed Very Fast
  • Output Quality Good
  • Voice Cloning Not Supported
  • Languages 9
  • GPU VRAM CPU OK
  • Credits/1000 chars 10

Try Кокоро Now

Generate your first audio free. No credit card required.

Start Free