Отворен глас

Ultra

Мигновено клониране на гласа с гранулярна тон контрол

Moderate Скорост
Very Good Качество
Да. Клониране
10 Езици

За Отворен глас

OpenVoice е универсален моментен клониране на гласа модел, който позволява фино-зървен контрол над говорещия стил. За разлика от други клониращи модели, OpenVoice отделя гласова идентичност от говорещия стил, позволявайки да вземете клониран глас и да прилагате различни тонове - весели, тъжни, ядосани, развълнувани или шепнат - без нов референтен звук.

Ключови характеристики

Мигновено клониране

Клонирайте всеки глас от само няколко секунди звук.

Контрол на тона

Нанасяйте весели, тъжни, ядосани, развълнувани или шепотещи тонове.

Прехвърляне на стил

Разделяме гласова идентичност от езиков стил за гъвкавост.

Кръстословно

Използвайте клонирани гласове на различни езици.

Бърза обработка

Ефектно заключение за бързо поколение на глас.

Отворен източник

MIT лицензирани за търговски заявления.

Случаи на употреба

Емоционално съдържание Анимация на символите Интерактивни игри Аудиокнига на разказване Маркетингови видеокасети Виртуални асистентки

Как да използвате Отворен глас

  1. 1

    Запишете се безплатно или опитайте демото

    Създаване на безплатен TextToSpeechAI акаунт за да получите стартер кредити, или да използвате демото на страницата, за да чуете OpenVoice преди да се направи. Не е необходима местен GPU или инсталиране - всичко работи на нашите сървъри.

  2. 2

    Изберете отворен глас и качи референтен клип

    Изберете двигателя OpenVoice, след което качване на няколко секунди чист референтен звук за мигновено клониране на целевия глас. OpenVoice заснема идентичността на говоритела, така че можете да го използвате отново през всеки текст и тон.

  3. 3

    Въведете вашия текст

    Въведете или вметнете скрипта, който искате да се говори в клонирания глас. OpenVoice поддържа около 10 езика и кръстословна доставка, така че можете да пишете на друг език от референтния клип.

  4. 4

    Изберете тон стил и генерира

    Изберете един от деветте стила на отворен глас - по подразбиране, приятелски, весел, вълнуван, тъжен, ядосан, ужасен, крещене или шепнене - след това генерирайте. Същият клониран глас ще говори с тази емоционална доставка.

  5. 5

    Изтеглете или използвайте API

    Изтеглете звука си като MP3, WAV, или OGG, или автоматизирайте поколение през TextToSpeechAI API чрез преминаване на вашия клониран глас и тон стил в всяко искане.

Отворен глас АПИ

Генериране на речна програма с помощта на TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "Отворен глас може да говори с всеки тон \u002D весел, тъжен, или дори шепне.",
    "voice": "en_US-lessac-medium"
  }'

Често задавани въпроси

OpenVoice е напреднал модел за клониране на текст към глас, който отделя уникално гласова идентичност от езиковия стил. Това ви позволява да клонирате глас и след това прилагате различни емоционални тонове без да се нуждаете от нов референтен звук за всяка емоция. Тя е изградена за изразително, контролирано генериране на реч.

Да, OpenVoice изпълнява мигновено клониране на гласа от само няколко секунди референтен звук - не се изисква тренировка. След като гласът е заснет, OpenVoice може да използва тази идентичност през всеки текст и всеки тон стил, който изберете.

OpenVoice използва двуетапна архитектура, която разделя синтеза на основите на речта от преобразуване на тона. След клониране на гласа, можете да приложите всеки от 9 тона стилове - по подразбиране, приятелски, весело, вълнуващо, тъжно, ядосано, ужасено, крещене или шептане - и същият клониран глас говори различно въз основа на избрания ви тон без презапис.

OpenVoice поддържа девет езикови стилове: по подразбиране, приятелски, весели, вълнувани, тъжни, ядосани, ужасени, крещене и шепотене. Всеки стил преобразува емоционалната доставка, докато запазва клонираната идентичност на оратора, дава фино-зрял контрол върху това как се чете линията.

OpenVoice е отворен източник по лиценза на MIT, така че е свободен за търговска употреба. Както и всеки модел на клониране, уверете се, че имате подходящи права на всеки глас, който клонирате за търговски проекти.

Отворен глас поддържа около 10 езици, включително английски, китайски, японски, корейски и няколко европейски езици. Тя предлага също кръстословично клониране, така че можете да клонирате глас на един език и да го говорите естествено на друг.

OpenVoice има умерена генерация скорост, обикновено прави изречение в 2-4 секунди на GPU. Изходното качество е много добро, с ясна гласова репродукция и прехвърляне на тон, който поддържа идентичността на говоритела непокътнати, като убедително променя емоционалната доставка.

OpenVoice обикновено изисква 6-8GB VRAM в зависимост от размера на партидата и натоварването на тон. Той работи удобно на средната до горната средна граница GPUs, а на TextToSpeechAI от това се работи на нашите сървъри, така че не се нуждаете от местно хардуерно.

OpenVoice е двигател с ултра-тир, цени 50 кредита на 1000 символа. Ултра нивото отразява напредналата си тон контрол и допълнителния изчисление, необходими за клонирането плюс стил-конверсия тръбопровод.

OpenVoice е уникален за своя тон и стил контрол: можете да вземете един клониран глас и да го преизведете като весел, тъжен, ядосан или шепнат. F5-TTS е по-бърз и е нашият по подразбиране клониране двигател за естествена, неутрална реч. Изберете OpenVoice, когато се нуждаете от емоционален стил контрол, и F5-TTS, когато искате най-бързият естествен клонинг.

Създаване на клониран глас чрез качи референтен звук, след което да се зададе стил на тон във вашия API искане. API прилага избрания си емоционален тон към клонирания глас автоматично и връща звука в MP3, WAV или OGG формат.

Да. Регистрирайте се за безплатен TextToSpeechAI профила, за да получите стартер кредити и да опитате OpenVoice клониране и тон контрол, или да използвате демото на страницата първо. Няма локално настройване - качване на референтен клип, изберете тон и генерирайте в браузъра.

Technical Specs

  • Generation Speed Moderate
  • Output Quality Very Good
  • Voice Cloning Supported
  • Languages 10
  • GPU VRAM 3-6GB
  • Credits/1000 chars 50

Try Отворен глас Now

Generate your first audio free. No credit card required.

Start Free