Piper TTS

Basic

Швидке, невагомне синтезування тексту

Very Fast Швидкість
Good Якість
Ні Клонування
12 Мови

Про програму Piper TTS

Piper - це швидка, локальна система синтезу мовлення з тексту, оптимізована для Raspberry Pi та інших країв. Для роботи з ним використовують моделі, засновані на VITS, які пройшли навчання на високоякісних записах голосів, що надсилаються з мінімальними можливостями обчислення. Piper є найкращим для програм, які потребують синтезу мовлення у режимі реального часу без залежності від хмар.

Можливості ключів

Ультра- піковий синтезатор

Створює мовлення у режимі реального часу, навіть на низько потужних пристроях, на зразок Распбері Пі.

Оптимізований ЦП

Ефективно виконується на процесорі без потреби у дорогому обладнанні процесора.

12 Тутішні мови

Голоси нашого "перпера" охоплюють 12 мов, кожна з яких має рідну вимову.

Поза мережею

Працює повністю без з' єднання з мережею, не обов' язкове.

Privacy- first

Сделано, чтобы убегать местно, так что, когда ты сам удерживаешься, ему не нужно обладать.

Відкрити джерело

Повністю відкритий код у ліцензії MIT з активною спільнотою.

Випадки використання

Кмітливі помічники домівки Програми доступності Телефонні системи IVR Вбудовані пристрої Освітня програма Поза мережею програм

Piper TTS Voices

View All 25
Bryce (US English)
EN_US
Bui (Icelandic)
IS_IS
Carlos (Spanish (Spain))
ES_ES
Cori (Balanced) (UK English)
EN_GB
Cori (UK English)
EN_GB
Erik (Swedish)
SV_SE
French MLS (French)
FR_FR
German MLS (German)
DE_DE
Iseke (Kazakh)
KK_KZ
Issai (Kazakh)
KK_KZ
John (US English)
EN_US
Kristin (US English)
EN_US

Як користуватися Piper TTS

  1. 1

    Розписатися безкоштовно або відкрити демонстрацію

    Створіть вільний обліковий запис TextToSpeechAI для отримання початкових кредитів або скористайтеся демонстрацією на сторінці для того, щоб негайно спробувати Piper без підписування.

  2. 2

    Виберіть голос Piper

    Відкрийте бібліотеку і фільтр голосу за допомогою рушія Piper, а потім перегляньте голоси, які знаходяться на вашій мові і акценті, щоб знайти правильну.

  3. 3

    Ввести або вставити ваш текст

    Введіть або вставте скрипт, який ви бажаєте почути, до поля для введення тексту. Piper добре керує розділовими записами і довшими уривками, отже, ви можете перемістити всі абзаци.

  4. 4

    Скоригувати швидкість і створити

    Встановіть швидкість мовлення (приблизно 0, 5x у 2. 0x) у відповідності до вашого проекту, а потім натисніть кнопку " Створити," щоб Piper синтезував звук у секундах на процесорі.

  5. 5

    Звантажити аудіо або викликати API

    Звантажте ваш кліп як MP3, WAV або OGG з панелі результатів або надішліть цей же звук до точки кінця / v1/generate/ REST.

Piper TTS API

Створюйте програму мовлення за допомогою TextToSpeechAI програм API MEST.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "Ласкаво просимо до Piper, швидкого і легкого нейронного рушія синтезу мовлення.",
    "voice": "en_US-bryce-medium"
  }'

Часті запитання

Piper - це швидкий, легкий нейронний рушій для синтезу мовлення з тексту, який перетворює текст на мову, що відтворюється на натуральну, засновану на відео, моделі VITS, оптимізовані для ефективного визначення процесора, що робить Piper ідеальним для пристроїв ребер, автономних інструментів і програм, які можуть працювати у режимі реального часу. Ви можете спробувати Piper без обмежень на TextToSpeechAI у вашому переглядачі.

Так, Piper є повністю вільним і відкритим джерелом за умов дотримання ліцензійного управління, отже, ви можете використовувати його для особистих та комерційних проектів без ліцензування плат. За TextToSpeechAI ви можете спробувати Piper безкоштовно з вашими кредитами, і продовжувати використовувати 1 кредит на 1000 символів.

Так, Piper випущено за умовами доступності до ліцензій MIT, яка надає вам змогу користуватися комерційною системою. Ви можете доставити дані Piper у комерційні продукти, відео, програми і служби без сплати за сім' ї або додавання їх до сховища.

Голоси " Piper " на TextToSpeechAI охоплюють 12 мов: США і Британську англійську, німецьку, іспанську, італійську, голландську, шведську, ісландську, казахську, непальську та українську. Ми пропонуємо лише голосів, які дозволяють використовувати дані про підготовку.

Piper є одним з найшвидших рушіїв TTS, які працюють зручно у процесорі. Він може синтезувати мовлення у режимі реального часу навіть на Raspberry Pi, отже TextToSpeechAI більшість Piper надсилає запити на повернення звукових даних за секунду.

Ні, Piper не підтримує клонування голосів. Для клонування голосів він використовує лише попередньо підготовлені моделі голосів. Для клонування голосів скористайтеся інструментом Клонувати голос, який запускає Chatterbox.

Piper створює ясний, якісний звук, який добре підходить для допоміжних, систем IVR, для опису і доступності інструментів. Він не такий вже й гнучкий, як повільна внескова модель, але його співвідношення швидкості до якості є чудовим для більшості випадків щоденного використання.

Не потрібен процесор. Piper розроблено для запуску процесора і використовує лише декілька сотень мегабайтів пам' яті. Ось чому Piper є дуже придатним для автономних і вбудованих сценаріїв, де не буде призначеної версії GPU.

Так, Piper було створено для швидкого локального визначення і запущено повністю поза мережею після завантаження голосових моделей, без потреби у з' єднанні з мережею. Його невеликий слід і лише ЦП робить Piper одним з найкращих варіантів мовлення з автономного та налаштованого пристрою.

Обидва ці рушії є потужними, не буде клонування голосів. Пайпер покриває 12 мов, є найсвіжішим і коштує 1 кредит на 1000 символів, а VITS пропонує великий набір англомовних мов з 10 кредитами на 1000 символів. Щоб отримати різне значення, оберіть " Piper " для інших мов і " VITS."

Piper коштує 1 кредит на 1 000 символів, найнижча ціна за TextToSpeechAI. Нові рахунки отримують вільні кредити, отже, ви можете перевірити Piper без жодної вартості перед виконанням команди.

Виберіть голос Piper з бібліотеки голосів, а потім передайте його голос до / v1/generate/ endpoint з вашим токеном API. REST API виконує відтворення звукового інтерфейсу і повертає адресу URL звантаження, ви можете надіслати запит на вивід MP3, WAV або OGG.

Technical Specs

  • Generation Speed Very Fast
  • Output Quality Good
  • Voice Cloning Not Supported
  • Languages 12
  • GPU VRAM 500MB
  • Credits/1000 chars 1

Try Piper TTS Now

Generate your first audio free. No credit card required.

Start Free