Ang Piper TTS!

Basic

Mabilis, Magaan Neural Text-to-Speech

Very Fast Bilis
Good Kalidad
Hindi Cloning
12 Mga wika

Tungkol sa Ang Piper TTS!

Piper is a fast, local neural text-to-speech system optimized for Raspberry Pi and other edge devices. It uses VITS-based models that have been trained on high-quality voice recordings, delivering natural-sounding speech with minimal computational requirements. Piper is perfect for applications requiring real-time speech synthesis without cloud dependencies.

Mga Susing Katangian

Ultra-Mabilis na Sintesis

Ang mga ito ay maaaring ma-access sa pamamagitan ng mga mobile device tulad ng Raspberry Pi.

CPU-Optimized

Ang mga ito ay hindi na kailangang mag-imbak ng mga GPU hardware.

12 wika dito

Ang aming mga boses ng Piper ay sumasaklaw sa 12 wika, bawat isa ay may katutubong pagbigkas.

Offline na operasyon

Gumagana ganap na offline na walang koneksyon sa internet na kinakailangan.

Privacy-una

Dinisenyo upang tumakbo sa lokal, kaya ito ay hindi nangangailangan ng cloud service kapag self-host mo ito.

Magbukas ng source

Ang mga ito ay ganap na open-source sa ilalim ng MIT license na may aktibong komunidad development.

Gamitin ang mga kaso

Smart Home Assistants Aplikasyon ng Aksesibilidad Sistema ng Telepono ng IVR Embedded Devices Edukasyon Software Offline na mga Application

Ang Piper TTS! Voices

View All 25
Bryce (US English)
EN_US
Bui (Icelandic)
IS_IS
Carlos (Spanish (Spain))
ES_ES
Cori (Balanced) (UK English)
EN_GB
Cori (UK English)
EN_GB
Erik (Swedish)
SV_SE
French MLS (French)
FR_FR
German MLS (German)
DE_DE
Iseke (Kazakh)
KK_KZ
Issai (Kazakh)
KK_KZ
John (US English)
EN_US
Kristin (US English)
EN_US

Paano Gumamit Ang Piper TTS!

  1. 1

    Mag-sign up para sa libreng o buksan ang demo

    Lumikha ng isang libreng TextToSpeechAI account upang makatanggap ng starter credits, o gamitin ang on-page demo upang subukan Piper agad nang walang pag-sign in.

  2. 2

    Pumili ng isang Piper boses

    Buksan ang library ng boses at i-filter sa pamamagitan ng Piper engine, pagkatapos ay i-preview ang mga boses sa iyong target na wika at accent upang mahanap ang tamang isa.

  3. 3

    Ipasok o i-paste ang iyong teksto

    I-type o i-paste ang script na gusto mong sinabi sa kahon ng teksto. Piper handles punctuation at mas mahabang mga pasahe ng mabuti, kaya maaari mong ihulog sa buong mga talata.

  4. 4

    I-adjust ang bilis at bumuo

    Ang mga ito ay maaaring mag-iba mula sa 0.5 hanggang 2.0 mm (0.005 hanggang 0.008 in) sa haba, at ang mga ito ay maaaring mag-iba mula sa 0.005 hanggang 0.01 mm (0.05 hanggang 0.01 in) sa lapad.

  5. 5

    I-download ang audio o tawagan ang API

    Download your clip as MP3, WAV, or OGG from the result panel, or automate it by sending the same Piper voice slug to the /v1/generate/ REST endpoint.

Ang Piper TTS! API

Generate speech programmatically using the TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "Malapit sa lungsod ang Piper, isang mabilis at magaan na neural text\u002Dto\u002Dspeech engine.",
    "voice": "en_US-bryce-medium"
  }'

Mga Madalas Itanong

Piper ay isang mabilis, magaan neural text-to-speech engine na converts nakasulat na teksto sa natural-tunog na pananalita. Ito ay gumagamit ng VITS-based na malalim na pag-aaral modelo na-optimize para sa mahusay na CPU pagbubuod, na kung saan ay gumagawa ng Piper ideal para sa mga aparato ng gilid, offline na mga tool, at real-time na mga application. Maaari mong subukan ang Piper libre sa TextToSpeechAI direkta sa iyong browser.

Oo, Piper ay ganap na libre at open-source sa ilalim ng MIT lisensya, kaya maaari mong gamitin ito para sa personal at komersyal na mga proyekto nang walang mga bayad sa pag-license. Sa TextToSpeechAI maaari mong subukan Piper libre sa iyong starter credits, at patuloy na paggamit ng mga gastos lamang 1 credit bawat 1,000 character.

Oo, ang Piper ay inilabas sa ilalim ng permissive MIT license, na malinaw na nagpapahintulot sa komersyal na paggamit. Maaari mong ipadala ang audio na nilikha ng Piper sa mga komersyal na produkto, video, apps, at serbisyo nang hindi nagbabayad ng royalty o nagdaragdag ng pagkilala.

Ang mga boses ng Piper sa TextToSpeechAI takip 12 wika: US at British Ingles, Aleman, Espanyol, Pranses, Italyano, Dutch, Suwesya, Iceland, Kazakh, Nepali at Ukrainian. Nag-aalok kami lamang ng mga boses ng Piper na ang pagsasanay data ay nagbibigay-daan sa komersyal na paggamit.

Piper ay isa sa mga pinakamabilis na TTS engine na magagamit at tumatakbo komportable sa CPU. Maaari itong synthesize pananalita sa real time kahit na sa isang Raspberry Pi, kaya sa TextToSpeechAI karamihan Piper mga kahilingan bumalik audio sa mabuti sa ilalim ng isang segundo.

Hindi, hindi sumusuporta ang Piper sa cloning ng boses. Ginagamit lamang nito ang mga pre-trained na modelo ng boses. Para sa cloning ng boses, gamitin ang Clone Voice tool, na nagpapatakbo ng Chatterbox.

Ang Piper ay gumagawa ng malinaw, kalidad na audio na angkop para sa mga assistant, IVR system, pagsasalaysay, at mga tool sa accessibility. Hindi ito mataas na katapatan tulad ng mas mabagal na premium na modelo, ngunit ang ratio ng bilis-sa-kalidad ay mahusay para sa karamihan ng mga araw-araw na paggamit ng mga kaso.

Ang Piper ay dinisenyo upang tumakbo sa CPU at gumagamit lamang ng ilang daang megabyte ng memorya. Ito ang dahilan kung bakit ang Piper ay isang mahusay na akma para sa offline at naka-embed na mga sitwasyon kung saan walang dedikadong GPU ay magagamit.

Oo, ang Piper ay binuo para sa mabilis na lokal na pag-uugnay at tumatakbo ganap na offline kapag ang mga modelo ng boses ay na-download, na walang koneksyon sa internet na kinakailangan. Ang maliit na footprint at CPU-only na disenyo ay ginagawang Piper isa sa mga pinakamahusay na pagpipilian para sa offline at on-device na pagsasalita.

Ang Piper ay sumasaklaw sa 12 wika, ang pinakamaliit na opsyon at nagkakahalaga ng 1 credit bawat 1,000 character, habang ang VITS ay nag-aalok ng isang malaking hanay ng mga nagsasalita ng Ingles sa 10 credit bawat 1,000 character. Pumili ng Piper para sa iba pang mga wika at VITS para sa iba't ibang mga wika sa Ingles.

Piper gastos 1 credit bawat 1,000 character, ang pinakamababang presyo sa TextToSpeechAI. Bagong account makakuha ng libreng starter credits, kaya maaari mong subukan Piper sa walang gastos bago committing.

Pumili ng isang Piper boses mula sa boses library, pagkatapos ay ipasa ang boses slug nito sa / v1 / lumikha ng / endpoint sa iyong API token. Ang REST API ay nagpapakita ng audio at bumalik ng isang pag-download URL, at maaari mong hilingin MP3, WAV, o OGG output.

Technical Specs

  • Generation Speed Very Fast
  • Output Quality Good
  • Voice Cloning Not Supported
  • Languages 12
  • GPU VRAM 500MB
  • Credits/1000 chars 1

Try Ang Piper TTS! Now

Generate your first audio free. No credit card required.

Start Free