Piper TTS

Basic

Text-to-speech thần kinh nhanh, nhẹ

Very Fast Tốc độ
Good Chất lượng
Không Bản sao
12 Ngôn ngữ

Về Piper TTS

ing the

Tính năng chính

Tổng hợp cực nhanh

Tạo ra giọng nói trong thời gian thực, ngay cả trên các thiết bị năng lượng thấp như Raspberry Pi.

Tối ưu hóa CPU

Chạy hiệu quả trên CPU mà không cần phần cứng GPU đắt tiền.

12 ngôn ngữ ở đây

Giọng nói Piper của chúng tôi bao gồm 12 ngôn ngữ, mỗi ngôn ngữ có cách phát âm bản địa.

Hoạt động ngoài mạng

Công việc hoàn toàn offline mà không cần kết nối internet.

Tư nhân trước

Được thiết kế để chạy ở địa phương, vì vậy nó không cần dịch vụ đám mây khi bạn tự lưu nó.

Mã nguồn mở

Toàn bộ mã nguồn mở theo giấy phép MIT với phát triển cộng đồng tích cực.

Tình huống sử dụng

Trợ lý nhà thông minhName Ứng dụng hỗ trợ người khuyết tật Hệ thống điện thoại IVRName Thiết bị nhúng Phần mềm giáo dụcName Ứng dụng ngoài mạng

Piper TTS Voices

View All 25
Bryce (US English)
EN_US
Bui (Icelandic)
IS_IS
Carlos (Spanish (Spain))
ES_ES
Cori (Balanced) (UK English)
EN_GB
Cori (UK English)
EN_GB
Erik (Swedish)
SV_SE
French MLS (French)
FR_FR
German MLS (German)
DE_DE
Iseke (Kazakh)
KK_KZ
Issai (Kazakh)
KK_KZ
John (US English)
EN_US
Kristin (US English)
EN_US

Cách sử dụng Piper TTS

  1. 1

    Đăng ký miễn phí hoặc mở bản demo

    Tạo một tài khoản TextToSpeechAI miễn phí để nhận tiền thưởng khởi động, hoặc sử dụng bản demo trên trang để thử Piper ngay lập tức mà không cần đăng nhập.

  2. 2

    Chọn giọng nói Piper

    Mở thư viện giọng nói và lọc theo bộ máy Piper, sau đó xem trước giọng nói trên ngôn ngữ và giọng điệu mục tiêu để tìm ra giọng nói đúng.

  3. 3

    Nhập hoặc dán văn bản của bạn

    Nhập hoặc dán văn lệnh bạn muốn nói vào hộp văn bản. Piper xử lý chấm câu và các đoạn dài tốt, vì vậy bạn có thể thả vào các đoạn văn hoàn chỉnh.

  4. 4

    Điều chỉnh tốc độ và tạo

    Đặt tốc độ nói (khoảng 0. 5x đến 2. 0x) phù hợp với dự án của bạn, sau đó bấm tạo để Piper tổng hợp âm thanh trong vài giây trên CPU.

  5. 5

    Tải về âm thanh hoặc gọi API

    Tải xuống đoạn phim của bạn như MP3, WAV, hoặc OGG từ bảng kết quả, hoặc tự động hóa nó bằng cách gửi cùng một Piper voice slug đến /v1/generate/ REST endpoint.

Piper TTS API

Tạo lời nói bằng cách lập trình sử dụng TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "Chào mừng đến Piper, một máy chuyển văn bản sang giọng nói nhẹ nhàng và nhanh.",
    "voice": "en_US-bryce-medium"
  }'

Câu hỏi thường gặp

Piper là một bộ máy chuyển văn bản sang nói nhanh, nhẹ, chuyển văn bản viết thành lời nói tự nhiên. Nó sử dụng mô hình học sâu dựa trên VITS được tối ưu hóa cho sự suy luận CPU hiệu quả, làm cho Piper lý tưởng cho các thiết bị rìa, công cụ không kết nối mạng, và ứng dụng thời gian thực. Bạn có thể thử Piper miễn phí trên TextToSpeechAI trực tiếp trong trình duyệt.

Yes, Piper is completely free and open-source under the MIT license, so you can use it for personal and commercial projects without licensing fees. On TextToSpeechAI you can try Piper free with your starter credits, and continued use costs just 1 credit per 1,000 characters.

Có, Piper được phát hành theo giấy phép MIT, cho phép sử dụng thương mại. Bạn có thể gửi âm thanh được tạo bởi Piper vào các sản phẩm thương mại, video, ứng dụng và dịch vụ mà không phải trả phí bản quyền hay thêm tên tác giả.

Các giọng nói Piper trên TextToSpeechAI bao gồm 12 ngôn ngữ: tiếng Anh Mỹ và Anh, tiếng Đức, tiếng Tây Ban Nha, tiếng Pháp, tiếng Ý, tiếng Hà Lan, tiếng Thụy Điển, tiếng Iceland, tiếng Kazakh, tiếng Nepal và tiếng Ukraina. Chúng tôi chỉ cung cấp giọng nói Piper mà dữ liệu huấn luyện cho phép sử dụng thương mại.

Piper là một trong những máy TTS nhanh nhất có sẵn và chạy thoải mái trên CPU. Nó có thể tổng hợp giọng nói trong thời gian thực ngay cả trên Raspberry Pi, vì vậy trên TextToSpeechAI hầu hết các yêu cầu Piper trả lại âm thanh trong ít hơn một giây.

Không, Piper không hỗ trợ sao chép giọng nói. Nó chỉ dùng các mẫu giọng nói đã được huấn luyện trước. Để sao chép giọng nói, hãy dùng công cụ Clone Voice, chạy Chatterbox.

Piper tạo ra âm thanh rõ ràng, chất lượng tốt phù hợp với trợ lý, hệ thống IVR, kể chuyện và công cụ truy cập. Nó không phải là độ chính xác cao như các mẫu cao cấp chậm hơn, nhưng tỷ lệ tốc độ-chất lượng của nó là tuyệt vời cho hầu hết các trường hợp sử dụng hàng ngày.

Không cần GPU. Piper được thiết kế để chạy trên CPU và chỉ dùng vài trăm megabyte bộ nhớ. Đó là lý do tại sao Piper phù hợp với các trường hợp không kết nối và nhúng mà không cần GPU riêng.

Có, Piper được xây dựng để suy luận địa phương nhanh và chạy hoàn toàn ngoài mạng khi các mô hình giọng nói của nó được tải xuống, không cần kết nối Internet. Dấu chân nhỏ và thiết kế chỉ CPU của nó làm cho Piper là một trong những lựa chọn tốt nhất cho giọng nói ngoài mạng và trên thiết bị.

Cả hai đều là những máy nhanh mà không có bản sao giọng nói. Piper bao gồm 12 ngôn ngữ, là tùy chọn nhẹ nhất và tốn 1 tín dụng cho mỗi 1000 ký tự, trong khi VITS cung cấp một tập hợp lớn các người nói tiếng Anh với 10 tín dụng cho mỗi 1000 ký tự. Chọn Piper cho các ngôn ngữ khác và VITS cho sự đa dạng trong tiếng Anh.

Piper có giá 1 tín dụng cho mỗi 1000 ký tự, giá thấp nhất trên TextToSpeechAI. Tài khoản mới có được tín dụng khởi động miễn phí, vì vậy bạn có thể thử nghiệm Piper miễn phí trước khi ký kết.

Chọn một giọng nói Piper từ thư viện giọng nói, sau đó truyền giọng nói của nó đến điểm cuối /v1/generate/ với token API của bạn. API REST tạo âm thanh và trả lại một URL tải về, và bạn có thể yêu cầu xuất MP3, WAV, hoặc OGG.

Technical Specs

  • Generation Speed Very Fast
  • Output Quality Good
  • Voice Cloning Not Supported
  • Languages 12
  • GPU VRAM 500MB
  • Credits/1000 chars 1

Try Piper TTS Now

Generate your first audio free. No credit card required.

Start Free