Chatterbox

Premium

Cơ chế sao chép giọng nói sau giọng nói sao chép TextToSpeechAI

Moderate Tốc độ
Very Good Chất lượng
Có chứ. Bản sao
15 Ngôn ngữ

Về Chatterbox

Chatterbox is an open-source, zero-shot voice cloning model with MIT licensed code and weights. On TextToSpeechAI it powers every cloned voice: upload 6 to 60 seconds of clear audio and Chatterbox reproduces that voice in any of the languages listed on the voice cloning page, with no training step.

Tính năng chính

Kiểu giọng Zero- Shot

Copy a voice from 6 to 60 seconds of audio. No training run needed.

Cross- Language

Clone from a English sample và tạo ra lời nói trong bất kỳ 15 ngôn ngữ nào trên trang clone.

Kiểu

Trong các thử nghiệm của chúng tôi, Chatterbox phù hợp với người nói tham chiếu gần hơn so với các động cơ nhân bản khác được cấp phép mà chúng tôi đánh giá.

Giấy phép thương mại

Giấy phép MIT cho cả mã và trọng lượng mô hình.

Tình huống sử dụng

Bản sao giọng nói để tạo nội dung Trình kể chuyện đa ngôn ngữ bằng một giọng nói Giọng nói nhân vật cho trò chơi Giọng nói cá nhân và thương hiệu

Cách sử dụng Chatterbox

  1. 1

    Tạo tài khoản miễn phí

    Đăng ký cho TextToSpeechAI để nhận tiền thưởng miễn phí.

  2. 2

    Tải lên đoạn phim tham chiếu

    Mở trang nhân bản giọng nói và tải lên 6 đến 60 giây lời nói rõ ràng từ giọng nói mà bạn có quyền nhân bản.

  3. 3

    Nhập văn bản và ngôn ngữ

    Nhập văn bản để nói và chọn một trong 15 ngôn ngữ xuất được hỗ trợ.

  4. 4

    Tạo lời nói

    TextToSpeechAI tạo ra văn bản trong giọng nói nhân bản với Chatterbox trên máy chủ GPU của chúng tôi.

  5. 5

    Tải xuống hoặc sử dụng API

    Tải về âm thanh hoàn thành, hoặc tự động tạo thông qua TextToSpeechAI REST API.

Chatterbox API

Tạo lời nói bằng cách lập trình sử dụng TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "Đây là giọng nói nhân bản của tôi, được tạo ra từ một đoạn ghi âm ngắn.",
    "voice": "en_US-kristin-medium"
  }'

Câu hỏi thường gặp

Chatterbox là một mô hình text-to-speech nguồn mở mà nhân bản một giọng nói từ một ghi chú tham khảo ngắn mà không cần đào tạo giọng nói. TextToSpeechAI sử dụng nó cho mỗi giọng nói nhân bản.

Có, cả mã Chatterbox và các mô hình cân nặng đều được phát hành theo giấy phép MIT. Bạn vẫn cần quyền sử dụng giọng nói mà bạn sao chép.

Tải lên từ 6 đến 60 giây lời nói rõ ràng từ một người nói duy nhất. Một bản ghi tĩnh không có nhạc hay tiếng nói nền sẽ cho kết quả tương tự nhất.

Một giọng nói nhân bản có thể nói 15 ngôn ngữ được liệt kê trên trang nhân bản giọng nói: tiếng Anh, tiếng Tây Ban Nha, tiếng Pháp, tiếng Đức, tiếng Ý, tiếng Bồ Đào Nha, tiếng Ba Lan, tiếng Nga, tiếng Hà Lan, tiếng Thổ Nhĩ Kỳ, tiếng Nhật, tiếng Hàn, tiếng Trung, tiếng Ả Rập và tiếng Hindi. Clip tham chiếu có thể là một ngôn ngữ khác với văn bản bạn tạo ra.

Lời nói nhân bản được hiển thị trên máy chủ GPU của chúng tôi và thường mất khoảng một phút cho một đoạn ngắn, vì giọng nói tham chiếu được xử lý lại cho mỗi thế hệ. Văn bản dài hơn thì mất nhiều thời gian hơn.

Tạo một giọng nói nhân bản là miễn phí. Tạo giọng nói với nó được tính theo từng ký tự, như bất kỳ giọng nói nào khác, và tài khoản mới nhận được tín dụng khởi đầu miễn phí để thử nó.

Tạo một giọng nói nhân bản thông qua API REST tại api.texttospeechai.com với token tài khoản của bạn, sau đó tham khảo nó trong yêu cầu tạo ra.

Technical Specs

  • Generation Speed Moderate
  • Output Quality Very Good
  • Voice Cloning Supported
  • Languages 15
  • GPU VRAM 4-8GB
  • Credits/1000 chars 5

Try Chatterbox Now

Generate your first audio free. No credit card required.

Start Free