Medium Sür'ət
Excellent Keyfiyyət
Bəli _Klonla
1 Dillər

Bağlan _Gün

ing the most accurate text-to-speech results for the most complex texts. Dia is a 1.6B parameter text-to-speech model that is designed to generate natural conversational speech with support for nonverbal sounds like laughter, sighs, and coughs. It excels at generating the most accurate text-to-speech results for the most complex texts. Dia is a 1.6B parameter text-to-speech model that is designed for the most complex texts.

Xüsusiyyətlər

Dialog yaradıldı

Təbii çoxlu-söhbətçi söhbətlərini fərqli səslərlə və dönmə ilə yarada bilərsiniz.

Sözsüz səslər

Təbii paralingvistik ifadələr üçün [laughs], [sighs], [coughs], (gasps) əlavə edin.

Səs Klonlama

Özəl səsləmə üçün 5-10 saniyəlik istinad səsindən hər hansı bir səsi klonla.

Təbii söhbət

1.6B parametrləri çox təbii söhbət prosodiya və intonasiya istehsal edir.

İstifadəçi

Dialoq və söhbət yaradılması Bir çox xarakterli audiokitab istehsalı Oyun personaj səsləri Podcast və məzmun yaratma

İstifadəsi _Gün

  1. 1

    Pulsuz qeyd olun ya da demo aç

    Başlanğıc kreditlərinizi tələb etmək üçün pulsuz TextToSpeechAI hesabını yarada bilərsiniz, ya da Dia dialogunu dərhal sınamaq üçün qeydiyyatsız demonu açın.

  2. 2

    Dia motorunu seç

    TTS panelində motor siyahısından Dia seçin. Dia çoxlu səsləndirici və səs klonlaşdırma dəstəyi ilə dialoq-oriented, ultra-tier modeldir.

  3. 3

    Etiketlərlə dialoq skriptini yazın

    Hər bir danışan dönəmində [S1] və [S2] istifadə edərək söhbətinizi tərtib edin və [laughs], [sighs], [coughs] və ya (gasps) kimi sözsüz təyinatları təbii reaksiya istədiyiniz yerlərə atın.

  4. 4

    Audionu yarat

    Dia skriptinizi host GPU-lara göndərmək üçün yaratma düyməsini basın. Dia iki səsli dialoqu və sizin sözsüz mətn etiketlərinizi tək səs faylı halında göstərəcəkdir.

  5. 5

    API-ni yüklə və ya çağır

    Son dialogu seçdiyiniz formatda yüklə, ya da hesabınızdakı tokenlə eyni [S1]/[S2] skriptini TextToSpeechAI API-yə göndərərək avtomatlaşdırın.

_Gün API

TextToSpeechAI REST API-ni istifadə edərək proqramlaşdırılmış səsi yarada bilərsiniz.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "Salam! Bu gün necəsiniz? [gülür] [S2] Mən yaxşıyam, soruşduğunuz üçün təşəkkür edirəm!",
    "voice": "en_US-lessac-medium"
  }'

Tez-tez Sorulan Sual

Dia Nari Labs-dan 1.6B parametrli dialog-oriented mətn-dən-söhbətə modeldir. Bir çox səsləndirici, sözsüz səslər və səs klonlaşdırması dəstəklənən təbii söhbət səsi yaratmaq üçün ixtisaslaşmışdır.

Bəli, Dia Apache 2.0 lisenziyasına tam uyğundur - həm kod, həm də model ağırlığı. Ticari tətbiqlərdə azad istifadə edilə bilər.

Dia hazırda yalnız İngilis dilini dəstəkləyir. Model təbii İngilis danışıq dili üçün optimallaşdırılmışdır.

Dia 1.6B parametr modeli üçün təxminən 10GB VRAM tələb edir. Ən azı 12GB GPU rahat işləmə üçün tövsiyə olunur. TextToSpeechAI-də bütün bunlar bizim hosted GPU-larda işləyir, buna görə də öz hardware'inizə ehtiyacınız yoxdur.

Bəli - Dia-nın dialogu elə Dia-nın yaradılması üçündür. Dia skriptinizdə [S1] və [S2] dönmələrini əvəzlədikdə, Dia TTS tək-oxuma TTS modelləri ilə əldə etmək çətin olan fərqli səslər və real dönmə ilə iki-oxuma söhbətini yaradır.

Skriptinizin hər sətirinə danışan şəxsi göstərmək üçün [S1] və ya [S2] prefiksi əlavə edin. Dia hər təqvim daşıyıcısına uyğun səs ayırır və söhbət gedişində onların arasında keçid edir, buna görə də [S1] və [S2] dialoqunuzda iki xarakter kimi davranır.

Bəli. Dia təxminən 5-10 saniyəlik təmiz istinad səsindən səs klonlaşdırmasını dəstəkləyir, bu da sizə səsləndirici üçün xüsusi səsi yenidən istifadə etməyə imkan verir. Siz klonlaşdırmanı [S1]/[S2] təqvimləri ilə birləşdirə bilərsiniz ki, bu zaman dialoqdakı hər bir xarakter klonlaşdırdığınız səs kimi səslənsin.

Dia [gülür], [sümük salır], [kökürək] və (qaşıntı) səslərini danışılmış sözlər deyil, təbiət paralingvistik səsləri kimi təqdim edir. Dialoqun daha insani görünməsi üçün reaksiyanı istədiyiniz yerə bir təqvim qoy - məsələn "[S1] Bu gülməlidir [gülür]".

Dia və Bark sözsüz səsləri dəstəkləyir, lakin Dia [S1]/[S2] ardınca gəlmə və səs klonlama ilə çoxlu-söhbətçi dialoqu üçün xüsusi hazırlanmışdır. İki nəfər arasında real söhbətlər və personaj işləri üçün Dia'yı seçin; Bark tək səsli danışıqda geniş dil əhatəliliyinə ehtiyacınız olduğunda daha yaxşı uyğun gəlir.

Dia ultra-tərkibli mühərrikdir, buna görə də 1000 karakterlik səsin 50 krediti xərclənir. Ultra-tərkibli mühərrik daha böyük 1.6B modeli və yüksək keyfiyyətli dialoq üçün istifadə etdiyi ~10GB GPU yaddaşını əks etdirir.

Bəli. Yeni TextToSpeechAI hesabları pulsuz kreditlər daxil edir və qeydiyyatdan keçmədən istifadə edə biləcəyiniz demo var. Bu, ödənişli planı seçmədən əvvəl [S1]/[S2] etiketləri ilə qısa Dia dialoqu yaratmaq üçün kifayətdir.

Bəli. Hesabınızdakı səhifədən API token-i əldə etdikdən sonra Dia dialog skriptini - [S1]/[S2] dönmə və [laughs] kimi etiketlər daxil olmaqla - TextToSpeechAI REST API-yə təqdim edə və nəticədə səsi proqramlaşdırılmış şəkildə yükləyə bilərsiniz.

Technical Specs

  • Generation Speed Medium
  • Output Quality Excellent
  • Voice Cloning Supported
  • Languages 1
  • GPU VRAM 10GB
  • Credits/1000 chars 50

Try _Gün Now

Generate your first audio free. No credit card required.

Start Free