Dia

Ultra

Dialoog-georganiseerde TTS met stem kloning en nieverbale klanke

Medium Spoed
Excellent Kwaliteit
Ja Kloning
1 Tale

Aangaande Dia

Dia deur Nari Labs is 'n 168B parameter se dialoog-geëkusde teks-na-sech model. Dit blink voort om natuurlike gespreksrede te genereer met ondersteuning vir nieverbale klanke soos gelag, sug, en hoes. Dia ondersteun multi-preser dialoog geslag en stem kloning van 5-10 sekondes van verwysing klank, wat dit ideaal maak om realistiese gesprekke en karakterstemme te skep.

Sleutelbronne

Dialoog geslag

Genereer natuurlike veel-praat gesprekke met verskillende stemme en herinneming.

Nieverbale klanke

Voeg [lagte] by, [sag], [kwes], (gasps) vir natuurlike paralinguistiese uitdrukking.

Stemvertolking

Kmid enige stem van 5-10 sekondes van verwysing oudio vir persoonlike spraak.

Natuurlike gesprekke

1,6B parameters produseer hoogs natuurlike gespreksprikkelende en intonasie.

Gebruik letterkase

Dialoog en gespreksgeslag Audioboek maak met veelvuldige karakters Speletjie karakter stemme Pêrel - en inhoudsskepping

Hoe om te gebruik Dia

  1. 1

    Teken gratis op of maak die demo nie oop nie

    Create a free TextToSpeechAI account to claim your starter credits, or open the no-signup demo to try Dia dialogue right away.

  2. 2

    Kies die Dia-enjin

    In die TTS paneelbord kies Dia van die enjin lys. Dia is die dialoog-gespreekde, ultra-ter model met veel-prekender en stem-same ondersteuning.

  3. 3

    Skryf 'n dialoog skrip met etiket

    Skryf jou gesprek met [S1] en [S2] om elke luidspreker te merk, en val in nieverbale merkers soos [lag], [sag], [skoene] of (gaspe) waar jy natuurlike reaksies wil hê.

  4. 4

    Genereer die oudio

    Kliek genereer na stuur jou Dia skrip na ons bediener GPUs. Dia gee die twee- praatder dialoog met skakelinbel en jou nieverbal etiket in 'n enkele oudio lêer.

  5. 5

    Laai die API af of bel dit

    Download the finished dialogue in your chosen format, or automate it by posting the same [S1]/[S2] script to the TextToSpeechAI API with your account token.

Dia API

Generate speech programmatically using the TextToSpeechAI REST API.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "Ek doen groot, dankie dat jy gevra het!",
    "voice": "en_US-lessac-medium"
  }'

Vrae wat dikwels gevra word

Dia is 'n 1. 1B parameter dialoog-geënt teks-na-sech model van Nari Labs. Dit spesialiseer in die genereer van natuurlike gesprek spraak met ondersteuning vir veelvuldige sprekers, nieverbale klanke en stemkloning.

Ja, Dia is ten volle Apaches wat deur die Apaches geregistreer is - kode sowel as modelgewigte.

Tans ondersteun Dia net Engels. Die model word vir natuurlike Engelse gespreksredes opgemaak.

Dia requires approximately 10GB of VRAM for its 1.6B parameter model. A GPU with at least 12GB is recommended for comfortable operation. On TextToSpeechAI all of this runs on our hosted GPUs, so you do not need any hardware of your own.

Ja - dialoog is presies waarvoor Dia gebou is. Deur [S1] af te wissel en [S2] draaie in jou skrif te maak, bring Dia TTS 'n vloeiende twee-preser gesprek voort met duidelike stemme en realistiese heraanname, wat moeiliker is om met enkel-prepler TTS-modelle te bereik.

Voorvoegsel elke lyn van jou skrif met [S1] of [S2] om te merk wie praat. Dia gee'n konsekwente stem aan elke etiket en wissel tussen hulle wanneer die gesprek beweeg, en [S2] tree dus op as die twee karakters in jou dialoog.

Ja. Dia ondersteun stemkloning van ongeveer 5-10 sekondes skoon verwysing oudio, wat jou toelaat om 'n spesifieke stem vir' n spreker weer te gebruik. Jy kan kloning kombineer met die [S1]/[S2] etiket sodat elke karakter in 'n dialoog klink soos die stem wat jy gekloon het.

Dia gee [lagte], [sakke], [suts] en (gasps) as natuurlike paralinguistiese klanke wat in die spraak geweef is eerder as woorde wat geuiter word. Plaas 'n etiket waar jy die reaksie wil hê - byvoorbeeld "S1] wat hilaries [lage] is" - om die dialoog meer mens te laat voel.

Dia en Bark ondersteun albei die uitdrukking van die nieverbale klanke, maar Dia is doel gebou vir veel-prekender dialoog met [S1]/ [S2] draai-inbeling en stem kloning. Kies Dia vir realistiese twee-persoon gesprekke en karakterwerk; Bark is beter pas wanneer jy breër taaldekking in enkel-stemoorhaal nodig het.

Dia is 'n ultra-ter masjien, so dit kos 50 krediete per 1 000 karakters van opgehaalde spraak. Die ultravlak weerspieël die groter 1,6B model en die ~10GB van GPU geheue wat dit gebruik vir hoë-knoriteit dialoog.

Yes. New TextToSpeechAI accounts include free starter credits, and there is a demo you can run without signing up. That is enough to generate a short Dia dialogue with [S1]/[S2] tags before deciding on a paid plan.

Yes. Once you have an API token from your account page you can submit Dia dialogue scripts - including [S1]/[S2] turns and tags like [laughs] - to the TextToSpeechAI REST API and download the resulting audio programmatically.

Technical Specs

  • Generation Speed Medium
  • Output Quality Excellent
  • Voice Cloning Supported
  • Languages 1
  • GPU VRAM 10GB
  • Credits/1000 chars 50

Try Dia Now

Generate your first audio free. No credit card required.

Start Free