ගැන එයා
ing the most accurate text-to-speech results. Dia is the first text-to-speech model to use the 1.6B parameter text-to-speech model, which is based on the 1.6B parameter text-to-speech model. Dia is the first text-to-speech model to use the 1.6B parameter text-to-speech model, which is based on the 1.6B parameter text-to-speech model.
ප්රධාන විශේෂාංග
සංවාද ජනනය
ස්වභාවික බහු-කථික සංවාදයන් වෙන් වූ හඬ සහ ආපසු ගැනීම් සමග ජනනය කරන්න.
වචන රහිත ශබ්ද
ස්වභාවික paralinguistic ප්රකාශය සඳහා [සිනහව], [සිනා], [කහවණු], (gasps) එකතු කරන්න.
හඬ ක්ලෝන කිරීම
පෞද්ගලික කථාව සඳහා උපුටා ශ්රව්ය තත්පර 5-10 සිට ඕනෑම හඬක් ක්ලෝන.
ස්වභාවික සංවාදය
1.6B පරාමිති ඉතා ස්වාභාවික සංවාදය prosody හා intonation නිෂ්පාදනය.
භාවිතය
භාවිතා කරන ආකාරය එයා
-
1
නොමිලේ ලියාපදිංචි වන්න හෝ දර්ශන විවෘත කරන්න
ඔබේ ආරම්භක ණය ඉල්ලා නොමිලේ TextToSpeechAI ගිණුමක් නිර්මාණය කරන්න, හෝ ඩය සංවාදය ඉක්මනින් උත්සාහ කිරීමට කිසිදු ලියාපදිංචිය ෙඩමෝ විවෘත.
-
2
Dia එන්ජිම තෝරන්න
TTS දෘෂ්ටි කෝණයෙන් එන්ජිම ලැයිස්තුව සිට Dia තෝරා. Dia සංවාදය-මුල් කරගත්, බහු-කථික සහ හඬ-ක්ලෝන සහාය සමග අති-ස්ථර ආකෘතිය වේ.
-
3
ටැග සහිත සංවාද ස්ක්රිප්ටයක් ලියන්න
එක් එක් කථිකයා වටය සලකුණු කිරීමට [S1] සහ [S2] භාවිතා ඔබේ සංවාදය රචනා, හා එවැනි nonverbal tags වැටීම [හිනාවෙනවා], [සිනා], [කහපාට], හෝ (gasps) ඔබ ස්වභාවික ප්රතිචාර අවශ්ය තැන.
-
4
ශ්රව්යය ජනනය කරන්න
අපගේ සත්කාරක GPUs වෙත ඔබේ Dia ස්ක්රිප්ට් යැවීමට ජනනය ක්ලික් කරන්න. Dia තනි ශබ්ද ගොනුවක් බවට ආපසු ගැනීම සහ ඔබේ වචනයෙන් තොර ටැග් සමඟ දෙදෙනෙකුගේ කථානායක සංවාදය ඉදිරිපත් කරයි.
-
5
API බාගත හෝ ඇමතුම්
ඔබගේ තේරීම් ආකෘතිය අවසන් සංවාදය බාගත, හෝ එම [S1] / [S2] TextToSpeechAI API සඳහා ස්ක්රිප්ට් ඔබගේ ගිණුම ටෝකන් සමග පල කිරීමෙන් එය ස්වයංක්රීය.
එයා API
TextToSpeechAI REST API භාවිතා කරමින් වැඩසටහන්ගතව කථාව ජනනය කරන්න.
curl -X POST "https://api.texttospeechai.com/v1/generate/" \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"text": "[S1] ආයුබෝවන්! අද ඔයාට කොහොමද? [සිනහ] [S2] මම හොඳින් කරනවා, ඇසූ ස්තුතියි!",
"voice": "en_US-lessac-medium"
}'
නිතර අසන ප්රශ්න
Technical Specs
- Generation Speed Medium
- Output Quality Excellent
- Voice Cloning Supported
- Languages 1
- GPU VRAM 10GB
- Credits/1000 chars 50