के बारे में सारांश
नीब द्वारा डियाडिया पैरामीटर संवाद से बातचीत की जा रही है. यह गैर-टंबिक ध्वनि के लिए समर्थन के साथ प्राकृतिक बातचीत, आह, और statcs. procuts. source बहु-10 सेकंड का समर्थन करता है और ऑडियो के ५-10 सेकंड से आवाज, यह यथार्थवादी चरित्र और बातचीत के लिए आदर्श बनाने के लिए किया जाता है.
कुंजी विशेषताएँ
संवाद बनाने का कार्य
ध्वनि तथा बारी-बार- बार बातचीत प्रारंभ करने में स्वाभाविक बहु- संवाद उत्पन्न करें.
अ- धातु ध्वनि
[हंसता ह जोड़ें, [साफ्स], [साफ्स] स्वाभाविक भाव के लिए ।
आवाज कोलोन
व्यक्तिगत बोलने के लिए संदर्भ के 5-10 सेकंड से किसी भी आवाज को नक़ल करें.
स्वाभाविक वार्तालाप
इससे पता चलता है कि आप दोनों को क्या करना चाहिए ।
केस इस्तेमाल करें
कैसे इस्तेमाल करें सारांश
-
1
स्वतंत्र या डेमो को खोलने के लिए हस्ताक्षर करें
अपने प्रारंभ श्रेय का दावा करने के लिए एक मुफ्त TextToSpeechAI खाता बनाएँ, या कोई साइनेक्टिक डेमो खोलने के लिए सही दूर से कोशिश करने के लिए.
-
2
जाँच इंजिन चुनें
TTS tTS taoबोर्ड द्वारा seama चयन इंजन सूची में. जाँच संवाद की संभावना है, stat-tatery-t-tainyy-t-tain मॉडल बहु-Ser और आवाजिंग समर्थन के साथ scing मॉडल है.
-
3
टैग के साथ संवाद स्क्रिप्ट लिखें
[S1] और [S2] प्रत्येक स्पीकर बारी, और जैसे अविष्ट टैग में छोड़ दें, [कोल, [गास], या (गा) जहां आप प्राकृतिक प्रतिक्रिया चाहते हैं वहाँ अपनी बातचीत बनाएं।
-
4
ऑडियो बनाएँ
हमारे होस्ट जीपीएस को आपकी जाँच के लिए क्लिक करें. जाँच करें कि दो- बिन्दुओं को बदलने के लिए और आपके गैर-रिट्राप टैग को एक एकल ऑडियो फ़ाइल में भेज रहे हैं.
-
5
डाउनलोड या काल एपीआई
आपके चुने हुए फॉर्मेट में संपूर्ण संवाद डाउनलोड करें, या एक ही [S1] पोस्ट के द्वारा स्वचालित रूप से इस स्क्रिप्ट को स्वचालित लोड करें आपके खाते के हिसाब से TextToSpeechAI000 एपीआई में.
सारांश एपीआई
TextToSpeechAI पुनर्गित्ट का प्रयोग करके भाषण प्रोग्राम प्रोग्रेड प्रोज़ेक्टिव उत्पन्न करें.
curl -X POST "https://api.texttospeechai.com/v1/generate/" \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"text": "[S1] वहाँ नमस्कार! तुम आज कैसे हो? [हंसता ह [S2] मैं बहुत कर रहा हूँ, के लिए धन्यवाद!",
"voice": "en_US-lessac-medium"
}'
बार बार पूछे जाने वाले प्रश्न
Technical Specs
- Generation Speed Medium
- Output Quality Excellent
- Voice Cloning Supported
- Languages 1
- GPU VRAM 10GB
- Credits/1000 chars 50