Dia
UltraTTS προσανατολισμένη στο διάλογο με κλωνοποίηση φωνής και μη λεκτική ήχους
Σχετικά Dia
Dia από Nari Labs είναι ένα 1.6B παράμετρος διαλόγου-εστιασμένο κείμενο σε-ομιλία μοντέλο. Υπερέχει στη δημιουργία φυσικών συνομιλίας ομιλία με υποστήριξη για μη λεκτική ήχους όπως γέλιο, αναστεναγμοί, και βήχας. Dia υποστηρίζει πολύ-ηχεία γενιά διαλόγου και φωνή κλωνοποίησης από 5-10 δευτερόλεπτα του ήχου αναφοράς, καθιστώντας το ιδανικό για τη δημιουργία ρεαλιστικών συνομιλιών και φωνές χαρακτήρα.
Βασικά χαρακτηριστικά
Γενιά διαλόγου
Δημιουργήστε φυσικές πολυ-συνομιλίες με διακριτές φωνές και γυρίσματα-κόλλημα.
Μη Διαβόλους Ήχοι
Προσθέστε [γέλια], [αναστενάζει], [βήχας], (λαχανιάζει) για φυσική παράγλωσση έκφραση.
Κλωνοποίηση φωνής
Κλώνε οποιαδήποτε φωνή από 5-10 δευτερόλεπτα ήχου αναφοράς για εξατομικευμένη ομιλία.
Φυσική Συνομιλία
1.6B παράμετροι παράγουν εξαιρετικά φυσική συνομιλία προσθετικότητα και τονισμό.
Περιπτώσεις χρήσης
Πώς να χρησιμοποιήσετε το φάρμακο Dia
-
1
Εγγραφείτε δωρεάν ή ανοίξτε το demo
Δημιουργήστε ένα δωρεάν λογαριασμό TextToSpeechAI για να διεκδικήσετε τις πιστώσεις εκκίνησης σας, ή ανοίξτε το demo χωρίς υπογραφή για να δοκιμάσετε το Dia διάλογο αμέσως.
-
2
Επιλέξτε τον κινητήρα Dia
Στο ταμπλό TTS επιλέξτε Dia από τη λίστα μηχανών. Dia είναι το προσανατολισμένο στο διάλογο, εξαιρετικά-tier μοντέλο με πολυ-επεξεργαστή και φωνητική υποστήριξη.
-
3
Γράψτε ένα σενάριο διαλόγου με ετικέτες
Συγκρίνετε τη συζήτησή σας χρησιμοποιώντας [S1] και [S2] για να σημειώσετε κάθε ομιλητής γυρίστε, και ρίξτε σε μη λεκτική ετικέτες όπως [γέλια], [αναστενάζει], [βήχας], ή (λαχανιάζει) όπου θέλετε φυσικές αντιδράσεις.
-
4
Δημιουργία ήχου
Κάντε κλικ για να στείλετε το σενάριο Dia σας σε μας φιλοξενεί GPUs. Dia καθιστά το διάλογο δύο ηχείων με τη λήψη στροφής και μη λεκτική ετικέτες σας σε ένα ενιαίο αρχείο ήχου.
-
5
Κατεβάστε ή καλέστε το API
Κατεβάστε το τελικό διάλογο στην επιλεγμένη μορφή σας, ή αυτοματοποιήστε το με την ανάρτηση του ίδιου [S1]/[S2] σεναρίου στο TextToSpeechAI API με το σήμα λογαριασμού σας.
Dia API
Δημιουργήστε ομιλία προγραμματικά χρησιμοποιώντας το TextToSpeechAI REST API.
curl -X POST "https://api.texttospeechai.com/v1/generate/" \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"text": "Γεια σας, πώς είστε σήμερα\u003B",
"voice": "en_US-lessac-medium"
}'
Συχνές Ερωτήσεις
Technical Specs
- Generation Speed Medium
- Output Quality Excellent
- Voice Cloning Supported
- Languages 1
- GPU VRAM 10GB
- Credits/1000 chars 50