در مورد بازنویسی
of the voice and apply it to the speaking style. OpenVoice is a powerful voice clone model that allows you to clone voices from a
ویژگیهای کلیدی
شبیهسازی فوری
هر صدایی را از چند ثانیه صدا کپی کنید.
کنترل صدا
غم، خشم، غمگینی، غمگینی.
انتقال سبک
این روش از روشهای جداسازی صدا برای رمزگذاری است.
زبانشناسی
از صداهای کلون شده در زبانهای مختلف استفاده کنید.
پردازش سریع
این روش برای تولید سریع صدا مناسب است.
منبع باز
این نرمافزار برای کاربردهای تجاری طراحی شدهاست.
موارد استفاده
چطور استفاده شود بازنویسی
-
1
ثبت نام رایگان یا آزمایش نمایش
Create a free TextToSpeechAI account to get starter credits, or use the on-page demo to hear OpenVoice before committing. No local GPU or install is needed - everything runs on our servers.
-
2
OpenVoice را انتخاب کنید و یک کلیپ مرجع را بارگذاری کنید
موتور OpenVoice را انتخاب کنید ، سپس چند ثانیه از صدای مرجع تمیز را برای شبیهسازی فوری صدای هدف بارگذاری کنید. OpenVoice هویت سخنران را ضبط میکند ، بنابراین میتوانید آن را در هر متن و صدای دیگر استفاده کنید.
-
3
وارد کردن متن
متنی را که میخواهید در صدای شبیهسازی شده خوانده شود را تایپ یا چسب دهید. OpenVoice از حدود ۱۰ زبان و ارائهٔ زبانهای مختلف پشتیبانی میکند، بنابراین میتوانید به زبان دیگری نسبت به کلیپ مرجع بنویسید.
-
4
انتخاب سبک و تولید
یکی از نه سبک صدای OpenVoice را انتخاب کنید — پیشفرض ، دوستانه ، شاد ، هیجانزده ، غمگین ، عصبانی ، ترسیده ، فریاد زدن یا زمزمه کردن — سپس تولید کنید. همان صدای شبیه سازی شده با آن انتقال احساسی صحبت خواهد کرد.
-
5
دانلود یا استفاده از API
صدای خود را به صورت MP3، WAV یا OGG دانلود کنید یا با گذراندن صدای شبیه سازی شده و سبک صدا در هر درخواست، تولید خودکار را از طریق API TextToSpeechAI انجام دهید.
بازنویسی API
این برنامه با استفاده از TextToSpeechAI REST API تولید میشود.
curl -X POST "https://api.texttospeechai.com/v1/generate/" \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"text": "این صدا میتواند با هر صدایی مانند شاد، غمگین یا حتی زمزمه صحبت کند.",
"voice": "en_US-lessac-medium"
}'
پرسشهای متداول
Technical Specs
- Generation Speed Moderate
- Output Quality Very Good
- Voice Cloning Supported
- Languages 10
- GPU VRAM 3-6GB
- Credits/1000 chars 50