TTS 2 tarzı

Ultra

İnsan seviyesindeki metin- konuşmaya biçim aktarımıName

Moderate Hız
Excellent Kalite
Hayır. Klonlama
1 Dilleri

Hakkında TTS 2 tarzı

StyleTTS 2 achieves human-level text-to-speech synthesis through style diffusion and adversarial training. It generates highly natural speech that rivals real human recordings. StyleTTS 2 represents the state-of-the-art in TTS quality and naturalness.

Ana Özellikler

İnsan seviyesi kalitesi

Kör testlerde insan kayıtlarından ayırt edilemeyen bir konuşma üretir.

İfadeci Tarz

Modellerin konuşma tarzı, mesajın doğal olarak farklılaşmasını sağlar.

Doğal Prozodi

Mükemmel ritim, stres ve intonasyon yayılma-tabanlı modelleme ile.

Stüdyo Sesleri

Ses kütüphanesinde hazır StyleTTS 2 seslerinden seç.

Hızlı Sonuç

Kaliteyi korurken oto-regresif modellerden daha hızlı.

Açık kaynak

MIT lisansı ile tam ticari kullanım hakları.

Kullanım durumları

Premium Sesli Kitaplar Profesyonel Seslendirmeler Film ve TV Yapımcılığı Yüksek kaliteli reklamcılık Podcast Yapımcılığı Seslendirme

TTS 2 tarzı Voices

View All 6
StyleTTS2 Default
EN
StyleTTS2 Expressive
EN
StyleTTS2 Fast
EN
StyleTTS2 Natural
EN
StyleTTS2 Neutral
EN
StyleTTS2 Quality
EN

Nasıl Kullanılır TTS 2 tarzı

  1. 1

    Ücretsiz kayıt olun

    Başlangıç kredisi almak için ücretsiz bir TextToSpeechAI hesabı oluşturun.

  2. 2

    StyleTTS2 motorunu seçin

    Ses kütüphanesinden StyleTTS2 ses seç.

  3. 3

    Metininizi girin

    Konuşturulmasını istediğiniz senaryoyu yazın veya yapıştırın. StyleTTS2 İngilizcede üstündür ve uzun bölümlerde doğal bir ses tonu, vurgu ve intonasyon sağlar.

  4. 4

    Ses oluştur

    Üreteceğe tıklayın ve TextToSpeechAI StyleTTS2 sesinizi GPU'da gösterecektir. Ultra-tier StyleTTS2 1000 karakter başına 50 krediye mal olur.

  5. 5

    API'yi indirin veya kullanın

    Bittiğinde StyleTTS2 ses MP3, WAV veya OGG olarak indirin veya üretimi otomatikleştirmek için StyleTTS2 sesinizle TextToSpeechAI API'yi arayınız.

TTS 2 tarzı API

TextToSpeechAI REST API'sini kullanarak programlı olarak konuşma oluşturun.

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "StyleTTS 2 konuşmayı o kadar doğal üretir ki profesyonel insan kayıtlarına rakip olur.",
    "voice": "styletts2-default"
  }'

Sık Sorulan Sorular

StyleTTS2, insan seviyesindeki konuşma sentezini sağlayan son teknolojili bir metin-sözlüğe modeldir. Kör dinleme testlerinde gerçek insan kayıtlarından neredeyse ayırt edilemeyen bir konuşma üretmek için stil yayılım ve karşıt eğitim kullanır. StyleTTS2'yi TextToSpeechAI'de ücretsiz olarak deneyebilirsiniz.

StyleTTS2, TextToSpeechAI üzerinde mevcut en yüksek kaliteli TTS seslerini üretir. Resmi değerlendirmelerde, MOS (Ortalama İzleme Puanı) testlerinde insan seviyesine ulaşmış, dinleyicilerin çoğunlukla gerçek bir insan konuşmacısından ayırt edemediği bir değere ulaşmıştır. Bu nedenle Tortoise ile birlikte Ultra katmanımızda yer almaktadır.

TextToSpeechAI üzerinde değil. Buradaki StyleTTS2 sesleri kütüphaneden hazır seslerdir. Ses klonlaması için, Chatterbox'u çalıştıran Klon Ses aracı kullanın.

Evet. StyleTTS2, telif ücreti ödemeden ticari kullanıma izin veren MIT lisansı altında yayınlandı. Bu da sesli kitaplar, reklamlar, filmler ve hakların önem taşıdığı diğer profesyonel StyleTTS2 projeleri için güvenli hale getiriyor.

StyleTTS2 öncelikle İngilizce' yi destekler, çünkü model İngilizce veri kümeleri üzerinde eğitildi. Diğer dillerde, Piper veya Bark sesleri veya klonlanmış bir ses kullanın.

StyleTTS2 ortalama bir üretim hızına sahiptir. Tortoise gibi autoregressive modellerden çok daha hızlıdır ama Piper gibi hafif motorlardan daha yavaştır. Üst kalitesi ve hesaplama maliyeti nedeniyle, StyleTTS2 gerçek zamanlı bir model olarak değil Ultra katmanımızda fiyatlandırılır.

StyleTTS2, çıkarım için yaklaşık 4-6GB VRAM gerektirir. Bark veya Tortoise'dan daha fazla bellek kullanır ve daha yüksek kaliteli bir çıkış sağlar. TextToSpeechAI'de tüm StyleTTS2 işlemleri GPU'larımızda çalışır, bu yüzden kendi donanımınıza ihtiyacınız yoktur.

StyleTTS2 Ultra-tier modelidir ve TextToSpeechAI üzerinde 1000 karakter başına 50 krediye mal olur. Bu premium fiyatlandırma insan seviyesi kalitesini ve GPU kaynaklarını yansıtır. Karşılaştırma için, VITS gibi standart modellerin 1000 karakter başına 10 krediye mal olması ve Piper'in 1000 karakter başına 1 krediye mal olması gerekir.

Her ikisi de Ultra seviye (1000 karakter başına 50 kredi) ve İngilizce. StyleTTS2 çok daha hızlı, Tortoise ise uzun bölümlerde biraz daha doğal ses çıkarabilir. Birçok klipe ihtiyacınız olduğunda StyleTTS2'yi, zaman kısıtlaması olmadığında Tortoise'yi seçin.

StyleTTS2 24kHz' de yüksek kaliteli ses üretir. TextToSpeechAI aracılığıyla sonuçları MP3, WAV veya OGG olarak indirebilirsiniz ve StyleTTS2' nin harika kalitesi son dosyada korunması için yüksek kaliteli kodlama kullanıyoruz.

StyleTTS2 konuşma hızı ayarlarını destekliyor ve kütüphanedeki her ses kendi sunumunu yapıyor, bu yüzden farklı bir ses seçmek prozodiyi değiştiriyor.

Kütüphanemizden bir StyleTTS2 sesi seçin, sonra API taleplerinde bu sesi referans edin. TextToSpeechAI tüm GPU işlemlerini yönetir ve premium StyleTTS2 sesinizle bir indirme URL'si geri döndürür.

Technical Specs

  • Generation Speed Moderate
  • Output Quality Excellent
  • Voice Cloning Not Supported
  • Languages 1
  • GPU VRAM 4-6GB
  • Credits/1000 chars 50

Try TTS 2 tarzı Now

Generate your first audio free. No credit card required.

Start Free