情報 ヴィーツ
-efficient, and highly-efficient TTS model that generates natural-sounding speech. It combines variational autoencoders with adversarial learning for
主要な特徴
ファストシンセシス
音声生成のためのエンドツーエンドアーキテクチャを提案した。
バッチ処理
複数のテキストを効率的に同時に処理する。
自然言語
VAE+GAN訓練は自然な韻律とリズムを生み出す。
マルチスピーカー
単一モデルは複数のスピーカ音声をサポートする。
効率的
低メモリフリットリンクと良い性能を持つ。
オープンソース
MITのライセンスを どんなユースケースでも
ユースケース
ヴィーツ Voices
View All 109LJSpeech (English Female)
ENVCTK Speaker 225 (English Female)
ENVCTK Speaker 226 (English Male)
ENVCTK Speaker 227 (English Male)
ENVCTK Speaker 228 (English Female)
ENVCTK Speaker 229
ENVCTK Speaker 230
ENVCTK Speaker 231
ENVCTK Speaker 232
ENVCTK Speaker 233
ENVCTK Speaker 234
ENVCTK Speaker 236
EN使い方 ヴィーツ
-
1
無料で登録するか、デモを試してみてください。
無料のTextToSpeechAIアカウントを作成してスタートクレジットを得るか、登録する前にVITSを聴くためにページ上のデモを使用する。
-
2
VITS 音声またはスピーカーを選択
音声ライブラリをブラウズし、VITS バードでマークされた音声を選択します。VCTK スピーカーセットを含むマルチスピーカー VITS ライブラリでは、多くの異なる音声から選択できます。
-
3
テキストを入力
話すテキストをエディタに入力または貼り付けます。VITS は長い文章を扱いやすく、バッチや大容量のコンテンツに適しています。
-
4
音声を生成
VITS で音声合成を行うには、 生成をクリックしてください。VITS は非常に速く、標準的なレベル (1000 文字あたり 10 クレジット) で、結果は低コストで迅速に返されます。
-
5
API をダウンロードまたは使用
音声をMP3、WAV、OGGとしてダウンロードするか、TextToSpeechAI REST APIを通して同じVITS音声を呼び出し、自分のアプリケーションで自動生成する。
ヴィーツ API
Generate speech programmatically using the TextToSpeechAI REST API.
curl -X POST "https://api.texttospeechai.com/v1/generate/" \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"text": "VITSは,高容量アプリケーションに対して,高速で自然な音声を提供する。",
"voice": "vits-ljspeech"
}'
よくある質問
Technical Specs
- Generation Speed Very Fast
- Output Quality Good
- Voice Cloning Not Supported
- Languages 10
- GPU VRAM 1-2GB
- Credits/1000 chars 10