关于 聊天箱
查特盒是一个开放源码零发语音克隆模型,拥有麻省理工学院许可的代码和重量。 在 TextToSpeechAI 上,它赋予了每个克隆声音权力:上传6至60秒清晰的音频和查特盒复制出以语音克隆页面上任何语言发出的声音,没有培训步骤。
关键特征
零热声音克隆
6至60秒的音频 发出一个声音 不需要训练
双
克隆页面上以15种语言中的任何一个语言发表演讲。
衡量的议长相似性
在我们自己的测试中 查特本箱比我们评估的其他 特许克隆引擎 更贴近了 参考演讲者
商业许可证
代码和模型重量的麻省理工学院执照
使用案例
制作内容的语音克隆
以一个声音多语种叙述
游戏字符声音
个人和品牌的声音
如何使用 聊天箱
-
1
创建一个自由账户
注册 TextToSpeechAI 获得免费启动分数 。
-
2
上传引用剪辑
打开语音克隆页面 上传6到60秒的清晰讲话 来自于你有权克隆的声音
-
3
输入文本和语言
输入要发言的文本和选择15种支持输出语言之一的文本。
-
4
生成演讲
TextToSpeechAI 将我们GPU服务器上的 查特框的克隆语音中的文字转换成文本 。
-
5
下载或使用 API
下载完成的音频, 或通过 TextToSpeechAI REST API 自动生成 。
聊天箱 API AIP AIPI AIP
以TextToSpeechAIREST API 生成有计划的语言。
curl -X POST "https://api.texttospeechai.com/v1/generate/" \
-H "Authorization: Bearer YOUR_API_TOKEN" \
-H "Content-Type: application/json" \
-d '{
"text": "这是我克隆的声音, 由短短的录音录制而成。",
"voice": "en_US-kristin-medium"
}'
常问问题
查特箱是一种开放源码文本到语音模型,它从一个短的参考录音中克隆一个声音,而没有经过任何每段声音训练。 TextToSpeechAI 对所有克隆声音都使用它。
聊天盒代码和模型重量 都根据麻省理工学院的许可证发布
上传6至60秒之间 由一位发言者清晰的演讲。 安静的录音, 没有音乐或背景声音, 最接近的就是匹配。
克隆人可以使用语音克隆页面上列出的15种语言:英语、西班牙语、法语、德语、意大利语、葡萄牙语、波兰语、俄语、荷兰语、土耳其语、日语、韩语、中文、阿拉伯语和印地语。 参考短片可以使用与您所生成的文本不同的语言。
克隆的演讲会通过我们的 GPU 服务器,通常需要大约一分钟的时间过短一段,因为参考声音会为每一代人再次处理。更长的文本需要更长的时间。
创建克隆声音是自由的。 生成语音时,每个字符都像其他任何声音一样被收用,而新账户则获得免费的启动积分来尝试。
Yes. Create a cloned voice through the REST API at api.texttospeechai.com with your account token, then reference it in your generation requests.
Technical Specs
- Generation Speed Moderate
- Output Quality Very Good
- Voice Cloning Supported
- Languages 15
- GPU VRAM 4-8GB
- Credits/1000 chars 5