เสียงของปลาหมึกName

Ultra

เสียงพูดคุณภาพสูงสุด ด้วยความเป็นธรรมชาติที่ไม่เหมือนใคร

Very Slow ความเร็ว
Exceptional คุณภาพ
ไม่มี กำลังสร้างคอลลิน
1 ภาษา

เกี่ยวกับ เสียงของปลาหมึกName

s available. Tortoise TTS is the only TTS model that uses the

ตัวเลือกหลัก

คุณภาพสูงสุด

เสียงที่ออกมาจาก TTS ที่มีคุณภาพสูงที่สุด

เสียงอักขระ

เลือกจากเสียงของ Tortoise ที่ทำไว้แล้วในไลบรารีเสียง

เสียงธรรมชาติKCharselect unicode block name

เก็บรูปแบบการพูดที่ละเอียดอ่อน และแสดงออกเล็กๆ

ปรับความเร็วการแสดงผล

แสดงด้วยการตั้งค่าความเร็ว ดังนั้นคลิปจึงจบลงในเวลาที่เหมาะสม

ความลึกของอารมณ์

สร้างเสียงพูด ด้วยอารมณ์ที่แท้จริง

โอเพนซอร์ส

ใบอนุญาต Apache 2.0 กับสิทธิ์การใช้งานเชิงพาณิชย์

กรณีการใช้

หนังสือเสียง Premium การผลิตภาพยนตร์ คำบรรยายภาพยนตร์เอกสาร เสียงพูดของผู้เชี่ยวชาญ โครงการแฟ้มสำรองข้อมูล เนื้อหาระดับสูง

เสียงของปลาหมึกName Voices

View All 18
Tortoise Angie
EN
Tortoise Deniro
EN
Tortoise Freeman
EN
Tortoise Geralt
EN
Tortoise Halle
EN
Tortoise Jlaw
EN
Tortoise Lj
EN
Tortoise Mol
EN
Tortoise Myself
EN
Tortoise Pat
EN
Tortoise Pat2
EN
Tortoise Snakes
EN

วิธีการใช้ เสียงของปลาหมึกName

  1. 1

    ลงทะเบียนฟรี

    สร้างบัญชี TextToSpeechAI ฟรี เพื่อรับเครดิตเริ่มต้น Tortoise เป็นเครื่องจักร Ultra- Tier (50 เครดิตต่อ 1000 อักขระ) ดังนั้น เครดิตฟรีจึงเหมาะสมสำหรับการทดสอบครั้งแรก

  2. 2

    เลือกเสียงของ Tortoise

    เลือกเสียงหนึ่งในเสียงที่ Tortoise ใช้อยู่แล้ว จากตัวเลือกการค้นหาเสียง

  3. 3

    พิมพ์ข้อความของคุณ

    พิมพ์หรือปักหมุดข้อความที่คุณต้องการให้ถูกพูดออกมา เพราะ Tortoise ทำงานช้า โปรดเริ่มด้วยข้อความสั้น ๆ เพื่อยืนยันเสียงและระดับเสียงก่อนที่จะส่งบทหนังสือเสียงหรือสคริปต์ยาว ๆ ทั้งหมด

  4. 4

    สร้าง

    คลิกที่สร้าง และอดทน ตัวตะกั่วใช้เวลา 30 วินาที ถึงหลายนาทีต่อคลิป

  5. 5

    ดาวน์โหลดหรือใช้ API

    เมื่อสร้างเสร็จแล้ว ให้ดาวน์โหลดเพลงของคุณเป็น MP3, WAV, หรือ OGG หรือเรียกมันจากประวัติของคุณ เพื่ออัตโนมัติงานของ Tortoise ให้เรียก API TextToSpeechAI และให้เวลาหมดอายุนานขึ้น เพราะ Tortoise แสดงผลช้า

เสียงของปลาหมึกName ตัวช่วยการใช้งาน

สร้างเสียงพูดโดยใช้โปรแกรม โดยใช้ REST API TextToSpeechAI

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "เต่าใช้เวลา แต่ผลลัพธ์ก็คุ้มค่าที่จะรอ",
    "voice": "tortoise-angie"
  }'

คำถามที่ถามบ่อย

Tortoise TTS เป็นโมเดลการแปลงข้อความเป็นเสียงแบบอัตโนมัติที่สร้างโดย James Betker ซึ่งให้ความสำคัญกับคุณภาพเสียงมากกว่าสิ่งอื่น ๆ มันรวมการสร้างแบบจำลองภาษาที่ใช้เทรนเนอร์กับการถอดรหัสแบบกระจายเพื่อสร้างการพูดที่มีความเป็นธรรมชาติ, ความลึกของอารมณ์ และเสียงที่คล้ายกับเสียงของมนุษย์ มันถูกมองว่าเป็นหนึ่งในกลไกการแปลงข้อความเป็นเสียงแบบโอเพนซอร์สที่มีความเป็นจริงมากที่สุด

ใช่ Tortoise TTS เป็นโอเพนซอร์สภายใต้ใบอนุญาต Apache 2.0 ที่อนุญาตให้ใช้ในเชิงพาณิชย์ แก้ไข และกระจายออกไปบน TextToSpeechAI Tortoise อยู่ในระดับ Ultra ที่ 50 credits per 1000 characters เพราะความต้องการในการคำนวณที่หนักและคุณภาพของผลลัพธ์ที่ยอดเยี่ยม

Tortoise ถูกออกแบบมาให้ทำงานช้า: มันจะสร้างคลิปตัวเลือกหลายคลิปโดยอัตโนมัติ และจากนั้นจะปรับปรุงคลิปที่ดีที่สุดด้วยโมเดลการกระจายเสียง และขั้นตอนการจัดอันดับ CLVP ใหม่ ระบบท่อคุณภาพแรกนี้หมายความว่า คลิปเดียวจะใช้เวลาตั้งแต่ 30 วินาที ถึงหลายนาที ขึ้นอยู่กับความยาวของข้อความ และคุณภาพที่ตั้งไว้ก่อนหน้านี้ ข้อเสียคือ Tortoise จะผลิตเสียงที่ดูธรรมชาติที่สุดของกลไก TTS ใดๆ

ไม่ใช่บน TextToSpeechAI วันนี้ โมเดล Open Source มีค่าตั้งค่าที่ แลกเปลี่ยนความเร็วกับคุณภาพ เราแสดงด้วยการตั้งค่าที่เน้นความเร็ว ดังนั้นคลิปจึงจบลงในเวลาที่เหมาะสม

ไม่ใช่บน TextToSpeechAI เสียงของ Tortoise ที่นี่เป็นเสียงที่ทำมาแล้วจากไลบรารี สำหรับโคลนเสียง ใช้เครื่องมือโคลนเสียง ซึ่งจะทำงาน Chatterbox

Tortoise ถูกฝึกโดยใช้ข้อมูลเสียงภาษาอังกฤษเป็นหลัก ดังนั้น ภาษาอังกฤษจึงเป็นภาษาที่มีความแม่นยำสูงสุด สำหรับภาษาอื่น ๆ ใช้เสียง Piper หรือ Bark หรือเสียงที่ถูกโคลน

Tortoise ผลิตเสียงที่พิเศษ บางครั้งก็ไม่แตกต่างจากเสียงของมนุษย์ มันจับภาพการหายใจ ความลังเล เสียงและเสียงสะท้อนอารมณ์ที่แท้จริง ที่รุ่นที่เบากว่าพลาดไป นี่คือเหตุผลที่มันยังคงเป็นที่ชื่นชอบสำหรับหนังสือเสียงระดับพรีเมี่ยม การบรรยายภาพยนตร์ และงานเสียงที่สูงสุดที่ความเป็นจริงเป็นสิ่งสำคัญ

Tortoise ใช้ VRAM ประมาณ 12-24GB ขึ้นอยู่กับการตั้งค่าและขนาดของการประมวลผล ดังนั้น GPU ระดับสูง เช่น RTX 3090, 4090 หรือ A100 จึงแนะนำให้ใช้ในระบบภายใน CPU inferencing สามารถทำได้ตามเทคนิค แต่ช้ามากๆ บน TextToSpeechAI โมเดลทำงานบนโครงสร้างพื้นฐานของ GPU ของเรา ดังนั้นคุณจึงไม่ต้องการฮาร์ดแวร์ใดๆ

Tortoise แสดงเสียง WAV ที่มีคุณภาพสูง 24 kHz ผ่าน TextToSpeechAI คุณสามารถขอ MP3, WAV หรือ OGG และเราแปลงรหัสด้วยการเข้ารหัสที่รักษาคุณภาพไว้ ดังนั้นคุณจะเก็บรายละเอียดของโมเดลในรูปแบบใดก็ได้ที่โปรเจกของคุณต้องการ

Tortoise อยู่ในระดับราคา Ultra ที่ 50 เครดิตต่อ 1000 อักขระ สะท้อนเวลาที่ GPU ใช้ในการสร้างภาพถ่ายที่มีคุณภาพสูงสุด บัญชีใหม่จะได้รับเครดิตเริ่มต้นฟรี ดังนั้นคุณสามารถทดสอบ Tortoise ก่อนที่จะทำการคอมมิชชั่นได้ ระดับ Ultra ยังรวมถึง StyleTTS2

เครื่องจักรทั้งสองตัวเป็นเครื่องจักรระดับสูงสุด แต่มันต่างกัน เครื่องจักร Tortoise TTS นั้น มีความลึกซึ้งทางอารมณ์และความเป็นธรรมชาติสูงสุด แต่มันเป็นเครื่องจักรที่ช้าที่สุด StyleTTS2 นั้น ทำการสร้างเสียงได้เร็วกว่า StyleTTS2 มาก ทำให้มันเป็นตัวเลือกที่ดีกว่า เมื่อคุณต้องการคลิปจำนวนมาก หรือต้องการให้มีการตอบสนองเร็วขึ้น เลือก Tortoise เมื่อคุณภาพไม่สามารถต่อรองได้ และเวลาไม่ใช่ข้อจำกัด

ใช่ ลงทะเบียนที่ TextToSpeechAI เพื่อรับเครดิตเริ่มต้นฟรี จากนั้นเลือกเสียงของ Tortoise เพื่อสร้างคลิปโดยไม่ต้องติดตั้งอะไรเลย เพราะ Tortoise ทำงานช้า เริ่มด้วยประโยคสั้น ๆ ก่อนที่จะทำงานที่ยาวกว่า

Technical Specs

  • Generation Speed Very Slow
  • Output Quality Exceptional
  • Voice Cloning Not Supported
  • Languages 1
  • GPU VRAM 12-24GB
  • Credits/1000 chars 50

Try เสียงของปลาหมึกName Now

Generate your first audio free. No credit card required.

Start Free