ቀን

Ultra

የድምፅ ቅንጅት እና የድምፅ ድምፆች

Medium ፍጥነት
Excellent ጥራት
አዎ መተላለፊያ
1 ቋንቋዎች

ስለ ቀን

ing the most accurate text-to-speech results for the most complex conversations. Dia is a 1.6B parameter text-to-speech model that is designed to generate natural conversational speech with support for nonverbal sounds like laughter, sighs, and coughs. It excels at generating the most accurate text-to-speech results for the most complex conversations. Dia is a 1.6B parameter text-to-speech model that

የዋና ባህሪያት

የመስሪያውን ቅርጽ

በተለያዩ ድምጾችና ዙር በመውሰድ ተፈጥሯዊ የብዙ-ተናጋሪ ውይይቶችን ይፈጥሩ

የድምፅ መጠን

[የሚስጥራዊነት]

የድምፅ መተላለፊያ

የድምፅ ፋይል

ምናሌ

1.6B ፓራሜትሮች በጣም ተፈጥሯዊ የንግግር ፕሮሶዲ እና ተንኮል ያመጡ.

ጥቅም

የዳታ ፋይል የኦዲዮ መጽሐፍ ምርት በብዙ ፊደላት የጨዋታውን ፊደል ቅርጽ የፖድካስት እና የውስጥ ርዕስ መፍጠር

እንዴት እንደሚጠቀሙ ቀን

  1. 1

    ነጻ ምዝገባ ወይም ዲሞን ይከፈት

    ነጻ TextToSpeechAI መለያ ለመፍጠር የእርስዎን መጀመሪያ ክሬዲቶች ለመጠየቅ, ወይም Dia የዳያሎጂን ቀጥሎ ለመሞከር ምንም-መመዝገብ ዲሞን ይከፈታል.

  2. 2

    የቀን/ሰዓት አማራጭ ምረጡ

    በቲቲኤስ ዳሽቦርድ ውስጥ ዲያ ከኢንጂን ዝርዝር ውስጥ ይምረጡ. ዲያ የዳያስፖራ-ተኮር ነው፣ ከፍ ያለ ደረጃ ሞዴል በብዙ-ተናጋሪ እና የድምፅ-ክሎኒንግ ድጋፍ.

  3. 3

    የዳታ ስክሪፕት

    የንግግርዎን ርዕስ በ [S1] እና [S2] በመጠቀም የንግግር ዙር እያንዳንዱን ለማሳየት እና እንደ [laughs], [sighs], [coughs], ወይም (gasps) ባሉ ያልተናገሩ መለያዎች ውስጥ ለመውጣት ይስጡ።

  4. 4

    የድምፅ ፋይል

    የዲያ ስክሪፕትዎን ወደ ተቀባይ GPUs ለመላክ ይጫኑ. ዲያ የሁለት-ተናጋሪውን ቃለ ምልልስ በዙር-መውሰድ እና በአንድ የድምፅ ፋይል ውስጥ ያልተናገሩ መለያዎችዎን ያቀርባል.

  5. 5

    መተግበሪያውን ያውርዱ

    የተጠናቀቀውን ማውጫ በፈለግክበት ቅርጸት አውርድ፣ ወይም ተመሳሳይ [S1]/[S2] ስክሪፕት በTextToSpeechAI API ላይ በሂሳብዎ ቶኬን በመላክ አውቶማቲክ አድርግ።

ቀን መተላለፊያ

የTextToSpeechAI REST APIን በመጠቀም ፕሮግራም በመፍጠር ንግግርን ይፈጥሩ

curl -X POST "https://api.texttospeechai.com/v1/generate/" \
  -H "Authorization: Bearer YOUR_API_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{
    "text": "[S1] ጤና ይስጥልኝ! ዛሬ እንዴት ነህ? [የሚጨነቅ] [S2] በጣም ደስተኛ ነኝ፣ ለጠየቅክኝ አመሰግናለሁ!",
    "voice": "en_US-lessac-medium"
  }'

ብዙ ጊዜ የሚጠየቁ ጥያቄዎች

Dia ከናሪ ላብስ የመጣ 1.6B ፓራሜትር የዳያስፖራ-ተኮር ጽሑፍ-ወደ-ንግግር ሞዴል ነው. በብዙ ተናጋሪዎች፣ በማይናገሩ ድምፆች፣ በድምፅ ክሎኒንግ የተደገፈ በመሆኑ በባህላዊ የንግግር ንግግር ማምረት ላይ ያተኮረ ነው

አዎ, Dia በሙሉ Apache 2.0 ፈቃድ ነው - ኮድ እና ሞዴል ክብደት. በኮሜርሲያዊ ፕሮግራሞች ነጻ ሊጠቀም ይችላል.

በወቅቱ Dia አማርኛ ብቻ ይደግፋል. ሞዴሉ ለነጭ አማርኛ ቃለ ምልልስ ንግግር የተሻሻለ ነው.

ዲያ ለ1.6B ፓራሜትር ሞዴሉ የቪሬም 10GB ያስፈልጋል. በግማሽ 12GB ያለው የጂፒዩ ለተሻለ ስራ የሚመከር ነው. በTextToSpeechAI ላይ ሁሉም ነገር በሆስቴድ ጂፒዩዎች ላይ ይሠራል፣ ስለዚህ የራስዎን ማንኛውንም ሃርድዌር አያስፈልግዎትም.

አዎ - ቃለ ምልልስ Dia ለ የተገነባው ነው. በ [S1] እና [S2] ዙሮች በስክሪፕትዎ በመለዋወጥ, Dia TTS በልዩ ድምፆች እና እውነተኛ ዙር-መያዝ, ይህም በአንድ-ተናጋሪ TTS ሞዴሎች ጋር ለማግኘት አስቸጋሪ ነው የሚፈስ ሁለት-ተናጋሪ ውይይት ያመጣል.

የስክሪፕትዎ መስመር ሁሉ በ [S1] ወይም [S2] ማን እንደሚናገረው ለማሳየት መስመርን ይቀላቅሉ. Dia ለእያንዳንዱ መለያ ትክክለኛ የሆነ ድምፅ ይሰጣል እና ውይይቱ ሲንቀሳቀስ በመካከላቸው ይለዋወጣል ፣ ስለዚህ [S1] እና [S2] በዳታዎ ውስጥ እንደ ሁለት ፊደላት ይሠራሉ ፡፡

አዎ. ዲአይአ ከ5-10 ሰከንዶች የሙቀት መጠን ያለው የድምፅ ቅንጣት ይደግፋል፣ ለተናጋሪው የተወሰነውን ድምፅ እንደገና መጠቀም ትችላለህ። ቅንጣቱን በ[S1]/[S2] መለያዎች ማቀናጀት ትችላለህ፣ ስለዚህ በንግግር ውስጥ ያለው ፊደል ሁሉ እንደ ቅንጣቱ ድምፅ ይሰማል።

ዲያ [የሚስቅ], እና (የሚስቅ) እንደ ተፈጥሯዊ paralinguistic ድምፆች በንግግር ውስጥ የተቀመጠ ከሚናገሩ ቃላት ይልቅ ያቀርባል. ምላሽ ይፈልጋሉ - ለምሳሌ "[S1] ይህ አስደሳች ነው [የሚስቅ]" - ውይይቱን የበለጠ ሰው ለማድረግ መለያ ምልክት ያስቀምጡ.

ዲያ እና ባርክ ሁለቱም የቃላትን ያልሆኑ ድምጾችን ይደግፋሉ፣ ግን ዲያ በ [S1] / [S2] ዙር መያዝ እና የድምፅ ክሎኒንግ ለብዙ-ተናጋሪ ቃለ ምልልስ የተገነባ ነው። ለሁለቱም ሰው እውነተኛ ቃለ ምልልስ እና የፊደል ሥራ ዲያ ይምረጡ፤ ባርክ በአንድ-ድምፅ ተናጋሪነት ስፋት ያለው የቋንቋ ስፋት ያስፈልግዎታል

ዲያ አጠቃላይ ደረጃ ያለው መሳሪያ ነው፣ ስለዚህ በእያንዳንዱ 1,000 የቀረበው ንግግር አንቀጾች ላይ 50 ክሬዲት ይከፍላል። አጠቃላይ ደረጃው ትልቁን 1.6B ሞዴል እና ~10GB የ GPU ማስታወሻን ለከፍተኛ ጥራት ያለው ንግግር የሚጠቀምበትን ያመለክታል።

አዎ. አዲስ TextToSpeechAI መለያዎች ነፃ የጀማሪ ክሬዲቶች ያካትታሉ, እና ያለ መመዝገብ ሊንቀሳቀሱ የሚችሉበት ዲሞ አለ. ይህ በ [S1] / [S2] መለያዎች ጋር ጥቂት Dia ቃለ መጠይቅ ለማምጣት በቂ ነው በተቀመጠው ዕቅድ ላይ ከመወሰን በፊት.

አዎ. ከሂሳብዎ ገጽ ላይ API token ካገኙ በኋላ የዲአይአይ የድምጽ ቃለ መጠይቅ ስክሪፕቶችን - [S1]/[S2] ዙሮችን እና እንደ [laughs] ያሉ መለያዎችን ጨምሮ - ወደ TextToSpeechAI REST API ማቅረብ እና የተገኘውን ድምፅ ፕሮግራማዊ በሆነ መንገድ መውሰድ ይችላሉ።

Technical Specs

  • Generation Speed Medium
  • Output Quality Excellent
  • Voice Cloning Supported
  • Languages 1
  • GPU VRAM 10GB
  • Credits/1000 chars 50

Try ቀን Now

Generate your first audio free. No credit card required.

Start Free