StyleTTS 2

Free.ai (self-hosted) · tts · ~500 tokens တစ်ဦးချင်းစီ clip · 4.6 မှ 5 ဒီအမျိုးအစားရဲ့အသုံးပြုသူများ
~500 tokens တစ်ဦးချင်းစီ clip

StyleTTS 2 သည် a စာသားမှစကားပြောအသံ ကို Yinghao Aaron Li မှတည်ဆောက်ထားသည်။ Voice cloning without training data; expressive multilingual speech. မှာအခိုင်အမာဆုံး. Free.ai GPUs အပေါ် Self-hosted - သင်၏နေ့စဉ် token ကိုရေကန် (500 tokens ရုပ်ပုံတစ်ပုံစီ) ကိုတိုက်ခိုက်အခမဲ့ runs ။ အောက်တွင်ထုတ်ဝေ MIT - စီးပွားရေးလုပ်ငန်းအသုံးပြုခွင့်အပေါ် Free.ai.

မေးလေ့ရှိသောမေးခွန်းများ

StyleTTS 2 ဘာသာစကားများကျယ်ပြန့်အမျိုးအစားကိုထောက်ခံ. တိကျတဲ့စာရင်းအင်ဂျင်ပေါ်မူတည်; ဒီစာမျက်နှာပေါ်တွင်ပုံစံကိုမည်သည့်စာသားကိုလက်ခံရရှိပြီးအင်ဂျင်သည်၎င်း၏ထောက်ခံဘာသာစကားများမှာ render လိမ့်မယ်. သင်အတိအကျဘာသာစကားလိုအပ်လျှင်အပြည့်အဝ multi-engine picker အတွက် / voice / ကိုကြည့်ပါ.

အများစုအင်ဂျင်နီယာများ default အားဖြင့် neutral-အမေရိကန်အင်္ဂလိပ်နှင့်အင်္ဂလိပ်မဟုတ်သောဘာသာစကားများအတွက်ဒေသ-သင့်လျော်သော accent ပေး. Premium engines accent variants expose may - နှိုင်းယှဉ်ဖို့နမူနာ paste.

SSML ထောက်ခံမှုအင်ဂျင်အားဖြင့်ကွဲပြားခြားနား. Pause, prosody, နှင့်အလေးအနက် tags များအများဆုံးပရီမီယံအင်ဂျင်များနှင့်အချို့ကိုယ့်ကိုယ်ကို-hosted အပေါ်ဂုဏ်ပြုကြသည်. ရိုးရှင်းသောစာသားအမြဲအလုပ်လုပ် - မ markup လိုအပ်.

Streaming TTS သည် stream=true နှင့်အတူ /v1/tts/ API endpoint မှတဆင့်ပရီမီယံအင်ဂျင်များပေါ်တွင်ရရှိနိုင်သည်။ ဤစာမျက်နှာပေါ်တွင် web UI သည်တစ်ကြိမ် rendering ပြီးဆုံးပါကအပြည့်အဝ clip ကိုပြန်ပေးသည်။

StyleTTS 2 ကျွန်တော်တို့ရဲ့ကိုယ်ပိုင် GPUs ပေါ်မှာ runs. Generation ကိုသင်၏နေ့စဉ်အခမဲ့ရေချိုးခန်းကနေပထမဦးဆုံးဆွဲ. တစ်ခါတစ်ရံကုန်ဆုံး, ပေးဆောင် tokens ကိုစတင် $5 → 200,000 tokens. roughly ~5character per tokens, minimum 100 per clip.

Up to 5,000 characters per request on the web UI. ကြာရှည်အပိုင်းပိုင်းများအတွက် (audiobooks, အပြည့်အဝအခန်းများ), အသုံးပြု / voice / audiobook / which chunks and stitches automatically, or call the API inaloop.

ဟုတ်ကဲ့ - POST /v1/tts/batch/ သို့ strings များ၏စာရင်းကို, သို့မဟုတ် /workspace/ တွင်အလုပ်အကိုင်အ UI ကိုအသုံးပြုပါ ကြာရှည် pipeline ကိုထဲသို့ TTS ကြိုး (ဥပမာ, ဘာသာပြန် → ပြော → stitch).

ဟုတ်ကဲ့ - POST text ကို /v1/tts / model="StyleTTS 2" နှင့်အတူ (သို့မဟုတ်ဤစာမျက်နှာပေါ်တွင် slug). WAV သို့မဟုတ် MP3 ကိုပြန်လာ. ပြည့်စုံသောအညွှန်း + SDK snippets များအတွက် /api / ကိုကြည့်ပါ.

ဒီစာမျက်နှာက စာသား-to-စကားပြော, အသံ cloning မဟုတ် - အသံကအင်ဂျင်၏ default ဖြစ်ပါတယ်။ အသံ cloning အတွက် (အသံကို reference ကို upload လုပ်), / voice / clone / ကိုကြည့်ပါ, သင်အသံပိုင်ခွင့်သို့မဟုတ်ရှင်းလင်းသောစာရေးသားသဘောတူညီချက်ရှိရန်လိုအပ်သည်.

Free.ai-ပိုင်ဆိုင် GPUs အပေါ်ကိုယ်ပိုင်-hosted အင်ဂျင်များ run; ဘာမှကျွန်တော်တို့ရဲ့ဆာဗာများထွက်ခွာ. Premium ကိုအင်ဂျင်များကျွန်တော်တို့ရဲ့ DPA အောက်တွင် upstream မော်ဒယ်ပေးသွင်းသူများထံသို့စာသားကိုပေးပို့. ကျွန်တော်တို့ဟာသင်၏ inputs တွေကိုသင်တန်းမသင်နှင့်ဒေတာရောင်းမပေး.

ဟုတ်ကဲ့ - Free.ai generated audio ၏စီးပွားရေးလုပ်ငန်းအသုံးပြုမှုခွင့်ပြုချက်. အင်ဂျင်၏အောက်ခြေလိုင်စင် (Apache 2.0, MIT, သို့မဟုတ်ရောင်းချသူစည်းကမ်းချက်များ၌) အပေါ်နှင့်မော်ဒယ်အညွှန်းစာမျက်နှာပေါ်တွင်ပြသထားသည်; အလေ့အကျင့်တွင်ဤ voiceovers, ကြော်ငြာ, podcasts, နှင့် apps များအားလုံး in-scope တွင်ဖြစ်ကြသည်။

ဟုတ်ကဲ့ - မအောင်မြင်တဲ့အလုပ်အကိုင်များအရင်းအမြစ်သို့ auto-ပြန်အမ်း (နေ့စဉ်ရေကန်သို့မဟုတ်ပေးဆောင် tokens). ပြန်လည်ပေးချေမှုတစ်နေ့တည်းမှာပင်ပေါ်မပြသလျှင်, အီးမေးလ် contact@free.ai.

ချစ်ခြင်းမေတ္တာ Free.ai? သင့်ရဲ့မိတ်ဆွေများကိုပြောပါ!

ဒီစာမျက်နှာကိုရမှတ်