StyleTTS 2

Free.ai (self-hosted) · tts · ~500 Ցուցադրել clip · 4.6 Ընդունել 5 այս կատեգորիայի օգտատերեր
~500 Ցուցադրել clip

StyleTTS 2 is a տեքստը խոսելու ձայն built by Yinghao Aaron Li. Strongest at Voice cloning without training data; expressive multilingual speech.. Free.ai GPU-ների վրա ինքնուրույն տեղադրված — աշխատում է անվճար ձեր օրական token pool-ի դեմ (500 tokens Ընդհանուր). Հրապարակված է MIT - առևտրային օգտագործման թույլտվությամբ Free.ai.

Հաճախակի տրվող հարցեր

StyleTTS 2- ը աջակցում է լեզվի լայն շրջանակ։ Հստակ ցանկը կախված է մոդելից։ Այս էջում ներկայացված ձևը ընդունում է ցանկացած տեքստ և մոդել կցուցադրի այն աջակցվող լեզուներով։ Դիտեք /voice/- ը ամբողջական բազմմոդել ընտրողի համար, եթե հատուկ լեզվի կարիք ունեք։

Ամենատարածված համակարգերը լռելյայն ցուցադրում են անմիջական ամերիկյան անգլերեն և անգլերենից տարբեր լեզուների համար համապատասխան ակցենտ։ Premium համակարգերը կարող են ցուցադրել ակցենտային տարբերակներ՝ համեմատելու համար օրինակներ ներկել։

SSML- ի աջակցությունը տարբերվում է յուրաքանչյուր համակարգի համար։ Պատասխանի ժամանակ, ձայնագրության ժամանակ և շեշտադրման ժամանակ նշանները պահպանվում են շատ բարձրակարգ համակարգերում և որոշ ինքնատիպ համակարգերում։ Պարզ տեքստը միշտ աշխատում է՝ առանց նշման։

TTS-ի հոսքը հասանելի է premium-ի գործիքներում /v1/tts/ API վերջնական կետի միջոցով stream=true-ով։ Այս էջում գտնվող վեբ UI-ը վերադարձնում է ամբողջական կադրը, երբ նկարահանումը ավարտվում է։

StyleTTS 2-ը աշխատում է մեր սեփական GPU-ների վրա։ Սկզբում ստեղծում է ձեր օրական ազատ ռեսուրսներից։ Երբ այն սպառվում է, վճարված տոկոսները սկսվում են $5 → 200,000 տոկոսներից։ Առավելագույնը ~5 տոկոս յուրաքանչյուր հերոս, առավելագույնը 100 տոկոս յուրաքանչյուր կադր։

Վեբ UI-ի պահանջի համար մինչև 5000 գիրք։ Ավելի երկար հատվածների համար (հնչյունային գրքեր, ամբողջական գլուխներ), օգտագործեք /voice/audiobook/, որը ինքնաբերաբար կկտրվի և կկապվի, կամ API-ին զանգահարեք անընդհատ։

Yes - POST a list of strings to /v1/tts/batch/, or use the workspace UI at /workspace/ to chain TTS into a longer pipeline (e.g., translate → speak → stitch).

Այո - POST տեքստը /v1/tts/-ին model="StyleTTS 2"-ով (կամ այս էջում օգտագործված slug-ով)։ Վերադարձնում է WAV կամ MP3։ Գտնեք /api/-ը ամբողջական հղման և SDK հատվածների համար։

Այս էջը տեքստը խոսելուց ձայն դարձնելու գործիք է, ոչ թե ձայնի կլոնավորում - ձայնը համակարգի լրիվ մոդել է։ Ձայնի կլոնավորման համար (հղումային ձայնի ներբեռնում) տե՛ս /voice/clone/, որը պահանջում է, որ դուք ունեք ձայնի իրավունքները կամ գրավոր համաձայնություն ունեք։

Իրենց վրա աշխատող սարքեր, որոնք աշխատում են Free.ai- ի սեփական GPU- ների վրա, ոչինչ չի թողնում մեր սերվերները։ Premium սարքեր, որոնք տեքստը փոխանցում են մեր DPA- ի ներքո գտնվող մոդելի մատակարարներին։ Մենք չենք սովորեցնում ձեր մուտքագրումները և չենք վաճառում տվյալներ։

Այո - Free.ai-ը թույլ է տալիս ձայնագրված ձայնի առևտրային օգտագործումը։ Դիֆերենցիալի հիմքում ընկած լիցենզիան (Apache 2.0, MIT կամ արտադրողի պայմանները) ցուցադրվում է վերևում և մոդելի հղման էջում։ Պրակտիկայում դա նշանակում է, որ ձայնագրությունները, գովազդները, podcast-ները և ծրագրերը բոլորն էլ ներառված են օրինականության մեջ։

Այո - ձախողված աշխատանքները ավտոմատ կերպով վերադարձնել աղբյուր (օրական խումբ կամ վճարված տոկոսադրույքներ)։ Եթե վերադարձը չի ցուցադրվում նույն օրը, գրեք contact@free.ai հասցեին։

Սիրում ես Free.ai-ը, ասա ընկերներիդ։

Առաջարկել այս էջը