StyleTTS 2

Free.ai (self-hosted) · tts · ~500 ટોકન પ્રતિ clip · 4.6 માંથી 5 આ વર્ગના વપરાશકર્તાઓ
~500 ટોકન પ્રતિ clip

StyleTTS 2 એ a લખાણ-થી-ભાષણ અવાજ છે, Yinghao Aaron Li દ્વારા બનાવેલ છે. Voice cloning without training data; expressive multilingual speech. પર સૌથી મજબૂત. Free.ai GPUs પર સ્વયં-હોસ્ટ થયેલ — તમારા રોજિંદા ટોકન પુલ (500 ટોકન ક્લિપ પ્રતિ) સામે મુક્ત રીતે ચાલે છે. MIT નીચે બહાર પાડવામાં આવ્યું - Free.ai પર વ્યવસાયિક ઉપયોગની પરવાનગી.

વારંવાર પૂછાતા પ્રશ્નો

StyleTTS 2 ભાષાઓની વિશાળ શ્રેણીને આધાર આપે છે. ચોક્કસ યાદી એન્જિન પર આધારિત છે; આ પાના પરનો ફોર્મ કોઈપણ લખાણને સ્વીકારે છે અને એન્જિન તેની આધારભૂત ભાષાઓમાં રેન્ડર કરશે. જો તમને ચોક્કસ ભાષાની જરૂર હોય તો સંપૂર્ણ બહુ-એન્જિન પસંદ કરનાર માટે /voice/ જુઓ.

મોટાભાગના એન્જિનો મૂળભૂત રીતે તટસ્થ-અમેરિકન અંગ્રેજી અને અંગ્રેજી નહિં હોય તેવી ભાષાઓ માટે વિસ્તાર-સંબંધિત ઉચ્ચારણ રજૂ કરે છે. પ્રીમિયમ એન્જિનો ઉચ્ચારણની વિવિધતાઓ રજૂ કરી શકે છે - સરખામણી માટે નમૂનો ચોંટાડો.

SSML આધાર એંજિન દ્વારા બદલાય છે. અટકાવો, પ્રોસોડી, અને ભાર ટેગો મોટાભાગના પ્રીમિયમ એંજિન પર અને થોડા સ્વયં-હોસ્ટ થયેલ પર માન્ય છે. સાદા લખાણ હંમેશા કામ કરે છે - કોઈ માર્કઅપ જરૂરી નથી.

સ્ટ્રીમિંગ TTS એ stream=true સાથે /v1/tts/ API અંતબિંદુ મારફતે પ્રીમિયમ એન્જિનો પર ઉપલબ્ધ છે. આ પાનાં પરનું વેબ UI એકવાર રેન્ડરીંગ સમાપ્ત થાય ત્યારે સંપૂર્ણ ક્લિપને પાછું આપે છે.

StyleTTS 2 આપણા પોતાના GPUs પર ચાલે છે. જનરેશન તમારી દરરોજની મુક્ત પુલમાંથી પહેલેથી જ ખેંચે છે. એકવાર ખાલી થઈ જાય, ચૂકવેલ ટોકન $5 → 200,000 ટોકન પર શરૂ થાય છે. લગભગ ~5 ટોકન પ્રતિ અક્ષર, ક્લિપ પ્રતિ ઓછામાં ઓછા 100.

વેબ UI પર પ્રતિ વિનંતી ૫,૦૦૦ અક્ષરો સુધી. લાંબા ટુકડાઓ માટે (ઓડિયોબુક, સંપૂર્ણ પ્રકરણો), /voice/audiobook/ વાપરો જે આપોઆપ ચુકે છે અને સ્ટીચ કરે છે, અથવા લૂપમાં API ને બોલાવે છે.

હા - /v1/tts/batch/ પર શબ્દમાળાઓની યાદી POST કરો, અથવા /workspace/ પર કાર્યસ્થળ UI નો ઉપયોગ કરો TTS ને લાંબી પાઇપલાઇનમાં ચેનલ કરવા માટે (દા.ત., અનુવાદ → બોલો → સ્ટીચ).

હા - મોડેલ="StyleTTS 2" સાથે /v1/tts/ પર POST લખાણ (અથવા આ પાનાં પરની slug). WAV અથવા MP3 પાછું આપે છે. સંપૂર્ણ સંદર્ભ + SDK સ્નિપેટ્સ માટે /api/ જુઓ.

આ પાનું લખાણ-થી-ભાષા છે, અવાજ ક્લોનિંગ નથી - અવાજ એ એન્જિનનું મૂળભૂત છે. અવાજ ક્લોનિંગ માટે (સંદર્ભ ઓડિયો અપલોડ કરવા માટે), /voice/clone/ જુઓ, જે તમારે અવાજની અધિકારો અથવા સ્પષ્ટ લખાયેલ સંમતિ હોવી જરૂરી છે.

સ્વયં-હોસ્ટ થયેલ એન્જિનો Free.ai-માલિકી ધરાવતા GPUs પર ચલાવે છે; કંઇપણ અમારા સર્વરોને છોડતું નથી. પ્રીમિયમ એન્જિનો અમારા DPA ની અંદર અપસ્ટ્રીમ મોડેલ પૂરૂં પાડનારાઓને લખાણને પસાર કરે છે. અમે તમારા ઇનપુટ પર તાલીમ આપતા નથી અને માહિતી વેચતા નથી.

હા - Free.ai ઉત્પન્ન થયેલ ઓડિયોનો વાણિજ્યિક ઉપયોગ આપવાની પરવાનગી આપે છે. એન્જિનની નીચેની લાઇસન્સ (Apache 2.0, MIT, અથવા વેપારી શરતો) ઉપર અને મોડેલ સંદર્ભ પાના પર બતાવવામાં આવે છે; આનો અર્થ એ થાય કે વૉઇસઓવર, જાહેરાતો, પોડકાસ્ટ, અને કાર્યક્રમો બધા વિસ્તારમાં છે.

હા - નિષ્ફળ કામો આપોઆપ સ્ત્રોતને પાછા આપો (દિવસના પુલ અથવા ચૂકવેલ ટોકન). જો પાછા આપવાનું એ જ દિવસે દેખાય નહિં, contact@free.ai ને ઇમેઇલ કરો.

Free.ai પ્રેમ કરો? તમારા મિત્રોને કહો!

આ પાનાંને દર આપો