Parler-TTS Large

Free.ai (self-hosted) · tts · ~500 ટોકન પ્રતિ clip · 4.6 માંથી 5 આ વર્ગના વપરાશકર્તાઓ
~500 ટોકન પ્રતિ clip

Parler-TTS Large એ a લખાણ-થી-ભાષણ અવાજ છે, HuggingFace દ્વારા બનાવેલ છે. Controllable speech ("spoken quickly with a British accent"), research. પર સૌથી મજબૂત. Free.ai GPUs પર સ્વયં-હોસ્ટ થયેલ — તમારા રોજિંદા ટોકન પુલ (500 ટોકન ક્લિપ પ્રતિ) સામે મુક્ત રીતે ચાલે છે. Apache 2.0 નીચે બહાર પાડવામાં આવ્યું - Free.ai પર વ્યવસાયિક ઉપયોગની પરવાનગી.

વારંવાર પૂછાતા પ્રશ્નો

Parler-TTS Large ભાષાઓની વિશાળ શ્રેણીને આધાર આપે છે. ચોક્કસ યાદી એન્જિન પર આધારિત છે; આ પાના પરનો ફોર્મ કોઈપણ લખાણને સ્વીકારે છે અને એન્જિન તેની આધારભૂત ભાષાઓમાં રેન્ડર કરશે. જો તમને ચોક્કસ ભાષાની જરૂર હોય તો સંપૂર્ણ બહુ-એન્જિન પસંદ કરનાર માટે /voice/ જુઓ.

મોટાભાગના એન્જિનો મૂળભૂત રીતે તટસ્થ-અમેરિકન અંગ્રેજી અને અંગ્રેજી નહિં હોય તેવી ભાષાઓ માટે વિસ્તાર-સંબંધિત ઉચ્ચારણ રજૂ કરે છે. પ્રીમિયમ એન્જિનો ઉચ્ચારણની વિવિધતાઓ રજૂ કરી શકે છે - સરખામણી માટે નમૂનો ચોંટાડો.

SSML આધાર એંજિન દ્વારા બદલાય છે. અટકાવો, પ્રોસોડી, અને ભાર ટેગો મોટાભાગના પ્રીમિયમ એંજિન પર અને થોડા સ્વયં-હોસ્ટ થયેલ પર માન્ય છે. સાદા લખાણ હંમેશા કામ કરે છે - કોઈ માર્કઅપ જરૂરી નથી.

સ્ટ્રીમિંગ TTS એ stream=true સાથે /v1/tts/ API અંતબિંદુ મારફતે પ્રીમિયમ એન્જિનો પર ઉપલબ્ધ છે. આ પાનાં પરનું વેબ UI એકવાર રેન્ડરીંગ સમાપ્ત થાય ત્યારે સંપૂર્ણ ક્લિપને પાછું આપે છે.

Parler-TTS Large આપણા પોતાના GPUs પર ચાલે છે. જનરેશન તમારી દરરોજની મુક્ત પુલમાંથી પહેલેથી જ ખેંચે છે. એકવાર ખાલી થઈ જાય, ચૂકવેલ ટોકન $5 → 200,000 ટોકન પર શરૂ થાય છે. લગભગ ~5 ટોકન પ્રતિ અક્ષર, ક્લિપ પ્રતિ ઓછામાં ઓછા 100.

વેબ UI પર પ્રતિ વિનંતી ૫,૦૦૦ અક્ષરો સુધી. લાંબા ટુકડાઓ માટે (ઓડિયોબુક, સંપૂર્ણ પ્રકરણો), /voice/audiobook/ વાપરો જે આપોઆપ ચુકે છે અને સ્ટીચ કરે છે, અથવા લૂપમાં API ને બોલાવે છે.

હા - /v1/tts/batch/ પર શબ્દમાળાઓની યાદી POST કરો, અથવા /workspace/ પર કાર્યસ્થળ UI નો ઉપયોગ કરો TTS ને લાંબી પાઇપલાઇનમાં ચેનલ કરવા માટે (દા.ત., અનુવાદ → બોલો → સ્ટીચ).

હા - મોડેલ="Parler-TTS Large" સાથે /v1/tts/ પર POST લખાણ (અથવા આ પાનાં પરની slug). WAV અથવા MP3 પાછું આપે છે. સંપૂર્ણ સંદર્ભ + SDK સ્નિપેટ્સ માટે /api/ જુઓ.

આ પાનું લખાણ-થી-ભાષા છે, અવાજ ક્લોનિંગ નથી - અવાજ એ એન્જિનનું મૂળભૂત છે. અવાજ ક્લોનિંગ માટે (સંદર્ભ ઓડિયો અપલોડ કરવા માટે), /voice/clone/ જુઓ, જે તમારે અવાજની અધિકારો અથવા સ્પષ્ટ લખાયેલ સંમતિ હોવી જરૂરી છે.

સ્વયં-હોસ્ટ થયેલ એન્જિનો Free.ai-માલિકી ધરાવતા GPUs પર ચલાવે છે; કંઇપણ અમારા સર્વરોને છોડતું નથી. પ્રીમિયમ એન્જિનો અમારા DPA ની અંદર અપસ્ટ્રીમ મોડેલ પૂરૂં પાડનારાઓને લખાણને પસાર કરે છે. અમે તમારા ઇનપુટ પર તાલીમ આપતા નથી અને માહિતી વેચતા નથી.

હા - Free.ai ઉત્પન્ન થયેલ ઓડિયોનો વાણિજ્યિક ઉપયોગ આપવાની પરવાનગી આપે છે. એન્જિનની નીચેની લાઇસન્સ (Apache 2.0, MIT, અથવા વેપારી શરતો) ઉપર અને મોડેલ સંદર્ભ પાના પર બતાવવામાં આવે છે; આનો અર્થ એ થાય કે વૉઇસઓવર, જાહેરાતો, પોડકાસ્ટ, અને કાર્યક્રમો બધા વિસ્તારમાં છે.

હા - નિષ્ફળ કામો આપોઆપ સ્ત્રોતને પાછા આપો (દિવસના પુલ અથવા ચૂકવેલ ટોકન). જો પાછા આપવાનું એ જ દિવસે દેખાય નહિં, contact@free.ai ને ઇમેઇલ કરો.

Free.ai પ્રેમ કરો? તમારા મિત્રોને કહો!

આ પાનાંને દર આપો