MeloTTS

Free.ai (self-hosted) · tts · ~500 ટોકન પ્રતિ clip · 4.6 માંથી 5 આ વર્ગના વપરાશકર્તાઓ
~500 ટોકન પ્રતિ clip

MeloTTS એ a લખાણ-થી-ભાષણ અવાજ છે, MyShell દ્વારા બનાવેલ છે. Multilingual TTS પર સૌથી મજબૂત. Free.ai GPUs પર સ્વયં-હોસ્ટ થયેલ — તમારા રોજિંદા ટોકન પુલ (500 ટોકન ક્લિપ પ્રતિ) સામે મુક્ત રીતે ચાલે છે. MIT નીચે બહાર પાડવામાં આવ્યું - Free.ai પર વ્યવસાયિક ઉપયોગની પરવાનગી.

API વડે વાપરો

OpenAI-સુસંગત REST API. કી બનાવો અને સેકન્ડોમાં આ મોડેલને બોલાવો.

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"melotts","text":"hello world"}'
API દસ્તાવેજ API કી મેળવો

વારંવાર પૂછાતા પ્રશ્નો

MeloTTS ભાષાઓની વિશાળ શ્રેણીને આધાર આપે છે. ચોક્કસ યાદી એન્જિન પર આધારિત છે; આ પાના પરનો ફોર્મ કોઈપણ લખાણને સ્વીકારે છે અને એન્જિન તેની આધારભૂત ભાષાઓમાં રેન્ડર કરશે. જો તમને ચોક્કસ ભાષાની જરૂર હોય તો સંપૂર્ણ બહુ-એન્જિન પસંદ કરનાર માટે /voice/ જુઓ.

મોટાભાગના એન્જિનો મૂળભૂત રીતે તટસ્થ-અમેરિકન અંગ્રેજી અને અંગ્રેજી નહિં હોય તેવી ભાષાઓ માટે વિસ્તાર-સંબંધિત ઉચ્ચારણ રજૂ કરે છે. પ્રીમિયમ એન્જિનો ઉચ્ચારણની વિવિધતાઓ રજૂ કરી શકે છે - સરખામણી માટે નમૂનો ચોંટાડો.

SSML આધાર એંજિન દ્વારા બદલાય છે. અટકાવો, પ્રોસોડી, અને ભાર ટેગો મોટાભાગના પ્રીમિયમ એંજિન પર અને થોડા સ્વયં-હોસ્ટ થયેલ પર માન્ય છે. સાદા લખાણ હંમેશા કામ કરે છે - કોઈ માર્કઅપ જરૂરી નથી.

સ્ટ્રીમિંગ TTS એ stream=true સાથે /v1/tts/ API અંતબિંદુ મારફતે પ્રીમિયમ એન્જિનો પર ઉપલબ્ધ છે. આ પાનાં પરનું વેબ UI એકવાર રેન્ડરીંગ સમાપ્ત થાય ત્યારે સંપૂર્ણ ક્લિપને પાછું આપે છે.

MeloTTS આપણા પોતાના GPUs પર ચાલે છે. જનરેશન તમારી દરરોજની મુક્ત પુલમાંથી પહેલેથી જ ખેંચે છે. એકવાર ખાલી થઈ જાય, ચૂકવેલ ટોકન $5 → 200,000 ટોકન પર શરૂ થાય છે. લગભગ ~5 ટોકન પ્રતિ અક્ષર, ક્લિપ પ્રતિ ઓછામાં ઓછા 100.

વેબ UI પર પ્રતિ વિનંતી ૫,૦૦૦ અક્ષરો સુધી. લાંબા ટુકડાઓ માટે (ઓડિયોબુક, સંપૂર્ણ પ્રકરણો), /voice/audiobook/ વાપરો જે આપોઆપ ચુકે છે અને સ્ટીચ કરે છે, અથવા લૂપમાં API ને બોલાવે છે.

હા - /v1/tts/batch/ પર શબ્દમાળાઓની યાદી POST કરો, અથવા /workspace/ પર કાર્યસ્થળ UI નો ઉપયોગ કરો TTS ને લાંબી પાઇપલાઇનમાં ચેનલ કરવા માટે (દા.ત., અનુવાદ → બોલો → સ્ટીચ).

હા - મોડેલ="MeloTTS" સાથે /v1/tts/ પર POST લખાણ (અથવા આ પાનાં પરની slug). WAV અથવા MP3 પાછું આપે છે. સંપૂર્ણ સંદર્ભ + SDK સ્નિપેટ્સ માટે /api/ જુઓ.

આ પાનું લખાણ-થી-ભાષા છે, અવાજ ક્લોનિંગ નથી - અવાજ એ એન્જિનનું મૂળભૂત છે. અવાજ ક્લોનિંગ માટે (સંદર્ભ ઓડિયો અપલોડ કરવા માટે), /voice/clone/ જુઓ, જે તમારે અવાજની અધિકારો અથવા સ્પષ્ટ લખાયેલ સંમતિ હોવી જરૂરી છે.

સ્વયં-હોસ્ટ થયેલ એન્જિનો Free.ai-માલિકી ધરાવતા GPUs પર ચલાવે છે; કંઇપણ અમારા સર્વરોને છોડતું નથી. પ્રીમિયમ એન્જિનો અમારા DPA ની અંદર અપસ્ટ્રીમ મોડેલ પૂરૂં પાડનારાઓને લખાણને પસાર કરે છે. અમે તમારા ઇનપુટ પર તાલીમ આપતા નથી અને માહિતી વેચતા નથી.

હા - Free.ai ઉત્પન્ન થયેલ ઓડિયોનો વાણિજ્યિક ઉપયોગ આપવાની પરવાનગી આપે છે. એન્જિનની નીચેની લાઇસન્સ (Apache 2.0, MIT, અથવા વેપારી શરતો) ઉપર અને મોડેલ સંદર્ભ પાના પર બતાવવામાં આવે છે; આનો અર્થ એ થાય કે વૉઇસઓવર, જાહેરાતો, પોડકાસ્ટ, અને કાર્યક્રમો બધા વિસ્તારમાં છે.

હા - નિષ્ફળ કામો આપોઆપ સ્ત્રોતને પાછા આપો (દિવસના પુલ અથવા ચૂકવેલ ટોકન). જો પાછા આપવાનું એ જ દિવસે દેખાય નહિં, contact@free.ai ને ઇમેઇલ કરો.

Free.ai પ્રેમ કરો? તમારા મિત્રોને કહો!

આ પાનાંને દર આપો