MeloTTS

Free.ai (self-hosted) · tts · ~500 ტოკენები clip · 4.6 დან 5 ამ კატეგორიის მომხმარებლები
~500 ტოკენები clip

MeloTTS is a ტექსტის საუბრად გადამუშავების ხმა built by MyShell. Strongest at Multilingual TTS. Free.ai GPU-ზე — მუშაობს უფასოდ თქვენი ყოველდღიური ტოკენების ბაზის წინააღმდეგ (500 tokens ვიდეო კლიპზე). Free.ai-ზე გამოშვებული MIT-ის ქვეშ - კომერციული გამოყენება ნებადართულია.

API- ს გამოყენება

OpenAI- სთან თავსებადი REST API. გასაღების შექმნა და ამ მოდელის გამოძახება წამებში.

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"melotts","text":"hello world"}'
დოკუმენტაცია API კოდის მიღება

ხშირად დასმული კითხვებიName

MeloTTS მხარს უჭერს მრავალ ენას. ზუსტი სია დამოკიდებულია პროგრამაზე; ამ გვერდზე არსებული ფორმა იღებს ნებისმიერ ტექსტს და პროგრამა აჩვენებს მას მხარდაჭერილ ენაზე. თუ თქვენ სპეციფიკური ენა გჭირდებათ, ნახეთ / voice/ სრული მრავალ- პროგრამის არჩევისთვის.

უმეტესობა პროგრამების ნაგულისხმევი ენაა ნეიტრალური ამერიკული ინგლისური და რეგიონული აქცენტები ინგლისურზე განსხვავებული ენებისთვის. Premium პროგრამებმა შეიძლება აქცენტების ვარიანტებიც გამოავლინონ - შეადგინეთ ნიმუში შედარებისთვის.

SSML მხარდაჭერა განსხვავდება პროგრამის მიხედვით. პაუზის, პროზოდიის და ხაზგასმის ჭდეები უმეტეს პრემიუმ პროგრამებში და ზოგიერთ თვითდაფუძნებულ პროგრამაში ითვლება. ჩვეულებრივი ტექსტი ყოველთვის მუშაობს - მარკირება არ არის საჭირო.

TTS-ის გადაცემა ხელმისაწვდომია premium-ის მოდულებზე /v1/tts/ API-ს ბოლო წერტილის stream=true-ით. ამ გვერდის ვებ ინტერფეისი იღებს სრულ ვიდეო კლიპს, როდესაც რენდერინგი დასრულებულია.

MeloTTS მუშაობს ჩვენი GPU- ებზე. პირველი თქვენი ყოველდღიური უფასო ბაზისგან იღებს. როდესაც ის ამოიწურება, გადახდილი ტოკენები $5 → 200,000 ტოკენით იწყება. დაახლოებით ~5 ტოკენი სიმბოლოზე, მინიმუმ 100 ტოკენი ვიდეო კლიპზე.

5000 სიმბოლომდე ერთ მოთხოვნაზე ვებ ინტერფეისში. უფრო გრძელი ნაწილებისთვის (აუდიო წიგნები, სრული თავები), გამოიყენეთ /voice/audiobook/, რომელიც ავტომატურად ქმნის ნაწილებს და აკავშირებს, ან API-ს გამოძახება ციკლით.

Yes - POST a list of strings to /v1/tts/batch/, or use the workspace UI at /workspace/ to chain TTS into a longer pipeline (e.g., translate → speak → stitch).

დიახ - POST ტექსტი / v1/ tts / - ში model=" MeloTTS "- ით (ან slug ამ გვერდზე). უკან ბრუნდება WAV ან MP3. ნახეთ / api / სრული მისამართისთვის + SDK ნაჭრები.

ეს გვერდი ტექსტიდან საუბრის მოდული, არა კი ხმათა კლონირებაა - ხმაები მოდულის ნაგულისხმევი პარამეტრია. ხმათა კლონირებისთვის (რეფერენტული აუდიოს ჩატვირთვა), იხილეთ /voice/clone/, რომელიც მოითხოვს ხმათა უფლებების ან წერილობითი თანხმობის მქონე პირს.

თვითდაფუძნებული მოდული მუშაობს Free.ai- ის გრაფიკული პროცესორების საკუთრებაში; ჩვენი სერვერებიდან არაფერი არ გადის. პრემიუმ მოდული ტექსტს გადასცემს ზედა მოდელის მომწოდებლებს ჩვენი DPA- ს მიხედვით. ჩვენ არ ვასწავლით თქვენს ჩანაწერებს და არ ვყიდით მონაცემებს.

დიახ - Free.ai აუდიოს კომერციული გამოყენების უფლებას იძლევა. მოდულის ლიცენზია (Apache 2.0, MIT ან მწარმოებლის პირობები) მოცემულია ზემოთ და მოდელის რეფერალური გვერდის ზემოთ; პრაქტიკაში ეს ნიშნავს, რომ აუდიოს, რეკლამების, ვიდეოების და პროგრამების გამოყენება ყველასთვის ნებადართულია.

დიახ — ვერ შესრულებული დავალებები ავტომატურად დაბრუნდება წყაროში (დღეღამისო ან გადახდილი ტოკენები). თუ დაბრუნება იმავე დღეს არ მოხდება, დაგვიკავშირდით contact@free.ai.

ჲბთფაქ ლთ Free.ai?

ამ გვერდის შეფასება