StyleTTS 2

Free.ai (self-hosted) · tts · ~500 ტოკენები clip · 4.6 დან 5 ამ კატეგორიის მომხმარებლები
~500 ტოკენები clip

StyleTTS 2 is a ტექსტის საუბრად გადამუშავების ხმა built by Yinghao Aaron Li. Strongest at Voice cloning without training data; expressive multilingual speech.. Free.ai GPU-ზე — მუშაობს უფასოდ თქვენი ყოველდღიური ტოკენების ბაზის წინააღმდეგ (500 tokens ვიდეო კლიპზე). Free.ai-ზე გამოშვებული MIT-ის ქვეშ - კომერციული გამოყენება ნებადართულია.

ხშირად დასმული კითხვებიName

StyleTTS 2 მხარს უჭერს მრავალ ენას. ზუსტი სია დამოკიდებულია პროგრამაზე; ამ გვერდზე არსებული ფორმა იღებს ნებისმიერ ტექსტს და პროგრამა აჩვენებს მას მხარდაჭერილ ენაზე. თუ თქვენ სპეციფიკური ენა გჭირდებათ, ნახეთ / voice/ სრული მრავალ- პროგრამის არჩევისთვის.

უმეტესობა პროგრამების ნაგულისხმევი ენაა ნეიტრალური ამერიკული ინგლისური და რეგიონული აქცენტები ინგლისურზე განსხვავებული ენებისთვის. Premium პროგრამებმა შეიძლება აქცენტების ვარიანტებიც გამოავლინონ - შეადგინეთ ნიმუში შედარებისთვის.

SSML მხარდაჭერა განსხვავდება პროგრამის მიხედვით. პაუზის, პროზოდიის და ხაზგასმის ჭდეები უმეტეს პრემიუმ პროგრამებში და ზოგიერთ თვითდაფუძნებულ პროგრამაში ითვლება. ჩვეულებრივი ტექსტი ყოველთვის მუშაობს - მარკირება არ არის საჭირო.

TTS-ის გადაცემა ხელმისაწვდომია premium-ის მოდულებზე /v1/tts/ API-ს ბოლო წერტილის stream=true-ით. ამ გვერდის ვებ ინტერფეისი იღებს სრულ ვიდეო კლიპს, როდესაც რენდერინგი დასრულებულია.

StyleTTS 2 მუშაობს ჩვენი GPU- ებზე. პირველი თქვენი ყოველდღიური უფასო ბაზისგან იღებს. როდესაც ის ამოიწურება, გადახდილი ტოკენები $5 → 200,000 ტოკენით იწყება. დაახლოებით ~5 ტოკენი სიმბოლოზე, მინიმუმ 100 ტოკენი ვიდეო კლიპზე.

5000 სიმბოლომდე ერთ მოთხოვნაზე ვებ ინტერფეისში. უფრო გრძელი ნაწილებისთვის (აუდიო წიგნები, სრული თავები), გამოიყენეთ /voice/audiobook/, რომელიც ავტომატურად ქმნის ნაწილებს და აკავშირებს, ან API-ს გამოძახება ციკლით.

Yes - POST a list of strings to /v1/tts/batch/, or use the workspace UI at /workspace/ to chain TTS into a longer pipeline (e.g., translate → speak → stitch).

დიახ - POST ტექსტი / v1/ tts / - ში model=" StyleTTS 2 "- ით (ან slug ამ გვერდზე). უკან ბრუნდება WAV ან MP3. ნახეთ / api / სრული მისამართისთვის + SDK ნაჭრები.

ეს გვერდი ტექსტიდან საუბრის მოდული, არა კი ხმათა კლონირებაა - ხმაები მოდულის ნაგულისხმევი პარამეტრია. ხმათა კლონირებისთვის (რეფერენტული აუდიოს ჩატვირთვა), იხილეთ /voice/clone/, რომელიც მოითხოვს ხმათა უფლებების ან წერილობითი თანხმობის მქონე პირს.

თვითდაფუძნებული მოდული მუშაობს Free.ai- ის გრაფიკული პროცესორების საკუთრებაში; ჩვენი სერვერებიდან არაფერი არ გადის. პრემიუმ მოდული ტექსტს გადასცემს ზედა მოდელის მომწოდებლებს ჩვენი DPA- ს მიხედვით. ჩვენ არ ვასწავლით თქვენს ჩანაწერებს და არ ვყიდით მონაცემებს.

დიახ - Free.ai აუდიოს კომერციული გამოყენების უფლებას იძლევა. მოდულის ლიცენზია (Apache 2.0, MIT ან მწარმოებლის პირობები) მოცემულია ზემოთ და მოდელის რეფერალური გვერდის ზემოთ; პრაქტიკაში ეს ნიშნავს, რომ აუდიოს, რეკლამების, ვიდეოების და პროგრამების გამოყენება ყველასთვის ნებადართულია.

დიახ — ვერ შესრულებული დავალებები ავტომატურად დაბრუნდება წყაროში (დღეღამისო ან გადახდილი ტოკენები). თუ დაბრუნება იმავე დღეს არ მოხდება, დაგვიკავშირდით contact@free.ai.

ჲბთფაქ ლთ Free.ai?

ამ გვერდის შეფასება