StyleTTS 2

Free.ai (self-hosted) · tts · ~500 टोकन प्रति clip · 4.6 पासून 5 या विभागातील वापरकर्ता
~500 टोकन प्रति clip

StyleTTS 2 हे a आहे text-to-speech voice Yinghao Aaron Li द्वारे बनवलेले आहे. Strongest at Voice cloning without training data; expressive multilingual speech.. Free.ai GPUs वर स्व-होस्ट - आपल्या दैनंदिन टोकन पूल विरुद्ध मुक्तपणे चालते (500 टोकन प्रति क्लिप). Released under MIT — commercial use permitted on Free.ai.

वारंवार विचारले जाणारे प्रश्न

StyleTTS 2 अनेक भाषांना समर्थन पुरवते. सखोल यादी इंजिनवर अवलंबून असते; या पानावरील फॉर्म कोणत्याही पाठ्य स्वीकारतो व इंजिन समर्थीत भाषांमधून रेंडरिंग करते. विशिष्ट भाषा आवश्यक असल्यास पूर्ण बहु- इंजिन निवडक करीता /voice/ पहा.

बहुतेक इंजिन मुलभूतरित्या न्युट्रल- अमेरिकन इंग्रजी व गैर- इंग्रजी भाषा करीता क्षेत्र- योग्य उच्चारण दर्शवितात. प्रीमियम इंजिन उच्चारण बदल दर्शवू शकतात - तुलना करीता नमुना चिकटवा.

SSML समर्थन इंजिननुरूप बदलते. पॅसेज, प्रोसोडी, व जोर टॅग सर्वात प्रीमियम इंजिन व काही स्वयं- यजमानवर मानले जातात. सादा पाठ्य नेहमी कार्य करते - मार्कअप आवश्यक नाही.

स्ट्रीमिंग TTS प्रीमियम इंजिनवर /v1/tts/ API endpoint द्वारे stream=true सह उपलब्ध आहे. या पानावरील वेब UI रेंडरिंग पूर्ण झाल्यानंतर संपूर्ण क्लिप परत करतो.

StyleTTS 2 आपल्या स्वतःच्या GPU वर चालते. जनरेशन प्रथम आपल्या दैनंदिन मोफत पूल पासून ड्रॉप करते. एकदा संपल्यावर, मोफत टोकन $5 → 200,000 टोकन पासून सुरू होतात. सुमारे ~5 टोकन प्रति अक्षर, किमान 100 प्रति क्लिप.

5000 अक्षरांपर्यंत वेब UI वर प्रति विनंती. लांब भागांसाठी (ऑडिओबुक, संपूर्ण अध्याय), /voice/audiobook / वापरा जे स्वयंचलितपणे चिप्स आणि स्टीफन्स वापरतात, किंवा loop मध्ये API ला कॉल करा.

या योजनेत, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी

होय - POST /v1/tts/ वरील पाठ्य मॉडेल=" StyleTTS 2 "सह (किंवा या पानावरील slug). WAV किंवा MP3 परत करते. पूर्ण संदर्भासाठी + SDK स्निपेट्स करीता /api/ पहा.

हे पान पाठ्य- ते- वक्तव्य आहे, आवाज क्लोन नाही - आवाज इंजिनचे मुलभूत आहे. आवाज क्लोन करीता (संदर्भ ऑडिओ अपलोड करणे), /voice/clone/ पहा, ज्यास तुम्हाला आवाज अधिकार किंवा स्पष्ट लिहिलेल्या परवानगीची आवश्यकता आहे.

Free.ai- मालकीचे GPUs वर स्वयं- होस्ट केलेले इंजिन चालविले जाते; आमच्या सर्वर पासून काहीही बाहेर पडत नाही. प्रीमियम इंजिन आमच्या DPA अंतर्गत upstream मॉडेल पुरवठादारांना पाठ्य पाठवते. आम्ही तुमच्या इनपुट वर प्रशिक्षण देत नाही आणि माहिती विकत घेत नाही.

होय - Free.ai निर्मित ऑडिओचा व्यावसायिक वापर करण्यास परवानगी देते. इंजिनची खालची परवाना (Apache 2.0, MIT, किंवा विक्रेता नियम) वरील आणि मॉडेल संदर्भ पानावर दर्शविली जाते; व्यवहारात याचा अर्थ आवाज, जाहिरात, पॉडकास्ट, आणि अनुप्रयोग सर्व क्षेत्रात आहेत.

होय - अपयशी काम स्वचलितरित्या स्त्रोत (दिवसीय पूल किंवा मोफत टोकन) कडे परत केले जाते. जर परतफेड त्याच दिवशी दिसली नाही तर, contact@free.ai ला ईमेल करा.

Free.ai ला आवडते? आपल्या मित्रांना सांगा!

या पानाचे गुणांकन करा