StyleTTS 2

Free.ai (self-hosted) · tts · ~500 प्रति टोकन clip · 4.6 बाट 5 यो कोटिका प्रयोगकर्ता
~500 प्रति टोकन clip

StyleTTS 2 a पाठ-बाट-वाचन आवाज द्वारा निर्माण गरिएको छ Yinghao Aaron Li। Strongest at Voice cloning without training data; expressive multilingual speech.. Free.ai GPUs मा आत्म-होस्ट - आफ्नो दैनिक टोकन पूल विरुद्ध निःशुल्क चल्छ (500 टोकन प्रति क्लिप)। MIT अन्तर्गत जारी गरिएको — व्यावसायिक प्रयोगलाई Free.ai मा अनुमति दिइएको छ ।

प्राय सोधिने प्रश्न

StyleTTS 2 ले भाषाको विस्तृत दायरा समर्थन गर्दछ । सहि सूची इन्जिनमा निर्भर गर्दछ; यो पृष्ठमा फारमले कुनै पनि पाठ स्वीकार गर्दछ र इन्जिनले यसको समर्थित भाषाहरूमा रेन्डर गर्नेछ । यदि तपाईँलाई विशिष्ट भाषा आवश्यक छ भने पूर्ण बहु-इञ्जिन चयनकर्ताका लागि / आवाज / हेर्नुहोस् ।

धेरै इन्जिनहरू पूर्वनिर्धारित रूपमा तटस्थ-अमेरिकी अंग्रेजी र गैर-अङ्ग्रेजी भाषाहरूको लागि क्षेत्र-सहि अभिव्यक्ति रेन्डर गर्दछ। प्रिमियम इन्जिनहरूले अभिव्यक्ति प्रकार्यहरू प्रकट गर्न सक्छन् - तुलना गर्न नमूना टाँस्नुहोस्।

SSML समर्थन इन्जिनद्वारा फरक हुन्छ । पज, प्रोसोडी, र जोड ट्यागहरू धेरै प्रिमियम इन्जिनहरूमा र केही स्व- होस्ट गरिएकोहरूमा सम्मान गरिन्छ । सादा पाठ सधैँ काम गर्दछ - मार्कअप आवश्यक छैन ।

स्ट्रिमिङ TTS प्रवाह=सत्यसँग /v1/tts/ API अन्त बिन्दु मार्फत प्रिमियम इन्जिनमा उपलब्ध छ । यो पृष्ठमा वेब UI ले रेन्डरिङ समाप्त भएपछि पूरा क्लिप फर्काउँछ ।

StyleTTS 2 हाम्रो आफ्नै GPUs मा चल्छ. पुस्ता पहिलो आफ्नो दैनिक निःशुल्क पूल देखि रेखाचित्र. एक पटक depleted, भुक्तानी टोकन $5मा सुरु → 200,000 टोकन. लगभग ~5प्रति वर्ण टोकन, न्यूनतम 100 प्रति क्लिप.

सम्म 5,000 वेब UI मा प्रति अनुरोध क्यारेक्टरहरू. लामो टुक्रा लागि (अडियो पुस्तकहरू, पूर्ण अध्याय), प्रयोग / आवाज / अडियो पुस्तक / जो chunks र स्वचालित stitches, वा एक लूप मा एपीआई कल.

हो - POST /v1/tts/batch / स्ट्रिङ को एक सूची, वा /workspace / मा कार्यस्थान UI लामो पाइपलाइन मा TTS chain गर्न प्रयोग (उदाहरणका लागि, अनुवाद → बोल्नुहोस् → बुनाई)।

हो - /v1/tts/ मा पाठ POST गर्न मोडल="StyleTTS 2" (वा यो पृष्ठमा slug) संग । WAV वा MP3 फर्काउँछ । पूरा सन्दर्भ + SDK स्निपेटका लागि /api/ हेर्नुहोस् ।

यो पृष्ठ पाठ-देखि-वाचन हो, आवाज क्लोनिङ होइन - आवाज इन्जिनको पूर्वनिर्धारित हो । आवाज क्लोनिङका लागि (संदर्भ अडियो अपलोड गर्न), /voice/clone/ हेर्नुहोस्, जसले तपाईँलाई आवाज अधिकारहरूको मालिक वा स्पष्ट लिखित सहमति आवश्यक पर्दछ ।

आत्म-होस्ट इन्जिन Free.ai-स्वामित्व GPUs मा चल्छ; केही हाम्रो सर्भर छोड्छ. प्रिमियम इन्जिन पाठ पास हाम्रो DPA अन्तर्गत अपस्ट्रिम मोडेल प्रदायकहरू गर्न. हामी आफ्नो इनपुट मा ट्रेन छैन र डाटा बेच्न छैन.

हो - Free.ai ले उत्पन्न अडियोको व्यावसायिक प्रयोगलाई अनुमति दिन्छ । इन्जिनको आधारभूत लाइसेन्स (Apache 2.0, MIT, वा विक्रेता शर्तहरू) माथि र मोडेल सन्दर्भ पृष्ठमा देखाइएको छ; अभ्यासमा यसको अर्थ आवाज, विज्ञापन, पोडकास्ट, र अनुप्रयोगहरू सबै-क्षेत्रमा छन् ।

हो - असफल काम स्रोत गर्न स्वचालित-रिफन्ड (दिन भरी पूल वा भुक्तानी टोकन). एक रिफन्ड एउटै दिन देखिँदैन भने, इमेल contact@free.ai.

प्रेम Free.ai? आफ्नो साथीहरूलाई भन्नुहोस्!

यो पृष्ठ दर