Kokoro

Free.ai (self-hosted) · tts · ~500 टोकन प्रति clip · 4.6 पासून 5 या विभागातील वापरकर्ता
~500 टोकन प्रति clip

Kokoro हे a आहे text-to-speech voice Hexgrad द्वारे बनवलेले आहे. Strongest at Fast, natural speech. Free.ai GPUs वर स्व-होस्ट - आपल्या दैनंदिन टोकन पूल विरुद्ध मुक्तपणे चालते (500 टोकन प्रति क्लिप). Released under Apache 2.0 — commercial use permitted on Free.ai.

API द्वारे वापरा

OpenAI-सुसंगत REST API. किल्ली निर्माण करा व सेकंदांमध्ये हे मॉडेल कॉल करा.

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"kokoro","text":"hello world"}'
API दस्तऐवजीकरण API कि प्राप्त करा

वारंवार विचारले जाणारे प्रश्न

Kokoro अनेक भाषांना समर्थन पुरवते. सखोल यादी इंजिनवर अवलंबून असते; या पानावरील फॉर्म कोणत्याही पाठ्य स्वीकारतो व इंजिन समर्थीत भाषांमधून रेंडरिंग करते. विशिष्ट भाषा आवश्यक असल्यास पूर्ण बहु- इंजिन निवडक करीता /voice/ पहा.

बहुतेक इंजिन मुलभूतरित्या न्युट्रल- अमेरिकन इंग्रजी व गैर- इंग्रजी भाषा करीता क्षेत्र- योग्य उच्चारण दर्शवितात. प्रीमियम इंजिन उच्चारण बदल दर्शवू शकतात - तुलना करीता नमुना चिकटवा.

SSML समर्थन इंजिननुरूप बदलते. पॅसेज, प्रोसोडी, व जोर टॅग सर्वात प्रीमियम इंजिन व काही स्वयं- यजमानवर मानले जातात. सादा पाठ्य नेहमी कार्य करते - मार्कअप आवश्यक नाही.

स्ट्रीमिंग TTS प्रीमियम इंजिनवर /v1/tts/ API endpoint द्वारे stream=true सह उपलब्ध आहे. या पानावरील वेब UI रेंडरिंग पूर्ण झाल्यानंतर संपूर्ण क्लिप परत करतो.

Kokoro आपल्या स्वतःच्या GPU वर चालते. जनरेशन प्रथम आपल्या दैनंदिन मोफत पूल पासून ड्रॉप करते. एकदा संपल्यावर, मोफत टोकन $5 → 200,000 टोकन पासून सुरू होतात. सुमारे ~5 टोकन प्रति अक्षर, किमान 100 प्रति क्लिप.

5000 अक्षरांपर्यंत वेब UI वर प्रति विनंती. लांब भागांसाठी (ऑडिओबुक, संपूर्ण अध्याय), /voice/audiobook / वापरा जे स्वयंचलितपणे चिप्स आणि स्टीफन्स वापरतात, किंवा loop मध्ये API ला कॉल करा.

या योजनेत, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी, 1/3 भाग (1/3) साठी

होय - POST /v1/tts/ वरील पाठ्य मॉडेल=" Kokoro "सह (किंवा या पानावरील slug). WAV किंवा MP3 परत करते. पूर्ण संदर्भासाठी + SDK स्निपेट्स करीता /api/ पहा.

हे पान पाठ्य- ते- वक्तव्य आहे, आवाज क्लोन नाही - आवाज इंजिनचे मुलभूत आहे. आवाज क्लोन करीता (संदर्भ ऑडिओ अपलोड करणे), /voice/clone/ पहा, ज्यास तुम्हाला आवाज अधिकार किंवा स्पष्ट लिहिलेल्या परवानगीची आवश्यकता आहे.

Free.ai- मालकीचे GPUs वर स्वयं- होस्ट केलेले इंजिन चालविले जाते; आमच्या सर्वर पासून काहीही बाहेर पडत नाही. प्रीमियम इंजिन आमच्या DPA अंतर्गत upstream मॉडेल पुरवठादारांना पाठ्य पाठवते. आम्ही तुमच्या इनपुट वर प्रशिक्षण देत नाही आणि माहिती विकत घेत नाही.

होय - Free.ai निर्मित ऑडिओचा व्यावसायिक वापर करण्यास परवानगी देते. इंजिनची खालची परवाना (Apache 2.0, MIT, किंवा विक्रेता नियम) वरील आणि मॉडेल संदर्भ पानावर दर्शविली जाते; व्यवहारात याचा अर्थ आवाज, जाहिरात, पॉडकास्ट, आणि अनुप्रयोग सर्व क्षेत्रात आहेत.

होय - अपयशी काम स्वचलितरित्या स्त्रोत (दिवसीय पूल किंवा मोफत टोकन) कडे परत केले जाते. जर परतफेड त्याच दिवशी दिसली नाही तर, contact@free.ai ला ईमेल करा.

Free.ai ला आवडते? आपल्या मित्रांना सांगा!

या पानाचे गुणांकन करा