StyleTTS 2

Free.ai (self-hosted) · tts · ~500 ಇದಕ್ಕಾಗಿನ ಸೂಚನೆಗಳು clip · 4.6 ಈ ಫಾರ್ಮಾಟ್‍ 5 ಈ ಪಂಗಡದ ಬಳಕೆದಾರರು
~500 ಇದಕ್ಕಾಗಿನ ಸೂಚನೆಗಳು clip

StyleTTS 2 is a ಪಠ್ಯದಿಂದ ಧ್ವನಿ built by Yinghao Aaron Li. Strongest at Voice cloning without training data; expressive multilingual speech.. Free.ai GPU ಗಳ ಮೇಲೆ ಸ್ವಯಂ- ಆತಿಥೇಯಗೊಂಡಿದೆ - ನಿಮ್ಮ ದಿನನಿತ್ಯದ ಟೋಕನ್ ಪೂಲ್ (500 ಟೋಕನ್ ಕ್ಲಿಪ್) ವಿರುದ್ಧ ಉಚಿತವಾಗಿ ಚಲಿಸುತ್ತದೆ. Released under MIT - commercial use permitted on Free.ai.

ಅನೇಕವೇಳೆ ಪ್ರಶ್ನೆಗಳು

StyleTTS 2 ವಿವಿಧ ಭಾಷೆಗಳು ಬೆಂಬಲಿತವಾಗಿಲ್ಲ. ನಿಖರವಾದ ಪಟ್ಟಿಯು ಎಂಜಿನ್ ಮೇಲೆ ಆಧಾರಗೊಂಡಿದೆ; ಈ ಪುಟದ ವಿನ್ಯಾಸವು ಯಾವುದೆ ಪಠ್ಯವನ್ನು ಸ್ವೀಕರಿಸುತ್ತದೆ ಹಾಗು ಎಂಜಿನ್ ಬೆಂಬಲಿತ ಭಾಷೆಗಳಲ್ಲಿ ನೀಡುತ್ತದೆ. ಒಂದು ನಿಶ್ಚಿತ ಭಾಷೆ ಅಗತ್ಯವಿರುವಲ್ಲಿ /jap/ Dultiano ಅನ್ನು ಆಯ್ಕೆ ಮಾಡುವ ಕಾರ್ಯಕ್ಕೆ ನೋಡಿ.

ಬಹು ಎಂಜಿನ್ ವೈರ್ಯ ಅಮೆರಿಕನ್ ಅನ್ನು ಪೂರ್ವನಿಯೋಜಿತವಾಗಿ ಅನುಕ್ರಮವಾಗಿ ನಿರೂಪಿಸುತ್ತದೆ ಹಾಗು ಒಂದು ಪ್ರದೇಶ- ಪಾರದರ್ಶಕ ಹಾಗು ಎನ್ಗ್ಲರಷ್ ಭಾಷೆಗಳಿಗೆ ಪೂರಕವಾದ ನಿರೂಪಣೆಯನ್ನು ಆಂಶಿಕವಾಗಿ ಒದಗಿಸುತ್ತದೆ. ಪ್ರಿಮಿಶನ್ ಯಂತ್ರಗಳು ವರ್ಚುಯ ಅನುಕ್ರಮವನ್ನು (ಮ್ಯುಡಿಕಾನ್) - ಒಂದು ಮಾದರಿ ಅಂಟಿಕೆಯನ್ನು ಬಯಲುಪಡಿಸಬಹುದು.

SSML ಬೆಂಬಲವು ಎಂಜಿನ್ ಮೂಲಕ ಭಿನ್ನವಾಗಿದೆ. ತಾತ್ಕಾಲಿಕ, ತಾತ್ಕಾಲಿಕ, ಮತ್ತು ಒತ್ತು ಟ್ಯಾಗ್‌ಗಳು ಹೆಚ್ಚಿನ ಇಂಜಿನ್ ಎಂಜಿನ್‌ಗಳು ಹಾಗು ಕೆಲವು ಸ್ವಇಂಟಾ host ಆದಾನಗಳಲ್ಲಿ ಗೌರವಾರ್ಹವಾಗಿವೆ. ಯಾವಾಗಲೂ ಪಠ್ಯ - ಯಾವುದೆ ಮಾರ್ಕೋಪ್ ಅಗತ್ಯವಿಲ್ಲ.

TTS ಅನ್ನು ಕಾರ್ಯಗತಗೊಳಿಸುವುದು, /v1/tts/ API ಕೊನೆಯ ಬಿಂದುವನ್ನು ಸ್ಟ್ರೀಮ್‌ನೊಂದಿಗೆ ಸೇರಿಸಿ, ಇಂಜಿನಲ್‌ ಎಂಜಿನ್‌ಗಳಲ್ಲಿ ಲಭ್ಯವಿದೆ. ಈ ಪುಟದ ಜಾಲ UI ಒಂದು ಬಾರಿ ಪ್ರದರ್ಶನದ ನಂತರ ಪೂರ್ಣ ಚಿತ್ರವನ್ನು ಹಿಂದಿರುಗಿಸುತ್ತದೆ.

StyleTTS 2 runs on our own GPUs. Generation draws from your daily free pool first. Once depleted, paid tokens start at $5 → 200,000 tokens. Roughly ~5 tokens per character, minimum 100 per clip.

ಜಾಲ UI ಯಲ್ಲಿ ಕೋರಿಕೆಗೆ 5,000 ಅಕ್ಷರಗಳವರೆಗೆ (ಆಡಿಯೋ ಬುಕ್‌, ಪೂರ್ಣ ಅಧ್ಯಾಯಗಳು), / burn/audbook/ subjects/ subjects, ಅಥವಾ API ಅನ್ನು ಒಂದು ಪ್ಲಾಪ್‌ಕಲ್ಲಿ ಕರೆದಿ.

ಹೌದು - /v1/ tts/ batch/ ಗೆ ವಾಕ್ಯಗಳ ಪಟ್ಟಿಯನ್ನು POST ಮಾಡಿ, ಅಥವಾ TTS ಅನ್ನು ಒಂದು ಉದ್ದವಾದ ಪೈಪ್ ಲೈನ್ ಗೆ ಜೋಡಿಸಲು / workspace/ ನಲ್ಲಿನ ಕೆಲಸದ ಸ್ಥಳ UI ಅನ್ನು ಬಳಸಿ (ಉದಾ., ಅನುವಾದಿಸು → ಮಾತನಾಡು → ಜೋಡಿಸು).

Yes - POST text to /v1/tts/ with model="StyleTTS 2" (or the slug on this page). Returns WAV or MP3. See /api/ for full reference + SDK snippets.

ಈ ಪುಟವು ಪಠ್ಯ- ಪಠ್ಯ- ಲಿಪ್ಯಂಶ ಅಲ್ಲ, ಧ್ವನಿಯು ಎಂಜಿನ್‌ನ ಪೂರ್ವನಿಯೋಜಿತ ಸ್ಥಿತಿಗೆ ಬರುತ್ತದೆ. ಧ್ವನಿಯನ್ನು ಬಳಸಲು (ಉನ್‌ವರ್ಡ್ ಒಂದು ಪರವಾನಗಿಯ ಆಡಿಯೋ ಅನ್ನು ಉತ್ಥಾಪಿಸಲಾಗಿರುತ್ತದೆ), ಈ ಧ್ವನಿ ಹಕ್ಕುಗಳನ್ನು ನಿಮ್ಮ ಸ್ವಂತವಾಗಿ ಮಾಡಿಕೊಳ್ಳಲು / subject/ seckon/ evol/ clasol/ clasol; ಈ ಮೂಲಕ ನಿಮ್ಮ ಧ್ವನಿ ಹಕ್ಕುಗಳನ್ನು ಹೊಂದಲು ಅಗತ್ಯಪಡಿಸಲಾಗಿದೆ ಅಥವಾ ಲಿಪ್‌ ಮಾಡಲಾದ ಸಾಂಸ್ಕೃತಿಕ ಒಪ್ಪಿಗೆಯನ್ನು (ಸಂಘಟಿತವಾಗಿ).

ಸ್ವಯಂ-ಸೇರಿಸಿಕೊಂಡ Free.ai GPUS ಅನ್ನು ಚಲಾಯಿಸುತ್ತದೆ; ಯಾವುದೂ ನಮ್ಮ ಪರಿಚಾರಕಗಳನ್ನು ಬಿಡುವುದಿಲ್ಲ. ಪ್ರೇರಿಯಮ್ ಎಂಜಿನ್‌ಗಳು ಪಠ್ಯವನ್ನು ನಮ್ಮ DPA ನ ಕೆಳಗಿರುವ ಉತ್ಪತ್ತಿಯ ಉತ್ಪಾದಕರಿಗೆ ಕಳುಹಿಸುತ್ತವೆ. ನಾವು ನಿಮ್ಮ ಪ್ರೊಗ್ರಾಮ್‌ಗಳಿಗೆ ತರಬೇತಿ ನೀಡುವುದಿಲ್ಲ ಮತ್ತು ದತ್ತವನ್ನು ಮಾರುವುದಿಲ್ಲ.

ಹೌದು, Free.ai ಉತ್ಪಾದಿಸಲಾದ ಆಡಿಯೊದ ಜಾಹೀರಾತು ಬಳಕೆ. ಎಂಜಿನ್ನ ಒಳಪಿಡಿ ಲೈಸನ್ಸ್ (Apache 2.0, MIT, ಅಥವಾ ಮಾರಾಟಗಾರ ಪದಗಳು) ಮೇಲೆ ಮತ್ತು MIT ಪ್ರೊಗ್ರಾಮ್ ಪ್ರೊಗ್ರಾಮ್‌ ಪುಟದಲ್ಲಿ ತೋರಿಸಲ್ಪಡುತ್ತದೆ. ಈ ಅರ್ಥದಲ್ಲಿ ಧ್ವನಿವಿಧಾನಗಳು, ಜಾಹೀರಾತುಗಳು, ಜಾಹೀರಾತುಗಳು, ಜಾಹೀರಾತುಗಳು ಮತ್ತು ಅಪಾನಗಳು ಇತ್ಯಾದಿ ಎಲ್ಲವನ್ನು ಪರದೆಗಳಲ್ಲಿ ನೀಡಲಾಗುತ್ತದೆ.

Yes - failed jobs auto-refund to the source (daily pool or paid tokens). If a refund does not show up the same day, email contact@free.ai.

Like this tool? Share it!

ಈ ಪುಟಕ್ಕೆ ರೇಖಾರೂಪಿಸು