MeloTTS

Free.ai (self-hosted) · tts · ~500 символы в расчете на clip · 4.6 от 5 пользователей этой категории
~500 символы в расчете на clip

MeloTTS - a Голос в текст, построенный MyShell. Самый сильный в Multilingual TTS. Самоорганизуется на Free.ai GPU — бесплатно против вашего ежедневного символического пула ( 500 токенов на клип). Выпущен под MIT - коммерческое использование разрешено на Free.ai.

Использование через API

OpenAI-совместимый REST API. Выделите ключ и позвоните этой модели за секунды.

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"melotts","text":"hello world"}'
Документация API Выбрать ключ API

Часто задаваемые вопросы

MeloTTS поддерживает широкий круг языков. Точный список зависит от двигателя; форма на этой странице принимает любой текст, и двигатель будет передаваться на его поддерживаемых языках. См./ zook/ для полного многодвигательного сборщика, если вам нужен конкретный язык.

Большинство двигателей делают нейтральный американский английский по умолчанию и делают региональный акцент для неанглийских языков.

Поддержка SSML варьируется в зависимости от двигателя. Пользование, прозодиоз и метки акцентов почитаются на большинстве двигателей и на нескольких самозаводных двигателях. Постоянный текст всегда работает - не требуется разметки.

На премиальных двигателях TTS можно получить доступ через /v1/ts/ API конечная точка с потоком = ==Веб-сайт UI на этой странице возвращает полный клип после завершения.

MeloTTS работает на наших собственных GPU. Поколение сначала получается из вашего ежедневного бесплатного бассейна. После истощения, оплачиваемые жетоны начинаются с 5 · 200 000 символов. Примерно ~5 символов на персонажа, минимум 100 за клип.

До 5000 знаков на запрос в Интернете UI. Для более длинных частей (аудиокниги, полные главы) используйте/скаки/аудиобук, которые автоматически накладывают и швы, или назовите API в петле.

Да - POST список струн /v1/tts/batch/, или использование рабочего пространства UI на /рабочем пространстве/ для цепочки TTS в более длинный трубопровод (например, перевод β говорящий β stech).

Да - текст POST в /v1/tts/ с моделью = "MeloTTS" (или пуля на этой странице). Возвращает WAV или MP3. См. /api/ для полного использования + SDK snippets.

Эта страница - это текст-пик, а не клонирование голоса - голос - это по умолчанию двигатель. Для клонирования голоса (загрузка справочной аудиосвязи) см. / voard/clone/, что требует, чтобы вы либо владеете правами голоса, либо имели явное письменное согласие.

Самоходные двигатели работают на ГПС, принадлежащих Free.ai; ничего не оставляет наших серверов. Премиум двигателя передает текст поставщикам моделей вверх по течению в рамках нашего ДПВ. Мы не тренируемся на ваших входных данных и не продаем данные.

Да - Free.ai предоставляет коммерческое использование генерированного аудио. Основные права двигателя (Apache 2.0, MIT, или условия поставщика) показаны выше и на типовой справочной странице; на практике это означает голосовые очки, рекламы, подкасты и приложения все в пределах охвата.

Yes - failed jobs auto-refund to the source (daily pool or paid tokens). If a refund does not show up the same day, email contact@free.ai.

Love Free.ai? Tell your friends!

Строка