MeloTTS

Free.ai (self-hosted) · tts · ~500 Torneiras por clip · 4.6 a partir de 5 utilizadores desta categoria
~500 Torneiras por clip

MeloTTS é a Voz de texto a voz construído por MyShell. A mais forte em Multilingual TTS. Self-hosted on Free.ai GPUs — corre livre contra a sua piscina cotidiana de tokens (500 tokens por clipe). Lançado sob MIT - uso comercial permitido em Free.ai.

Utilizar através da API

API REST compatível com a OpenAI. Gere uma chave e chame este modelo em segundos.

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"melotts","text":"hello world"}'
Documentação da API Obter a chave da API

Perguntas Frequentes

MeloTTS suporta uma ampla gama de idiomas. A lista exata depende do motor; o formulário nesta página aceita qualquer texto e o motor irá renderizar em suas línguas suportadas. Veja /voice / para o picker multi-motor completo se você precisar de uma língua específica.

A maioria dos motores rendem o inglês neutra-americano por padrão e um acento regional adequado para idiomas não-inglês. Os motores premium podem expor variantes de accento - colar uma amostra para comparar.

O suporte SSML varia por motor. Pausa, prosódia e ênfase as etiquetas são honradas na maioria dos motores premium e em alguns auto-hosted. Texto simples sempre funciona - nenhuma marca necessária.

A TTS de streaming está disponível em motores premium através do /v1/tts/ API endpoint com stream=true. A UI web nesta página devolve o clip completo uma vez que termina a renderização.

MeloTTS funciona em nosso próprio GPUs. Geração tira de sua piscina gratuita diária primeiro. Uma vez esgotado, fichas pagas começam com $5 → 200.000 fichas. Aproximadamente ~5 fichas por personagem, mínimo 100 por clipe.

Até 5.000 caracteres por pedido na UI web. Para peças mais longas (audiobooks, capítulos completos), use /voice/audiobook/ que pedaços e pontos automaticamente, ou chame a API em um loop.

Sim - POST uma lista de cordas para /v1/tts/batch /, ou usar a interface de trabalho em /workspace/ para encadenar TTS em um pipeline mais longo (por exemplo, traduzir → falar → ponto).

Sim - Texto POST para /v1/tts/ com model="MeloTTS" (ou o engoma nesta página). Devolve WAV ou MP3. Veja /api/ para referência completa + SDK snippets.

Esta página é texto-a- voz, não clonagem de voz - a voz é o padrão do motor. Para clonagem de voz (uploading a reference audio), consulte /voice/clone/, que requer que você seja proprietário dos direitos de voz ou tenha consentimento escrito explícito.

Motores auto-hostados executam-se em GPU pertencentes ao Free.ai; nada deixa nossos servidores. Os motores premium passam texto para fornecedores de modelos a montante sob nosso DPA. Nós não treinamos em seus insumos e não vendemos dados.

Sim - Free.ai concede uso comercial do áudio gerado. A licença subjacente do motor (Apache 2.0, MIT ou termos do fornecedor) é mostrada acima e na página de referência do modelo; na prática isso significa que os anúncios, podcasts e aplicativos são todos in-scop.

Sim - trabalhos falhados reembolsar automaticamente para a fonte (pool diário ou fichas pagas). Se um reembolso não aparecer no mesmo dia, e-mail contact@free.ai.

Adoro Free.ai? Diga aos seus amigos!

Avaliar esta página