MeloTTS

Free.ai (self-hosted) · tts · ~500 tokens por clip · 4.6 desde 5 usuarios desta categoría
~500 tokens por clip

MeloTTS é a voz de síntese de texto construído por MyShell. Máis forte en Multilingual TTS. Auto-aloxado en Free.ai GPUs — executa libremente contra o seu conxunto de tokens diarios (500 tokens por clip). Publicado baixo MIT - uso comercial permitido baixo Free.ai.

Usar a API

API REST compatíbel con OpenAI. Xere unha chave e chame a este modelo en segundos.

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"melotts","text":"hello world"}'
Documentación da API Obter a chave da API

Preguntas frecuentes

MeloTTS soporta unha ampla variedade de linguas. A lista exacta depende do motor; o formulario desta páxina acepta calquera texto e o motor renderizará nas linguas soportadas. Consulte / voice / para o selector completo de múltiples motores se precisa unha lingua específica.

A maioría dos motores renderizan o inglés americano neutro por omisión e un acento apropiado para a rexión para as linguas que non sexan inglesas. Os motores Premium poden expor variantes de acentos - apegue unha mostra para comparar.

O soporte de SSML varía segundo o motor. As etiquetas de pausa, prosodi e énfase son respectadas na maioría dos motores premium e en algúns auto- hospedados. O texto simple sempre funciona - non se precisan marcas.

A transmisión de TTS está dispoñíbel nos motores premium mediante o punto final da API / v1/ tts/ con stream=true. A interface web desta páxina devolve o clip completo cando remata a representación.

MeloTTS runs on our own GPUs. Generation draws from your daily free pool first. Once depleted, paid tokens start at $5 → 200,000 tokens. Roughly ~5 tokens per character, minimum 100 per clip.

Ata 5000 caracteres por petición na interface web. Para pezas máis longas (audiolibros, capítulos completos), use /voice/audiobook/ que se fragmenta e se une automaticamente, ou chame á API nun bucle.

Si - POST unha lista de cadeas a / v1/ tts/ batch /, ou empregar a interface do espazo de traballo en / workspace / para encadear TTS nun canal máis longo (por ex., traducir → falar → sutura).

Si - POST texto a / v1/ tts / con model=" MeloTTS "(ou o slug nesta páxina). Devolve WAV ou MP3. Consulte / api / para referencia completa + fragmentos do SDK.

Esta páxina é de texto- a- fala, non de clonación de voz - a voz é a predeterminada do motor. Para clonar a voz (enviar un son de referencia), consulte / voice/ clone /, que require que sexa o propietario dos dereitos da voz ou que teña un consentimento explícito por escrito.

Os motores auto- hospedados executan en GPUs de Free.ai; nada sae dos nosos servidores. Os motores Premium pasan o texto a provedores de modelos ascendentes baixo o noso DPA. Non adestramos coas súas entradas e non vendemos datos.

Si - Free.ai concede o uso comercial do son xerado. A licenza subxacente do motor (Apache 2.0, MIT ou termos do vendedor) móstrase enriba e na páxina de referencia do modelo; na práctica isto significa que as voces, anuncios, podcasts e programas están todos incluídos.

Yes - failed jobs auto-refund to the source (daily pool or paid tokens). If a refund does not show up the same day, email contact@free.ai.

Amas a Free.ai?

Cualificar esta páxina