Sesame CSM-1B

Free.ai (self-hosted) · tts · ~500 tokens por clip · 4.6 desde 5 usuarios desta categoría
~500 tokens por clip

Sesame CSM-1B é a voz de síntese de texto construído por Sesame. Máis forte en Real-time voice agents, conversational AI, streaming TTS where time-to-first-audio matters more than studio-perfect reads.. Auto- hospedado en GPUs Free.ai - executa libremente contra o seu conxunto diario de tokens (500 tokens por clip). Publicado baixo Apache 2.0 - uso comercial permitido baixo Free.ai.

Usar a API

API REST compatíbel con OpenAI. Xere unha chave e chame a este modelo en segundos.

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"csm-1b","text":"hello world"}'
Documentación da API Obter clave de API

Preguntas frecuentes

Sesame CSM-1B admite unha ampla gama de idiomas. A lista exacta depende do motor; o formulario desta páxina acepta calquera texto e o motor renderizará nos idiomas que admita. Consulta /voice/ para o selector completo de varios motores se precisas un idioma concreto.

A maioría dos motores renderizan inglés neutro americano por defecto e un acento propio da rexión para os idiomas que non son inglés. Os motores premium poden ofrecer variantes de acento: pega unha mostra para comparar.

A compatibilidade con SSML varía segundo o motor. As etiquetas de pausa, prosodia e énfase respéctanse na maioría dos motores premium e nalgúns autoaloxados. O texto simple sempre funciona: non fai falta marcado.

O TTS en streaming está dispoñible nos motores premium mediante o endpoint da API /v1/tts/ con stream=true. A interface web desta páxina devolve o clip completo cando remata a renderización.

Sesame CSM-1B funciona nas nosas propias GPU. A xeración sae primeiro da túa reserva diaria gratuíta. Cando se esgota, os tokens de pago comezan en $5 → 200,000 tokens. Aproximadamente ~5 tokens por carácter, cun mínimo de 100 por clip.

Ata 5,000 caracteres por solicitude na interface web. Para pezas máis longas (audiolibros, capítulos completos), usa /voice/audiobook/, que divide e xunta automaticamente, ou chama á API nun bucle.

Si - envía por POST unha lista de cadeas a /v1/tts/batch/, ou usa a interface do espazo de traballo en /workspace/ para encadear o TTS nunha canle máis longa (p. ex., traducir → falar → xuntar).

Si - envía o texto por POST a /v1/tts/ con model="Sesame CSM-1B" (ou o slug desta páxina). Devolve WAV ou MP3. Consulta /api/ para a referencia completa e fragmentos de SDK.

Esta páxina é de texto a voz, non de clonación de voz: a voz é a predeterminada do motor. Para clonar unha voz (subindo un audio de referencia), consulta /voice/clone/, que require que teñas os dereitos da voz ou un consentimento explícito por escrito.

Os motores autoaloxados funcionan en GPU propiedade de Free.ai; nada sae dos nosos servidores. Os motores premium pasan o texto a provedores de modelos externos baixo o noso DPA. Non adestramos coas túas entradas nin vendemos datos.

Si - Free.ai concede o uso comercial do audio xerado. A licenza subxacente do motor (Apache 2.0, MIT ou termos do provedor) móstrase arriba e na páxina de referencia do modelo; na práctica isto significa que locucións, anuncios, podcasts e aplicacións entran todos.

Si - os traballos fallidos reembólsanse automaticamente á orixe (reserva diaria ou tokens de pago). Se un reembolso non aparece o mesmo día, escribe a contact@free.ai.

Gústache Free.ai? Cóntallo aos teus amigos!

Valora esta páxina