AI Voice - Sesame CSM-1B

Uso comercial OK Modelos 581 Sin marca de agua No es necesario inscribirse
Modelo:
+ GPT-5, Claude, Gemini
Motor TTS Auto-acogida Apache 2.0
Sesame CSM-1B — Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio context turn. Self-hosted on Free.ai for the /voice/realtime/ tool.
0 caracteres ~0 tokens
Escalas de costos con recuento de caracteres
Generando discurso...

¿Qué hace? Sesame CSM-1B ¿Suena como?

Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio context turn. Self-hosted on Free.ai for the /voice/realtime/ tool.

Prueba la casilla de arriba con: Hola, mi nombre es Sam, y estoy leyendo esta muestra para demostrar la voz. - que es la frase canónica demo TTS.

Cuándo usar Sesame CSM-1B

Audiolibros

Forma larga narración con tono consistente. Pegue un capítulo a la vez, descargar como WAV o MP3, y coser externamente.

Introduccións de podcast

Parachoques de apertura cortos y lecturas de anuncios. Ajustar la velocidad de energía, el formato de cambio a MP3 para archivos más pequeños.

IVR + buzón de voz

Preguntas sobre el sistema de teléfono. Salida de calidad de estudio sin reserva, grabación o NDA con talento de voz.

Accesibilidad

Añadir audio junto con el contenido escrito para lectores de visión baja y disléxico.

Ejemplo de frases

"Welcome to the show, today we are exploring the future of AI."
"Your package has arrived. Please retrieve it from the front desk."
"Once upon a time, in a quiet village far away, lived a curious child."
"Press one for sales, two for support, or stay on the line for an agent."
"Breaking news: scientists have discovered a new species of deep-sea fish."
"Thank you for choosing us. We appreciate your business and look forward to serving you again."

Precios

Autoalojado en nuestras GPU. La generación usa primero tu cupo diario gratuito; una vez agotado, los paquetes de tokens de pago comienzan en $5 → 200 000 tokens. Aproximadamente ~5 tokens por carácter, mínimo 100 por clip.

Referencia completa del modelo → · Ver todas las voces TTS → · Comparar 2 voces lado a lado →

Opciones avanzadas
Resultado
Los picos se están agotando. Obtenga más tokens
¿Quieres mejores resultados? Modelos premium (GPT-5, Claude, Gemini) ofrecen una calidad más alta. Ver los planes

❤️ ¿Ama a Free.ai? ¡Dile a tus amigos!

Regístrate para obtener un enlace de referido y ganar 30 000 tokens por cada amigo.

¿Quieres más? Regístrate gratis: 30 000 tokens/día
Regístrate gratis

Procesando su solicitud...

Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio …

Cómo usar AI Voice - Sesame CSM-1B

1
Introduzca su entrada

Escriba texto, cargue un archivo o describa lo que quiera. No necesita cuenta.

2
Haga clic en generar

Nuestra IA procesa su solicitud en segundos utilizando los mejores modelos de código abierto.

3
Descargar y compartir

Descarga, copia o comparte tu resultado. Gratis para uso personal y comercial.

Utilice esta herramienta a través de API

Automatice esta herramienta desde su propio código. Endpoint REST compatible con OpenAI, Autentica de torre de portadora, no se requiere SDK adicional. Los costos de la conexión coinciden con la interfaz web.

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"text": "Hello from Free.ai", "voice": "af_heart", "model": "kokoro"}'

AI Voice - Sesame CSM-1B - FAQ

Sesame CSM-1B admite una amplia gama de idiomas. La lista exacta depende del motor; el formulario de esta página acepta cualquier texto y el motor se renderizará en sus idiomas soportados. Vea /voice/ para el selector multimotor completo si necesita un idioma específico.

La mayoría de los motores representan el inglés americano neutral por defecto y un acento apropiado para la región para idiomas no ingleses. Los motores premium pueden exponer variantes de acento - pegar una muestra para comparar.

El soporte SSML varía según el motor. Las etiquetas de pausa, prosodia y énfasis se honran en la mayoría de los motores premium y en algunos auto-anfitriones. El texto plano siempre funciona - no se requiere marcado.

La transmisión TTS está disponible en motores premium a través del punto final /v1/tts/ API con stream=true. La interfaz de usuario web de esta página devuelve el clip completo una vez que termina la renderización.

Sesame CSM-1B se ejecuta en nuestras propias GPU. La generación usa primero tu cupo diario gratuito. Una vez agotado, los tokens de pago comienzan en $5 → 200 000 tokens. Aproximadamente ~5 tokens por carácter, mínimo 100 por clip.

Hasta 5.000 caracteres por petición en la interfaz de usuario web. Para piezas más largas (audiolibros, capítulos completos), use /voice/audiobook/ que trozos y puntos automáticamente, o llame a la API en un bucle.

Sí - POST una lista de cadenas a /v1/tts/batch/, o utilizar la interfaz de usuario del espacio de trabajo en /workspace/ para encadenar TTS en una tubería más larga (por ejemplo, traducir → hablar → punto).

Sí - Mensaje de texto a /v1/tts/ con modelo="Sesame CSM-1B" (o la bala en esta página). Devuelve WAV o MP3. Vea /api/ para la referencia completa + fragmentos SDK.

Esta página es texto a voz, no clonación de voz - la voz es el valor predeterminado del motor. Para la clonación de voz (cargando un audio de referencia), véase /voice/clone/, que requiere que usted sea propietario de los derechos de voz o tenga consentimiento explícito por escrito.

Los motores auto-alojados funcionan con GPUs de Free.ai; nada sale de nuestros servidores. Los motores Premium pasan texto a los proveedores de modelos de arriba bajo nuestro DPA. No entrenamos en sus entradas y no vendemos datos.

Sí - Free.ai concede el uso comercial de audio generado. La licencia subyacente del motor (Apache 2.0, MIT, o términos del proveedor) se muestra arriba y en la página de referencia del modelo; en la práctica esto significa que las voces en off, anuncios, podcasts y aplicaciones están todas en el alcance.

Sí - trabajos fallidos auto-reembolso a la fuente (al día de la reserva o tokens pagados). Si un reembolso no aparece el mismo día, envíe un correo electrónico a contact@free.ai.

Regístrate gratis: 30 000 tokens/día

Crear cuenta gratuita

No se requiere tarjeta de crédito

¿Cómo calificaría a esta herramienta?

4.6/5 from 5 ratings

¿Ama a Free.ai? ¡Dile a tus amigos!