AI Voice - Sesame CSM-1B

Uso commerciale OK modelli 581 Nessuna filigrana Nessun segno necessario
Modello:
+ GPT-5, Claude, Gemini
Motore TTS Auto-ospitalità Apache 2.0
Sesame CSM-1B — Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio context turn. Self-hosted on Free.ai for the /voice/realtime/ tool.
0 caratteri ~0 token
Bilancia dei costi con conteggio dei caratteri
Generazione discorso...

Cosa fa Sesame CSM-1B Sembra?

Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio context turn. Self-hosted on Free.ai for the /voice/realtime/ tool.

Provate la casella qui sopra con: Ciao, mi chiamo Sam, e sto leggendo questo campione per dimostrare la voce. - che è la frase demo TTS canonica.

Quando usare Sesame CSM-1B

Audiolibri

Narrazione a lunga forma con tono coerente. Incolla un capitolo alla volta, scarica come WAV o MP3, e cuci all'esterno.

Intro podcast

Paraurti e lettura pubblicità a breve apertura. Regolare la velocità per l'energia, il formato-interruttore a MP3 per i file più piccoli.

IRIS + segreteria

Prompt del sistema telefonico. Uscita di qualità senza prenotazione, registrazione, o NDA con talento vocale.

Accessibilità

Aggiungi audio insieme a contenuti scritti per lettori di bassa visione e dislessici. Drop-in su qualsiasi pagina.

Frasi di esempio

"Welcome to the show, today we are exploring the future of AI."
"Your package has arrived. Please retrieve it from the front desk."
"Once upon a time, in a quiet village far away, lived a curious child."
"Press one for sales, two for support, or stay on the line for an agent."
"Breaking news: scientists have discovered a new species of deep-sea fish."
"Thank you for choosing us. We appreciate your business and look forward to serving you again."

Prezzi

Auto-hosted sulle nostre GPU. La generazione attinge prima dal tuo pool giornaliero gratuito; una volta esaurito, i pacchetti di token a pagamento partono da $5 -> 200.000 token. Circa ~5 token per carattere, minimo 100 per clip.

Riferimento completo del modello → · Visualizza tutte le voci TTS → · Confronta 2 voci affiancate →

Opzioni avanzate
Risultato
I token sono bassi. Ottenere più token
Vuoi risultati migliori? Modelli premium (GPT-5, Claude, Gemini) forniscono una qualità superiore. Visualizza Piani

❤️ Love Free.ai? Dillo ai tuoi amici!

Iscriviti per ottenere un link di referral e guadagnare 30.000 token per amico.

Ne vuoi ancora? Iscriviti gratis: 30.000 token al giorno
Iscriviti gratis

Elaborazione della tua richiesta...

Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio …

Come usare AI Voice - Sesame CSM-1B

1
Inserisci il tuo input

Digitare testo, caricare un file o descrivere ciò che si desidera. Nessun account necessario.

2
Fare clic su genera

La nostra AI elabora la tua richiesta in pochi secondi utilizzando i migliori modelli open-source.

3
Scarica & condivisione

Scaricare, copiare o condividere il risultato. Gratis per uso personale e commerciale.

Usa questo strumento tramite API

Automatizzare questo strumento dal proprio codice. Endpoint REST compatibile con OpenAI, auth Bearer-token, nessun SDK aggiuntivo richiesto. I costi Token corrispondono all'interfaccia web.

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"text": "Hello from Free.ai", "voice": "af_heart", "model": "kokoro"}'

AI Voice - Sesame CSM-1B - FAQ

Sesame CSM-1B supporta un'ampia gamma di lingue. L'elenco esatto dipende dal motore; il modulo su questa pagina accetta qualsiasi testo e il motore verrà visualizzato nelle lingue supportate. Vedere /voice/ per il picker multimotore completo se avete bisogno di una lingua specifica.

La maggior parte dei motori rende l'inglese neutro-americano per impostazione predefinita e un accento adatto alla regione per le lingue non inglesi. I motori premium possono esporre le varianti di accento - incolla un campione da confrontare.

Il supporto SSML varia a seconda del motore. Pausa, prosodia e tag enfasi sono onorati sulla maggior parte dei motori premium e su alcuni auto-ospitato. Testo semplice funziona sempre - nessun markup richiesto.

Streaming TTS è disponibile su motori premium tramite l'endpoint /v1/tts/ API con stream=true. L'interfaccia utente web di questa pagina restituisce il clip completo una volta che il rendering termina.

Sesame CSM-1B funziona sulle nostre GPU. La generazione attinge prima dal tuo pool giornaliero gratuito. Una volta esaurito, i token a pagamento partono da $5 -> 200.000 token. Circa ~5 token per carattere, minimo 100 per clip.

Fino a 5.000 caratteri per richiesta sulla UI web. Per pezzi più lunghi (audiolibri, capitoli completi), utilizzare /voice/audiobook/ che si cuce automaticamente, o chiamare l'API in un ciclo.

Sì - POST una lista di stringhe in /v1/tts/batch/, oppure utilizzare l'interfaccia utente dello spazio di lavoro in /workspace/ per incatenare TTS in una pipeline più lunga (ad esempio, tradurre → parlare → punto).

Sì - Testo POST a /v1/tts/ con model="Sesame CSM-1B" (o il proiettile di questa pagina). Restituisce WAV o MP3. Vedere /api/ per riferimento completo + snippet SDK.

Questa pagina è testo a voce, non clonazione vocale - la voce è il valore predefinito del motore. Per la clonazione vocale (caricando un audio di riferimento), vedere /voice/clone/, che richiede di possedere i diritti di voce o avere esplicito consenso scritto.

I motori auto-ospitati funzionano su GPU di proprietà di Free.ai; nulla lascia i nostri server. I motori Premium passano testo ai fornitori di modelli a monte sotto il nostro DPA. Non ci alleniamo sui vostri input e non vendono dati.

Sì - Free.ai garantisce l'uso commerciale dell'audio generato. La licenza di base del motore (Apache 2.0, MIT, o termini del fornitore) è visualizzata sopra e sulla pagina di riferimento del modello; in pratica questo significa che voiceover, annunci, podcast e applicazioni sono tutti in-scope.

Sì - i lavori falliti vengono rimborsati automaticamente alla fonte (pool giornaliero o token a pagamento). Se un rimborso non arriva lo stesso giorno, scrivi a contact@free.ai.

Iscriviti gratis: 30.000 token al giorno

Crea account gratuito

Non è richiesta alcuna carta di credito

Come valuteresti questo strumento?

4.6/5 from 5 ratings

Love Free.ai? Dillo ai tuoi amici!