AI Voice - Sesame CSM-1B

Kommersiell användning OK 581-modeller Inget vattenmärke Ingen registrering behövs
Förlaga:
+ GPT-5, Claude, Gemini
TTS-motor Självvärdig Apache 2.0
Sesame CSM-1B — Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio context turn. Self-hosted on Free.ai for the /voice/realtime/ tool.
0 tecken ~0 tokens
Kostnadsskalor med teckenräkning
Skapar tal...

Vad gör Sesame CSM-1B Låter det som?

Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio context turn. Self-hosted on Free.ai for the /voice/realtime/ tool.

Prova rutan ovan med: Hej, mitt namn är Sam, och jag läser detta prov för att visa rösten. - Det är den kanoniska TTS demo fras.

När ska du använda Sesame CSM-1B

Ljudböcker

Långformig berättande med konsekvent ton. Klistra in ett kapitel åt gången, ladda ner som WAV eller MP3 och sy externt.

Podcast-intros

Korta öppningsstötar och ad-reads. Justera hastigheten för energi, format-brytare till MP3 för mindre filer.

IVR + röstbrevlåda

Telefonsystem frågar. Studiokvalitetsutgång utan bokning, inspelning eller NDA med talförmåga.

Tillgänglighet

Lägg till ljud tillsammans med skriftligt innehåll för låg-vision och dyslexiska läsare. Drop-in på alla sidor.

Provfraser

"Welcome to the show, today we are exploring the future of AI."
"Your package has arrived. Please retrieve it from the front desk."
"Once upon a time, in a quiet village far away, lived a curious child."
"Press one for sales, two for support, or stay on the line for an agent."
"Breaking news: scientists have discovered a new species of deep-sea fish."
"Thank you for choosing us. We appreciate your business and look forward to serving you again."

Prissättning

Själv-värd på våra GPUs. Generation drar från din dagliga fri pool först; när det tar slut, betalas token förpackningar börjar på $ 5 → 200.000 polletter. Grovt ~5 polletter per karaktär, minst 100 per klipp.

Fullständig modellreferens → · Se alla TTS-röster → · Jämför 2 röster sida vid sida →

Avancerade alternativ
Resultat
Tokens börjar bli låg. Få fler tokener
Vill du ha bättre resultat? Premiummodeller (GPT-5, Claude, Gemini) levererar högre kvalitet. Visa Planer

❤️ Love Free.ai? Tell your friends!

Registrera dig för att få en referenslänk och tjäna 30.000 polletter per vän.

Vill du ha mer? Registrera dig gratis: 30 000 polletter/dag
Registrera dig gratis

Bearbetning av din begäran...

Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio …

Hur du använder AI Voice - Sesame CSM-1B

1
Ange din inmatning

Skriv text, ladda upp en fil eller beskriv vad du vill. Inget konto behövs.

2
Klicka på generera

Vår AI behandlar din begäran på några sekunder med hjälp av de bästa öppen källkodsmodellerna.

3
Ladda ner & dela

Ladda ner, kopiera eller dela ditt resultat. Gratis för personligt och kommersiellt bruk.

Använd verktyget via API

Automatisera verktyget från din egen kod. OpenAI-kompatibel REST endpoint, Bearer-token auth, inget extra SDK krävs. Token kostnader matchar webbgränssnittet.

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"text": "Hello from Free.ai", "voice": "af_heart", "model": "kokoro"}'

AI Voice - Sesame CSM-1B - FAQ

Sesame CSM-1B stöder ett brett spektrum av språk. Den exakta listan beror på motorn. Formuläret på den här sidan accepterar alla texter och motorn återger på de språk som stöds. Se /voice/ för den fullständiga multimotorväljaren om du behöver ett specifikt språk.

De flesta motorer ger neutral-amerikanska engelska som standard och en region-lämplig accent för icke-engelska språk. Premium motorer kan exponera accent varianter - klistra in ett prov för att jämföra.

SSML-stöd varierar beroende på motor. Paus, prosody och betoningstaggar är hedrade på de flesta premiummotorer och på några självvärdiga. Enkel text fungerar alltid - ingen markering krävs.

Strömma TTS finns på premium motorer via /v1/tts/ API-slutpunkten med stream=true. Webben UI på denna sida returnerar hela klippet när rendering avslutas.

Sesame CSM-1B körs på våra egna GPU. Generation drar från din dagliga fri pool först. När utarmat, betalas polletter börjar på $ 5 → 200.000 tokens. Grovt ~5 tokens per karaktär, minst 100 per klipp.

Upp till 5000 tecken per begäran på webben UI. För längre stycken (audioböcker, fullständiga kapitel), använd /voice/audiobook/ som delar och stygn automatiskt, eller ring API i en loop.

Ja - POST en lista med strängar till /v1/tts/batch/, eller använd arbetsytan UI på /workspace/ för att kedja TTS till en längre pipeline (t.ex., översätta → tala → stygn).

Ja - POST text till /v1/ tts/ med modell="Sesame CSM-1B" (eller snigel på denna sida). Returnerar WAV eller MP3. Se /api/ för fullständig referens + SDK snippets.

Den här sidan är text-till-tal, inte röstkloning - rösten är motorns standard. För röstkloning (uppladdning av ett referensljud), se /voice/clone/, vilket kräver att du antingen äger rösträttigheterna eller har ett uttryckligt skriftligt samtycke.

Självvärdiga motorer körs på Free.ai-ägda GPU:er; ingenting lämnar våra servrar. Premiummotorer skickar text till uppströms modeller under vår DPA. Vi tränar inte på dina ingångar och säljer inte data.

Ja - Free.ai beviljar kommersiell användning av genererat ljud. Motorns underliggande licens (Apache 2.0, MIT, eller leverantörsvillkor) visas ovan och på modellens referenssida; i praktiken betyder det röstövergångar, annonser, podcasts och appar är alla i-scope.

Yes - failed jobs auto-refund to the source (daily pool or paid tokens). If a refund does not show up the same day, email contact@free.ai.

Registrera dig gratis: 30 000 polletter/dag

Skapa gratis konto

Inget kreditkort krävs

Hur skulle du värdera det här verktyget?

4.6/5 from 5 ratings

Love Free.ai? Tell your friends!