AI Voice - Sesame CSM-1B

Kommerzielle Nutzung OK Modelle 581 Kein Wasserzeichen Keine Anmeldung erforderlich
Modell:
+ GPT-5, Claude, Gemini
TTS-Motor Selbstversorger Apache 2.0
Sesame CSM-1B — Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio context turn. Self-hosted on Free.ai for the /voice/realtime/ tool.
0 Zeichen ~0 Token
Kostenskala mit Zeichenzahl
Rede erzeugen...

Was macht das? Sesame CSM-1B Klingt das so?

Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio context turn. Self-hosted on Free.ai for the /voice/realtime/ tool.

Versuchen Sie die Box oben mit: Hallo, mein Name ist Sam, und ich lese dieses Beispiel, um die Stimme zu demonstrieren. - das ist der kanonischen TTS Demo-Phrase.

Wann ist zu verwenden? Sesame CSM-1B

Hörbücher

Langform-Erzählung mit gleichbleibendem Ton. Einfügen eines Kapitels auf einmal, downloaden als WAV oder MP3, und nähen Sie extern.

Podcast-Intros

Kurze Öffnung Stoßfänger und Anzeigen. Justieren Geschwindigkeit für Energie, Format-Schalter auf MP3 für kleinere Dateien.

IVR + Voicemail

Telefonsystem-Anforderung. Studio-Qualität Ausgabe ohne Buchung, Aufnahme oder NDAs mit Sprachtalent.

Zugänglichkeit

Hinzufügen von Audio neben schriftlichen Inhalten für Low-Vision-und Legasthenic-Leser. Drop-in auf jeder Seite.

Beispielsätze

"Welcome to the show, today we are exploring the future of AI."
"Your package has arrived. Please retrieve it from the front desk."
"Once upon a time, in a quiet village far away, lived a curious child."
"Press one for sales, two for support, or stay on the line for an agent."
"Breaking news: scientists have discovered a new species of deep-sea fish."
"Thank you for choosing us. We appreciate your business and look forward to serving you again."

Preisgestaltung

Selbst-hosted auf unseren GPUs. Generation zieht aus Ihrem täglichen freien Pool zuerst; einmal, das läuft, zahlen Token Packs beginnen bei $5 → 200.000 Token. Grob ~5 Token pro Charakter, mindestens 100 pro Clip.

Vollständige Musterreferenz → · Alle TTS Stimmen sehen → · Vergleichen Sie 2 Stimmen nebeneinander →

Erweiterte Optionen
Ergebnis
Die Tokens sind knapp. Mehr Token erhalten
Willst du bessere Ergebnisse? Premium-Modelle (GPT-5, Claude, Gemini) liefern eine höhere Qualität. Pläne anzeigen

❤️ Liebe Free.ai? Erzählen Sie Ihren Freunden!

Melde dich an, um einen Verweis zu erhalten und pro Freund 30.000 Token zu verdienen.

Willst du mehr? Kostenlos registrieren: 30.000 Tokens/Tag
Kostenlos anmelden

Ihre Anfrage bearbeiten...

Sesame CSM-1B - Apache 2.0. Conversational Speech Model designed for low-latency, real-time voice. 24 kHz output, sounds best with a short reference-audio …

Wie man verwendet AI Voice - Sesame CSM-1B

1
Geben Sie Ihre Eingabe ein

Geben Sie Text ein, laden Sie eine Datei hoch oder beschreiben Sie, was Sie wollen. Kein Konto erforderlich.

2
Klicken Sie auf Erzeugung

Unsere KI verarbeitet Ihre Anfrage in Sekundenschnelle mit den besten Open-Source-Modellen.

3
& Teilen herunterladen

Downloaden, kopieren oder teilen Sie Ihr Ergebnis. Kostenlos für den persönlichen und kommerziellen Gebrauch.

Verwenden Sie dieses Tool über API

Automatisieren Sie dieses Tool aus Ihrem eigenen Code. OpenAI-kompatible REST-Endpunkt, Bearer-Token-Auth, kein zusätzliches SDK erforderlich. Tokenkosten entsprechen der Web-Schnittstelle.

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"text": "Hello from Free.ai", "voice": "af_heart", "model": "kokoro"}'

AI Voice - Sesame CSM-1B - FAQ

Sesame CSM-1B unterstützt eine Vielzahl von Sprachen. Die genaue Liste hängt von der Engine ab; das Formular auf dieser Seite akzeptiert jeden Text und die Engine wird in den unterstützten Sprachen rendern. Siehe /voice/ für den vollständigen Mehr-Engine-Picker, wenn Sie eine bestimmte Sprache benötigen.

Die meisten Motoren machen standardmäßig neutral-amerikanisches Englisch und einen regionsgerechten Akzent für nicht-englische Sprachen. Premium-Motoren können Akzentvarianten aussetzen - fügen Sie ein Beispiel zum Vergleich ein.

Die SSML-Unterstützung variiert je nach Motor. Pause, Prosody und Betonung Tags werden auf den meisten Premium-Motoren und auf einigen selbstgehosteten geehrt. Klarer Text funktioniert immer - kein Markup erforderlich.

Streaming TTS ist auf Premium-Engines über den /v1/tts/ API-Endpunkt mit stream=true verfügbar. Die Web-UI auf dieser Seite gibt den kompletten Clip zurück, sobald die Rendering-Endung abgeschlossen ist.

Sesame CSM-1B läuft auf unseren eigenen GPUs. Generation zieht sich zuerst aus Ihrem täglichen freien Pool. Einmal erschöpft, beginnen bezahlte Tokens bei $5 → 200.000 Tokens. Ungefähr ~5 Tokens pro Charakter, mindestens 100 pro Clip.

Bis zu 5.000 Zeichen pro Anfrage auf der Web-UI. Für längere Stücke (Audiobücher, ganze Kapitel), verwenden /voice/audiobook/ die klunks und stichs automatisch, oder rufen Sie die API in einer Schleife.

Ja - POST eine Liste von Strings in /v1/tts/batch/, oder verwenden Sie die Workspace UI in /workspace/, um TTS in eine längere Pipeline zu ketten (z.B. übersetzen → sprechen → Stich).

Ja - POST-Text in /v1/tts/ mit model="Sesame CSM-1B" (oder der Schnecke auf dieser Seite). Gibt WAV oder MP3 zurück. Siehe /api/ für vollständige Referenz + SDK-Schnipsel.

Diese Seite ist Text-zu-Speech, nicht Sprachklonen - die Stimme ist die Standardeinstellung des Motors. Zum Stimmenklonen (Upload eines Referenz-Audios) siehe /voice/clone/, was erfordert, dass Sie entweder die Sprachrechte besitzen oder eine ausdrückliche schriftliche Zustimmung haben.

Selbstgehostete Motoren laufen auf Free.ai-eigenen GPUs; nichts verlässt unsere Server. Premium-Engines übergeben Text an vorgelagerte Modellanbieter unter unserem DPA. Wir trainieren nicht auf Ihre Eingänge und verkaufen keine Daten.

Ja - Free.ai gewährt kommerzielle Nutzung von generiertem Audio. Die zugrunde liegende Lizenz der Engine (Apache 2.0, MIT, oder Verkäuferbegriffe) wird oben und auf der Modellreferenzseite angezeigt; in der Praxis bedeutet dies, dass Voiceovers, Anzeigen, Podcasts und Apps alle in-scope sind.

Ja - fehlgeschlagene Jobs automatisch-zurückerstatten an die Quelle (täglich Pool oder bezahlt Tokens). Wenn eine Rückerstattung nicht am selben Tag angezeigt wird, email contact@free.ai.

Kostenlos registrieren: 30.000 Tokens/Tag

Kostenloses Konto erstellen

Keine Kreditkarte erforderlich

Wie würden Sie dieses Tool bewerten?

4.6/5 from 5 ratings

Liebe Free.ai? Erzählen Sie Ihren Freunden!