Speech to Speech

Kommerzielle Nutzung OK 380+ Modelle Kein Wasserzeichen Keine Anmeldung erforderlich
Modell:
+ GPT-5, Claude, Gemini
Beschreiben Sie das Video, um fortzufahren.
0 / 5000 Zeichen · 0 Sätze Melde dich kostenlos für 6× mehr → Kosten-Updates live basierend auf Stimme + Länge
Kokoro ist unsere Standardeinstellung - schnelle, natürliche Lesevorgänge. Stimmen Auto-Karte zum besten Motor.
Kosten für Live-Token
Tippen Sie ein, um Ihre Kosten für die ausgewählte Stimme zu sehen.
-
Kostenlos registrieren — 30.000 Zeichen/Tag
Erweiterte Optionen
1.0x
0
SSML-Tags anzeigen
SSML-Tag Cheatsheet: <break time="500ms"/> - Ruhe / Pause <prosody rate="slow" pitch="high">text</prosody> - Steuergeschwindigkeit/Stich pro Abschnitt <emphasis level="strong">text</emphasis> - ein Wort betonen <say-as interpret-as="date">01/15/2026</say-as> - Datum / Nummer / Telefon ausrufen <sub alias="World Wide Web">WWW</sub> - Abkürzungen richtig lesen
Herunterladen

Was man mit AI-Stimmen machen kann

YouTube-Erzählung

Kurzbefehle, Dokumentationen, Erklärer erzählen. Kokoro behandelt lange Lesevorgänge ohne Nähte; paare dich mit den Video-Tools, um + Bildunterschrift zu dub.

Hörbücher und Podcasts

Drehen Sie einen Blog-Post, Transkript oder PDF in ein lauschbares MP3. Umschalten Sie lange Stiche für Kapitel-Größe Ausgabe.

Anzeigen & Voiceover

Wählen Sie Chatterbox für ausdrucksstarke liest. 30-Sekunden-Anzeige-Skripte kosten ~150 Token — ein Bruchteil der ElevenLabs-Klasse Preisgestaltung.

Sprachenlernen

Hören Sie jede Passage in nativen klingenden Sprache in 37 Sprachen. Passen Sie Geschwindigkeit 0.5×-2×, um Aussprache zu bohren.

Spieldialog

Prototype NPC dialogue with character voices. Dia handles multi-speaker scenes; pair emotion + pitch for villains and heroes.

Zugänglichkeit

Lese-aloud für lange Artikel, Formularfelder, Produktkopie. WAV Export landet in jeder Screen-Reader-Pipeline.

Wie Free.ai TTS verglichen werden

Was du bekommst Free.ai ElevenLabs Play.ht Murf.ai
Tägliche kostenlose Nutzung5K+ chars/day10K chars / month2.5K words10 minutes
Einschließlich Stimmen17432~900 (premium paywall)120+
Sprachen373214220+
Unterstützung für SSML
Sprachklonen inklusiveFrei$22+/mo$39+/moEnterprise
Öffentliche API
Freier Antrieb Kokoro, Piper, Dia…---
Anmeldung erforderlichNeinYesYesYes
Die Zahlen des Wettbewerbers spiegeln die öffentlich gelisteten freien Stufen ab 2026 wider. Prüfen Sie jeden Anbieter auf aktuelle Planbedingungen.
Erweiterte Optionen
Ergebnis
Die Tokens sind knapp. Erhalten Sie mehr Token
Willst du bessere Ergebnisse? Premium-Modelle (GPT-5, Claude, Gemini) liefern eine höhere Qualität. Pläne anzeigen

❤️ Love this tool? Share it!

Melde dich an, um einen Verweis zu erhalten und pro Freund 30.000 Token zu verdienen.

Willst du mehr? Melde dich kostenlos an für 30K Tokens/Tag + 10K Bonus
Kostenlos anmelden

Ihre Anfrage bearbeiten...

Verwandeln Sie Ihre Stimme in eine andere Stimme in Echtzeit mit freier KI-Sprachumwandlung.

Verwendung Speech to Speech

1
Geben Sie Ihre Eingabe ein

Geben Sie Text ein, laden Sie eine Datei hoch oder beschreiben Sie, was Sie wollen.

2
Klicken Sie auf Generieren

Unsere KI verarbeitet Ihre Anfrage in Sekundenschnelle mit den besten Open-Source-Modellen.

3
Herunterladen & Teilen

Downloaden, kopieren oder teilen Sie Ihr Ergebnis. Kostenlos für den persönlichen und kommerziellen Gebrauch.

Verwenden Sie dieses Tool über API

Automatisieren Sie dieses Tool aus Ihrem eigenen Code. OpenAI-kompatible REST-Endpunkt, Bearer-Token-Auth, kein zusätzliches SDK erforderlich. Tokenkosten entsprechen der Web-Schnittstelle.

curl -X POST https://api.free.ai/v1/tts/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"text": "Hello from Free.ai", "voice": "af_heart", "model": "kokoro"}'

Speech to Speech - FAQ

Laden Sie eine Sprachaufnahme hoch und wählen Sie eine Zielstimme aus – die KI hält Ihre Worte und Intonation, aber tauscht die Sprachidentität aus.

Laden Sie einen kurzen Audioclip hoch, wählen Sie die Zielstimme aus 174 Optionen und klicken Sie auf Konvertieren. Die neue Stimme spricht Ihre ursprünglichen Wörter mit passendem Timing.

Ja, Ihr täglich kostenlos genutzter Tokenpool (6.000 Gast, 30.000 registriert) kostet ungefähr das gleiche wie TTS durch die Dauer.

Ja. Speech-to-Speech bewahrt das Timing, die Betonung und die emotionalen Konturen Ihres Inputs – nur die Sprachidentität ändert sich.

MP3, WAV, M4A oder die meisten gängigen Audioformate bis zu 500MB hochladen. Speech-to-Speech-Ausgabe wird als WAV-Datei geliefert.

Ja — zunächst Ihre Stimme auf /voice/clone/ klonen, dann Ihre geklonte Stimme als Ziel in der Sprache-zu-Sprechen-Taste auswählen.

Sehr nah an der Zielstimme. Moderne Sprach-Sprech-Modelle bewahren die Prosody treu und verschieben Timbre auf die gewählte Zielstimme.

Ja. Nehmen Sie eine grobe Aufnahme mit Ihrer eigenen Stimme auf, dann sprechen Sie mit einer professionellen, klingenden Zielstimme. Spart die Wiederaufnahmezeit.

Am besten in der gleichen Sprache. Cross-language Speak-to-Speech Werke, aber Aussprache leiden kann — für übersetzte Voiceover, verwenden Sie TTS auf dem übersetzten Text.

Bis zu 500MB pro Upload. Längere Clips dauern länger. Für beste Ergebnisse, teilen sehr lange Aufnahmen in 5–10 Minuten Sprach-zu-Sprech-Teile.

Ja. Ihr Eingangsaudio wird auf unseren GPUs verarbeitet und nach Sprach-zu-Sprechen-Abschluss gelöscht. Nichts wird langfristig gespeichert oder für das Training verwendet.

Podcast-Anonymisierung, Voice-over-Redo mit einer professionellen Stimme, Synchronisation mit konsistentem Ton, Charakter-Swaps für Animation und Sprach-Aktiv-Experiment.

Kostenlos registrieren — 30.000 Zeichen/Tag

Kostenloses Konto erstellen

Keine Kreditkarte erforderlich

Wie würden Sie dieses Tool bewerten?

Love this tool? Share it!