Podcast-Transkription

Kommerzielle Nutzung OK Modelle 581 Kein Wasserzeichen Keine Anmeldung erforderlich
Modell:
+ GPT-5, Claude, Gemini
Laden Sie eine Podcast-Episode hoch und erhalten Sie ein sauberes, sprecher-beschriftetes Transkript mit automatisch erkannten Kapitelmarkern aus Stillelücken. Langformdateien bis zu 2GB, 99 Sprachen, Whisper-large-v3 Genauigkeit. Exportieren Sie als SRT/VTT für Ihren Video-Podcast, schlichte TXT für Show Notes oder JSON für die Bearbeitung in Descript-Stil Workflows.

Ziehen und Drop Ihre Podcast-Episode, oder klicken Sie auf zum Durchsuchen

MP3, WAV, M4A, OGG, MP4 — Langzeit-Episoden bis zu 2 GB

- - - -
Kapitelmarker werden clientseitig aus Segmentlücken berechnet und an das Transkript angehängt. Fügen Sie sie in YouTube oder Spotify Beschreibungen als-is ein.
Token Schätzung für diesen Clip
-
Podcast-Transkript
Selbsterkannte Kapitel

Ich überschreibe deinen Podcast...

Lange Episoden dauern mehrere Minuten. Sie können diese Registerkarte schließen, wenn E-Mail-wenn-done markiert ist.

Für Podcaster + Show Editoren gebaut

Noten in einer Paste anzeigen

Laden Sie die Episode hoch, laden Sie die TXT herunter. Lautsprecheretiketten inline, Kapitel-Zeitstempel bereit für Ihre Spotify/YouTube Beschreibung, Blog-Post geschrieben in 10 Minuten statt 4 Stunden.

Untertitel für Video-Podcasts

Exportieren Sie SRT oder WebVTT mit Lautsprecheretiketten. Fallen Sie direkt in Premiere, Final Cut oder DaVinci Resolve – oder laden Sie Ihr YouTube-Video für saubere Bildunterschriften hoch.

Textbasierte Episodenbearbeitung

JSON Export gibt Ihnen jedes Wort mit Start/End-Zeitstempeln. Pipe in Descript, Reaper oder einen benutzerdefinierten Workflow – Bearbeiten durch Hervorhebung von Text statt Scrubbing.

Wie Podcast-Transkription funktioniert

  1. Ziehen Sie Ihre Episode auf die Drop-Zone — MP3, WAV, M4A, MP4, bis zu 2GB.
  2. Lassen Sie Lautsprecher-Etiketten und Kapitel-Marker an (sie sind die Standardwerte). Wählen Sie Ihr Ausgabeformat.
  3. Wir überprüfen die Dauer + Preis es, bevor Sie irgendwelche Token ausgeben. Klicken Sie auf Transcribe.
  4. Download sprecher-beschriftete TXT, SRT, VTT oder JSON. Kapitel Marker Schiff neben, bereit zu einfügen.

Free.ai Podcast-Transkription vs. Descript, Riverside, Otter

Funktion Free.ai Descript Riverside Otter.ai
PreisPay-per-use ($0.003/min)$15-30/mo$19/mo$16.99/mo
Dateigröße max.2 GB5 GBTied to record session500 MB (varies)
Veröffentlichungen
Automatische Kapitel-Marker (Schweigen-basiert)Manual-Paid tier
Ausfuhr von SRT/VTTPaid
Sprachen9922100+English-focused
Öffentliche API--Limited
Die Preisgestaltung für Wettbewerber spiegelt die öffentlich notierten Stufen im Jahr 2026 wider. Prüfen Sie jeden Anbieter auf aktuelle Pläne.
Erweiterte Optionen
Ergebnis
Die Tokens sind knapp. Mehr Token erhalten
Willst du bessere Ergebnisse? Premium-Modelle (GPT-5, Claude, Gemini) liefern eine höhere Qualität. Pläne anzeigen

❤️ Liebe Free.ai? Erzählen Sie Ihren Freunden!

Melde dich an, um einen Verweis zu erhalten und pro Freund 30.000 Token zu verdienen.

Willst du mehr? Kostenlos registrieren: 30.000 Tokens/Tag
Kostenlos anmelden

Ihre Anfrage bearbeiten...

Beschrifte Podcasts kostenlos mit KI. Lautsprecheretiketten, Kapitelmarker, SRT-Export.

Wie man verwendet Podcast-Transkription

1
Geben Sie Ihre Eingabe ein

Geben Sie Text ein, laden Sie eine Datei hoch oder beschreiben Sie, was Sie wollen. Kein Konto erforderlich.

2
Klicken Sie auf Erzeugung

Unsere KI verarbeitet Ihre Anfrage in Sekundenschnelle mit den besten Open-Source-Modellen.

3
& Teilen herunterladen

Downloaden, kopieren oder teilen Sie Ihr Ergebnis. Kostenlos für den persönlichen und kommerziellen Gebrauch.

Verwenden Sie dieses Tool über API

Automatisieren Sie dieses Tool aus Ihrem eigenen Code. OpenAI-kompatible REST-Endpunkt, Bearer-Token-Auth, kein zusätzliches SDK erforderlich. Tokenkosten entsprechen der Web-Schnittstelle.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

Podcast-Transkription - FAQ

Das Podcast-Tool unterstützt Standard-Lautsprecherdiarisierung und Kapitelmarker (Schweigen-Gap-Erkennung >2s) und unterstützt Langzeitdateien bis zu 2GB. Die Ausgabeformate umfassen SRT + VTT für Show-Notes-Videoclips, schlichte TXT für Blog-Posts und strukturierte JSON mit Per-Turn-Timestamps + Lautsprecherlabels für die Bearbeitung in Descript-Stil Workflows.

Bis zu 2GB pro Datei - etwa ein 14-Stunden-Audio-Podcast bei 128 kbps MP3. Lange Dateien sind serverseitig für Widerstandsfähigkeit gelocht; Sie erhalten ein einzelnes zusammengeführtes Transkript zurück.

Ja. Die Lautsprecherdiarisierung ist standardmäßig ON. Wir erkennen 2-10 verschiedene Stimmen über ECAPA-Stimmeeinbettungen, beschriften sie Lautsprecher 1 / 2 /... und wenden die Etiketten auf jedes Segment an. Sie können sie in der Ergebnisansicht umbenennen.

Stille Lücken länger als 2 Sekunden - die natürlichen bricht Podcaster verwenden zwischen Segmenten. Jedes Kapitel erhält einen Zeitstempel, den Sie direkt in Ihre Show-Noten mit einem "Kapitel:"-Block für YouTube + Spotify einfügen können.

Descript kostet $15-$30 pro Monat für 10 Stunden Transkription, gebunden an ihren Editor. Wir berechnen pro-use bei ~500 tokens/min auf Whisper ($5 = 200K tokens = ~400 Minuten), kein Abonnement, einfachen Export können Sie überall einfügen.

Riverside ist ein Aufnahmestudio, das Ihre eigenen Sessions kostenlos in ihrer App transkribiert, aber erst nach der Aufnahme mit ihnen. Wir transkribieren alle MP3/WAV/MP4 unabhängig davon, wo es aufgenommen wurde.

Otter Caps bei 300 Minuten/Monat auf der freien Ebene und ist englischsprachig ausgerichtet. Wir unterstützen 99 Sprachen bei der gleichen Whisper-large-v3 Genauigkeit ohne monatliche Kappe - Sie zahlen pro Minute transkribiert.

Ja - wählen Sie SRT oder WebVTT als Ausgabeformat. Lautsprecheretiketten sind inline (SRT) oder als <v Speaker N> Tags (VTT) enthalten, die die meisten modernen Player korrekt wiedergeben.

Whisper-large-v3 behandelt Musikbetten und leichtes Reverb gut (typische Wortfehlerrate 3-7%). Sehr laute Musik oder schwere Überlappung mindert die Genauigkeit - betrachten Sie das Laufen /Musik/vocal-remover/ zuerst auf einer Kopie oder das Aufspalten Ihrer Kälte.

Whisper behandelt die häufigsten Namen, aber höchst markenspezifische Jargon kann einen Post-edit Pass benötigen. Eine ~30-Minuten-Episode hat typischerweise 5-10 Marken-/Namenskorrekturen, die manuell angewendet werden müssen.

Laden Sie sie einzeln hier hoch oder nutzen Sie unsere /batch/ Funktion, die sich einmal angemeldet hat, um eine Saison anzustehen. Die API unter /api/ akzeptiert auch POST /v1/stt/ für das programmatische Batching.

Nein. Hochgeladene Dateien werden nach Abschluss der Transkription gelöscht. Ihr Transkript befindet sich in Ihrem /account/history zum Download, wenn angemeldet; anonyme Benutzer erhalten einen 24-Stunden-Share-Link.

Kostenlos registrieren: 30.000 Tokens/Tag

Kostenloses Konto erstellen

Keine Kreditkarte erforderlich

Wie würden Sie dieses Tool bewerten?

Liebe Free.ai? Erzählen Sie Ihren Freunden!