Transkription des Interviews

Kommerzielle Nutzung OK Modelle 581 Kein Wasserzeichen Keine Anmeldung erforderlich
Modell:
+ GPT-5, Claude, Gemini
1-on-1 Interview Transkription mit 2-Sprecher-Diarisierung. Benannt die Labels (Interviewer / Interviewee, oder die tatsächlichen Namen) vor dem Absenden — jedes Zitat wird zeitgestempelt und die Output-Exporte als lesbare Q&A bereit für Ihren Journalismus schreiben, Podcast zeigen Notizen oder Forschungsdatensatz.

Ziehen und Drop Ihre Interview-Aufnahme, oder klicken Sie auf zu durchsuchen

MP3, WAV, M4A, MP4 — bis zu 1 GB. Telefonaufnahmen (Mono, 8 kHz) unterstützt.

- - - -
Die Lautsprecher-Diarisierung ist immer für dieses Tool (2 Lautsprecher gezwungen). Labels Standard zu Ihren Namen oben - editierbar Post-Transcription.
Token-Schätzung für dieses Interview
-
Interview-Transkript

Interview übertragen und Referenten identifizieren...

Normalerweise 30s-3min je nach Länge.

Für Journalisten, Forscher und qualitative Interviewer gebaut

Journalismus + Schreibarbeiten

Exportieren Sie den Q&A TXT mit Zeitstempeln – zitieren Sie mit Vertrauen, zitieren Sie die genaue Sekunde, fügen Sie direkt in Ihre Geschichte oder Newsroom CMS.

Qualitative Forschung

Export JSON for coding in NVivo/Atlas.ti/Dedoose. Every turn has start/end timestamps + speaker labels - ready for thematic analysis.

Personal- und Einstellungsgespräche

Transcribe-Kandidat ruft mit Zustimmung. DOCX-Export mit Lautsprecher-Labels macht es einfach, mit dem Einstellungspanel zu teilen.

Wie die Transkription des Interviews funktioniert

  1. Lassen Sie Ihre Aufnahme auf der Upload-Zone fallen — MP3/WAV/MP4 bis zu 1GB. Funktioniert mit Telefoninterviews.
  2. Nennen Sie Speaker 1 und Speaker 2 auf die tatsächlichen Namen um (oder lassen Sie Standardeinstellungen).
  3. Überprüfen Sie das Angebot und klicken Sie auf Transcribe. Wir machen 2-Lautsprecher-Diarisierung automatisch.
  4. Holen Sie sich ein sauberes Q&A Transkript. Laden Sie TXT/DOCX/SRT/VTT/JSON mit Ihren angepassten Lautsprechernamen.

Free.ai gegen Rev.com, Otter, Trint

Funktion Free.ai Rev.com (AI) Otter.ai Trint
Preis$0.003/min$1.50/min$16.99/mo$60/mo
Lautsprecheretiketten vor dem Einreichen umbenennenPost-editPost-editPost-edit
DOCX AusfuhrPaid
Sprachen9930+English-focused30+
Öffentliche APILimited
Anmeldung erforderlichNeinYesYesYes
Die Preisgestaltung für Wettbewerber spiegelt die in der öffentlichen Liste aufgeführten 2026-Stufen wider.
Erweiterte Optionen
Ergebnis
Die Tokens sind knapp. Mehr Token erhalten
Willst du bessere Ergebnisse? Premium-Modelle (GPT-5, Claude, Gemini) liefern eine höhere Qualität. Pläne anzeigen

❤️ Liebe Free.ai? Erzählen Sie Ihren Freunden!

Melde dich an, um einen Verweis zu erhalten und pro Freund 30.000 Token zu verdienen.

Willst du mehr? Kostenlos registrieren: 30.000 Tokens/Tag
Kostenlos anmelden

Ihre Anfrage bearbeiten...

Transcribe Interviews mit freien KI. Automatische Lautsprecher-Beschriftung und Zeitstempel.

Wie man verwendet Transkription des Interviews

1
Geben Sie Ihre Eingabe ein

Geben Sie Text ein, laden Sie eine Datei hoch oder beschreiben Sie, was Sie wollen. Kein Konto erforderlich.

2
Klicken Sie auf Erzeugung

Unsere KI verarbeitet Ihre Anfrage in Sekundenschnelle mit den besten Open-Source-Modellen.

3
& Teilen herunterladen

Downloaden, kopieren oder teilen Sie Ihr Ergebnis. Kostenlos für den persönlichen und kommerziellen Gebrauch.

Verwenden Sie dieses Tool über API

Automatisieren Sie dieses Tool aus Ihrem eigenen Code. OpenAI-kompatible REST-Endpunkt, Bearer-Token-Auth, kein zusätzliches SDK erforderlich. Tokenkosten entsprechen der Web-Schnittstelle.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

Transkription des Interviews - FAQ

Der Interview-Modus zwingt die 2-Lautsprecher-Diarisierung und ermöglicht es Ihnen, die Labels in "Interviewer" und "Interviewee" (oder benutzerdefinierte Namen) umzubenennen. Jeder Lautsprecher-Wendevorgang erhält einen sauberen Zeitstempel und die Ausgabe wird als lesbare Q&A-Paare für ein Journalisten-Writup bereit gestellt.

MP3, WAV, M4A, FLAC, OGG, MP4, WebM, MOV und jedes andere Format ffmpeg können dekodieren. Telefoninterviews (Mono, 8 kHz) arbeiten - Whisper behandelt die niedrige Bitrate anmutig.

Ja. Vor dem Absenden von Etiketten (Standards an "Interviewer" / "Interviewee") oder in der Ergebnisansicht bearbeiten - jedes Segment-Updates an Ort und Stelle und der Export verwendet Ihre Namen.

Rev kostet $1,50/Minute für KI-Transkription und $1,99+Minute für Mensch-verifiziert. Wir verwenden das gleiche Whisper-large-v3 Modell Rev bietet in ihrer KI-Ebene, bei ~500 Tokens/min (ca. $0,003/min - 500x billiger als Rev AI).

Otter Caps bei 300 freien Minuten pro Monat und ist nur Englisch. Wir unterstützen 99 Sprachen auf Whisper-large-v3, keine monatliche Kappe, pay-as-you-go.

Trint beginnt bei $60/Monat für 7 Stunden. Wir berechnen pro-use - ungefähr $0.003/min. Für einen gelegentlichen Journalisten, der 10-20 Interviews pro Jahr macht, ist Free.ai im Wesentlichen kostenlos; für einen Nachrichtenraum, der Hunderte macht, schlägt unsere Preisgestaltung immer noch Trint um 50-80%.

TXT (sauberes Q&A-Format mit Zeitstempeln), SRT (für Video-Interview-Untertitel), VTT, JSON (für Nachbearbeitung) und DOCX (Microsoft Word - bereit für Editoren).

Ja - Telefon Audio (Mono, 8 kHz) funktioniert gut. Laden Sie Ihre Aufnahme (Google Voice, OpenPhone, ein.wav von einem Handheld-Recorder, etc.). Genauigkeit ist typischerweise 92-96% für saubere Telefon-Audio.

Sehr hoch für sauberes Audio mit minimaler Querverhaltung (> 95 % richtige Lautsprecherzuweisung). Genauigkeit sinkt, wenn beide Lautsprecher miteinander sprechen - diese Clips bei Bedarf in zwei separate Uploads teilen.

Audiodateien werden nach der Transkription gelöscht. Die Transkriptionen werden unter Ihrem Konto für 7 Tage (bezahlt) oder 24 Stunden (kostenlos) gespeichert. Für alles, was empfindlich ist, laden Sie die TXT/DOCX herunter und löschen Sie die Historienzeile.

Ja - die Ansicht "Zeitstempel" zeigt jede Runde mit ihrer Startzeit. Kopieren Sie das Zitat + Zeitstempel direkt in Ihren Artikel für die Überprüfungsfähigkeit, oder verwenden Sie den JSON-Export für programmatische Zitation.

Verwenden Sie /transcribe/meeting/ statt dessen Transkription des Interviews ermöglicht es Ihnen, 2-10 Lautsprecher einzustellen. Das /transcribe/interview/-Tool ist für 1-on-1-Format optimiert.

Kostenlos registrieren: 30.000 Tokens/Tag

Kostenloses Konto erstellen

Keine Kreditkarte erforderlich

Wie würden Sie dieses Tool bewerten?

Liebe Free.ai? Erzählen Sie Ihren Freunden!