Speech to Text

Kommerzielle Nutzung OK Modelle 579 Kein Wasserzeichen Keine Anmeldung erforderlich
Modell:
+ GPT-5, Claude, Gemini
Upload an audio or video file - or paste a URL - and get a clean transcript with timestamps. Speaker diarization, SRT/VTT subtitle export, 100+ languages with auto-detect. Cost scales exactly with clip length. Powered by Whisper large-v3-turbo (self-hosted), plus premium Wizper and ElevenLabs STT.

Ziehen und Drop Audio / Video, oder klicken Sie zum Durchsuchen

MP3, WAV, MP4, WebM, M4A - bis zu 500MB

- - -
Whisper large-v3 - 99 Sprachen, Best-in-Class-Genauigkeit.
Token Schätzung für diesen Clip
-
YouTube, Instagram, TikTok, Spotify und 1.300+ Plattformen
URL-Transkriptionskosten basieren auf der tatsächlichen Dauer des Clips — wir zitieren nach dem Download. Erwarten Sie ~500 Token/Minute auf Whisper.
Aufzeichnung: 0:00

Echtzeit-Transkription mit Ihrem Mikrofon

Text

Ich überschreibe Ihre Audio-...

Dies kann einen Moment für längere Dateien dauern.

Was Menschen transkribieren mit Free.ai

Interviews + Podcasts

Diarization beschriftet jeden Lautsprecher. Exportieren Sie SRT direkt in Ihren Video-Editor oder Klartext für einen Artikel schreiben.

Auto-Unterschriften + Untertitel

Laden Sie einen YouTube Upload oder TikTok hoch, wählen Sie SRT oder WebVTT und brennen Sie die Untertitel mit /video/subtitle/.

Sitzungsnotizen

Upload a Zoom/Teams recording - get transcript + speaker labels. Pair with /write/summarize/ for bullet-point minutes.

Vorlesungen + Lektionen

Transcribe eine 90-minütige Vorlesung, dann verwenden /study/flashcards/ oder /write/summarize/, um es in Studienmaterial zu verwandeln.

Fremdsprachen-Audio

Whisper erkennt automatisch 99 Sprachen. Im Original protokollieren, dann den Text durch /translate/ senden, um Sprachen zu springen.

Rechts- und medizinische

Zeitstempel, Lautsprecheretiketten, JSON-Export mit jedem Wort Anfang/Ende Zeit — genaue Gericht-Reporter oder klinisch-Noten-Vorbereitung.

Wie Free.ai Transkription vergleicht

Was du bekommst Free.ai Otter.ai Descript Rev.com
Tägliche kostenlose Nutzung5K+ tokens/day300 minutes/mo1 hr/month-
MotorWhisper large-v3-turboProprietaryProprietaryHuman + AI
Sprachen99English-focused2230+
Veröffentlichungen
Ausfuhr von SRT/VTTPaidPaid
Öffentliche APILimitedLimited
Live-Streaming-STT (frei) Paid--
Anmeldung erforderlichNeinYesYesYes
Die Zahlen des Wettbewerbers spiegeln die öffentlich gelisteten freien Stufen ab 2026 wider. Prüfen Sie jeden Anbieter auf aktuelle Pläne.
Erweiterte Optionen
Ergebnis
Die Tokens sind knapp. Mehr Token erhalten
Willst du bessere Ergebnisse? Premium-Modelle (GPT-5, Claude, Gemini) liefern eine höhere Qualität. Pläne anzeigen

❤️ Liebe Free.ai? Erzählen Sie Ihren Freunden!

Melde dich an, um einen Verweis zu erhalten und pro Freund 30.000 Token zu verdienen.

Willst du mehr? Kostenlos registrieren: 30.000 Tokens/Tag
Kostenlos anmelden

Ihre Anfrage bearbeiten...

Best free speech to text tool. Upload MP3, WAV, MP4 or record live. Auto-detect language. Speaker diarization. No sign up required.

Wie man verwendet Speech to Text

1
Geben Sie Ihre Eingabe ein

Geben Sie Text ein, laden Sie eine Datei hoch oder beschreiben Sie, was Sie wollen. Kein Konto erforderlich.

2
Klicken Sie auf Erzeugung

Unsere KI verarbeitet Ihre Anfrage in Sekundenschnelle mit den besten Open-Source-Modellen.

3
& Teilen herunterladen

Downloaden, kopieren oder teilen Sie Ihr Ergebnis. Kostenlos für den persönlichen und kommerziellen Gebrauch.

Verwenden Sie dieses Tool über API

Automatisieren Sie dieses Tool aus Ihrem eigenen Code. OpenAI-kompatible REST-Endpunkt, Bearer-Token-Auth, kein zusätzliches SDK erforderlich. Tokenkosten entsprechen der Web-Schnittstelle.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

Speech to Text - FAQ

Free.ai bietet Whisper-powered Sprache zu Text mit ausgezeichneter Genauigkeit, 99 Sprachen, Untertitel-Export, Lautsprechererkennung und Live-Mikrofonaufnahme - völlig kostenlos.

Laden Sie eine Audio- oder Videodatei hoch (MP3, WAV, MP4, M4A), klicken Sie auf Transcribe und erhalten Sie in Sekundenschnelle genaue Textsprache. Oder nehmen Sie live von Ihrem Mikrofon auf.

Ja. Fügen Sie eine YouTube-URL in die URL-Registerkarte und die Sprache, Text-Tool extrahiert die Audio-und konvertiert es. Funktioniert mit Instagram, TikTok, Spotify und 1.300+ Plattformen.

Ja. Auto-Erkennen oder wählen Sie aus 99 Sprachen. Unsere Rede zu Text behandelt Akzente, Hintergrundgeräusche und gemischtsprachige Audio gut.

Ja. Wählen Sie mehrere Audiodateien auf einmal - jede wird durch Sprache an Text mit Fortschrittsverfolgung gesendet und die Ergebnisse sind separat oder kombiniert herunterladbar.

Ja. Die Sprache zu Text API unter /api/ ist OpenAI-kompatibel. Audioprogrammatisch hochladen und JSON mit Transkript, Sprache und Zeitstempeln empfangen.

Ja. Die Erkennung von Lautsprechern vor dem Hochladen und die Sprachausgabe in Text wird pro Lautsprecher (Sprecher 1, Lautsprecher 2...) gekennzeichnet.

Speech to text akzeptiert Dateien bis zu 500MB pro Upload. Für mehrstündige Inhalte, teilen Sie das Audio in Stücke zuerst.

Sehr präzise für klare Audio - typisch 95%+ Wortgenauigkeit in Englisch mit unserem Whisper großen-v3 Backend. Qualität hängt von Audioklarheit, Akzent und Hintergrundgeräuschen ab.

Ja. Das Transkript ist in vollem Umfang editierbar. Fehler beheben, formatieren und kopieren/downloaden als TXT, SRT oder VTT.

Ja. Audio wird auf eigenen GPUs verarbeitet und nach der Rede zu Text komplettiert gelöscht. Nichts wird langfristig gespeichert, geteilt oder für Schulungen verwendet.

Ja. Laden Sie eine Audio- oder Videodatei in /chat/ hoch und bitten Sie die AI, sie zu transkribieren - kombinieren Sie Sprache mit Text mit Anschlussfragen und Zusammenfassung in einem Workflow.

Kostenlos registrieren: 30.000 Tokens/Tag

Kostenloses Konto erstellen

Keine Kreditkarte erforderlich

Wie würden Sie dieses Tool bewerten?

Liebe Free.ai? Erzählen Sie Ihren Freunden!