Speech to Text

Kommersiell användning OK 579-modeller Inget vattenmärke Ingen registrering behövs
Förlaga:
+ GPT-5, Claude, Gemini
Upload an audio or video file - or paste a URL - and get a clean transcript with timestamps. Speaker diarization, SRT/VTT subtitle export, 100+ languages with auto-detect. Cost scales exactly with clip length. Powered by Whisper large-v3-turbo (self-hosted), plus premium Wizper and ElevenLabs STT.

Dra och släpp ljud/video, eller klicka för att bläddra

MP3, WAV, MP4, WebM, M4A - upp till 500MB

- - -
Whisper stor-v3 - 99 språk, bäst i klassen noggrannhet.
Token uppskattning för detta klipp
-
YouTube, Instagram, TikTok, Spotify och 1.300+ plattformar
URL transkription kostnad är baserad på klippets faktiska varaktighet — vi citerar efter nedladdning. Förvänta ~500 polletter / minut på Whisper.
Inspelning: 0:00

Retroaktiv transkription med hjälp av mikrofonen

Överskrift

Skriva in ditt ljud...

Detta kan ta ett tag för längre filer.

Vad människor transkriberar med Free.ai

Intervjuer + podcasts

Diarisering etiketter varje högtalare. Exportera SRT direkt till din videoredigerare, eller vanlig text för en artikel skriva upp.

Automatiska bildtexter + textning

Ladda upp en YouTube-uppladdning eller TikTok, välj SRT eller WebVTT och bränn undertexter på med /video/subtitle/. One-stop bildtext arbetsflöde.

Möteskommentarer

Upload a Zoom/Teams recording - get transcript + speaker labels. Pair with /write/summarize/ for bullet-point minutes.

Föreläsningar + lektioner

Skriv en 90-minuters föreläsning, använd sedan /study/flashcards/ eller /write/summarize/ för att göra den till studiematerial.

Ljud på främmande språk

Whisper upptäcker 99 språk automatiskt. Skriv in texten i originalet och skicka sedan texten via /translate/ för att hoppa över språk.

Juridiskt + medicinskt

Tidstämpelr, högtalaretiketter, JSON exporterar med varje ords start/sluttid – korrekt rättsreporterare eller klinisk notprep.

Hur Free.ai transkription jämför

Vad du får Free.ai Otter.ai Descript Rev.com
Fri daglig användning5K+ tokens/day300 minutes/mo1 hr/month-
MotorWhisper large-v3-turboProprietaryProprietaryHuman + AI
Språk99English-focused2230+
Högtalardiarisering
SRT/VTT-exportPaidPaid
Offentligt APILimitedLimited
Live-streaming av STT (fri) Paid--
Registrering krävsInte allsYesYesYes
Konkurrenter siffror återspeglar offentligt listade fria nivåer från och med 2026. Kontrollera varje leverantör för aktuella planer.
Avancerade alternativ
Resultat
Tokens börjar bli låg. Få fler tokener
Vill du ha bättre resultat? Premiummodeller (GPT-5, Claude, Gemini) levererar högre kvalitet. Visa Planer

❤️ Love Free.ai? Tell your friends!

Registrera dig för att få en referenslänk och tjäna 30.000 polletter per vän.

Vill du ha mer? Registrera dig gratis: 30 000 polletter/dag
Registrera dig gratis

Bearbetning av din begäran...

Best free speech to text tool. Upload MP3, WAV, MP4 or record live. Auto-detect language. Speaker diarization. No sign up required.

Hur du använder Speech to Text

1
Ange din inmatning

Skriv text, ladda upp en fil eller beskriv vad du vill. Inget konto behövs.

2
Klicka på generera

Vår AI behandlar din begäran på några sekunder med hjälp av de bästa öppen källkodsmodellerna.

3
Ladda ner & dela

Ladda ner, kopiera eller dela ditt resultat. Gratis för personligt och kommersiellt bruk.

Använd verktyget via API

Automatisera verktyget från din egen kod. OpenAI-kompatibel REST endpoint, Bearer-token auth, inget extra SDK krävs. Token kostnader matchar webbgränssnittet.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

Speech to Text - FAQ

Free.ai erbjuder Whisper-drivet tal till text med utmärkt noggrannhet, 99 språk, textningsexport, högtalardetektering och levande mikrofoninspelning - helt gratis.

Ladda upp en ljud-eller videofil (MP3, WAV, MP4, M4A), klicka på Transcript och få korrekt tal till text på några sekunder. Eller spela in live från din mikrofon.

Ja. Klistra in alla YouTube-webbadresser i URL-fliken och talet till textverktyget extraherar ljudet och konverterar det. Fungerar med Instagram, TikTok, Spotify och 1.300+ plattformar.

Ja. Automatiskt upptäcka eller välja mellan 99 språk. Vårt tal till text hanterar accenter, bakgrundsljud och blandad språk ljud bra.

Ja. Välj flera ljudfiler samtidigt - varje skickas via tal till text med framsteg spårning och resultaten kan laddas ner separat eller kombineras.

Ja. Talet till text API på /api/ är OpenAI-kompatibel. Ladda upp ljudprogrammatiskt och ta emot JSON med utskriften, språket och tidsstämpeln.

Ja. Växla högtalardetektion innan uppladdning och talet till textutmatningen är märkt per högtalare (talare 1, talare 2...). Lägger till 50% till tokenkostnad.

Tal till text accepterar filer upp till 500 MB per uppladdning. För flertimmarsinnehåll, dela ljudet i bitar först.

Mycket exakt för klart ljud - typiskt 95% + ordnoggrannhet på engelska med vår Whisper stor-v3 bakgrundsgränssnitt. Kvalitet beror på ljud klarhet, accent och bakgrundsljud.

Ja. Avskriften är fullt redigerbar på plats. Fixa fel, reformat och kopiera/ladda ner som TXT, SRT eller VTT.

Ja. Ljudet behandlas på våra egna GPU och raderas efter tal till text kompletterar. Ingenting lagras långsiktigt, delas, eller används för utbildning.

Ja. Ladda upp en ljud- eller videofil i /chat/ och be AI att transkribera den - kombinera tal till text med uppföljningsfrågor och sammanfattning i ett arbetsflöde.

Registrera dig gratis: 30 000 polletter/dag

Skapa gratis konto

Inget kreditkort krävs

Hur skulle du värdera det här verktyget?

Love Free.ai? Tell your friends!