Speech to Text

IPER usa Bé Models 579 Sense marca d' aigua No cal signar-up
Model:
+ GPT-5, Claude, Gemini
Upload an audio or video file - or paste a URL - and get a clean transcript with timestamps. Speaker diarization, SRT/VTT subtitle export, 100+ languages with auto-detect. Cost scales exactly with clip length. Powered by Whisper large-v3-turbo (self-hosted), plus premium Wizper and ElevenLabs STT.

Arrossegueu i deixeu anar l' àudio/video o cliqueu per navegar

MP3, WAV, MP4, WebM, M4A - fins a 500MB

- - -
Whisper granv3 - 99 llengües, precisió de millor classe.
Estimació Token per aquest vídeo
-
YouTube, Instagram, TikTok, bookmarkify i 1.300+
El cost de la transcripció d' URL està basat en la durada real del vídeo que cito després de baixar. S' espera que ~500 fitxes/ minuts al Rumuz.
Gravació: 0:00

Recripció en temps real utilitzant el micròfon

Transcript

Transcribant l'àudio...

Això pot trigar un moment per més fitxers.

El que la gent transcrivi amb Free.ai

Entrevista + podcasts

Etiquetes de la divisió cada altaveu. Exporta SRT directament a l' editor de vídeo, o text pla per a un article d' escriptura.

Autotítols + subtítols

Publica una pujada de YouTube o TikTok, escolliu SRT o WebVTT, i crema els subtítols amb /video/subtítol /. Una parada del flux de treball del títol.

Notes de la Reunió

Upload a Zoom/Teams recording - get transcript + speaker labels. Pair with /write/summarize/ for bullet-point minutes.

Lliçons + lliçons

Trancribliu una lliçó de 90 minuts, llavors useu / study/flashcards / o / write/ summarize/ per convertir- la en material d'estudi.

àudio en llengua estrangera

Whisper auto- detecta automàticament 99 idiomes. Trancric en l' original, després envia el text a través de / traduir/ saltar les llengües.

Legal + medicina

Marques de temps, etiquetes de parlant, JSON export amb cada paraula del temps de sortida de precisiódentiu dels tribunals o prep clínics.

Com es compara la transcripció Free.ai

El que tens. Free.ai Otter.ai Descript Rev.com
Ús lliure de dia5K+ tokens/day300 minutes/mo1 hr/month-
MotorWhisper large-v3-turboProprietaryProprietaryHuman + AI
Idiomes99English-focused2230+
Diarització del president
SRT / VTT exportPaidPaid
API públicaLimitedLimited
SET en directe (graduat) Paid--
Es requereix la signaturaNoYesYesYes
Les figures de composició reflecteixen públicament els ties lliures llistat com a 2026. Comproveu cada proveïdor per als plans actuals.
Opcions avançades
Resultat
Els Torken s'han quedat sense sortida. Obtén més Torken
Vols millors resultats? Models Premium (GPT-5, Claude, Gemini)) proporciona una qualitat superior. Visualitza Plans

❤️ Love Free.ai? Tell your friends!

Signen per obtenir un enllaç de referència i guanyen 25.000 fitxes per amic.

Vols més? Signa lliure: 30.000 fitxes/ dia
Signa lliure

S' està processant la vostra petició...

Best free speech to text tool. Upload MP3, WAV, MP4 or record live. Auto-detect language. Speaker diarization. No sign up required.

Com usar- lo Speech to Text

1
Introduïu l' entrada

Escriu text, puja un fitxer o descriu el que vulguis. No cal compte.

2
Generació de clic

El nostre processos IA en segons que s' usen els millors models de codi obert.

3
Descarrega i comparteix

Baixeu, copieu o compartiu el vostre resultat. Lliure per a ús personal i comercial.

Usa aquesta eina mitjançant l' API

Automatitza aquesta eina del vostre propi codi. Els costos OpenAI- compatible amb el punt d' acabament, l' autenticació Beer- token, sense necessitat extra de SDK. Perken coincideixen amb la interfície web.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

Speech to Text - FAQ

Free.ai ofereix un discurs Whisper-d'un text excel·lent, amb un excel·lent, 99 llengües, export de subtítols, detecció d'altaveu i captura de micròfons en directe - completament lliures.

Publica un fitxer d' àudio o vídeo (MP3, WAV, MP4, M4A), clica Tranc, i obté un discurs precís al text en segons. O registre viu des del micròfon.

Si. Enganxa qualsevol URL de YouTube a la pestanya URL i el discurs a l' eina de text extraieu l' àudio i la converteix. Funciona amb Instagram, TikTok, Tateify, i 1.300 plataformes +.

Sí, detecta automàticament o selecciona des de 99 idiomes. El nostre discurs a text gestiona accents, soroll de fons i àudio en llenguatge mixta.

Sí. Seleccioneu múltiples fitxers d' àudio a la vegada - cada un s' envia a través del llenguatge al text amb el seguiment del progrés i els resultats es poden descarregar separadament o combinar.

Sí. El discurs a l' API de text a / api / és compatible amb l' OpenAI. Carrega el programa d' àudio i rep JSON amb la transcripció, el llenguatge i els segells de temps.

Sí. Commuta la detecció del President abans de pujar i la sortida de text s' etiqueta per altaveu ( Altaveu 1, Altaveu 2...). Afegiu un 50% per a mostrar el cost.

El discurs al text accepta fitxers a 500MB per pujada. Per a contingut multi- hores, primer divideix l' àudio en trossos.

Molt precisa per a l' ús d' àudio cinemagy 95%+ paraula en anglès amb el dorsal Whisper granv3. La qualitat depèn de la claredat de l' àudio, l' accent i el soroll de fons.

Sí. La transcripció és completament editable en el lloc. Arreglant errors, reformat, i copieu/ baixar com a TXT, SRT o VT.

Sí. L' àudio es processa en les nostres pròpies GPUs i s' esborra després de que el discurs completi el text. No hi ha res que es pugui desar a llarg termini, compartit o usat per a entrenar.

Sí. Pugeu un fitxer d' àudio o vídeo en / chat / i demaneu a l'AI que transcrivisca (combineu el discurs al text amb preguntes de seguiment i resumització en un flux de treball.

Signa lliure: 30.000 fitxes/ dia

Crea compte lliure

No es requereix targeta de crèdit

Com valoraries aquesta eina?

Like this tool? Share it!