Speech to Text

Utilização comercial OK Modelos 579 Sem marca de água Não é necessário registo
Modelo:
+ GPT-5, Claude, Gemini
Upload an audio or video file - or paste a URL - and get a clean transcript with timestamps. Speaker diarization, SRT/VTT subtitle export, 100+ languages with auto-detect. Cost scales exactly with clip length. Powered by Whisper large-v3-turbo (self-hosted), plus premium Wizper and ElevenLabs STT.

Arraste e solte áudio/vídeo, ou clique para navegar

MP3, WAV, MP4, WebM, M4A - até 500MB

- - -
Whisper grande-v3 - 99 idiomas, a melhor precisão em classe.
Estimativa de token para este clipe
-
YouTube, Instagram, TikTok, Spotify e 1.300+ plataformas
O custo da transcrição de URL é baseado na duração real do clipe — citamos após o download. Aguarde ~500 tokens/minuto no Whisper.
Registo: 0:00

Transcrição em tempo real usando o seu microfone

Transcrição

Transcrição do áudio...

Isto pode levar um momento para arquivos mais longos.

O que as pessoas transcribem com Free.ai

Entrevistas + podcasts

A diarização etiqueta cada alto-falante. Exporte SRT diretamente para o seu editor de vídeo, ou texto simples para um artigo de escrita.

Auto legendas + legendas

Envie um upload do YouTube ou TikTok, escolha SRT ou WebVTT e queimar as legendas com /video/subtitle /. Fluxo de trabalho de legendas de um só parar.

Notas de reunião

Upload a Zoom/Teams recording - get transcript + speaker labels. Pair with /write/summarize/ for bullet-point minutes.

Leções + aulas

Transcriba uma palestra de 90 minutos, depois use /estudo/flashcards/ ou /write/summarize/ para transformá-la em material de estudo.

Áudio em língua estrangeira

Whisper auto-detecta 99 idiomas. Transcriba no original, em seguida envie o texto através /traduzir/ saltar idiomas.

Legal + médico

Marcas de tempo, rótulos de alto-falante, JSON exporta com o tempo de partida/fim de cada palavra — prep preciso-reporter do tribunal ou nota clínica.

Como se compara a transcrição Free.ai

O que você obtém Free.ai Otter.ai Descript Rev.com
Uso diário gratuito5K+ tokens/day300 minutes/mo1 hr/month-
MotorWhisper large-v3-turboProprietaryProprietaryHuman + AI
Línguas99English-focused2230+
Diarização dos oradores
Exportação de SRT / VTTPaidPaid
API PúblicaLimitedLimited
streaming ao vivo STT (gratuito) Paid--
Inscrição necessáriaNãoYesYesYes
Os números de concorrentes reflectem níveis livres listados publicamente a partir de 2026. Verifique cada fornecedor para os planos atuais.
Opções avançadas
Resultado
Os tokens estão a ficar baixos. Obter mais tokens
Queres melhores resultados? Modelos premium (GPT-5, Claude, Gemini) oferecem uma qualidade superior. Ver Planos

❤️ Adoro Free.ai? Diga aos seus amigos!

Inscreva-se para obter um link de referência e ganhar 30.000 fichas por amigo.

Queres mais? Inscreva-se gratuitamente: 30 000 fichas/dia
Inscreva-se livre

Tratamento do seu pedido...

Best free speech to text tool. Upload MP3, WAV, MP4 or record live. Auto-detect language. Speaker diarization. No sign up required.

Como Utilizar Speech to Text

1
Introdução

Digite texto, carregue um arquivo ou describa o que você quer. Não é necessária nenhuma conta.

2
Clique em gerar

Nossa IA processa o seu pedido em segundos usando os melhores modelos de código aberto.

3
Baixar & compartilhar

Baixe, copie ou compartilhe o seu resultado. Gratuito para uso pessoal e comercial.

Use esta ferramenta através da API

Automate esta ferramenta a partir do seu próprio código. Endpoint REST compatível com o OpenAI, Bearer-token auth, não é necessário SDK extra. O token custa corresponder à interface web.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

Speech to Text - FAQ

Free.ai oferece voz Whisper-potenciada para texto com excelente precisão, 99 idiomas, exportação de subtítulos, detecção de alto-falantes e captura de micrônicos ao vivo - completamente grátis.

Envie um arquivo de áudio ou vídeo (MP3, WAV, MP4, M4A), clique em Transcribe e obtenha a fala precisa em segundos. Ou gravar ao vivo do seu microfone.

Sim. Pega qualquer URL do YouTube na aba URL e a fala em ferramenta de texto extrai o áudio e converte-o. Funciona com Instagram, TikTok, Spotify e 1.300+ plataformas.

Sim. Detecção automática ou seleção de 99 idiomas. Nossa fala em texto manipula acentuações, ruído de fundo e áudio em língua mista bem.

Sim. Selecione vários arquivos de áudio de uma vez - cada um é enviado através da fala para texto com rastreamento de progresso e os resultados são downloadáveis separadamente ou combinados.

Sim. O discurso para texto API at /api/ é compatível com o OpenAI. Envie áudio programáticamente e receba JSON com a transcrição, linguagem e selos de tempo.

Sim. Alternar a Detecção de Faladeiro antes de carregar e o discurso para o texto saída é rotulado por altofalante (Alvo 1, Falador 2...). Adiciona 50% ao custo de token.

A fala ao texto aceita arquivos até 500MB por upload. Para conteúdo de várias horas, dividir o áudio em pedaços primeiro.

Muito preciso para áudio claro - tipicamente 95%+ de precisão de palavra em inglês com nosso motor Whisper grande-v3. Qualidade depende da clareza, acento e ruído de fundo.

Sim. A transcrição é totalmente editável no local. Corregir erros, reformatar e copiar/descarregar como TXT, SRT ou VTT.

Sim. O áudio é processado em nossas próprias GPUs e excluído após a fala para texto completa. Nada é armazenado a longo prazo, compartilhado ou usado para treinamento.

Sim. Envie um arquivo de áudio ou vídeo em /chat / e peça à IA para transcrivê-lo - combinar a fala em texto com perguntas de acompanhamento e summarização em um fluxo de trabalho.

Inscreva-se gratuitamente: 30 000 fichas/dia

Criar Conta Livre

Não é necessário cartão de crédito

Como você avalia esta ferramenta?

Adoro Free.ai? Diga aos seus amigos!