Transcrição de Podcast

Utilização comercial OK Modelos 581 Sem marca de água Não é necessário registo
Modelo:
+ GPT-5, Claude, Gemini
Subir um episódio de podcast e obter uma transcrição limpa, marcada por alto-falante com marcadores de capítulos detectados automaticamente de lacunas de silêncio. Arquivos de forma longa até 2GB, 99 idiomas, Whisper-grande-v3 precisão. Exporte como SRT/VTT para seu podcast de vídeo, TXT simples para notas de exibição, ou JSON para edição em fluxos de trabalho em estilo Descrito.

Arraste e solte o episódio de podcast, ou clique para navegar

MP3, WAV, M4A, OGG, MP4 — episódios de longa forma até 2GB

- - - -
Os marcadores de capítulo são calculados ao lado do cliente de lacunas de segmento e ligados à transcrição. Coloque-os no YouTube ou Spotify descrições como é.
Estimativa de token para este clipe
-
Transcrição de Podcast
Capítulos detectados automaticamente

Tradução do seu podcast...

Os episódios longos demoram vários minutos. Pode fechar esta guia se o email-quando-cometer for verificado.

Construído para podcasters + editores de exibição

Mostrar notas em uma pasta

Subir o episódio, baixar os rótulos do altofalante TXT, capítulos de marcas de tempo prontos para a sua descrição Spotify/YouTube, post de blog escrito em 10 minutos em vez de 4 horas.

Subtítulos do podcast de vídeo

Exportação SRT ou WebVTT com rótulos de alto-falante. Deixe diretamente em Premiere, Final Cut ou DaVinci Resolve — ou envie ao lado do seu vídeo do YouTube para legendas limpas.

Edição de episódios baseados em texto

JSON export dá-lhe cada palavra com start/end selos de tempo. Pipe in Descript, Reaper, ou um fluxo de trabalho personalizado — editando texto em vez de esfregar.

Como a transcrição de podcast funciona

  1. Arraste o episódio para a zona de gota — MP3, WAV, M4A, MP4, até 2GB.
  2. Deixe os rótulos de alto-falante e os marcadores de capítulos em (eles são os padrão). Escolha o seu formato de saída.
  3. Verificamos a duração + preço acima antes de gastar quaisquer fichas. Clique em Transcriba.
  4. Baixe o TXT, SRT, VTT ou JSON com marcas de capítulos, ao lado, pronto para colar.

Free.ai transcrição de podcast vs Descrição, Riverside, Otter

Característica Free.ai Descript Riverside Otter.ai
PreçoPay-per-use ($0.003/min)$15-30/mo$19/mo$16.99/mo
Tamanho máximo do ficheiro2 GB5 GBTied to record session500 MB (varies)
Diarização dos oradores
Marcadores de capítulos automáticos (de base de silência)Manual-Paid tier
Exportação SRT/VTTPaid
Línguas9922100+English-focused
API Pública--Limited
O preço dos concorrentes reflecte os níveis publicados em 2026. Verifique cada fornecedor para os planos atuais.
Opções avançadas
Resultado
Os tokens estão a ficar baixos. Obter mais tokens
Queres melhores resultados? Modelos premium (GPT-5, Claude, Gemini) oferecem uma qualidade superior. Ver Planos

❤️ Adoro Free.ai? Diga aos seus amigos!

Inscreva-se para obter um link de referência e ganhar 30.000 fichas por amigo.

Queres mais? Inscreva-se gratuitamente: 30 000 fichas/dia
Inscreva-se livre

Tratamento do seu pedido...

Transcriba podcasts para texto com IA gratuitamente. Marcadores de altofalante, marcadores de capítulo, exportação SRT.

Como Utilizar Transcrição de Podcast

1
Introdução

Digite texto, carregue um arquivo ou describa o que você quer. Não é necessária nenhuma conta.

2
Clique em gerar

Nossa IA processa o seu pedido em segundos usando os melhores modelos de código aberto.

3
Baixar & compartilhar

Baixe, copie ou compartilhe o seu resultado. Gratuito para uso pessoal e comercial.

Use esta ferramenta através da API

Automate esta ferramenta a partir do seu próprio código. Endpoint REST compatível com o OpenAI, Bearer-token auth, não é necessário SDK extra. O token custa corresponder à interface web.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

Transcrição de Podcast - FAQ

Transcrição de Podcast de podcast é padrão para a diarização de alto-falantes e marcadores de capítulos (detecção de silencios >2s), e suporta arquivos de longo prazo até 2GB. Formatos de saída incluem SRT + VTT para clipes de vídeo show-notes, TXT simples para posts de blog e JSON estruturado com marcas de tempo por turno + alto-falante para edição em fluxos de trabalho estilo Descrip.

Até 2 GB por arquivo - aproximadamente um podcast de áudio de 14 horas em 128 kbps MP3. Arquivos longos são pedaços do lado do servidor para resiliência; você recebe uma única transcrição fusionada de volta.

Sim. A diarização do alto-falante está ON por padrão. Detectamos 2-10 vozes distintas através de ECAPA encaixações de voz, rótula-as Falador 1 / 2 /... e aplica os rótulos a cada segmento. Você pode renomeá-los na vista de resultado.

Silêncio lacunas mais de 2 segundos - os podcasters de quebras naturais usam entre segmentos. Cada capítulo recebe um selo temporal que você pode colar diretamente em suas notas de exibição com um bloco "Capítulos:" para YouTube + Spotify.

Descrição cargas $15-$30 por mês por 10 horas de transcrição, ligadas ao seu editor. Nós cobramos por uso em ~500 fichas/min em Whisper ($5 = fichas de 200K = ~400 minutos), sem assinatura, exportação simples você pode colar em qualquer lugar.

Riverside é um estúdio de gravação que transcribe suas próprias sessões gratuitamente dentro de seu aplicativo, mas apenas depois de gravação com eles. Transcribemos qualquer MP3/WAV/MP4 independentemente de onde foi gravado.

O tampa de otter a 300 minutos/mes no nível livre e é focado em inglês. Nós apoiamos 99 idiomas na mesma precisão Whisper-large-v3 sem tampa mensal - você paga por minuto transcrito.

Sim - escolher SRT ou WebVTT como formato de saída. Os rótulos de alto-falante são incluídos na linha (SRT) ou como tags <v Speaker N> (VTT) que a maioria dos jogadores modernos representam corretamente.

Whisper-large-v3 maneja camas de música e bem reverberar a luz (taxa de erro de palavra típica 3-7%).Music muito alto ou sobreposição degrades precisão - considerar executar /music/vocal-remover/ primeiro em uma cópia, ou dividir o seu frio abre.

Whisper maneja nomes mais comuns, mas o gergon altamente específico de marca pode precisar de um passe pós-edição. Um episódio de ~30 minutos geralmente tem 5-10 correções de marca/nome para aplicar manualmente.

Carregue-os um por um aqui, ou use o nosso recurso /batch/ uma vez assinado para a fila de espera para uma temporada. A API em /api/ também aceita POST /v1/stt/ para o programação de batagem.

Não. Os arquivos enviados são excluídos após transcrição completa. Sua transcrição senta em sua /conta/ história para download se assinar; os usuários anônimos obtêm um link de compartilhamento 24 horas.

Inscreva-se gratuitamente: 30 000 fichas/dia

Criar Conta Livre

Não é necessário cartão de crédito

Como você avalia esta ferramenta?

Adoro Free.ai? Diga aos seus amigos!