Transcripció de podcasts

Askunci utilitza Bé Models 380+ Sense marca d' aigua No cal signar-up
Model:
+ GPT-5, Claude, Gemini
Publica un episodi de podcast i agafa una transcripció neta, altaveu- etiquetada amb marques de capítol auto- detectades des de buits de silenci. Els fitxers de forma llarga fins a 2GB, 99 idiomes, Whisper- altv3. Exporta com SRT/ VTT per al vostre podcast de vídeo, format pla TXT per a mostrar notes, o JSON per editar els fluxs de treball d' estil Descript.

Arrossegueu i deixeu anar el vostre episodi de podcast, o cliqueu per navegar

MP3, WAV, M4A, OGG, MP4 AhCE, episodis de forma de llarg fins a 2GB

- - - -
Les marques de capítol es calculen des de intervals de segment i adjunten a la transcripció. Enganxar- les a YouTube o puntsify descripcions com a.
Estimació Token per aquest vídeo
-
Transcripció de podcast
capítols detectats automàticament

Transcribant el teu podcast...

Els episodis llargs prenen uns quants minuts. Podeu tancar aquesta pestanya si es marca el correu electrònic quan es marca l' identificador.

Es construeix per a podcasts + mostra editors

Mostra les notes en una enganxat

Carrega l' episodi, descarrega les etiquetes TXT. Altaveu en línia, capítol marques de temps preparades per a la vostra descripció " louteify/YouTube," publica en 10 minuts enlloc de 4 hores.

Subtítols en vídeo

Exporta SRT o WebVT amb etiquetes d' altaveu. Deixeu- lo directament al Premiere, Talla final, o DaVinci resolució del KByp o pujar al costat del vídeo de YouTube per a títols nets.

Edició dels episodi basats en text

L' exportació JSON us ofereix cada paraula amb marques de temps d' inici/ final. Conducte al Descript, Voler, o un flux de treball personalitzat edit amb el ressaltat del text en comptes de netejar.

Com funciona la transcripció de podcast

  1. Arrossegueu el vostre episodi a la zona de desplegament MP3, WAV, M4A, MP4, fins a 2GB.
  2. Deixa les etiquetes de l' altaveu i les marques de capítol (que són les per omissió). Seleccioneu el format de sortida.
  3. Comprovem la durada + preu abans de passar qualsevol fitxes.
  4. Descarrega la nau de marques de l' altaveu TXT, SRT, VTT o JSON. Pistes de capítol junt, a punt per enganxar.

Free.ai podcast transcription vs Descript, Riverside, Otter

Característica Free.ai Descript Riverside Otter.ai
PreuPay-per-use ($0.003/min)$15-30/mo$19/mo$16.99/mo
Mida màx. de fitxer2 GB5 GBTied to record session500 MB (varies)
Diarització del president
Marcadors de capítol automàtic (silència basada)Manual-Paid tier
Exportació SRT/VTTPaid
Idiomes9922100+English-focused
API pública--Limited
Comprotector de preus reflexa els ties públics en 2026. Comproveu cada proveïdor per als plans actuals.
Opcions avançades
Resultat
Els Torken s'han quedat sense sortida. Obtén més Torken
Vols millors resultats? Models Premium (GPT-5, Claude, Gemini TERM_ 7__) ofereix una qualitat més alta. Visualitza Plans

❤️ Love Free.ai? Tell your friends!

Signen per obtenir un enllaç de referència i guanyen 25.000 fitxes per amic.

Vols més? Signa lliure per a 30K fitxes/ dia + 10K bo
Signa lliure

S' està processant la vostra petició...

Poden escriure podcasts al text amb IA per a etiquetes lliures. Altaveu, marques de capítol, exportació SRT.

Com usar- lo Transcripció de podcasts

1
Introduïu l' entrada

Escriu text, puja un fitxer, o descriu el que vulguis. No cal compte.

2
Generació de clic

La nostra IA processa la vostra petició en segons usant els millors models de codi obert.

3
Descarrega i comparteix

Baixeu, copieu o compartiu el vostre resultat. Lliure per a ús personal i comercial.

Usa aquesta eina mitjançant l' API

Automatitza aquesta eina del vostre propi codi. Els costos OpenAI- compatible amb el punt d' acabament, l' autenticació Beer- token, sense necessitat extra de SDK. Perken coincideixen amb la interfície web.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

Transcripció de podcasts - FAQ

L' eina podcast és per omissió per a l' altaveu de la diarització i els marcadors de capítol (silence- interval -% 2 - 2 - 2, i permet fitxers de forma llarga fins a 2GB. Els formats de sortida inclouen SRT + VT per a mostrar fragments de vídeo, format pla TXT per als articles de bloc, i estructurat JSON amb marques de temps per gir + etiquetes d' altaveu per a editar els fluxs d' estil de l' estil Descript.

Fins a 2GB per fitxer TL aproximadament un podcast d' àudio de 14 hores a 128 kbps MP3. Els fitxers llargs són un marge de servidor per a la resistència; obtindreu una sola transcripció fusionada.

Sí. Per omissió, la diarització del President està en posició. detectem 2- 10 veus diferents mitjançant encastats de veu PACA, etiquetar- los com a un / 2 /... i aplicar les etiquetes a cada segment. Podeu reanomenar- les en la vista de resultats.

Els llocs buits de silenci més de 2 segons sypher els podcasts naturals usen entre segments. Cada capítol té una marca de temps que podeu enganxar directament a les notes del vostre programa amb un bloc "coctús:" per a YouTube + puntsync.

Cjecta d' càrrecs $15- 30 dòlars per mes durant 10 hores de transcripció, lligat a l' editor. Carrem per- use a ~500 fitxes/min en Rumuz ($5 = 200K fitxes = ~400 minuts), sense subscripció, una exportació senzilla que podeu enganxar a qualsevol lloc.

Riverside és un estudi de gravació que transcrivi les vostres pròpies sessions per a alliberar-se a la seva aplicació, però només després de gravar-les. transcrivim qualsevol MP3/WAV/MP4 independentment d' on es va gravar.

Otter barrets a 300 minuts/ mesos sobre l'espectador lliure i està en anglès. Permetem 99 idiomes a la mateixa precisió del Rumul-v3 sense cap valor mensual que pagueu per minut transcribent.

Sí pick SRT o WebVTT com a format de sortida. Les etiquetes del President són incloses en línia (SRT) o com a etiquetes <v President N> (VT) que la majoria dels reproductors moderns representen correctament.

El Rumul- v3 gestiona els llits de música i la llum reverbi bé (índex de paraules- error- 7%). Molt forta música o molt pesat sobreposen la precisió de l' arc de dades en execució /music/ bivocal-rever/ primer en una còpia, o dividir el vostre fred s' obre.

El murmuris gestiona els noms més comuns, però l' argot específic de la marca pot necessitar un passi d' edició de correus. Un episodi ~30 minuts normalment té 5- 10 marques/nom per aplicar manualment.

Carregar- los un en un moment aquí, o usar la nostra característica / batch/ una vegada signat en una temporada. L' API a / a / api/ també accepta POST / v1t/ stt / per a la per lots temàtica del programa.

No. Els fitxers pujats s' esborraran després de completar la transcripció. La vostra transcripció es troba en el vostre compte / compte/ historial per a descarregar- se si està signada; els usuaris anònims reben un enllaç compartit de 24 hores.

Signa't amb Free 30.000 fitxes/ dia

Crea compte lliure

No cal targeta de crèdit

Com valoraries aquesta eina?

Like this tool? Share it!