Trascrizzioni di podcast

Usu commerciale OK Modelli 581 Nessuna filigrana Nudda iscrizioni necessaria
Modellu:
+ GPT-5, Claude, Gemini
Caricà un episodiu di podcast è ottene una trascrizzioni pulita, etichettata da l'oraturi cù marcatori di capitulu rilevati automaticamenti da i spazii di silenziu. Fichieri di forma longa finu à 2GB, 99 lingue, Whisper-large-v3 precisione. Esporta comu SRT/VTT per u vostru podcast video, TXT simplice per note di spettaculu, o JSON per l'editazione in flussi di travagliu in stile Descript.

Trascina e lasci u vostru podcast, o cliccate pi sfogliari

MP3, WAV, M4A, OGG, MP4 — episodi di forma longa finu à 2GB

- - - -
I marcaturi di capitulu sunnu calcolati di latu clientu di i segmenti di spaziu e attaccati â trascrizzioni. Incollalli in descrizzioni di YouTube o Spotify comu sunnu.
Stima di token pi stu clip
-
Podcast transcript
Capittuli rilevati automaticamenti

Trascrivennu u vostru podcast...

Li episodi longhi pigghianu assai minuti. Potete chiùdiri sta linguetta si l'opzioni "e-mail-when-done" è marcata.

Costruitu pi podcasters + editori di spettaculi

Mostrari li note in una sola copia

Carica l'episodiu, scaricà u TXT. etichette speaker inline, capitulu timestamps pronti per a vostra descrizzione Spotify / YouTube, blog post scrittu in 10 minuti invece di 4 ore.

Sottotitoli di podcast video

Esporta SRT o WebVTT cù etichette di parlanti. Trasferisci direttamente in Premiere, Final Cut o DaVinci Resolve - o carica incù u vostru video YouTube per dittitulari puliti.

Edizzioni di episodi basata supra lu testu

L'esportazione JSON vi dà ogni parola cù marcatori di tempu di iniziu / fine. Pipe in Descript, Reaper, o un flussu di travagliu persunalizatu - edità evidenziendu u testu invece di scrubbing.

Comu a trascrizzioni podcast funziona

  1. Trascinate u vostru episodiu nantu à a zona di rilasciu - MP3, WAV, M4A, MP4, finu à 2GB.
  2. Lascia attivati l'etichetti di l'altoparlanti e li marcaturi di capitulu (sunu predefiniti). Sceglite u vostru furmatu di output.
  3. Cuntrollemu a durata + u prezzu prima di spende i token. Cliccate Transcribe.
  4. Scaricate TXT, SRT, VTT o JSON etichettati di l'oratori. I marcatori di capitulu sò spediti incù, pronti à incollassi.

Free.ai podcast trascrizione vs Descript, Riverside, Otter

Caratteristichi Free.ai Descript Riverside Otter.ai
PrezzuPay-per-use ($0.003/min)$15-30/mo$19/mo$16.99/mo
Dimensioni massima di u file2 GB5 GBTied to record session500 MB (varies)
Diarization Speaker
Marcatori di capitulu automatici (basatu supra lu silenziu)Manual-Paid tier
Esportazione SRT/VTTPaid
Lingue9922100+English-focused
API Pubblica--Limited
I prezzi di i cuncurrenti riflettenu i livelli publicamente elencati in 2026. Controllà ogni fornitore per i piani attuali.
Opzioni avanzate
Risurtatu
Tokens scarsi. Pigghia cchiù token
Volete risultati megghiu? Modelli Premium (GPT-5, Claude, Gemini) offrenu una qualità più alta. Visualizza i piani

❤️ Amuri Free.ai? Dì i vostri amichi!

Iscriviti per ottene un ligame di rifirimentu è guadagnà 25.000 gettoni per amicu.

Voli di più? Iscriviti gratuitamenti: 30,000 tokens/day
Iscriviti

Elaborazione di a vostra richiesta...

Transcrivi podcasts in testu cù AI gratuitamente. Etichette di parlanti, marcatori di capitulu, esportazione SRT.

Comu usari Trascrizzioni di podcast

1
Inserisci u vostru input

Scrivi u testu, carica un file o discrivi chiddu chi vogghiu. Nudda cuntu necisariu.

2
Cliccate pi generari

A nostra IA processa a vostra richiesta in secunni usannu i migliori mudelli open-source.

3
Scaricari e cunniviri

Scaricate, copiate o sparte u vostru risultatu. Libru per usu persunale è cummerciale.

Usa stu strumentu via API

Automate stu strumentu da u vostru propiu codice. OpenAI-compatible REST endpoint, Bearer-token auth, no extra SDK required. Token costs match the web interface.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

Trascrizzioni di podcast - FAQ

U strumentu podcast hè predefinitu per a diarizazione di l'oratori è i marcatori di capitulu (rilevazione di silenziu-gap > 2s), è supporta i fugliali di forma longa finu à 2GB. I formati di output includi SRT + VTT per i clip video di mostra-note, TXT simplice per i post di blog, è JSON strutturatu cù timestamps per-turn + etichette di l'oratori per l'editazione in flussi di travagliu in stile Descript.

Finu à 2GB per file - circa 14 ore di podcast audio à 128 kbps MP3. I file lunghi sò spartuti in pezzi da u latu di u servitore per a resilienza; riceverete una sola trascrizzioni unita.

Sì. A diarizazione di l'altoparlanti è attivata pi default. Ricerchemu 2-10 voci distinte ntraversu l'incorporazioni di voce ECAPA, li etichettamu Altoparlanti 1 / 2 /... e applichemu l'etichette a ogni segmentu. Li pudete rinuminari ntâ vista di risultati.

Silenzia i spazii di silenziu cchiù longhi di 2 secondi - i pause naturali usati da i podcasters trà i segmenti. Ogni capitulu hà un timestamp chì pudete incollà drittu in i vostri show-notes cù un bloccu "Chapters:" per YouTube + Spotify.

Descript carica $ 15- $ 30 al mese per 10 ore di trascrizione, legatu à u so editore. Facciamu u caricamentu per l'usu à ~ 500 tokens / min su Whisper ($ 5 = 200K tokens = ~ 400 minuti), senza abbonamentu, esportazione semplice chì pudete incollà ovunque.

Riverside hè un studio di registrazione chì trasscrive e vostre sessioni di registrazione gratuitamente in a so app, ma solu dopu à a registrazione cù elli. Transcrivemu qualsiasi MP3 / WAV / MP4 indipendentemente da induve hè statu registratu.

Otter hè limitatu à 300 minuti/mese in u livellu gratuitu è hè focalizatu in inglese.Supportemu 99 lingue à a stessa precisione di Whisper-large-v3 senza limitu mensili - paghi per minutu trascrittu.

Sì - sceglite SRT o WebVTT comu furmatu di uscita. L'etichetti di l'altoparlanti sunnu inclusi in linea (SRT) o comu tag <v Speaker N> (VTT) ca la maggiuranza di li lettori muderni riprisentanu currettamente.

Whisper-large-v3 gestisci bè i letti musicali è u riverberu liggeru (tipicamente u tassu di errore di parolla 3-7%). A musica assai forte o a sovrapposizione pesante degrada a precisione - cunsiderà l'esecuzione di /music/vocal-remover/ prima di una copia, o sparghjendu i vostri aperti freddi.

Whisper gestisci i nomi cchiù cumuni, ma u jargonu altamente specificu di marca pò avè bisognu di un passaghju di post-edizione. Un episodiu di ~ 30 minuti hà tipicamente 5-10 correzioni di marca / nome da applicà manualmente.

Carica li unu à una chistu, o usa la nostra funzioni /batch/ una vota chi fici u login pi fari a coda di na staggiuni. L'API di /api/ accetta puru POST /v1/stt/ pi lu batch programmaticu.

No. I fugliali caricati sunnu eliminati dopu a trascrizzioni. A vostra trascrizzioni si trova ntâ storia di /account/ pi scaricari si site loggati; l'utenti anònimi eranu cunnivisi cu un ligami di cunnizzioni di 24 ore.

Iscriviti gratuitamenti: 30,000 tokens/day

Crea un contu

Nessuna carta di creditu richiesta

Comu valutate stu strumentu?

Amuri Free.ai? Dì i vostri amichi!