Trascrizione in podcast

Uso commerciale OK modelli 581 Nessuna filigrana Nessun segno necessario
Modello:
+ GPT-5, Claude, Gemini
Carica un episodio podcast e ottieni una trascrizione pulita con i marcatori di capitolo rilevati automaticamente dalle lacune del silenzio. File a forma lunga fino a 2GB, 99 lingue, Whisper-large-v3. Esporta come SRT/VTT per il tuo podcast video, TXT normale per le note di visualizzazione, o JSON per modificare i flussi di lavoro in stile Descript.

Trascinare e rilasciare l'episodio podcast, o fare clic per sfogliare

MP3, WAV, M4A, OGG, MP4 sugli episodi a lunga forma fino a 2GB

- - - -
I marcatori del capitolo sono client-side calcolati dalle lacune del segmento e collegati alla trascrizione. Incollarli in YouTube o Spotify descrizioni come-è.
Stima del token per questa clip
-
Trascrizione podcast
Capitoli rilevati automaticamente

Trascrivendo il tuo podcast...

Gli episodi lunghi richiedono diversi minuti. Puoi chiudere questa scheda se email-quando-fatto è selezionato.

Costruito per podcasters + editor di spettacoli

Mostra le note in una sola incolla

Carica l'episodio, scarica le etichette TXT. Speaker in linea, timestamp di capitolo pronti per la tua descrizione Spotify/YouTube, post sul blog scritto in 10 minuti invece di 4 ore.

Sottotitoli podcast video

Esporta SRT o WebVTT con etichette di altoparlanti. Rilascia direttamente in Premiere, Final Cut, o DaVinci Resolve molto o carica insieme al tuo video YouTube per didascalie pulite.

Modifica di episodio basato sul testo

L'esportazione JSON ti dà ogni parola con i timestamp di inizio/fine. Connetteti a Descript, Reaper o a un flusso di lavoro personalizzato Modifica evidenziando il testo invece di pulire.

Come funziona la trascrizione del podcast

  1. Trascinare il vostro episodio sulla zona di caduta MP3, WAV, M4A, MP4, fino a 2GB.
  2. Lasciare le etichette degli altoparlanti e i marcatori dei capitoli attivi (sono i valori predefiniti).
  3. Controlliamo la durata + prezzo in su prima di spendere qualsiasi gettoni. Clicca Trascrivi.
  4. Scaricare TXT, SRT, VTT o JSON. I marcatori del capitolo vengono spediti insieme, pronti per l'incollaggio.

Free.ai trascrizione podcast vs Descript, Riverside, Otter

Caratteristica Free.ai Descript Riverside Otter.ai
PrezzoPay-per-use ($0.003/min)$15-30/mo$19/mo$16.99/mo
Dimensione massima del file2 GB5 GBTied to record session500 MB (varies)
Diarizzazione dei diffusori
Marcatori automatico dei capitoli (basato sul silenzio)Manual-Paid tier
Esportazione SRT/VTTPaid
Lingue9922100+English-focused
API pubbliche--Limited
I prezzi dei concorrenti riflettono i livelli elencati pubblicamente nel 2026. Controllare ogni fornitore per i piani attuali.
Opzioni avanzate
Risultato
I token sono bassi. Ottenere più token
Vuoi risultati migliori? Modelli premium (GPT-5, Claude, Gemini) forniscono una qualità superiore. Visualizza Piani

❤️ Love Free.ai? Dillo ai tuoi amici!

Iscriviti per ottenere un link di referral e guadagnare 30.000 gettoni per amico.

Ne vuoi ancora? Iscriviti gratis: 30.000 gettoni al giorno
Iscriviti gratis

Elaborazione della tua richiesta...

Trascrivere podcast a testo con AI gratis. Etichette dei relatori, indici di capitolo, esportazione SRT.

Come usare Trascrizione in podcast

1
Inserisci il tuo input

Digitare testo, caricare un file o descrivere ciò che si desidera. Nessun account necessario.

2
Fare clic su genera

La nostra AI elabora la tua richiesta in pochi secondi utilizzando i migliori modelli open-source.

3
Scarica & condivisione

Scaricare, copiare o condividere il risultato. Gratis per uso personale e commerciale.

Usa questo strumento tramite API

Automatizzare questo strumento dal proprio codice. Endpoint REST compatibile con OpenAI, auth Bearer-token, nessun SDK aggiuntivo richiesto. I costi Token corrispondono all'interfaccia web.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

Trascrizione in podcast - FAQ

Trascrizione in podcast podcast predefinisce la diarizzazione degli altoparlanti e i marcatori dei capitoli (rilevamento del gap >2s) e supporta file a lunga forma fino a 2GB. I formati di output includono SRT + VTT per clip video per show-notes, TXT per post sul blog e JSON strutturato con timestamp per-turn + etichette degli altoparlanti per modificare i flussi di lavoro in stile Descript.

Fino a 2GB per file - circa un podcast audio di 14 ore a 128 kbps MP3. I file lunghi sono accomunati dal server per la resilienza; si ottiene una sola trascrizione unita indietro.

Sì. La diarizzazione degli altoparlanti è attiva per impostazione predefinita. Rilevamo 2-10 voci distinte tramite le inserzioni vocali ECAPA, le etichettamo Speaker 1 / 2 /... e applichiamo le etichette ad ogni segmento. È possibile rinominarle nella vista dei risultati.

Spacchi di silenzio più lunghi di 2 secondi - i podcasters di rottura naturale usano tra i segmenti. Ogni capitolo ottiene un timestamp che è possibile incollare direttamente nelle vostre note-show con un blocco "Capitolo:" per YouTube + Spotify.

Descript addebita $15-$30 al mese per 10 ore di trascrizione, legato al loro editor. Noi addebitare per uso a ~500 gettoni / min su Whisper ($5 = 200K gettoni = ~400 minuti), nessun abbonamento, semplice esportazione è possibile incollare ovunque.

Riverside è uno studio di registrazione che trascrive gratuitamente le tue sessioni all'interno della loro app, ma solo dopo aver registrato con loro. Trascriviamo qualsiasi MP3/WAV/MP4 indipendentemente da dove è stato registrato.

Lontra tappi a 300 minuti al mese sul livello Gratis ed è focalizzato sull'inglese. Supportiamo 99 lingue alla stessa precisione Whisper-large-v3 senza un tappo mensile - si paga al minuto trascritto.

Sì, scegliete SRT o WebVTT come formato di output. Le etichette dei diffusori sono incluse in linea (SRT) o come tag <v Speaker N> (VTT) che la maggior parte dei lettori moderni rende correttamente.

Whisper-large-v3 gestisce bene letti musicali e riverbero leggero (tasso tipico di errore-word 3-7%). Musica molto forte o sovrapposizioni pesanti degrada l'accuratezza - considerare l'esecuzione /music/vocal-remover/ prima su una copia, o dividere il freddo si apre.

Whisper gestisce nomi più comuni, ma un gergo altamente specifico per il marchio potrebbe richiedere un passaggio post-edit. Un episodio di ~30 minuti ha tipicamente 5-10 correzioni di marca/nome da applicare manualmente.

Caricali uno alla volta qui, o usa la nostra funzione /batch/ una volta registrato per fare la coda in una stagione. L'API di /api/ accetta anche POST /v1/stt/ per il batching programmatico.

No. I file caricati vengono cancellati dopo la trascrizione completa. La tua trascrizione si trova nella tua /account/ cronologia per il download se registrato; gli utenti anonimi ricevono un collegamento di condivisione 24 ore.

Iscriviti gratis: 30.000 gettoni al giorno

Crea account gratuito

Non è richiesta alcuna carta di credito

Come valuteresti questo strumento?

Love Free.ai? Dillo ai tuoi amici!