Speech to Text

Uso commerciale OK modelli 579 Nessuna filigrana Nessun segno necessario
Modello:
+ GPT-5, Claude, Gemini
Upload an audio or video file - or paste a URL - and get a clean transcript with timestamps. Speaker diarization, SRT/VTT subtitle export, 100+ languages with auto-detect. Cost scales exactly with clip length. Powered by Whisper large-v3-turbo (self-hosted), plus premium Wizper and ElevenLabs STT.

Trascinare e rilasciare audio / video, o fare clic per navigare

MP3, WAV, MP4, WebM, M4A - fino a 500MB

- - -
Whisper large-v3 - 99 lingue, precisione migliore in classe.
Stima del token per questa clip
-
YouTube, Instagram, TikTok, Spotify e piattaforme 1.300+
Il costo di trascrizione dell'URL si basa sulla durata effettiva del clip che citiamo dopo il download. Aspettatevi ~500 gettoni/minuto su Whisper.
Registrazione: 0:00

Trascrizione in tempo reale con il microfono

Trascrizione

Trascrivendo l'audio...

Potrebbe volerci un momento per dei file più lunghi.

Cosa trascrive la gente con Free.ai

Interviste + podcast

Etichetta diarizzata ogni altoparlante. Esporta SRT direttamente nel tuo editor video, o testo semplice per una scrittura di articoli.

Didascalie automatiche + sottotitoli

Caricare un upload YouTube o TikTok, scegliere SRT o WebVTT, e masterizzare i sottotitoli con /video/subtitle/.

Note di riunione

Upload a Zoom/Teams recording - get transcript + speaker labels. Pair with /write/summarize/ for bullet-point minutes.

Lezioni frontali + lezioni

Trascrivere una lezione di 90 minuti, quindi utilizzare /studio/scheda/ o /scrivi/ sommare/ per trasformarlo in materiale di studio.

Audio in lingua straniera

Whisper rileva automaticamente 99 lingue. Trascrivere nell'originale, quindi inviare il testo attraverso /translate/ per saltare le lingue.

Legale + medico

Orari, etichette di altoparlanti, JSON esportare con ogni parola di inizio/fine tempo Cronologia accurato corte-reporter o clinica-note preparazione.

Come la trascrizione Free.ai confronta

Che cosa ottieni Free.ai Otter.ai Descript Rev.com
Uso quotidiano gratuito5K+ tokens/day300 minutes/mo1 hr/month-
MotoreWhisper large-v3-turboProprietaryProprietaryHuman + AI
Lingue99English-focused2230+
Diarizzazione dei diffusori
Esportazione SRT / VTTPaidPaid
API pubblicheLimitedLimited
Live streaming STT (gratis) Paid--
Iscrizione richiestaNo.YesYesYes
I dati dei concorrenti riflettono livelli liberi elencati pubblicamente a partire dal 2026. Controllare ogni fornitore per i piani attuali.
Opzioni avanzate
Risultato
I token sono bassi. Ottenere più token
Vuoi risultati migliori? Modelli premium (GPT-5, Claude, Gemini) forniscono una qualità superiore. Visualizza Piani

❤️ Love Free.ai? Dillo ai tuoi amici!

Iscriviti per ottenere un link di referral e guadagnare 30.000 gettoni per amico.

Ne vuoi ancora? Iscriviti gratis: 30.000 gettoni al giorno
Iscriviti gratis

Elaborazione della tua richiesta...

Best free speech to text tool. Upload MP3, WAV, MP4 or record live. Auto-detect language. Speaker diarization. No sign up required.

Come usare Speech to Text

1
Inserisci il tuo input

Digitare testo, caricare un file o descrivere ciò che si desidera. Nessun account necessario.

2
Fare clic su genera

La nostra AI elabora la tua richiesta in pochi secondi utilizzando i migliori modelli open-source.

3
Scarica & condivisione

Scaricare, copiare o condividere il risultato. Gratis per uso personale e commerciale.

Usa questo strumento tramite API

Automatizzare questo strumento dal proprio codice. Endpoint REST compatibile con OpenAI, auth Bearer-token, nessun SDK aggiuntivo richiesto. I costi Token corrispondono all'interfaccia web.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@audio.mp3", "language": "auto"}'

Speech to Text - FAQ

Free.ai offre un linguaggio a testo alimentato da Whisper con eccellente precisione, 99 lingue, esportazione sottotitoli, rilevamento altoparlanti e cattura del microfono dal vivo - completamente gratuito.

Caricare un file audio o video (MP3, WAV, MP4, M4A), fare clic su Trascrivi, e ottenere un discorso accurato al testo in pochi secondi. O registrare dal vivo dal microfono.

Sì. Incolla qualsiasi URL YouTube nella scheda URL e Speech To Text di testo parla in modo da estrarre l'audio e converterlo. Funziona con piattaforme Instagram, TikTok, Spotify e 1.300+.

Sì. Rilevamento automatico o selezione da 99 lingue. Il nostro discorso al testo gestisce accenti, rumore di fondo e audio in lingua mista.

Sì. Selezionare più file audio contemporaneamente - ciascuno viene inviato attraverso il discorso al testo con il monitoraggio dei progressi e i risultati sono scaricabili separatamente o combinati.

Sì. Il discorso a testo API a /api/ è compatibile con OpenAI. Caricare programmaticamente audio e ricevere JSON con la trascrizione, la lingua e l'orario.

Sì. Attivare il rilevamento dei diffusori prima di caricare e l'output del discorso al testo è etichettato per altoparlante (Speaker 1, Speaker 2...). Aggiunge il 50% al costo token.

Il discorso al testo accetta file fino a 500MB per ogni caricamento. Per i contenuti multi-ora, dividere l'audio in parti prima.

Molto preciso per un audio chiaro - tipicamente 95%+ di precisione delle parole in inglese con il nostro backend Whisper large-v3. La qualità dipende dalla chiarezza audio, accento e rumore di fondo.

Sì. La trascrizione è completamente modificabile in-place. Correggi errori, riformat, e copia/download come TXT, SRT o VTT.

Sì. L'audio viene elaborato sulle nostre GPU e cancellato dopo il discorso al testo completo. Nulla viene memorizzato a lungo termine, condiviso o utilizzato per l'addestramento.

Sì. Caricare un file audio o video in /chat/ e chiedere all'AI di trascriverlo - combinare discorso a testo con domande di follow-up e sintesi in un flusso di lavoro.

Iscriviti gratis: 30.000 gettoni al giorno

Crea account gratuito

Non è richiesta alcuna carta di credito

Come valuteresti questo strumento?

Love Free.ai? Dillo ai tuoi amici!