Trascrizione libbira cureanu

Trascrivi l'audiu è u video cureanu in testu cù AI. Veloce, accuratu è gratuitu.

Comu funziona

  1. Vadu a Trascritturi Free.ai
  2. Carica lu vostru fugliale audio o video cureanu
  3. A nostra IA rileva automaticamenti cureanu è lu trascrivi
  4. Scarica a trascrizzioni comu testu o suttatituli SRT

cureanu Caratteristiche di trascrizzioni

  • ✓Sviluppatu di faster-whisper (licenza MIT)
  • ✓Rilevazione automatica di lingua cureanu
  • ✓Supporta MP3, WAV, MP4, M4A, FLAC, è più
  • ✓Esportazione di marcaturi di tempu e di sottotituli (SRT)
  • ✓Nessun limitu di dimensione di u file in i piani pagati
  • ✓Privatu e sicuru -- i file sunnu canciati dopu l'elaborazioni

Dettagli lingua

Linguacureanu
Codice ISOko
Modellufaster-whisper
PrezzuLiberu

Più lingue

Tutti li lingue

FAQ

Whisper large-v3-turbo atterra in u so livellu di precisione più altu in cureanu - sottu u 7% di u tassu di errore di parolla in i benchmarks standard. In pratica, chì significa chì l'audiu di studio pulitu torna quasi perfettu, è l'audiu di conversazione hè utilizzabile cù una pulizia minima.(Tier A, under 7% word error rate on benchmark sets - noi pubbrichiamu tiers WER onesti piuttostu ca reclami di marketing.)

Sì - a trascrizzioni cureanu pigghia prima di u vostru pool di tokens gratuiti. L'audiu costa circa 50 tokens à u minutu, cusì u pool di tokens anònimu copre qualchì ora di audio ogni ghjornu. I conti cunnessi piglianu un pool di tokens più grande di 30.000. Dopu, a trascrizzioni hè pagata à u usu, cù ricarica di tokens da $1.

cureanu i trascrizzioni sò ritornati in scrittura nativa (UTF-8). u testu cureanu nun hà spazi tra li parolle nativamente; i timestamps di diarization agghiùnninu pause naturali à i turni di parlanti.

MP3, WAV, M4A, FLAC, OGG, OPUS, e WEBM sò accettati direttamente. Per i video (MP4, MOV, MKV) estrichemu a pista audio di u servituri prima di inviallu à Whisper - ùn avete bisognu di cunvertisce nulla. U listessu pipeline indipendentementi da a lingua di u sorgenti, cumpresu cureanu.

U limitu di carichi anonimi hè di circa 500 MB per file. I conti cunnessi ghjunghjenu finu à 2 GB. A durata ùn hè micca un limitu rigidu - i file lunghi sò spartuti automaticamenti (finestre di 30 sicondi cu sovrapposizioni) è ripigghiati in una singula trascrizzioni cu marcaturi di tempu continui. cureanu Registrazioni di multi-ore (podcast, lezioni intere, riunioni) funzionanu bè.

Sì - a diarizazione di l'oratori hè attivata per difettu per ogni trascrizzioni cureanu. L'output hè segmentatu comu Oratore 1 / Oratore 2 / Oratore 3 cù marcaturi di tempu, cusì l'intervista, i discussioni di pannelli, e riunioni multi-partiti tornanu etichettati. A diarizazione corre in un mudellu separatu è funziona u listessu trà tutte e lingue supportate.

Sì - cullà l'URL in /transcribe/youtube/ per YouTube o /transcribe/podcast/ per i podcast (Apple, Spotify, RSS). Scarichiamu l'audiu, lu lanciamu attraversu Whisper cù language=ko, è ritornemu a trascrizzioni cù timestamp è etichette di parlanti. Cuntinutu tipichi cureanu: podcasts, cunferenze, interviste è cuntenutu YouTube di forma longa in cureanu sò i carichi di travagliu più cumuni chì vedemu.

Whisper costa circa 50 tokens à u minutu di audio, cusì una registrazione di un'ora costa ~3,000 tokens. A maiò parte di l'utilizatori ùn spendenu mai nulla - u pool gratuitu di 30,000 tokens copre clip corti, note vocali, è podcasts unilaterali. Oltre à questu, a trascrizzione hè pagata à u usu, cù tokens ricaricati da $1.

Sì - sunnu dispunibbili sia i timestamp a livellu di segmentu (ogni ~10-30 siconni) ca a livellu di parola. U livellu di parola è u predefinitu pi l'esportazzioni di sottotituli VTT/SRT, accussì li dittagli si sincronizzanu riga pi riga. Ntâ API, impostate timestamps="word" ntô corpu dâ richiesta. cureanu i trascrizzioni sò ritornati in scrittura nativa (UTF-8). u testu cureanu nun hà spazi tra li parolle nativamente; i timestamps di diarization agghiùnninu pause naturali à i turni di parlanti.

Sì. POST audio (multipart/form-data, nome di campu "file") a /v1/transcribe/ cu lingua=ko - o omittir u parametru lingua pi lassari ca Whisper si ritruvi automaticamenti. Ritorna JSON cu la trascrizzioni, segmenti, timestamp, e etichette di l'autuparlanti. Rifirimentu cumpletu e snippet SDK a /api/.

Sì - una vota chi a trascrizzioni fini, cliccate Traduttu o incollate u testu in /translate/. cureanu si currispondi a ogni altra lingua ca suppurtamu (più di 200). Pi li minuti di riunioni, a trascrizzioni passa pi /summarize/; pi lu dubbitu, mandallu a /voice/tts/ pi rende l'audiu ntâ lingua di destinazioni.

Whisper hè addestratu in 680K ore di audio rumori reali, cusì a trascrizzioni cureanu hè robusta à u rumore di fondu, letti di musica, è registrazioni di qualità di u telefuninu.Si una trascrizzioni si rivela inutilizzabile, mandate un email à contact@free.ai cu u fugliale - vi rimborseremu i tokens è vedemu s'un altru motore gestisci megliu u vostru audio.

Amuri Free.ai? Dì i vostri amichi!

Valuta sta pàggina