Trascrizione gratuita tagico

Trascrivere audio e video tagico in testo con AI. Veloce, preciso e gratuito.

Come funziona

  1. Vai al Trascrittore Free.ai
  2. Carica il tuo file audio o video tagico
  3. Il nostro AI rileva automaticamente tagico e lo trascrive
  4. Scarica la tua trascrizione come testo o sottotitoli SRT

tagico Caratteristiche della trascrizione

  • ✓Powered by faster-whisper (licensing MIT)
  • ✓Rilevamento automatico della lingua tagico
  • ✓Supporta MP3, WAV, MP4, M4A, FLAC e altro ancora
  • ✓Esportazione di cartellini orari e sottotitoli (SRT)
  • ✓Nessun limite di dimensione del file sui piani a pagamento
  • ✓Privato e sicuro -- i file vengono eliminati dopo l'elaborazione

Dettagli della lingua

Linguatagico
Codice ISOtg
Modello AIfaster-whisper
PrezzoGratis

FAQ

tagico è un linguaggio meno rifluito per Whisper - large-v3-turbo si trova sopra il 25% di tasso di errore di parola, a volte ben sopra. La trascrizione è utile per la ricerca e la sintesi, ma non deve essere trattata come pubblicazione-pronto. Se un motore di maggiore precisione diventa disponibile per tagico lo infiliamo automaticamente.(Tier D, over 25% word error rate sui set di benchmark - pubblichiamo livelli WER onesti piuttosto che reclami di marketing.)

Sì - la trascrizione tagico attinge dal tuo token pool giornaliero. L'audio costa circa 50 token al minuto, quindi la piscina giornaliera anonima copre alcune ore di audio al giorno. I conti registrati ricevono una piscina giornaliera più grande di 30.000 token. Oltre a questo, la trascrizione è pay-as-you-go, con token top-up da $1.

Le trascrizioni tagico vengono restituite in UTF-8 standard con l'ortografia normale della lingua.

MP3, WAV, M4A, FLAC, OGG, OPUS e WEBM sono accettati direttamente. Per i video (MP4, MOV, MKV) estraiamo il lato server della traccia audio prima di inviarlo a Whisper - non è necessario convertire nulla da soli. Stessa pipeline indipendentemente dal linguaggio sorgente, compreso tagico.

Anonimo carica il tappo a circa 500 MB per file. I conti registrati arrivano a 2 GB. La durata non è un limite difficile - i file lunghi vengono ritagliati automaticamente (30 secondi di finestre con sovrapposizione) e ricuciti in un unico trascritto con temporizzazioni continue. Le registrazioni a più ore tagico (podcast, lezioni complete, riunioni) funzionano bene.

Sì - la dializzazione degli altoparlanti è impostata di default per ogni trascrizione tagico. L'output è segmentato come Speaker 1 / Speaker 2 / Speaker 3 con timestamp, quindi tornano le interviste, le discussioni in panel e le riunioni multi-partitiche etichettate. La dializzazione funziona su un modello separato e funziona allo stesso modo in tutte le lingue che supportiamo.

Sì Incolla l'URL in /transcribe/youtube/ per YouTube o /transcribe/podcast/ per i feed podcast (Apple, Spotify, RSS). Scaricamo l'audio, lo eseguiamo attraverso Whisper con la lingua=tg, e restituiamo la trascrizione con timestamp ed etichette degli altoparlanti. Tipico contenuto tagico: conferenze, interviste, note vocali e contenuti di YouTube in tagico tutto il lavoro - incolla un URL in /transcribe/youtube/ o carica il file direttamente.

Whisper costa circa 50 gettoni al minuto di audio, quindi una registrazione di un'ora è ~3.000 gettoni. La maggior parte degli utenti non spende mai nulla - il pool giornaliero gratuito di 30.000 gettoni copre brevi clip, note vocali e podcast una tantum. Oltre a questo, la trascrizione è pay-as-you-go, con token top-up da $1.

Sì - sono disponibili sia i timestamp a livello di segmento (ogni ~10-30 secondi) che quelli a livello di parola. Il livello di parola è il valore predefinito per l'esportazione di sottotitoli VTT/SRT, quindi le didascalie sincronizzano riga per riga. Sull'API impostare timestamps="word" nel corpo della richiesta. Le trascrizioni tagico vengono restituite in UTF-8 standard con l'ortografia normale della lingua.

Sì. Audio POST (multipart/form-data, nome campo "file") a /v1/trascrivi/ con la lingua=tg - o omette il parametro lingua per lasciare che Whisper venga rilevato automaticamente. Restituisce JSON con la trascrizione, i segmenti, i timestamp ed etichette degli altoparlanti.

Sì - una volta terminata la trascrizione, fare clic su Traduci o incolla il testo in /translate/. tagico coppie con ogni altra lingua che supportiamo (200+). Per i minuti di riunione pipe la trascrizione attraverso /summarize/; per il doppiaggio inviarlo a /voice/tts/ per rendere l'audio nella lingua di destinazione.

L'allenamento al rumore di Whisper aiuta meno a questo livello - il collo di bottiglia è la quantità di tagico audio Whisper sega durante l'allenamento, non rumore. L'audio pulito in studio batte ancora l'audio rumoroso, ma non raggiungerà la precisione che si ottiene su un linguaggio ad alta risorsa.Se una trascrizione viene di nuovo inutilizzabile, email contact@free.ai con il file - rimborseremo i gettoni e verificare se un motore diverso gestisce meglio l'audio.

Love Free.ai? Dillo ai tuoi amici!

Valuta questa pagina