Free finès Transcripció

Trancricte finès i vídeo a text amb IA. Ràpid, precís i lliure.

Com funciona

  1. Vés a la Transcribador Free.ai
  2. Puja el vostre fitxer d' àudio finès o vídeo
  3. La nostra IA detecta automàticament el finès i transcrivi
  4. Descarrega la vostra transcripció com a text o subtítols de l' SRT

Característiques de la contrascripció finès

  • ✓Powered by faster-whisper (Juditat MIT)
  • ✓Detecció automàtica de llenguatge finès
  • ✓Suport MP3, WAV, MP4, M4A, FLAC, i més
  • ✓Marques de temps i exportació de subtítols (RT)
  • ✓No hi ha límits de mida de fitxer en els plans pagats
  • ✓Els fitxers privats i segurs s' esborraran després de processar- los

Detalls de l' idioma

Idiomafinès
Codi ISOfi
Model IAfaster-whisper
PreuLliure

PMF

Whisper gran control de 3 nanes finès sòlidment 7- 15% d' error de paraula a l' àudio de referència. S' espera que hi hagi càlculs ocasionals en nom d' entitats, números i vocabulari tècnics dens; la major part de la transcripció sigui correcta.(Tier B, 7-15% word error rate sobre conjunts de referència - publicarem els corbatas de veritat en comptes de les reclamacions de màrqueting.)

Sí, la transcripció finès dibuixa des de la teva piscina diària. Els costos d' àudio són uns 50 fitxes per minut, per tant la piscina anònima cobreix unes poques hores d' àudio per dia. Els comptes amb signe tenen una piscina diària de 30.000 vegades més gran. Pass, la transcripció paga a mà, amb fitxes de $ 1, 1, 000.

Les transcripcions finès es retornen en UTF- 8 estàndard amb la normal othografia del llenguatge.

MP3, WAV, M4A, FLAC, OGG, OPUS, and WEBM are accepted directly. For video (MP4, MOV, MKV) we extract the audio track server-side before sending it to Whisper - you do not need to convert anything yourself. Same pipeline regardless of source language, including finès.

El temps anònim puja a més de 500 MB per fitxer. Els comptes amb signe de signe es van a 2 GB. La durada no és un límit difícil - els fitxers llargs es bloquegen automàticament (30 segons les finestres amb sobreposen) i es van cosir en una sola transcripció amb marques de temps continues. Multi- hora finèss (dides, lliçons completes, treball).

Sí, la diarització de l' altaveu és per omissió per a cada transcripció finès. La sortida està segmentada com a ponent 1 / Presidenta 2 / Orador 3 amb marques de temps, així que entrevistes, plafó i reunions multifèriques tornen etiquetada. La Diarització funciona en un model separat i funciona el mateix en totes les llengües que donem suport.

Sí, bibliography enganxa l' URL a / trancrib/tube/ per YouTube o / trancrisc/ a través de fonts de podcasts (Apple, bookmarkify, RSS). El baixem a través de l' àudio Whisper amb el llenguatge=fi, i retornem la transcripció amb marques de temps i etiquetes Orador. Típic finès contingut: Les lliçons, les entrevistes, les notes de veu i YouTube en finès tot el treball - enganxant un URL a / trancribe/tube/ o puja el fitxer directament.

Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.

Sí - tant nivell de segment (cada ~10- 30 segons) com a marques de temps de paraula estan disponibles. El nivell de paraula és l' exportació per als subtítols VT/ SRT de manera que els títols sincronitzaen la línia. En el valor de l' API set marques=" word " en el cos sol· licitud. Les transcripcions finès es retornen en UTF- 8 estàndard amb la normal othografia del llenguatge.

Sí. POST d' àudio (multipart/form- data, nom de camp "fitxer") a / v1/ trancrib / amb el llenguatge=fi - o ometre el paràmetre de l' idioma per a permetre que el Whisper autodetect. Retorna JSON amb la transcripció, segments, marques de temps i etiquetes d' altaveu. Pridor de referència completa i retall de SDK a / pi / a/.

Sí, una vegada que la transcripció acabi, feu clic a la traducció o enganxa el text en / renom /. finès parelles amb cada altre idioma que recol· laborem (200+). Per a que es filtri la transcripció a través de /ummarize /; per a que l' envia a /voice/ tts/ per a renderitzar l' àudio en el llenguatge objectiu.

Whisper està entrenat en centenars de milers d' hores d' àudio real del món, de manera que tolerarà el soroll de fons i les gravacions de qualitat del telèfon a finès. Per a millors resultats, proporcionar àudio net (setmòm, sense música) - en aquest seguit de soroll es basa en la taxa de valors de referència. If a transcript comes back unusable, email contact@free.ai with the file - we will refund the tokens and look at whether a different engine handles your audio better.

Like this tool? Share it!

Valora aquesta pàgina