Free àrab Transcripció
Trancricte àrab i vídeo a text amb IA. Ràpid, precís i lliure.
Com funciona
- Vés a la Transcribador Free.ai
- Puja el vostre fitxer d' àudio àrab o vídeo
- La nostra IA detecta automàticament el àrab i transcrivi
- Descarrega la vostra transcripció com a text o subtítols de l' SRT
Característiques de la contrascripció àrab
- ✓Powered by faster-whisper (Juditat MIT)
- ✓Detecció automàtica de llenguatge àrab
- ✓Suport MP3, WAV, MP4, M4A, FLAC, i més
- ✓Marques de temps i exportació de subtítols (RT)
- ✓No hi ha límits de mida de fitxer en els plans pagats
- ✓Els fitxers privats i segurs s' esborraran després de processar- los
Detalls de l' idioma
| Idioma | àrab |
| Codi ISO | ar |
| Model IA | faster-whisper |
| Preu | Lliure |
Més idiomes
Visualitza tots els idiomesPMF
Whisper gran control de 3 nanes àrab sòlidment 7- 15% d' error de paraula a l' àudio de referència. S' espera que hi hagi càlculs ocasionals en nom d' entitats, números i vocabulari tècnics dens; la major part de la transcripció sigui correcta.(Tier B, 7-15% word error rate sobre conjunts de referència - publicarem els corbatas de veritat en comptes de les reclamacions de màrqueting.)
Sí, la transcripció àrab dibuixa des de la teva piscina diària. Els costos d' àudio són uns 50 fitxes per minut, per tant la piscina anònima cobreix unes poques hores d' àudio per dia. Els comptes amb signe tenen una piscina diària de 30.000 vegades més gran. Pass, la transcripció paga a mà, amb fitxes de $ 1, 1, 000.
L' àrab és controlat en el nivell modern d' àrab estàndard (MSA) per omissió. Egipí, Llengua, Golf i el discurs babiloquial són reconeguts però transcrivides a MSA othografia - Whisper no fa roman o conservador d' ortografia dialecte. Per a només els encanteris específics de MSA/ News/lecure esperen l' ús de la connexió d' àudio- B; Maghbi o egiples egipcies que baixa.
MP3, WAV, M4A, FLAC, OGG, OPUS, and WEBM are accepted directly. For video (MP4, MOV, MKV) we extract the audio track server-side before sending it to Whisper - you do not need to convert anything yourself. Same pipeline regardless of source language, including àrab.
El temps anònim puja a més de 500 MB per fitxer. Els comptes amb signe de signe es van a 2 GB. La durada no és un límit difícil - els fitxers llargs es bloquegen automàticament (30 segons les finestres amb sobreposen) i es van cosir en una sola transcripció amb marques de temps continues. Multi- hora àrabs (dides, lliçons completes, treball).
Sí, la diarització de l' altaveu és per omissió per a cada transcripció àrab. La sortida està segmentada com a ponent 1 / Presidenta 2 / Orador 3 amb marques de temps, així que entrevistes, plafó i reunions multifèriques tornen etiquetada. La Diarització funciona en un model separat i funciona el mateix en totes les llengües que donem suport.
Sí, bibliography enganxa l' URL a / trancrib/tube/ per YouTube o / trancrisc/ a través de fonts de podcasts (Apple, bookmarkify, RSS). El baixem a través de l' àudio Whisper amb el llenguatge=ar, i retornem la transcripció amb marques de temps i etiquetes Orador. Típic àrab contingut: clips de notícies, sermons, lliçons i entrevistes polítiques en àrab són les càrregues de treball més comuns; enganxar un URL de YouTube a / trancribe/tube / o pujar el fitxer.
Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.
Sí - tant nivell de segment (cada ~10- 30 segons) com a marques de temps de paraula estan disponibles. El nivell de paraula és l' exportació per als subtítols VT/ SRT de manera que els títols sincronitzaen la línia. En el valor de l' API set marques=" word " en el cos sol· licitud. Les transcripcions àrab es retornen en el seu guió natiu a esquerra i es mostren correctament en qualsevol visor conscient RTL (els lectors, Words, Google Docs).
Sí. POST d' àudio (multipart/form- data, nom de camp "fitxer") a / v1/ trancrib / amb el llenguatge=ar - o ometre el paràmetre de l' idioma per a permetre que el Whisper autodetect. Retorna JSON amb la transcripció, segments, marques de temps i etiquetes d' altaveu. Pridor de referència completa i retall de SDK a / pi / a/.
Sí, una vegada que la transcripció acabi, feu clic a la traducció o enganxa el text en / renom /. àrab parelles amb cada altre idioma que recol· laborem (200+). Per a que es filtri la transcripció a través de /ummarize /; per a que l' envia a /voice/ tts/ per a renderitzar l' àudio en el llenguatge objectiu.
Whisper està entrenat en centenars de milers d' hores d' àudio real del món, de manera que tolerarà el soroll de fons i les gravacions de qualitat del telèfon a àrab. Per a millors resultats, proporcionar àudio net (setmòm, sense música) - en aquest seguit de soroll es basa en la taxa de valors de referència. If a transcript comes back unusable, email contact@free.ai with the file - we will refund the tokens and look at whether a different engine handles your audio better.