Fri arabiska Transkription

Översättning arabiska ljud och video till text med AI. Snabb, exakt och fri.

Hur det fungerar

  1. Gå till Free.ai Transscriber
  2. Ladda upp din arabiska ljud- eller videofil
  3. Vår AI upptäcker automatiskt arabiska och transkriberar det
  4. Ladda ner din utskrift som text eller SRT text

arabiska Transkription funktioner

  • ✓Drivs av faster-whisper (licensierade för MIT)
  • ✓Automatisk arabiska språkdetektering
  • ✓Stöder MP3, WAV, MP4, M4A, FLAC, och mer
  • ✓Tidstämpel och undertextexport (SRT)
  • ✓Inga filstorleksgränser för betalda planer
  • ✓Privat och säker -- filer raderas efter behandling

Språkdetaljer

Språkarabiska
Förlaga till bilaga I till förordning (EG) nr 661/2009ar
Förlaga till AIfaster-whisper
PrisFritt

Fler språk

Visa alla språk

Vanliga frågor

Whisper large-v3-turbo handtag arabiska solidly — 7-15% ordfelfrekvens på referensljud. Räkna med enstaka substitutioner på namngivna enheter, siffror och tät teknisk vokabulär; huvuddelen av utskriften kommer att vara korrekt.(Tier B, 7-15% word error rate på benchmarking-uppsättningar - vi publicerar ärliga WER-nivåer snarare än marknadsföringskrav.)

Ja - arabiska transkription drar från din dagliga gratis tokenpool först. Ljud kostar ca 50 polletter per minut, så den anonyma dagliga poolen täcker några timmar ljud per dag. Inskrivna konton får en större 30.000-token daglig pool. Tidigare är transkription pay-as-you-go, med token toppar från $ 1.

Arabiska hanteras på den moderna standarden arabiska (MSA) nivå som standard. Egyptiska, Levantin, Gulf, och Maghrebi colloquial tal är erkända men transkriberas i MSA ortografi - Whisper inte romanisera eller bevara dialekt-specifika stavningar. För ren MSA nyheter / lecture audio förvänta nivå B noggrannhet; tunga Maghrebi eller egyptiska colloquial pushes som lägre.

MP3, WAV, M4A, FLAC, OGG, OPUS, och WEBM accepteras direkt. För video (MP4, MOV, MKV) extraherar vi ljudspår server-sidan innan du skickar den till Whisper - du behöver inte konvertera något själv. Samma rörledning oavsett källspråk, inklusive arabiska.

Anonyma uppladdningar kapsyl på ungefär 500 MB per fil. Inskrivna konton går upp till 2 GB. Varaktighet är inte en hård gräns - långa filer är hopklippta automatiskt (30-sekunders fönster med överlappning) och sys tillbaka till en enda utskrift med kontinuerliga tidsstämpelr. Flertimmars arabiska inspelningar (podcasts, fullständiga föreläsningar, möten) fungerar bra.

Ja - högtalardiarization är på som standard för varje arabiska utskrift. Utmatningen är segmenterad som högtalare 1 / högtalare 2 / högtalare 3 med tidsstämpel, så intervjuer, paneldiskussioner och flerpartsmöten kommer tillbaka märkt. Diarization körs på en separat modell och fungerar på samma sätt över alla språk vi stöder.

Ja - klistra in webbadressen till /transcript/youtube/ för YouTube eller /transcribe/podcast/ för podcast-flöden (Apple, Spotify, RSS). Vi hämtar ljudet, kör det genom Whisper med språk=ar, och returnera utskriften med tidsstämplar och högtalaretiketter. Typiskt arabiska innehåll: nyhetsklipp, predikningar, föreläsningar och politiska intervjuer i arabiska är de vanligaste arbetsbelastningarna; klistra in en YouTube- URL i /transcribe/youtube/ eller ladda upp filen.

Whisper kostar ca 50 tokens per minut ljud, så en timme inspelning är ~3 000 tokens. De flesta användare aldrig spendera något - den fria dagliga poolen av 30.000 polletter täcker korta klipp, röst anteckningar, och engångs podcasts. Bortom det, transkription är pay-as-you-go, med symboliska toppar från $ 1.

Ja - både segmentnivå (varje ~10-30 sekunder) och tidstämpel på ordnivå finns tillgängliga. Word-nivå är standard för VTT/SRT-undertextexport så bildtexterna synkroniseras rad för rad. På API-uppsättningen tidsstämpelr="ord" i begärans kropp. arabiska utskrifter returneras i deras ursprungliga höger-till-vänster skript och återges korrekt i alla RTL-aware-tittare (browsers, Word, Google Docs).

Ja. POST- ljud (multipart/ form- data, fältnamn "fil") till /v1/ transcript/ med språk=ar - eller utelämna språkparametern för att låta Whisper automatiskt detektera. Returnerar JSON med utskrift, segment, tidsstämpel och högtalaretiketter. Full referens och SDK- snippets på /api/.

Ja - när transkription är klar, klicka på Översätt eller klistra in texten i /translate/. arabiska par med alla andra språk vi stöder (200+). För mötesminuter rör utskriften genom /summarize /; för dubbning skicka den till /voice/tts / för att göra ljud i målspråket.

Whisper är utbildad på hundratusentals timmar av verkliga ljud, så det tolererar bakgrundsljud och telefon-kvalitet inspelningar på arabiska. För bästa resultat, leverera rent ljud (headset mikrofon, ingen musik säng) - vid denna nivå buller föreningar baslinje felfrekvensen.Om en utskrift kommer tillbaka oanvändbar, e-post contact@free.ai med filen — vi kommer att återbetala tokens och titta på om en annan motor hanterar ditt ljud bättre.

Love Free.ai? Tell your friends!

Betygsätt denna sida