Darmowe arabski Transcription
Transscribe arabski audio i video do tekstu za pomocą AI. Szybka, dokładna i darmowa.
Jak działa
- Idź na Free.ai Transkreber
- Wyślij plik audio lub wideo arabski
- Nasz AI automatycznie wykrywa arabski i przepisuje go
- Pobierz transkrypcję jako tekst lub napisy SRT
arabski Funkcje przepisu
- ✓Zasilane przez faster-whisper (z licencji MIT)
- ✓Automatyczne wykrywanie języka arabski
- ✓Wsparcie MP3, WAV, MP4, M4A, FLAC i więcej
- ✓Czasy i eksport napisów (SRT)
- ✓Brak ograniczeń w zakresie wielkości pliku w planach płatnych
- ✓Prywatne i bezpieczne -- pliki są usuwane po przetwarzaniu
Szczegóły językowe
| Język | arabski |
| Kod ISO | ar |
| Model AI | faster-whisper |
| Cena | Darmowe |
Więcej języków
Wyświetl wszystkie językiFAQ
Szepchać duży-v3-turbo arabski solidnie — 7-15% częstotliwość błędów słownych w audio referencyjnym. Oczekuj przypadkowych substytucji na nazwane podmioty, numery i gęste słownictwo techniczne; większość transkrypcji będzie poprawna.(Tier B, 7-15% word error rate na zestawach porównawczych - publikujemy szczere poziomy WER zamiast żądań marketingowych.)
Tak - arabski transkrypcja czerpuje najpierw z codziennego bezpłatnego tokena. Audio kosztuje około 50 tokenów na minutę, więc anonimowy dzienny basen obejmuje kilka godzin audio dziennie. Podpisane konta otrzymują większe 30 000 token dzienny basen. Mimo to, transkrypcja jest pay-as-yo-go, z tokenem top-ups z $1.
Arabski jest obsługiwany na poziomie nowoczesnych Standard Arabski (MSA) domyślnie. Egipt, Levantine, Zatoka, i Maghrebi kolokwial przemówienie są rozpoznawane, ale transkrybowane w MSA ortografii - Whisper nie rymaniazują ani nie zachowują sformułowania dialektów. Dla czyste wiadomości MSA/lectura audio oczekują dokładności szczegółu B; ciężki Maghrebi lub egipski kolokwial tłumi, które niżej.
MP3, WAV, M4A, FLAC, OGG, OPUS i WEBM są akceptowane bezpośrednio. Dla wideo (MP4, MOV, MKV) wyciągamy z serwera audio przed wysłaniem go do Whisper - nie musisz nic konwersjonować. Ten sam rurociąg niezależnie od języka źródłowego, w tym arabski.
Anonimowe przesyłanie nakłada się przy oknie około 500 MB za plik. Podpisane konta przechodzą do 2 GB. Czas trwania nie jest trudnym ograniczeniem - długie pliki są automatycznie rozkładane (30-sekundowe okna z nakładem) i przyszyte do jednego transkryptu z ciągłymi czasowymi emplazami. Wielogodzinne nagrania arabski (podkasty, pełne wykłady, spotkania) pracują dobrze.
Tak - diaryzacja głośnika jest domyślnie włączona dla każdego transkryptu arabski. Wyjście jest segmentowane jako głośnik 1 / głośnik 2 / głośnik 3 z czasowymi symptomy, więc wywiady, panele dyskusji i spotkania wielostronne pojawiają się z napisem. Diaryzacja działa na oddzielnym modelu i pracuje tak samo w każdym języku, który wspieramy.
Tak - wklej URL do /transklasyw/youtube/ dla YouTube lub /transkript/podcast/ dla podcast paszy (Apple, Spotify, RSS). Pobieramy audio, przełączamy przez Whisper przez język=ar, a zwracamy transkrypt z etykietami czasowymi i głośnika. Typowa zawartość arabski: Klipy wiadomości, kazania, wykłady i wywiady polityczne w arabski są najczęściej zajęciami pracy; wklej URL YouTube do /transcribe/youtube / lub prześlij plik.
Whisper kosztuje około 50 tokenów na minutę audio, więc jednogodzinne nagranie to ~3 000 tokenów. Większość użytkowników nigdy nie wydaje nic - bezpłatny codzienny basen z 30 000 żetonów obejmuje krótkie klipy, notatki głosowe i jednorazowe podcasty. Poza tym transkrypcja jest pay-as-yo-go, z tokenem top-ups z $1.
Tak - zarówno poziom segmentu (co ~10-30 sekund) jak i czasowe emplestry rzędu słowa są dostępne. Poziom słowa jest domyślnym dla eksportu napisów VTT/SRT tak, że podpisy synchronizują się liniowo po linii. Na zestawie API czasowe emplestry=" słowo" w organizmie żądania. arabski transkrypty są zwracane w swoim native skrypt od prawej do lewej i prawidłowo wyświetlane w dowolnym RTL-świadomym widzu (browsers, Word, Google Docs).
Tak. Posterunki audio (multipart/form-data, nazwa pola "file") do /v1/transcribe/ z językiem=ar - lub pominąć parametr języka, aby pozwolić Whisper wykrywać auto. Zwraca JSON z transkrypcją, segmentami, czasami i etykietami głośnika. Pełne odniesienie i SDK srippes at /api /.
Tak - raz transkrypcja kończy się, kliknij Przetłumacz lub wklej tekst do /przetłumacz /. arabski pary z każdym innym językiem, który obsługujemy (200+). Na spotkanie minut przewozi transkrypcję przez /summarize /; dla dubbing wyślij go do /voice/tts / aby wyświetlić audio w języku docelowym.
Whisper jest wyszkolony na setki tysięcy godzin audio real-world, więc toleruje hałas tła i nagrania jakości telefonicznej na arabski. Dla najlepszych rezultatów, zasilanie czystym audio (główka mikrofonu, bez łóżka muzycznego) - w tym poziomie hałasu związuje wartość błędu.Jeśli transkrypta wróci nieużytkowy, email contact@free.ai z plikiem - zwrócimy żetony i zobaczymy, czy inny silnik obsługuje dźwięk lepiej.