თავისუფალი არაბული ტრანსკრიპცია
არაბული აუდიოს და ვიდეოების ტექსტად გადაწერა AI-ით. სწრაფი, ზუსტი და უფასო.
როგორ მუშაობს
- გადასვლა Free.ai ტრანსკრიპტორი
- თქვენი არაბული აუდიო ან ვიდეო ფაილის ჩატვირთვა
- ჩვენი AI ავტომატურად იპყრობს არაბული და გადაწერს მას
- ჩამოტვირთეთ თქვენი ტრანსკრიპცია როგორც ტექსტი ან SRT სუბტიტრები
არაბული ტრანსკრიპციის ფუნქციები
- ✓შექმნილია faster-whisper-ს მიერ (MIT ლიცენზია)
- ✓არაბული ენის ავტომატური ამოცნობა
- ✓MP3, WAV, MP4, M4A, FLAC და სხვა ფაილების მხარდაჭერა
- ✓დროის ნიშნები და სუბტიტრების ექსპორტი (SRT)
- ✓ფაილის ზომის საზღვრის გარეშე გადახდილი გეგმებისთვის
- ✓პირადი და უსაფრთხო -- ფაილები დამუშავების შემდეგ იკარგება
ენის დეტალები
| ენა | არაბული |
| ISO კოდი | ar |
| AI მოდელი | faster-whisper |
| ფასი | უფასო |
მეტი ენაName
ყველა ენის ჩვენებახშირად დასმული კითხვები
Whisper large-v3-turbo სწორად უმკლავდება არაბული-ს - 7-15% სიტყვების შეცდომის მაჩვენებელი აუდიოს ბაზაზე. იმედი მაქვს, რომ სახელწოდებების, ციფრების და რთული ტექნიკური ლექსიკონის შემთხვევითი ჩანაცვლებები იქნება; ტრანსკრიპციის დიდი ნაწილი სწორი იქნება.(Tier B, 7-15% word error rate on benchmark sets — ჩვენ გამოვცემთ ნამდვილ WER-ის დონეებს, ვიდრე მარკეტინგულ განცხადებებს.)
დიახ - არაბული ტრანსკრიპცია იღებს ყოველდღიური უფასო ტოკენების ბაზა. აუდიო ღირს დაახლოებით 50 ტოკენი წუთში, ასე რომ ყოველდღიური ანონიმური ბაზა ფარავს რამდენიმე საათის აუდიოს დღეში. შესული ანგარიშები იღებენ უფრო დიდ 30,000-ტოკენის ყოველდღიურ ბაზა. ამის შემდეგ, ტრანსკრიპცია არის გადახდის გზით, ტოკენების დამატება $1-დან.
არაბული ნაგულისხმევად თანამედროვე სტანდარტული არაბული (MSA) დონეზეა. ეგვიპტური, ლევანტური, გუფთა და მაგრაბის საუბარი აღიქმება, მაგრამ ტრანსკრიბირებულია MSA ორთოგრაფიით - Whisper არ იტაცებს ლონდონურ ან არ ინარჩუნებს დიალექტური სპეციფიკური მართლწერას. MSA- ს ახალი ამბების/ ლექციის აუდიოსთვის B დონის სიზუსტე უნდა მოელით; მძიმე მაგრაბის ან ეგვიპტური საუბარი ამ დონეს ქვემოთ წევს.
MP3, WAV, M4A, FLAC, OGG, OPUS და WEBM იღება პირდაპირ. ვიდეო (MP4, MOV, MKV) ვიდეოებისთვის ჩვენ აუდიო დისკის ამოღებას სერვერის მხრიდან ვახდენთ, სანამ ის Whisper- ში გაგზავნილ იქნა - თქვენ არ გჭირდებათ რაიმეს პირადად გადაქცევა. იგივე გზა, მიუხედავად წყაროს ენისა, არაბული- შიც.
ანონიმური ჩატვირთვების საზღვარია დაახლოებით 500 MB ფაილზე. შესული ანგარიშები იზრდება 2 GB-მდე. ხანგრძლივობა არ არის მკაცრი საზღვარი - გრძელი ფაილები ავტომატურად იყოფა ნაჭრებად (30 წამიანი ფანჯრები გადაჭიმვით) და ერთ ტრანსკრიპტში იკრიბება უწყვეტი დროის ნიშნებით. მრავალსაათიანი არაბული ჩანაწერები (podcasts, სრული ლექციები, შეხვედრები) კარგად მუშაობს.
დიახ - მსაუბრეთა დიარიზაცია ნაგულისხმევად ჩართულია ყველა არაბული ტრანსკრიპტისთვის. გამონატანი სეგმენტირებულია როგორც მსაუბრე 1 / მსაუბრე 2 / მსაუბრე 3 დროის სტიკერებით, ასე რომ ინტერვიუები, პანელის განხილვები და მრავალპარტიული შეხვედრები დაბრუნდება წარწერებით. დიარიზაცია მუშაობს განსხვავებულ მოდელში და მუშაობს იგივე ყველა ენაზე, რომელსაც ჩვენ ვუჭერთ მხარს.
დიახ - URL- ის ჩასმა / transcribe/ youtube- ში YouTube- ისთვის ან / transcribe/ podcast / - ში podcast- ების (Apple, Spotify, RSS) მისაღებად. ჩვენ ავტვირთავთ აუდიოს, ვახორციელებთ მას Whisper- ში language=ar- ით და ვუბრუნებთ ტრანსკრიპტს დროის და საუბრის ნიშნებით. ტიპიური არაბული- ის შინაარსი: ახალი ამბების ვიდეოები, ლოცვები, ლექციები და პოლიტიკური ინტერვიუები არაბული- ში ყველაზე გავრცელებული სამუშაოა; YouTube URL- ის ჩასმა /transcribe/youtube/- ში ან ფაილის ჩატვირთვა.
Whisper-ის ფასი 50 ტოკენია აუდიოს წუთში, ასე რომ ერთი საათიანი ჩაწერა ღირს ~3000 ტოკენია. უმეტესობა მომხმარებელი არასდროს ხარჯავს რამეს - ყოველდღიური უფასო 30 000 ტოკენია მოიცავს მოკლე კლიპებს, ხმის ჩანაწერებს და ერთჯერად პოდსტეებს. ამაზე მეტის ტრანსკრიპცია ფასდება გამოყენების მიხედვით, ტოკენების დამატება $1-დან.
დიახ — დროის ნიშნები ხელმისაწვდომია როგორც სეგმენტის დონეზე (ყველა ~10-30 წამში), ასევე სიტყვის დონეზე. სიტყვის დონე არის ნაგულისხმევი VTT/SRT სუბტიტრების ექსპორტისთვის, ასე რომ სინქრონიზაცია ხდება ხაზ-ხაზ. API-ზე დაწესებულია დროის ნიშნები "word" მოთხოვნის ტექსტში. არაბული transcripts are returned in their native right-to-left script and render correctly in any RTL-aware viewer (browsers, Word, Google Docs). ↑ 2008 წლის 10 იანვარი.
დიახ. POST აუდიო (multipart/form-data, field name "file") /v1/transcribe/-ში language=ar - ან ენა პარამეტრის გამოტოვება, რათა Whisper-მა ავტომატურად დაადასტუროს. იძლევა JSON-ს ტრანსკრიპტით, სეგმენტებით, დროის ნიშნებით და მთავარ ჭრილში. სრული მითითება და SDK ნაჭრები /api/-ში.
დიახ — როგორც კი ტრანსკრიპცია დასრულდება, დააჭირეთ მთარგმნელს ან ჩასვით ტექსტი /translate/-ში. არაბული თავსებადია ყველა სხვა ენასთან, რომელსაც ჩვენ ვემხრობით (200+). შეხვედრის ანგარიშების შემთხვევაში ტრანსკრიპცია გადაეგზავნება /summarize/-ში; დუბლირების შემთხვევაში გადაეგზავნება /voice/tts/-ში, რათა აუდიო ენაზე გადავიდეს.
Whisper- ს სწავლება ათასობით ათასი საათის რეალური აუდიოს საფუძველზე ხორციელდება, ამიტომ ის იტანს ფონის ხმას და ტელეფონის ხარისხის ჩაწერას არაბული- ზე. საუკეთესო შედეგების მისაღებად, მიაწოდეთ სუფთა აუდიო (ყურსასმენის მიკროფონი, მუსიკალური საწოლი არ არის) - ამ დონეზე ხმა ზრდის ბაზალური შეცდომის მაჩვენებელს.2007 წლის 12 იანვარს, ოფიციალური ვებ-გვერდი დასრულდა. ↑ If a transcript comes back unuseable, email contact@free.ai with the file — we will refund the tokens and look if another engine handles your audio better.