თავისუფალი მარათჰი ტრანსკრიპცია
მარათჰი აუდიოს და ვიდეოების ტექსტად გადაწერა AI-ით. სწრაფი, ზუსტი და უფასო.
როგორ მუშაობს
- გადასვლა Free.ai ტრანსკრიპტორი
- თქვენი მარათჰი აუდიო ან ვიდეო ფაილის ჩატვირთვა
- ჩვენი AI ავტომატურად იპყრობს მარათჰი და გადაწერს მას
- ჩამოტვირთეთ თქვენი ტრანსკრიპცია როგორც ტექსტი ან SRT სუბტიტრები
მარათჰი ტრანსკრიპციის ფუნქციები
- ✓შექმნილია faster-whisper-ს მიერ (MIT ლიცენზია)
- ✓მარათჰი ენის ავტომატური ამოცნობა
- ✓MP3, WAV, MP4, M4A, FLAC და სხვა ფაილების მხარდაჭერა
- ✓დროის ნიშნები და სუბტიტრების ექსპორტი (SRT)
- ✓ფაილის ზომის საზღვრის გარეშე გადახდილი გეგმებისთვის
- ✓პირადი და უსაფრთხო -- ფაილები დამუშავების შემდეგ იკარგება
ენის დეტალები
| ენა | მარათჰი |
| ISO კოდი | mr |
| AI მოდელი | faster-whisper |
| ფასი | უფასო |
მეტი ენაName
ყველა ენის ჩვენებახშირად დასმული კითხვები
მარათჰი არის Whisper- ის საშუალო რესურსის ენა - დიდი v3- ტურბო 15- 25% სიტყვის შეცდომის მაჩვენებელს იკავებს. ტრანსკრიპტის ფუნდამენტი საიმედოა; მოსალოდნელია სახელწოდებების შეცდომები, კოდის გადართვის შემთხვევითი შეცდომები და მოკლე გამოთქმების შეცდომები. ხალხის გადასვლა დაგეგმეთ გამოცემის ხარისხის გამოსასვლელისთვის.(Tier C, 15-25% word error rate on benchmark sets — ჩვენ გამოვცემთ ნამდვილ WER-ის დონეებს, ვიდრე მარკეტინგულ განცხადებებს.)
დიახ - მარათჰი ტრანსკრიპცია იღებს ყოველდღიური უფასო ტოკენების ბაზა. აუდიო ღირს დაახლოებით 50 ტოკენი წუთში, ასე რომ ყოველდღიური ანონიმური ბაზა ფარავს რამდენიმე საათის აუდიოს დღეში. შესული ანგარიშები იღებენ უფრო დიდ 30,000-ტოკენის ყოველდღიურ ბაზა. ამის შემდეგ, ტრანსკრიპცია არის გადახდის გზით, ტოკენების დამატება $1-დან.
მარათჰი ტრანსკრიპტები იგზავნება ევნაგარი სკრიპტში (UTF-8).
MP3, WAV, M4A, FLAC, OGG, OPUS და WEBM იღება პირდაპირ. ვიდეო (MP4, MOV, MKV) ვიდეოებისთვის ჩვენ აუდიო დისკის ამოღებას სერვერის მხრიდან ვახდენთ, სანამ ის Whisper- ში გაგზავნილ იქნა - თქვენ არ გჭირდებათ რაიმეს პირადად გადაქცევა. იგივე გზა, მიუხედავად წყაროს ენისა, მარათჰი- შიც.
ანონიმური ჩატვირთვების საზღვარია დაახლოებით 500 MB ფაილზე. შესული ანგარიშები იზრდება 2 GB-მდე. ხანგრძლივობა არ არის მკაცრი საზღვარი - გრძელი ფაილები ავტომატურად იყოფა ნაჭრებად (30 წამიანი ფანჯრები გადაჭიმვით) და ერთ ტრანსკრიპტში იკრიბება უწყვეტი დროის ნიშნებით. მრავალსაათიანი მარათჰი ჩანაწერები (podcasts, სრული ლექციები, შეხვედრები) კარგად მუშაობს.
დიახ - მსაუბრეთა დიარიზაცია ნაგულისხმევად ჩართულია ყველა მარათჰი ტრანსკრიპტისთვის. გამონატანი სეგმენტირებულია როგორც მსაუბრე 1 / მსაუბრე 2 / მსაუბრე 3 დროის სტიკერებით, ასე რომ ინტერვიუები, პანელის განხილვები და მრავალპარტიული შეხვედრები დაბრუნდება წარწერებით. დიარიზაცია მუშაობს განსხვავებულ მოდელში და მუშაობს იგივე ყველა ენაზე, რომელსაც ჩვენ ვუჭერთ მხარს.
დიახ - URL- ის ჩასმა / transcribe/ youtube- ში YouTube- ისთვის ან / transcribe/ podcast / - ში podcast- ების (Apple, Spotify, RSS) მისაღებად. ჩვენ ავტვირთავთ აუდიოს, ვახორციელებთ მას Whisper- ში language=mr- ით და ვუბრუნებთ ტრანსკრიპტს დროის და საუბრის ნიშნებით. ტიპიური მარათჰი- ის შინაარსი: WhatsApp-ის ხმის ჩანაწერები, YouTube-ის ბლოგები და მოკლე ფორმის ვიდეოები ყველაზე გავრცელებული მარათჰი-ის სამუშაო დატვირთვებია - URL-ის ჩასმა /transcribe/youtube/-ში ან აუდიოს პირდაპირი ჩატვირთვა.
Whisper-ის ფასი 50 ტოკენია აუდიოს წუთში, ასე რომ ერთი საათიანი ჩაწერა ღირს ~3000 ტოკენია. უმეტესობა მომხმარებელი არასდროს ხარჯავს რამეს - ყოველდღიური უფასო 30 000 ტოკენია მოიცავს მოკლე კლიპებს, ხმის ჩანაწერებს და ერთჯერად პოდსტეებს. ამაზე მეტის ტრანსკრიპცია ფასდება გამოყენების მიხედვით, ტოკენების დამატება $1-დან.
დიახ — დროის ნიშნები ხელმისაწვდომია როგორც სეგმენტის დონეზე (ყველა ~10-30 წამში), ასევე სიტყვის დონეზე. სიტყვის დონე არის ნაგულისხმევი VTT/SRT სუბტიტრების ექსპორტისთვის, ასე რომ სინქრონიზაცია ხდება ხაზ-ხაზ. API-ზე დაწესებულია დროის ნიშნები "word" მოთხოვნის ტექსტში. მარათჰი ტრანსკრიპტები იგზავნება ევნაგარი სკრიპტში (UTF-8).
დიახ. POST აუდიო (multipart/form-data, field name "file") /v1/transcribe/-ში language=mr - ან ენა პარამეტრის გამოტოვება, რათა Whisper-მა ავტომატურად დაადასტუროს. იძლევა JSON-ს ტრანსკრიპტით, სეგმენტებით, დროის ნიშნებით და მთავარ ჭრილში. სრული მითითება და SDK ნაჭრები /api/-ში.
დიახ — როგორც კი ტრანსკრიპცია დასრულდება, დააჭირეთ მთარგმნელს ან ჩასვით ტექსტი /translate/-ში. მარათჰი თავსებადია ყველა სხვა ენასთან, რომელსაც ჩვენ ვემხრობით (200+). შეხვედრის ანგარიშების შემთხვევაში ტრანსკრიპცია გადაეგზავნება /summarize/-ში; დუბლირების შემთხვევაში გადაეგზავნება /voice/tts/-ში, რათა აუდიო ენაზე გადავიდეს.
Whisper- ის ხმაურიანი ძლიერება ჯერ კიდევ მოქმედებს მარათჰი- ზე, მაგრამ ამ ზუსტობის დონეზე ნებისმიერი დამატებითი ხმაური ზრდის ბაზალური შეცდომის მაჩვენებელს. სუფთა ყურსასმენის ხმა უფრო კარგი შედეგია, ვიდრე ტელეფონის ან ლეპტოპის მიკროფონის ჩაწერა.2007 წლის 12 იანვარს, ოფიციალური ვებ-გვერდი დასრულდა. ↑ If a transcript comes back unuseable, email contact@free.ai with the file — we will refund the tokens and look if another engine handles your audio better.