თავისუფალი ფარერული ტრანსკრიპცია

ფარერული აუდიოს და ვიდეოების ტექსტად გადაწერა AI-ით. სწრაფი, ზუსტი და უფასო.

როგორ მუშაობს

  1. გადასვლა Free.ai გადამწერი
  2. თქვენი ფარერული აუდიო ან ვიდეო ფაილის ატვირთვა
  3. ჩვენი AI ავტომატურად იპყრობს ფარერული და გადაწერს მას
  4. ჩამოტვირთეთ თქვენი ტრანსკრიპცია როგორც ტექსტი ან SRT სუბტიტრები

ფარერული ტრანსკრიპციის ფუნქციები

  • შექმნილია faster-whisper-ს მიერ (MIT ლიცენზია)
  • ენა ფარერული ავტომატური ამოცნობა
  • MP3, WAV, MP4, M4A, FLAC და სხვა ფაილების მხარდაჭერა
  • დროის ნიშნები და სუბტიტრების ექსპორტი (SRT)
  • ფაილის ზომის საზღვრის გარეშე გადახდილი გეგმებისთვის
  • პირადი და უსაფრთხო -- ფაილები დამუშავების შემდეგ იკარგება

ენის დეტალები

ენაფარერული
ISO კოდიfo
AI მოდელიfaster-whisper
ფასიუფასო

ხშირად დასმული კითხვები

ფარერული არის ნაკლებად რესურსიანი ენა Whisper- ისთვის - large- v3- turbo 25% - ზე მეტი სიტყვის შეცდომის მაჩვენებელია, ზოგჯერ ბევრად უფრო მეტი. ტრანსკრიპტი სასარგებლოა ძებნისთვის და gist- ისთვის, მაგრამ არ უნდა იქნას მიჩნეული გამოქვეყნებისთვის მზად. თუ უფრო მაღალი სიზუსტის მოდული გახდება ხელმისაწვდომი ფარერული- ისთვის, ჩვენ მას ავტომატურად ჩავუერთებთ.(Tier D, over 25% word error rate on benchmark sets — ჩვენ გამოვცემთ ნამდვილ WER-ის დონეებს, ვიდრე მარკეტინგულ განცხადებებს.)

დიახ - ფარერული ტრანსკრიფცია ჯერ თქვენი ყოველდღიური უფასო ტოკენების ბაზის გამოყენებას იწყებს. აუდიო ღირს 50 ტოკენი წუთში, ასე რომ ყოველდღიური ანონიმური ბაზა ფარავს რამდენიმე საათს ყოველდღიური აუდიოს. შესული ანგარიშები იღებენ უფრო დიდ 30,000-ტოკენის ყოველდღიურ ბაზასაც. ამის შემდეგ ტრანსკრიფცია ფასდება გამოყენების მიხედვით, ტოკენების დამატება $1-დან.

ფარერული ტრანსკრიპტები იგზავნება სტანდარტულ UTF-8-ში ენის ჩვეულებრივი მართლწერით.

MP3, WAV, M4A, FLAC, OGG, OPUS და WEBM იღება პირდაპირ. ვიდეო (MP4, MOV, MKV) აუდიოს დისკის ამოღება ხდება სერვერის მხრიდან, სანამ იგი Whisper- ში გაგზავნილი იქნება - თქვენ არ გჭირდებათ რაიმეს თვითონ გადამუშავება. იგივე კონვეინერები, მიუხედავად წყაროს ენისა, მათ შორის ფარერული.

ანონიმური ჩატვირთვების საზღვარია დაახლოებით 500 MB ფაილზე. შესული ანგარიშები იზრდება 2 GB-მდე. ხანგრძლივობა არ არის მკაცრი საზღვარი - გრძელი ფაილები ავტომატურად იყოფა ნაჭრებად (30 წამიანი ფანჯრები გადაჭიმვით) და ერთ ტრანსკრიპტში იკრიბება უწყვეტი დროის ნიშნებით. მრავალსაათიანი ფარერული ჩანაწერები (podcasts, სრული ლექციები, შეხვედრები) კარგად მუშაობს.

დიახ - მთარგმნელის დიარიზაცია ნაგულისხმევად ჩართულია ყველა ფარერული ტრანსკრიპტისთვის. გამონატანი სეგმენტირებულია როგორც მთარგმნელი 1 / მთარგმნელი 2 / მთარგმნელი 3 დროის ნიშნებით, ასე რომ ინტერვიუები, პანელის განხილვები და მრავალპარტიული შეხვედრები დაბრუნდება წარწერებით. დიარიზაცია მუშაობს განსხვავებულ მოდელში და იგივე მუშაობს ყველა ენაზე, რომელსაც ჩვენ ვემხრობით.

დიახ — URL- ის ჩასმა /transcribe/youtube/- ში YouTube- ისთვის ან /transcribe/podcast/- ში podcast- ების (Apple, Spotify, RSS) მისაღებად. ჩვენ ავტვირთავთ აუდიოს, ვახორციელებთ მას Whisper- ით language=fo- ით და ვუბრუნებთ ტრანსკრიპციას დროის ნიშნებით და მთარგმნელის ჭდეებით. ტიპიური ფარერული შინაარსი: ლექცია, ინტერვიუ, ხმოვანი ჩანაწერი და YouTube-ის შინაარსი ფარერული-ში ყველა მუშაობს — URL-ის ჩასმა /transcribe/youtube/-ში ან ფაილის პირდაპირ ატვირთვა.

Whisper ღირს დაახლოებით 50 ტოკენი აუდიოს წუთში, ასე რომ ერთი საათიანი ჩაწერა ღირს ~3000 ტოკენი. უმეტესობა მომხმარებლის არასდროს ხარჯავს რამეს - ყოველდღიური უფასო 30 ტოკენი მოიცავს მოკლე კლიპებს, ხმის ჩანაწერებს და ერთჯერად ვიდეო ჩანაწერებს. ამაზე მეტის ტრანსკრიფცია ფასდება გამოყენების მიხედვით, ტოკენების დამატება $1-დან.

დიახ — დროის ნიშნები ხელმისაწვდომია როგორც სეგმენტის დონეზე (ყველა ~10-30 წამში), ასევე სიტყვის დონეზე. სიტყვის დონე არის ნაგულისხმევი VTT/SRT სუბტიტრების ექსპორტისთვის, ასე რომ სინქრონიზაცია ხდება ხაზ-ხაზ. API-ზე დაწესებულია დროის ნიშნები "word" მოთხოვნის ტექსტში. ფარერული ტრანსკრიპტები იგზავნება სტანდარტულ UTF-8-ში ენის ჩვეულებრივი მართლწერით.

დიახ. POST აუდიო (multipart/form-data, field name "file") /v1/transcribe/-ში language=fo-ით — ან გამოტოვეთ ენის პარამეტრი, რომ Whisper-მა ავტომატურად აღმოაჩინოს. უკან იბრუნებ JSON-ს ტრანსკრიპტით, სეგმენტებით, დროის ნიშნებით და მთარგმნელის ჭდეებით. სრული მითითება და SDK ნაჭრები /api/-ში.

დიახ — როგორც კი ტრანსკრიპცია დასრულდება, დააჭირეთ მთარგმნელს ან ჩასვით ტექსტი /translate/-ში. ფარერული თავსებადია ყველა სხვა ენასთან, რომელსაც ჩვენ ვემხრობით (200+). შეხვედრის ანგარიშების შემთხვევაში ტრანსკრიპცია გადაეგზავნება /summarize/-ში; დუბლირების შემთხვევაში გადაეგზავნება /voice/tts/-ში, რათა აუდიო ენაზე გადავიდეს.

Whisper- ის ხმაურის სწავლება ამ დონეზე ნაკლებად ეხმარება - საზღვარი არის ფარერული ხმოვანი მასა, რომელიც Whisper- მა ნახა სწავლების დროს, არა ხმაური. სუფთა სტუდიის ხმა მაინც უსწრებს ხმაურს, მაგრამ არცერთი არ მიაღწევს იმ სიზუსტეს, რომელსაც მიიღებთ მაღალი რესურსების ენაზე.2007 წლის 12 იანვარს, ოფიციალური ვებ-გვერდი დასრულდა. ↑ If a transcript comes back unuseable, email contact@free.ai with the file — we will refund the tokens and look if another engine handles your audio better.

ჲბთფაქ ლთ Free.ai?

ამ გვერდის შეფასება