Wizper (Whisper v3)

Free.ai · stt · ~500 ტოკენები minute

აუდიო ან ვიდეო ფაილის ჩამოგდება ან URL-ის ქვემოთ ჩასმა

~500 ტოკენები minute
ჟგჲბჲენჲ ჟვ ოპაგთ ნა ნაქთრვ დპატთფნთ ოპჲუვჟჲპთ. განახლების პარამეტრები Wizper (Whisper v3) →

Wizper (Whisper v3) არის a საუბარი-ტექსტი მოდელი. Routed through external models - ~500 tokens წუთში (50% markup over upstream cost).

API- ს გამოყენება

OpenAI- სთან თავსებადი REST API. გასაღების შექმნა და ამ მოდელის გამოძახება წამებში.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/wizper","audio_url":"https://..."}'
დოკუმენტაცია API კოდის მიღება

ხშირად დასმული კითხვებიName

Wizper (Whisper v3) ხმამაღალი აუდიოს ტექსტად გადაწერს. MP3, WAV, M4A ან ვიდეო ფაილის ჩატვირთვა და Wizper (Whisper v3)- მა დააბრუნებს სრულ ტრანსკრიპციას და შესაძლებელ SRT/ VTT სუბტიტრებს დროის ნიშნებით.

Wizper (Whisper v3) handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

სიტყვების შეცდომის მაჩვენებელი 5-10% -ია სუფთა ინგლისურ აუდიოში, 10-20% -ია ხმაურიან ან აქცენტირებული აუდიოში. იგივე არქიტექტურის დიდი ვარიანტები უფრო მეტად ახერხებენ რთული შემთხვევების გაუმჯობესებას - აირჩიეთ უფრო დიდი, თუ აუდიო უხეშია.

დიახ - ყველა სეგმენტი შეიცავს დაწყების/დასრულების დროის ნიშნებს. ექსპორტი როგორც SRT ან VTT და დროის ნიშნები პირდაპირ თქვენს ვიდეოზე.

Wizper (Whisper v3) არის პრემიუმ ტრანსკრიპციის მოწყობილობა. დაახლოებით ~500-1,500 ტოკენი აუდიოს წუთში, ხილული ცხოვრების წინ, სანამ თქვენ შექმნით. თვით- ჰოსტინგის ტრანსკრიპცია უფასოა თქვენი 30,000-ტოკენის ყოველდღიური ბაზის გამოყენებით; პრემიუმ მოდელები ფასდება გამოყენების მიხედვით, დამატებითი ფასები $1-დან.

MP3, WAV, M4A, FLAC, OGG, და ვიდეო (MP4, MOV, WebM) - აუდიოს ამოღება. მაქსიმალური 500 MB ერთ ჩატვირთვაზე. უფრო დიდი ფაილები? გაყოფა /audio/cut/-ით ან /v1/stt/batch/-ის გამოყენებით.

Speaker diarization is a separate pass - toggle "diarize" on /transcribe/. Wizper (Whisper v3) handles the transcription; diarization labels each segment with Speaker 1 / Speaker 2 / etc.

დიახ - / batch / იღებს აუდიო ფაილების საქაღალდეს. ყოველი ტრანსკრიპცია ხვდება /account/? tab=history- ში ორიგინალური ფაილის სახელით. საქაღალდეების ხის შენარჩუნებისთვის გამოიყენეთ API.

Yes - POST your audio to /v1/stt/transcribe/ with model="Wizper (Whisper v3)". Returns JSON with text + segments + word-level timestamps. /api/ has the full reference.

თვით-დაფუძნებული მოდელები ხმას გრაფიკული პროცესორის საშუალებით იღებენ; პრემიუმ მოდელები DPA-ს საშუალებით იღებენ. ხმა წაიშლება გაზიარების ფანჯრის შემდეგ (24 საათი ანონსირებული, 7 დღე ჩართული). ჩვენ არ ვასწავლით თქვენს შეყვანას.

დიახ - Free.ai უფლებას გაძლევთ ტრანსკრიპტების კომერციული გამოყენება. თქვენ უნდა გქონდეთ აუდიოს უფლება, რომელიც თქვენ ჩატვირთეთ (თქვენი საკუთარი ჩანაწერი, ლიცენზირებული მასალა ან შენახვა ნებართვის გარეშე).

რეალური დროის ფაქტორი დაახლოებით 0.05-0.2× - 60 წუთიანი ვიდეო ჩანაწერი 3-12 წუთში იწერება. Premium მოდელი ხშირად უფრო სწრაფად მთავრდება. ჩანართის დახურვისთვის გამოიყენეთ რიგის ღილაკი.

ჲბთფაქ ლთ Free.ai?

ამ გვერდის შეფასება