Wizper (Whisper v3)
Free.ai
·
stt
·
~500 жетони по minute
Wizper (Whisper v3) је a модел говора- у- текст. Преко спољашњих модела - ~500 токени по минуту (50% маркерирање преко трошкова нагоре).
Користи се преко АПИ‐ а
АПИ сагласан са OpenAI‐ ом. Генеришите кључ и позовите овај модел за секунде.
curl -X POST https://api.free.ai/v1/stt/ \
-H "Authorization: Bearer sk-free-..." \
-H "Content-Type: application/json" \
-d '{"model":"premium/wizper","audio_url":"https://..."}'
АПИ документација
Добављање АПИ кључа
често постављана питања
Wizper (Whisper v3) transcribes spoken audio into text. Upload an MP3, WAV, M4A, or video file and Wizper (Whisper v3) returns the full transcript plus optional SRT/VTT subtitles with timestamps.
Wizper (Whisper v3) handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.
Стапка словног-грешке је 5-10% на чистом енглеском аудиоузију, 10-20% на бучном или нагласљеном аудиоузи. Велике варијанте исте архитектуре смишљају боље на тешким случајевима - изаберите веће када је звук груб.
Да - сваки одељак садржи почетке и крајње временска ознака. Извези као СРТ или ВТТ и мапу пута директно на снимак.
Wizper (Whisper v3) је премијски транскрипциони мотор. О ~500–1,500 жетона по минуту звука, приказаних уживо пре него што створите. Само-домаћин транскрипција ради бесплатно на вашем 30.000-такен дневном базену; премијски модели су плаћања-а-и- го, са врховима од $1.
МП3, ВАВ, М4А, ФЛАЦ, ОГГ, плус видео (МП4, МОВ, ВебМ) - вадимо аудио. Макс. 500 МБ по слању. Дужи фајлови? Раздвојите са / audio/ cut/ или употребите / v1/stt/ batch /.
Дијаризација звучника је посебан пролаз - укључите и пребаците на /transcribed /. Wizper (Whisper v3) на транскрипцију; дијаризационе ознаке сваког одељка са спикером 1 / звучником 2 / itd.
Да - /batch/ прихвата фасциклу аудио фајлова. Сваки транскрипт слеће у / account /?tab=историју са изворним именом фајла. За одржавање фасцикле- дрвета користите АПИ.
Да - ПОСТ на /v1/stt/ transcribed/ са моделом=" Wizper (Whisper v3)". Враћа ЈСОН са текстом + сегменти + временски тастери р› ијечи. / api/ има пуну референцу.
Самодомаћински модели држе звук на нашим ГПУ‐ овима; премијум пролази са ДПА. Аудио се обрише након д› ијељења прозора (24х, 7d потписано). Не тренирамо на вашим улаза.
Да - зFree.ai допуњује комерцијалну употребу транскрипта. Потребна су вам права на аудио који сте убацили (вас сопствени снимак, дозволени материјал или садржај са пристанком).
Чинилац у реалном времену је отприлике 0,05–0,2× — 60-минутни транскриптор подемисије за 3‐ 12 минута. Премиум модели често завршавају брже. Користите дугме редоследа да затворите језичак.