Wizper (Whisper v3)

Free.ai · stt · ~500 Бер буш урынга minute

Аудио яки видео файлны төшерегез яки URLны түбәнгә урнаштырыгыз

~500 Бер буш урынга minute
Безнең якларда елгалар күп. Яңарту өчен Wizper (Whisper v3) →

Wizper (Whisper v3) is a сүздән-матнга модель. Routed through external models - ~500 tokens минутына (50% markup over upstream cost).

API аша куллану

OpenAI-га туры килгән REST API. Ключны булдырыгыз һәм бу модельне секундлар эчендә чакырыгыз.

curl -X POST https://api.free.ai/v1/stt/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/wizper","audio_url":"https://..."}'
Документация API ключын алу

Кайвакыт сорала торган сораулар

Wizper (Whisper v3) сөйләнгән аудионы текстка тәрҗемә итә. MP3, WAV, M4A яки видеофайлны куегыз һәм Wizper (Whisper v3) вакыт билгесе белән өстәмә SRT/VTT субтитрлары белән тулы тәрҗемәне кайтара.

Wizper (Whisper v3) handles dozens of languages - Whisper-family models cover 90+, others vary. Pick "auto-detect" or specify the language for highest accuracy.

Сүз хаталары дәрәҗәсе чиста инглиз телендә 5-10%, 10-20% тавышлы яки акцентлы аудиода. Шул ук архитектураның зур вариантлары авыр очракларда яхшырак эшли - аудио катлаулы булса зурракны сайлагыз.

Әйе - һәр сегмент башлану/азалу вакыты билгеләрен кертә. SRT яки VTT итеп экспортлау һәм вакытны видеога турыдан-туры күчерү.

Wizper (Whisper v3) - премиум транскрипция моторы. Минутына ~500-1500 аудио иконкасы, сезне барлыкка китерер алдыннан күрсәтелә. Үз-үзен тотучы транскрипция сезнең көн саен 30 000 иконка бассейнында бушлай эшли; премиум модельләр куллану буенча түләнә, $1-дан артыкка кадәр өстәмә түләү белән.

MP3, WAV, M4A, FLAC, OGG, һәм видео (MP4, MOV, WebM) - аудионы чыгарабыз. Бер йөкләү өчен максималь 500 МБ. Озынрак файллар? /audio/cut/ белән аерыгыз яки /v1/stt/batch/ кулланыгыз.

Speaker diarization is a separate pass - toggle "diarize" on /transcribe/. Wizper (Whisper v3) handles the transcription; diarization labels each segment with Speaker 1 / Speaker 2 / etc.

Әйе - /batch/ аудио файллар каталогын кабул итә. Һәрбер транскрипция /account/?tab=history каталогына оригиналь файл исеме белән урнаштырыла. Бульвар-куакны саклау өчен API кулланыгыз.

Yes - POST your audio to /v1/stt/transcribe/ with model="Wizper (Whisper v3)". Returns JSON with text + segments + word-level timestamps. /api/ has the full reference.

Үз-үзен тоту моделләре аудионы безнең графік процессорларда саклый; премиум DPA белән үтә. Аудио бүлешү тәрәзәсе тәмамланганнан соң юкка чыгарыла (24 сәгатьтән соң, 7 көнгә кадәр кертелгән). Без сезнең кертемнәрне өйрәнмибез.

Әйе - Free.ai транскрипцияләрне коммерция максатларында кулланырга рөхсәт итә. Сезгә үзегез урнаштырган аудионың хокуклары кирәк (үзегезнең яздыруыгыз, лицензияле материал яки рөхсәт ителгән эчтәлек).

Реаль вакыт факторы якынча 0.05-0.2× - 60 минутлык подкаст 3-12 минут эчендә языла. Премиум модельләре ешрак тизрәк тәмамлана. Табынны ябарга чират баскычын кулланыгыз.

Free.ai яратабыз?

Бу битне бәяләү