Бепул valliy Транскрипцияси

AI билан valliy аудио ва видеони матнга кўчиринг. Тез, аниқ ва бепул.

У қандай ишлайди

  1. _Кетиш Free.ai Транскриптор
  2. valliy аудио ёки видео файлингизни юклаб олинг
  3. Бизнинг AI автоматик тарзда valliy ни аниқлаб, уни транскрипция қилади
  4. Транскриптингизни матн ёки SRT субтитрлари сифатида юклаб олинг

valliy Транскрипция хусусиятлари

  • ✓faster-whisper томонидан қўлланилган (MIT лицензияси билан)
  • ✓Автоматик valliy тил аниқлаш
  • ✓MP3, WAV, MP4, M4A, FLAC ва бошқаларни қўллаб-қувватлайди
  • ✓Вақт белгилари ва субтитр экспорти (SRT)
  • ✓Файл ҳажми чеклови йўқ
  • ✓Шахсий ва хавфсиз -- файллар ишловдан сўнг ўчирилади

Тил тафсилотлари

Тилvalliy
ISO кодиcy
AI моделиfaster-whisper
НархОбод

Кўпроқ тиллар

Барча тилларни кўриш

Кўп саволлар

valliy Whisper учун ўртача ресурс тилидир - катта-v3-turbo 15-25% сўз хато даражаси бандида жойлашади. Транскриптнинг асосий қисми ишончли; номланган-энтитет хатоларини, баъзан код-ўтиш қийинчиликлари ва қисқа-айлантириш хатоларини кутинг. Чоп этиш-қимматли чиқинди учун инсон ўтказмасини режалаштиринг.(Бенчмарклар бўйича C, 15-25% word error rate даражалари - биз маркетинг талабларидан кўра ҳақиқий WER даражаларини эълон қиламиз.)

Ҳа - valliy транскрипцияси аввало сизнинг кундалик бепул токенларингиздан фойдаланади. Аудио дақиқасига 50 та токенга тушади, шунинг учун кундалик нотаниш пул бир неча соатлик аудиони қамраб олади. Кириб борган ҳисоблар кунига 30 000 та токендан кўпроқ пул олади. Будан кейин, транскрипция $1 дан бошланувчи токен тўловлари билан фойдаланилгани учун тўловни амалга оширади.

valliy транскриптлари стандарт UTF-8 билан тилнинг оддий орфографияси билан қайтарилади.

MP3, WAV, M4A, FLAC, OGG, OPUS ва WEBM форматлари тўғридан-тўғри қабул қилинади. Видео учун (MP4, MOV, MKV) биз аудио йўлакни сервер томонида, уни Whisper'га жўнатишдан олдин ажратамиз - сиз ҳеч нарсани ўзингизга айлантиришга эҳтиёж сезмайсиз. Манба тилидан қатъи назар, valliy'ни ҳам ҳисобга олган ҳолда, бир хил қувури.

Аноним юклашлар ҳар бир файл учун тахминан 500 MB гача чекланади. Кириб борган ҳисоблар 2 GB гача етади. Умумий муддат чеклови йўқ - узун файллар автоматик равишда (30 сониялик ойналар бир-бирига ўхшаш) бўлакларга бўлинади ва давомли вақт белгилари билан бир нусхага қайта тикланади. Бир неча соатлик valliy ёзувлари (подкастлар, тўлиқ дарсликлар, йиғилишлар) яхши ишлайди.

Ҳа - ҳар бир valliy транскрипти учун сўзловчи диаризацияси аввалдан ишга туширилган. Чиқимли маълумотлар 1-сўзловчи / 2-сўзловчи / 3-сўзловчига бўлинади ва вақт белгилари билан, интервьюлар, панел муҳокамалари ва кўп томонлама учрашувлар белгиланган ҳолда қайтарилади. Диаризация алоҳида моделда ишлайди ва биз қўллаб-қувватлаган барча тилларда бир хил ишлайди.

Ҳа - URL-манзилни YouTube учун /transcribe/youtube/ ёки подкастлар учун /transcribe/podcast/ га жойланг (Apple, Spotify, RSS). Биз аудиони юклаб оламиз, Whisper орқали language=cy билан ишга туширамиз ва вақт белгилари ва сўзловчилар белгилари билан транскриптни қайтарамиз. Типик valliy мазмуни: valliy'даги лекциялар, интервьюлар, овозли ёзувлар ва YouTube мазмуни ҳаммаси ишлайди - URL'ни /transcribe/youtube/'га жойланг ёки файлни тўғридан-тўғри юкланг.

Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.

Ҳа - иккита сегмент даражали (ҳар ~10-30 сонияда) ва сўз даражали вақт белгилари мавжуд. ВТТ/SRT субтитр экспорти учун сўз даражали стандарт, шунинг учун субтитрлар сатрма-сатр синхронлаштирилади. API талаб танасида timestamps="word"ни ўрнатиш керак. valliy транскриптлари стандарт UTF-8 билан тилнинг оддий орфографияси билан қайтарилади.

Ҳа. /v1/transcribe/'га POST аудио (кўп қисмли/форм-матн, майдон номи "файл") билан language=cy - ёки Whisper'ни автоматик аниқлаш учун тил параметрини қолдиринг. Транскрипт, сегментлар, вақт белгилари ва сўзловчи белгилари билан JSON қайтаради. /api/'да тўлиқ манба ва SDK парчалари.

Ҳа - транскрипция тугагандан сўнг, Таржимани босинг ёки матнни /translate/ га жойланг. valliy биз қўллаб-қувватлайдиган барча тиллар билан (200+) жуфтлашади. Йиғилишда протокол учун транскрипцияни /summarize/ орқали юборинг; дубляж учун уни /voice/tts/ га юборинг, у ерда у мақсад тилидаги аудиони кўрсатади.

Whisperнинг шовқинга чидамлилиги valliyга ҳам амал қилади, аммо бу аниқлик даражасида қўшимча шовқин базавий хато даражасини оширади. Тиш ювиш аудиоси телефон ёки ноутбук микрофони билан ёзишдан кўра яхшироқ натижа беради.Агар транскрипт ишлатилмаса, файл билан contact@free.ai электрон почтасига юборинг - биз сизга токенларни қайтарамиз ва бошқа мотор сизнинг аудионгизни яхшироқ бошқаришини текширамиз.

Free.aiни севинг? Дўстларингизга айтинг!

Бу саҳифани баҳолаш