Вольная руская транскрыпцыя

Ператварэньне руская аўдыё і відэа ў тэкст з дапамогай AI. Хутка, дакладна і бясплатна.

Як гэта працуе

  1. Перайсці да Транскриптор Free.ai
  2. Загрузіць ваш руская аўдыё- або відэафайл
  3. Наш машынны інтэлект аўтаматычна выяўляе руская і перапісвае яго
  4. Спампаваць ваш пераклад як тэкст або субтытры SRT

руская Функцыі перапіскі

  • Праграма faster-whisper (пад ліцэнзіяй MIT)
  • Аўтаматычнае вызначэнне мовы руская
  • Падтрымка MP3, WAV, MP4, M4A, FLAC і іншых
  • Экспарт субтытраў
  • Няма абмежавання памеру файла для платных планаў
  • Прыватныя і бяспечныя -- файлы выдаляюцца пасля апрацоўкі

Падрабязнасці мовы

Моваруская
Код ISOru
Модэль AIfaster-whisper
КоштВольна

Частыя пытанні

Whisper large-v3-turbo знаходзіцца ў найвышэйшым узроўні дакладнасці на руская — менш за 7% памылак словаў на стандартных тэставанні. На практыцы гэта азначае, што чыстае студыйнае гучанне вяртаецца амаль ідэальна, і гучанне размоваў можна выкарыстоўваць з мінімальным чысткай. (Tier A, under 7% word error rate on benchmark sets - we publish honest WER tiers rather than marketing claims.)

Так - руская перапіска спачатку бярэ з вашага штодзённага бесплатнага фонду. Аудыа каштуе каля 50 знакаў за хвіліну, таму ананімны штодзённы фонд ахоплівае некалькі гадзінаў гуку ў дзень. Уваходныя рахункі атрымліваюць большы штодзённы фонд у 30 000 знакаў. Пасля гэтага перапіска аплачваецца па карыстанні, з дадатковымі знакамі ад $1.

руская транскрыпты будуць вярнутыя ў стандартным UTF- 8 з звычайным правапісам мовы.

MP3, WAV, M4A, FLAC, OGG, OPUS і WEBM прымаюцца без прамежкавых фарматаў. Для відэа (MP4, MOV, MKV) мы выцягваем аўдыё- трэк з боку сервера перад адпраўкай яго ў Whisper - вам не трэба нічога пераўтвараць. Тым жа канвеерам незалежна ад зыходнай мовы, уключаючы руская.

Анімаваныя загрузкі могуць мець памер да 500 Мб на файл. Уваходныя рахункі могуць мець памер да 2 Гб. Працягласць не абмежавана - доўгія файлы аўтаматычна разбіраюцца на часткі (30-секундныя вокны з перакрываннем) і злучаюцца ў адзіны транскрыпт з працяглымі часовымі штампамі. Некалькігадзінныя запісы руская (подкаст, поўная лекцыя, сустрэча) працуюць добра.

Так — па змаўчанні дыярызацыя гаворкі ўключана для кожнай руская транскрыпцыі. Вывад падзяляецца на сегменты: Говорящий 1 / Говорящий 2 / Говорящий 3 з часовымі знакамі, таму інтэрв' ю, абмеркаванні і шматбаковыя сустрэчы будуць змешчаны ў сегментах. Дыярызацыя працуе па адмысловай мадэлі і працуе аднолькава для ўсіх моў, якія мы падтрымліваем.

Так — устаўце URL у / transcribe/ youtube / для YouTube або / transcribe/ podcast / для падкаст- стужак (Apple, Spotify, RSS). Мы загружаем аўдыё, запускаем яго праз Whisper з language=ru, і вяртаем транскрыпцыю з часовымі штампамі і этыкеткамі спевака. Тыповы змест руская: падкасты, лекцыі, інтэрв'ю і доўгі YouTube-кантэнт у руская - гэта найбольш распаўсюджаныя віды працы, якія мы бачым.

Whisper каштуе каля 50 знакаў за хвіліну гуку, таму гадзінны запіс каштуе каля 3000 знакаў. Большасць карыстальнікаў нічога не трацяць - бясплатны штодзённы фонд з 30 знакаў ахоплівае кароткія кліпы, галасавыя запісы і адну падкаст-праграму. За выключэннем гэтага, транскрыпцыя аплачваецца па выкарыстанні, з дадатковымі знакамі ад $1.

Так — даступныя як часопісы ўзроўню сегмента (каля 10-30 секунд), так і ўзроўню слова. Узровень слова - гэта па змаўчанні для экспарту субтытраў VTT/SRT, таму субтытры сінхранізуюць па радках. На API ўсталюйце timestamps="word" у тэкст запыту. руская транскрыпты будуць вярнутыя ў стандартным UTF- 8 з звычайным правапісам мовы.

Так. POST audio (multipart/form-data, field name "file") to /v1/transcribe/ with language=ru — або абмяжоўвайце параметр мовы, каб Whisper мог аўтаматычна вызначыць мову. Верне JSON з транскрыптам, сегментамі, часовымі штампамі і этыкеткамі гукарэжысёра. Поўная спасылка і выразкі SDK у /api/.

Так — пасля завяршэння транскрыпцыі націсніце Пераклад або ўстаўце тэкст у /translate/. руская працуе з усімі іншымі мовамі, якія мы падтрымліваем (200+). Для пратаколаў сустрэч транскрыпцыя праходзіць праз /summarize/; для дубліравання адпраўце яе ў /voice/tts/, каб атрымаць гук на мэтавай мове.

Праграма Whisper была падрыхтавана на аснове 680 тысяч гадзін гукавых запісаў, таму транскрыпцыя руская эфектыўная ў фонавым шуме, на музычных канапах і пры запісе на тэлефоне. Сільная абрэзка або некалькі перакрываючыхся дынамікаў усё роўна пагоршаць дакладнасць.Калі аўдыё не працуе, напішыце на contact@free.ai з файлам — мы вярнем вам грошы і паглядзім, ці іншы рухавік працуе з вашым аўдыё лепш.

Любіце Free.ai? Раскажыце сваім сябрам!

Ацэнка гэтай старонкі