датча бош транскрипция

датча аудио жана видеону AI менен текстке которуу. Жылдам, так жана акысыз.

Кантип иштейт

  1. _Жогору Free.ai транскриптору
  2. датча аудио же видео файлды жүктөп алуу
  3. Биздин ИИ автоматтык түрдө датчади таап, аны транскрипциялайт
  4. Транскрипцияңызды текст же SRT субтитрлери катары жүктөп алуу

датча Транскрипциянын өзгөчөлүктөрү

  • faster-whisper тарабынан иштелип чыккан (MIT лицензиясы)
  • датча тилин автоматтык түрдө аныктоо
  • MP3, WAV, MP4, M4A, FLAC жана башкаларды колдойт
  • Время и субтитры экспорта (SRT)
  • Платалык пландарда файлдын өлчөмүн чектөө жок
  • Жеке жана коопсуз -- файлдар иштетүү аяктагандан кийин өчүрүлөт

Тил тууралуу маалымат

Тилдатча
ISO кодуda
AI моделиfaster-whisper
БаасыАкысыз

Көбүрөөк тилдер

Бардык тилдер

Кайралануучу суроолор

Whisper large-v3-turbo датча менен жакшы иштей алат — 7-15% сөз каталары аудио тестте. Аты берилген объекттер, сандар жана техникалык сөздөрдүн кээде алмаштырылышына жол берилбейт; транскрипциянын көпчүлүгү туура болот.(Tier B, 7-15% word error rate on benchmark sets — биз маркетингдик билдирүүлөрдүн ордуна чыныгы WER деңгээлдерин жарыялайбыз.)

Да — датча транскрипция первоначально использует ваш бесплатный деньовой токен-фонд. Аудио стоит около 50 токенов в минуту, поэтому анонимный деньовой фонд покрывает несколько часов аудио в день. Входящие аккаунты получают более большой 30 000-токенный деньовой фонд. После этого транскрипция является платной, с токен-дополнениями от $1.

датча транскрипциялары стандарттуу UTF-8 форматында, тилдин нормалдуу орфографиясы менен кайтарылат.

MP3, WAV, M4A, FLAC, OGG, OPUS жана WEBM түздөн-түз кабыл алынат. Видео үчүн (MP4, MOV, MKV) биз аудио тректи серверден чыгарып, аны Whisperге жөнөтөбүз — сиз өзүңүз эч нерсени которууга муктаж эмессиз. Баштапкы тилден көз карандысыз бирдей конвейер, анын ичинде датча.

Анонимдүү жүктөө файлдын көлөмүн 500 МБга чейин чектейт. Кирген колдонуучулардын эсеби 2 ГБга чейин жетет. Узактыгы чектелбейт - узун файлдар автоматтык түрдө бөлүнөт (30 секунддук терезелер бирин-бири каптап) жана бирдиктүү транскриптке бирдиктүү убакыт белгилери менен бириктирилет. Бир нече сааттык датча жаздыруулар (подкасттар, толук лекциялар, жолугушуулар) жакшы иштейт.

Да — диаризация говорящего включена по умолчанию для каждого датча транскрипта. Вывод сегментируется как Говорящий 1 / Говорящий 2 / Говорящий 3 с временными метками, поэтому интервью, дискуссии и многосторонние встречи возвращаются с метками. Диаризация работает по отдельной модели и работает одинаково для всех поддерживаемых нами языков.

Да — URL-адрести /transcribe/youtube/ деп YouTube үчүн же /transcribe/podcast/ деп подкасттар үчүн (Apple, Spotify, RSS) киргизиңиз. Биз аудиону жүктөп, аны Whisper менен language=da менен иштетип, транскрипт менен убакыт белгилерин жана сүйлөгөндөрдүн этикеткаларын кайтарабыз. Типтүү датча мазмуну: лекциялар, интервьюлар, үн жазмалар жана YouTube мазмуну датча бардык иштешет — URL /transcribe/youtube/ге киргизиңиз же файлды түз эле жүктөңүз.

Whisper аудио мүнөтүнө 50 токенден турат, ошондуктан бир сааттык жаздыруу ~3000 токенге барабар. Колдонуучулардын көбү эч нерсеге акча жумшабайт - күнүнө 30 токенден турган акысыз топ кыска клиптерди, үн жазмаларын жана бир жолу жазылган подкасттарды камтыйт. Андан тышкары, транскрипция колдонууга жараша төлөнөт, токендин топтомолору $1ден башталат.

Да — сегменттик (ар бир ~10-30 секунд сайын) жана сөз деңгээлиндеги убакыт белгилери бар. Сөз деңгээли VTT/SRT субтитр экспорту үчүн алдын-ала орнотулган, ошондуктан субтитрлер саптан-сатка синхрондошот. APIде талаптын денесинде timestamps="word" коюңуз. датча транскрипциялары стандарттуу UTF-8 форматында, тилдин нормалдуу орфографиясы менен кайтарылат.

Да. POST аудио (multipart/form-data, field name "file") to /v1/transcribe/ with language=da — же Whisper-ге авто-таап алууга тил параметрин калтырыңыз. JSON менен транскрипт, сегменттер, убакыт белгилери жана сүйлөгөндөрдүн этикеткаларын кайтарат. Толук шилтеме жана SDK фрагменттери /api/.

Да — транскрипция бүткөндөн кийин, Тартуу баскычын басыңыз же текстти /translate/ папкасына көчүрүп салыңыз. датча колдогон бардык тилдер менен шайкеш келет (200+). Жолугушуу протоколдору үчүн транскрипцияны /summarize/ папкасына жөнөтүңүз; дублдоо үчүн аны /voice/tts/ папкасына жөнөтүңүз, ал жерде ал тилдеги аудиону көрсөтөт.

Whisper жүздөгөн миңдеген сааттык реалдуулуктун аудиосун үйрөнгөндүктөн, ал фондук ызы-чууну жана датчаде телефондук сапаттагы жаздырууларды толеранттуу кабыл алат. Эң мыкты натыйжалар үчүн таза аудиону (гарнитурадагы микрофон, музыкалык орундук жок) бериңиз — бул деңгээлде ызы-чуу базалык ката ылдамдыгын көбөйтөт.Эгерде транскрипт иштебей калса, файл менен бирге contact@free.ai дарегине кат жөнөтүңүз — биз сиздин акчаңызды кайтарып беребиз жана башка двигатель сиздин аудиоңузду жакшыраак иштете алабы деп карап көрөлү.

Free.aiди сүйөсүңбү? Досторуңа айт!

Бул барактын баасын берүү