Свабодны тэлугу Транскрипция
Перакладайце зтэлугу аўдыё і відэа ў тэкст з AI. Хутка, дакладна і бясплатна.
Як гэта працуе
- Перайсці да Транскриптор Free.ai
- Захаваць свой зтэлугу аўдыё- ці відэафайл
- Наш машынны інтэлект аўтаматычна выяўляе тэлугу і перапісвае яго
- Спампаваць ваш пераклад як тэкст або субтытры SRT
тэлугу Функцыі перапіскі
- ✓Праграма faster-whisper (пад ліцэнзіяй MIT)
- ✓Аўтаматычнае вызначэнне мовы тэлугу
- ✓Падтрымка MP3, WAV, MP4, M4A, FLAC і іншых
- ✓Экспарт субтытраў
- ✓Няма абмежавання памеру файла для платных планаў
- ✓Прыватныя і бяспечныя -- файлы выдаляюцца пасля апрацоўкі
Падрабязнасці мовы
| Мова | тэлугу |
| Код ISO | te |
| Модэль AI | faster-whisper |
| Кошт | Вольна |
Больш моў
Паказаць усе мовыЧастыя пытанні
тэлугу з' яўляецца мовай сярэдняга рэсурсу для Whisper - вялікі- v3- турбо прызямляецца ў 15- 25% слова памылкі. Асноўная частка транскрыпцыі надзейная; чакайце памылак названых сутнасцяў, час ад часу пераключэнне коду і кароткія выказванні. Плануйце праход чалавека для выдачы якасці публікацыі. (Tier C, 15-25% word error rate on benchmark sets - we publish honest WER tiers rather than marketing claims.)
Так - тэлугу перапіска спачатку бярэ з вашага штодзённага бесплатнага фонду. Аудыа каштуе каля 50 знакаў за хвіліну, таму ананімны штодзённы фонд ахоплівае некалькі гадзінаў гуку ў дзень. Уваходныя рахункі атрымліваюць большы штодзённы фонд у 30 000 знакаў. Пасля гэтага перапіска аплачваецца па карыстанні, з дадатковымі знакамі ад $1.
тэлугу транскрыпты будуць вярнутыя ў стандартным UTF- 8 з звычайным правапісам мовы.
MP3, WAV, M4A, FLAC, OGG, OPUS і WEBM прымаюцца без прамежкавых фарматаў. Для відэа (MP4, MOV, MKV) мы выцягваем аўдыё- трэк з боку сервера перад адпраўкай яго ў Whisper - вам не трэба нічога пераўтвараць. Такія ж канвееры незалежна ад моў крыніц, уключаючы тэлугу.
Анімаваныя загрузкі могуць мець памер да 500 Мб на файл. Уваходныя рахункі могуць мець памер да 2 Гб. Працягласць не абмежавана - доўгія файлы аўтаматычна разбіраюцца на часткі (30-секундныя вокны з перакрываннем) і злучаюцца ў адзіны транскрыпт з працяглымі часовымі штампамі. Некалькігадзінныя запісы тэлугу (подкаст, поўная лекцыя, сустрэча) працуюць добра.
Так — па змаўчанні дыярызацыя гаворкі ўключана для кожнай тэлугу транскрыпцыі. Вывад падзяляецца на сегменты: Говорящий 1 / Говорящий 2 / Говорящий 3 з часовымі знакамі, таму інтэрв' ю, абмеркаванні і шматбаковыя сустрэчы будуць змешчаны ў сегментах. Дыярызацыя працуе па адмысловай мадэлі і працуе аднолькава для ўсіх моў, якія мы падтрымліваем.
Так - устаўце URL у / transcribe/ youtube / для YouTube або / transcribe/ podcast / для падкаст- стужак (Apple, Spotify, RSS). Мы загружаем гук, запускаем яго праз Whisper з language=te, і вяртаем транскрыпцыю з часовымі знакамі і зваротнымі спасылкамі. Тыповы змест тэлугу: WhatsApp галасавыя запісы, YouTube vlogs, і кароткія відэа з'яўляюцца найбольш распаўсюджанымі зтэлугу рабочымі нагрузкамі - устаўце URL у /transcribe/youtube/ або загрузіць гук прама.
Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.
Так — даступныя як часопісы ўзроўню сегмента (каля 10-30 секунд), так і ўзроўню слова. Узровень слова - гэта па змаўчанні для экспарту субтытраў VTT/SRT, таму субтытры сінхранізуюць па радках. На API ўсталюйце timestamps="word" у тэкст запыту. тэлугу транскрыпты будуць вярнутыя ў стандартным UTF- 8 з звычайным правапісам мовы.
Так. POST audio (multipart/form-data, field name "file") to /v1/transcribe/ with language=te — або абмяжоўвайце параметр мовы, каб Whisper мог аўтаматычна вызначыць мову. Верне JSON з транскрыптам, сегментамі, часовымі штампамі і этыкеткамі гукарэжысёра. Поўная спасылка і выразкі SDK у /api/.
Так — пасля завяршэння транскрыпцыі націсніце Пераклад або ўстаўце тэкст у /translate/. тэлугу працуе з усімі іншымі мовамі, якія мы падтрымліваем (200+). Для пратаколаў сустрэч транскрыпцыя праходзіць праз /summarize/; для дубліравання адпраўце яе ў /voice/tts/, каб атрымаць гук на мэтавай мове.
Шумная надзейнасць Whisper яшчэ дзейнічае на тэлугу, але на гэтым узроўні дакладнасці любы дадатковы шум узмацняе базу памылак. Чысты гук з гарнітуры дае значна лепшыя вынікі, чым запіс з тэлефона або ноўтбука.Калі аўдыё не працуе, напішыце на contact@free.ai з файлам — мы вярнем вам грошы і паглядзім, ці іншы рухавік працуе з вашым аўдыё лепш.