Free валлӣ Транскриптсия

Тағйири валлӣ аудио ва видео ба матн бо AI. Суръат, дақиқ ва ройгон.

Чӣ тавр кор мекунад

  1. Гузаштан ба Free.ai Транскриптор
  2. Боркунии файли аудиоӣ ё видеоии валлӣ
  3. AI-и мо худкорона валлӣ-ро муайян мекунад ва онро нусхабардорӣ мекунад
  4. Боргирии нусхаи шумо ҳамчун матн ё зерсарлавҳаҳои SRT

валлӣ Хусусиятҳои тарҷума

  • ✓Бо faster-whisper (бо иҷозатномаи MIT)
  • ✓Муайянкунии худкори забони валлӣ
  • ✓MP3, WAV, MP4, M4A, FLAC ва ғайраро дастгирӣ мекунад
  • ✓Содироти вақт ва зернависи (SRT)
  • ✓Бе маҳдудияти андозаи файл дар нақшаҳои пардохтшуда
  • ✓Шахсӣ ва бехатар -- файлҳо баъди коркарди онҳо нобуд карда мешаванд

Тафсилоти забон

Забонҳоваллӣ
Коди ISOcy
Намунаи AIfaster-whisper
& НархОзод

Забонҳои иловагӣ

Намоиши ҳамаи забонҳо

Саволҳои зиёд

валлӣ забони миёнаи манбаъи барои Whisper - large- v3- turbo дар 15- 25% калимаи хатогӣ дар риштаи. Маълумоти ибтидоии нусхаи боэътимод аст; хатогиҳо номгузорӣ- мавҷудиятро интизор шавед, баъзан коди- мубодилаи ғавғоҳо, ва кӯтоҳ- гуфторҳои ноком. Пешбинии гузаштани инсон барои нашри сифат баромад. (Tier C, 15-25% word error rate on benchmark sets - we publish honest WER tiers rather than marketing claims.)

Ҳа - нусхаи валлӣ аз захираи ҳаррӯзаи ройгони шумо дар аввал гирифта мешавад. Садо тақрибан 50 токен дар як дақиқа арзиш дорад, бинобар ин захираи ҳаррӯзаи беном чанд соат аудиоро дар як рӯз фаро мегирад. Ҳисобҳои воридшуда захираи ҳаррӯзаи 30,000 токенро мегиранд. Баъд аз ин, нусхаи ройгон аст, бо иловаи токен аз $1.

валлӣ транскриптҳо дар стандарти UTF-8 бо орфографияи оддии забон бармегарданд.

MP3, WAV, M4A, FLAC, OGG, OPUS ва WEBM бевосита қабул карда мешаванд. Барои видео (MP4, MOV, MKV) мо роҳчаи аудиоро аз тарафи сервер пеш аз фиристодани он ба Whisper бароварда мекунем - шумо лозим нест, ки худи шумо ягон чизро табдил диҳед. Яке аз каналҳо новобаста аз забони сарчашма, аз ҷумла валлӣ.

Андозаи файли беному нишон дар 500 МБ барои ҳар як файл маҳдуд аст. Ҳисобҳои воридшуда то 2 ГБ мераванд. Маҳдудияти дарозии файлҳо вуҷуд надорад - файлҳои дароз ба таври худкор ба қисмҳо ҷудо карда мешаванд (30 сония тирезаҳо бо ҳамроҳшавӣ) ва ба як нусхаи ягона бо нишонаҳои вақти пайваста пайваст карда мешаванд. Сабтҳои бисёрсоатаи валлӣ (подкастҳо, дарсҳои пурра, вохӯриҳо) хуб кор мекунанд.

Да, диаризация оратора по умолчанию включена для каждого валлӣ транскрипта. Вывод делится на сегменты как оратора 1 / оратора 2 / оратора 3 с временными метками, так что интервью, дискуссии и многосторонние встречи возвращаются с метками. Диаризация работает на отдельном моделе и работает одинаково на всех языках, которые мы поддерживаем.

Да — URL-ро ба /transcribe/youtube/ барои YouTube ё /transcribe/podcast/ барои подкастҳо (Apple, Spotify, RSS) ҷойгир кунед. Мо аудиоро боргирӣ мекунем, онро тавассути Whisper бо language=cy иҷро мекунем ва транскриптро бо нишонаҳои вақт ва нишонаҳои сухангӯ бармегардонем. Мӯҳтавои валлӣ оддӣ: лексияҳо, мусоҳибаҳо, хотираҳои овозӣ ва мундариҷаи YouTube дар валлӣ ҳама кор мекунанд - URL-ро ба /transcribe/youtube/ гузоред ё файлро бевосита бор кунед.

Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.

Бале - ҳардуи сатҳҳои сегментӣ (ҳар ~10-30 сония) ва сатҳҳои калимаҳои вақт дастрасанд. Сатҳи калима пешфарзи содироти зерсарлавҳаҳои VTT/SRT мебошад, ки дар он ҷо сарлавҳаҳо сатҳ ба сатҳ синхронизатсия мешаванд. Дар API дар бадани дархости timestamps="word" -ро насб кунед. валлӣ транскриптҳо дар стандарти UTF-8 бо орфографияи оддии забон бармегарданд.

Ҳа. POST аудио (multipart/form-data, field name "file") ба /v1/transcribe/ бо language=cy - ё параметри забонро барои худмуайянкунии Whisper тарк кунед. JSON-ро бо транскрипт, сегментҳо, штампҳои вақт ва нишонаҳои сухангӯ бармегардонад. Истиснои пурра ва SDK-и фрагментҳо дар /api/.

Дар ин ҷо шумо метавонед матнро ба /translate/ ҷойгир кунед. валлӣ бо ҳамаи забонҳои дигаре, ки мо дастгирӣ мекунем (200+) ҳамроҳ мешавад. Барои протоколи вохӯрӣ матнро тавассути /summarize/ фиристед; барои дубляж онро ба /voice/tts/ фиристед, то садоро дар забони ҳадафӣ бозсозед.

Whisper-и садои устувор ҳанӯз ҳам ба валлӣ татбиқ мешавад, аммо дар ин дараҷаи дақиқӣ ҳар гуна садои иловагӣ ба миқдори хатои асосӣ илова мекунад. Садои тозаи гарданбанд натиҷаҳои хубтарро нисбат ба сабти микрофони телефон ё ноутбук медиҳад. If a transcript comes back unusable, email contact@free.ai with the file - we will refund the tokens and look at whether a different engine handles your audio better.

Шумо дӯст медоред Free.ai? Ба дӯстонатон бигӯед!

Баҳогузории ин саҳифа