японӣ озод
Тағйири японӣ аудио ва видео ба матн бо AI. Суръат, дақиқ ва ройгон.
Чӣ тавр кор мекунад
- Гузаштан ба Free.ai Транскриптор
- Бор кардани японӣ файли аудиоӣ ё видеоӣ
- ДИИ мо японӣ-ро ба таври худкор муайян мекунад ва онро нусхабардорӣ мекунад
- Боргирии нусхаи шумо ҳамчун матн ё зерсарлавҳаҳои SRT
японӣ Хусусиятҳои тарҷума
- ✓Бо faster-whisper (бо иҷозатномаи MIT)
- ✓Муайянкунии худкори японӣ забон
- ✓MP3, WAV, MP4, M4A, FLAC ва ғайраро дастгирӣ мекунад
- ✓Содироти вақт ва зернависи (SRT)
- ✓Бе маҳдудияти андозаи файл дар нақшаҳои пардохтшуда
- ✓Шахсӣ ва бехатар -- файлҳо баъди коркарди онҳо нобуд карда мешаванд
Тафсилоти забон
| Забонҳо | японӣ |
| Коди ISO | ja |
| Намунаи AI | faster-whisper |
| & Нарх | Озод |
Забонҳои иловагӣ
Намоиши ҳамаи забонҳоСаволҳои зиёд
Whisper large-v3-turbo дар дараҷаи дақиқии баландтарин дар японӣ - дар сатҳи 7% хатои калима дар стандартҳои стандартӣ қарор мегирад. Дар амал ин маънои тоза кардани студияи аудиоӣ ба наздикӣ комил бармегардад ва аудиои муошират бо тозакунии минималӣ истифодашаванда аст. (Tier A, under 7% word error rate on benchmark sets - we publish honest WER tiers rather than marketing claims.)
Ҳа — японӣ нусхабардорӣ аз захираи ҳаррӯзаи ройгони шумо дар аввал гирифта мешавад. Садо тақрибан 50 токен дар як дақиқа арзиш дорад, бинобар ин захираи ҳаррӯзаи беном чанд соат аудиоро дар як рӯз фаро мегирад. Ҳисобҳои воридшуда захираи ҳаррӯзаи калонтарро бо 30,000 токен мегиранд. Баъд аз ин, нусхабардорӣ бо пардохти истифодашаванда, бо пур кардани токен аз $1 пардохт мешавад.
японӣ transcripts are returned in native script (UTF-8). японӣ text has no spaces between words natively; diarization timestamps add natural breaks at speaker turns.
MP3, WAV, M4A, FLAC, OGG, OPUS ва WEBM бевосита қабул карда мешаванд. Барои видео (MP4, MOV, MKV) мо шиори аудиоро аз тарафи сервер пеш аз фиристодан ба Whisper бароварда мекунем — шумо лозим нест, ки худатон чизе табдил диҳед. Яке аз каналҳо новобаста аз забони сарчашма, аз ҷумла японӣ.
Андозаи файли беному нишон дар 500 МБ барои ҳар як файл маҳдуд аст. Ҳисобҳои воридшуда то 2 ГБ мераванд. Маҳдудияти дарозии файлҳо вуҷуд надорад - файлҳои дароз ба таври худкор ба қисмҳо ҷудо карда мешаванд (30 сония тирезаҳо бо ҳамроҳшавӣ) ва ба як нусхаи ягона бо нишонаҳои вақти пайваста пайваст карда мешаванд. Сабтҳои бисёрсоатаи японӣ (подкастҳо, дарсҳои пурра, вохӯриҳо) хуб кор мекунанд.
Да, диаризация оратора по умолчанию включена для каждого японӣ транскрипта. Вывод делится на сегменты как оратора 1 / оратора 2 / оратора 3 с временными метками, так что интервью, дискуссии и многосторонние встречи возвращаются с метками. Диаризация работает на отдельном моделе и работает одинаково на всех языках, которые мы поддерживаем.
Да — URL-ро ба /transcribe/youtube/ барои YouTube ё /transcribe/podcast/ барои подкастҳо (Apple, Spotify, RSS) ҷойгир кунед. Мо аудиоро боргирӣ мекунем, онро тавассути Whisper бо language=ja иҷро мекунем ва транскриптро бо нишонаҳои вақт ва нишонаҳои сухангӯ бармегардонем. Мӯҳтавои японӣ оддӣ: подкастҳо, лексияҳо, мусоҳибаҳо ва мундариҷаи YouTube-и дароз дар японӣ - ин боргузориҳои маъмултарини корӣ мебошанд, ки мо мебинем.
Whisper тақрибан 50 нишондиҳанда барои ҳар дақиқаи аудио арзиш дорад, бинобар ин сабти як соат ~3000 нишондиҳанда мебошад. Бисёре аз истифодабарандагон ҳеҷ гоҳ чизе сарф намекунанд - захираи рӯзонаи ройгони 30 нишондиҳанда клипҳои кӯтоҳ, хотираҳои овозӣ ва подкастҳои яккаратаро дар бар мегирад. Аз он зиёдтар, нусхабардорӣ пардохти истифодашаванда мебошад, бо нишондиҳандаҳои пурра аз $1.
Бале — ҳам дар сатҳи сегмент (ҳар ~10-30 сония) ва ҳам дар сатҳи калима аломатҳои вақт дастрасанд. Сатҳи калима пешфарзи содироти зерсарлавҳаҳои VTT/SRT мебошад, бинобар ин сарлавҳаҳо сатҳ ба сатҳ синхронизатсия мешаванд. Дар API аломатҳои вақтро дар шакли "word" дар бадани дархост гузоред. японӣ transcripts are returned in native script (UTF-8). японӣ text has no spaces between words natively; diarization timestamps add natural breaks at speaker turns.
Бале. POST аудио (multipart/form-data, field name "file") ба /v1/transcribe/ бо language=ja — ё параметри забонро барои иҷозат додани Whisper-и худмуайянкунӣ гузоред. JSON-ро бо транскрипт, сегментҳо, аломатҳои вақт ва нишонаҳои баландгӯяк бармегардонад. Истинодҳои пурра ва ҷузъҳои SDK дар /api/.
Ҳа — вақте ки тарҷума ба итмом расид, тугмаи Тарҷума ё матнро ба /translate/ ҷойгир кунед. японӣ бо ҳамаи забонҳои дигаре, ки мо дастгирӣ мекунем (200+) ҳамроҳ мешавад. Барои протоколҳои вохӯриҳо, транскриптро тавассути /summarize/ фиристед; барои дубляж онро ба /voice/tts/ фиристед, то садоро ба забони ҳадафӣ баргардонед.
Whisper дар 680K соатҳои садои шуури воқеӣ омӯзонида шудааст, бинобар ин, японӣ транскрипсия барои садои фонӣ, мусиқӣ ва сабтҳои сифати телефон устувор аст. Тақсимкунии сахт ё баландгӯякҳои зиёди якҷояшуда ҳанӯз ҳам ба дақиқӣ зарар мерасонанд.Агар шумо хоҳед, ки файли худро дар компютери худ нигоҳ доред, шумо метавонед онро дар компютери худ зеркашӣ кунед ва онро дар компютери худ истифода баред.