Free японӣ Транскриптсия

Тағйири японӣ аудио ва видео ба матн бо AI. Суръат, дақиқ ва ройгон.

Чӣ тавр кор мекунад

  1. Гузаштан ба Free.ai Транскриптор
  2. Боркунии файли аудиоӣ ё видеоии японӣ
  3. AI-и мо худкорона японӣ-ро муайян мекунад ва онро нусхабардорӣ мекунад
  4. Боргирии нусхаи шумо ҳамчун матн ё зерсарлавҳаҳои SRT

японӣ Хусусиятҳои тарҷума

  • ✓Бо faster-whisper (бо иҷозатномаи MIT)
  • ✓Муайянкунии худкори забони японӣ
  • ✓MP3, WAV, MP4, M4A, FLAC ва ғайраро дастгирӣ мекунад
  • ✓Содироти вақт ва зернависи (SRT)
  • ✓Бе маҳдудияти андозаи файл дар нақшаҳои пардохтшуда
  • ✓Шахсӣ ва бехатар -- файлҳо баъди коркарди онҳо нобуд карда мешаванд

Тафсилоти забон

Забонҳояпонӣ
Коди ISOja
Намунаи AIfaster-whisper
& НархОзод

Забонҳои иловагӣ

Намоиши ҳамаи забонҳо

Саволҳои зиёд

Whisper large-v3-turbo дар дараҷаи дақиқии баландтарин дар японӣ - дар сатҳи 7% хатои калима дар стандартҳои стандартӣ қарор мегирад. Дар амал ин маънои тоза кардани студияи аудиоӣ ба наздикӣ комил бармегардад ва аудиои муошират бо тозакунии минималӣ истифодашаванда аст. (Tier A, under 7% word error rate on benchmark sets - we publish honest WER tiers rather than marketing claims.)

Ҳа - нусхаи японӣ аз захираи ҳаррӯзаи ройгони шумо дар аввал гирифта мешавад. Садо тақрибан 50 токен дар як дақиқа арзиш дорад, бинобар ин захираи ҳаррӯзаи беном чанд соат аудиоро дар як рӯз фаро мегирад. Ҳисобҳои воридшуда захираи ҳаррӯзаи 30,000 токенро мегиранд. Баъд аз ин, нусхаи ройгон аст, бо иловаи токен аз $1.

японӣ transcripts are returned in native script (UTF-8). японӣ text has no spaces between words natively; diarization timestamps add natural breaks at speaker turns.

MP3, WAV, M4A, FLAC, OGG, OPUS ва WEBM бевосита қабул карда мешаванд. Барои видео (MP4, MOV, MKV) мо роҳчаи аудиоро аз тарафи сервер пеш аз фиристодани он ба Whisper бароварда мекунем - шумо лозим нест, ки худи шумо ягон чизро табдил диҳед. Яке аз каналҳо новобаста аз забони сарчашма, аз ҷумла японӣ.

Андозаи файли беному нишон дар 500 МБ барои ҳар як файл маҳдуд аст. Ҳисобҳои воридшуда то 2 ГБ мераванд. Маҳдудияти дарозии файлҳо вуҷуд надорад - файлҳои дароз ба таври худкор ба қисмҳо ҷудо карда мешаванд (30 сония тирезаҳо бо ҳамроҳшавӣ) ва ба як нусхаи ягона бо нишонаҳои вақти пайваста пайваст карда мешаванд. Сабтҳои бисёрсоатаи японӣ (подкастҳо, дарсҳои пурра, вохӯриҳо) хуб кор мекунанд.

Да, диаризация оратора по умолчанию включена для каждого японӣ транскрипта. Вывод делится на сегменты как оратора 1 / оратора 2 / оратора 3 с временными метками, так что интервью, дискуссии и многосторонние встречи возвращаются с метками. Диаризация работает на отдельном моделе и работает одинаково на всех языках, которые мы поддерживаем.

Да — URL-ро ба /transcribe/youtube/ барои YouTube ё /transcribe/podcast/ барои подкастҳо (Apple, Spotify, RSS) ҷойгир кунед. Мо аудиоро боргирӣ мекунем, онро тавассути Whisper бо language=ja иҷро мекунем ва транскриптро бо нишонаҳои вақт ва нишонаҳои сухангӯ бармегардонем. Мӯҳтавои японӣ оддӣ: podcasts, лексияҳо, мусоҳибаҳо ва мундариҷаи YouTube-и дароз дар японӣ бори кории маъмултаринест, ки мо мебинем.

Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.

Бале - ҳардуи сатҳҳои сегментӣ (ҳар ~10-30 сония) ва сатҳҳои калимаҳои вақт дастрасанд. Сатҳи калима пешфарзи содироти зерсарлавҳаҳои VTT/SRT мебошад, ки дар он ҷо сарлавҳаҳо сатҳ ба сатҳ синхронизатсия мешаванд. Дар API дар бадани дархости timestamps="word" -ро насб кунед. японӣ transcripts are returned in native script (UTF-8). японӣ text has no spaces between words natively; diarization timestamps add natural breaks at speaker turns.

Ҳа. POST аудио (multipart/form-data, field name "file") ба /v1/transcribe/ бо language=ja - ё параметри забонро барои худмуайянкунии Whisper тарк кунед. JSON-ро бо транскрипт, сегментҳо, штампҳои вақт ва нишонаҳои сухангӯ бармегардонад. Истиснои пурра ва SDK-и фрагментҳо дар /api/.

Дар ин ҷо шумо метавонед матнро ба /translate/ ҷойгир кунед. японӣ бо ҳамаи забонҳои дигаре, ки мо дастгирӣ мекунем (200+) ҳамроҳ мешавад. Барои протоколи вохӯрӣ матнро тавассути /summarize/ фиристед; барои дубляж онро ба /voice/tts/ фиристед, то садоро дар забони ҳадафӣ бозсозед.

Whisper бо 680K соатҳои садои шуои воқеӣ омӯзонида шудааст, бинобар ин, нусхаи японӣ барои садои фонӣ, мусиқӣ ва сабтҳои сифати телефон устувор аст. Тақсимкунии сахт ё баландгӯякҳои зиёди барҳамхӯрда ҳанӯз ҳам ба дақиқӣ зарар мерасонад. If a transcript comes back unusable, email contact@free.ai with the file - we will refund the tokens and look at whether a different engine handles your audio better.

Шумо дӯст медоред Free.ai? Ба дӯстонатон бигӯед!

Баҳогузории ин саҳифа