Free japanska Skriftaka

Afrita japanska hljóð og myndband í texta með AI. Fljótur, nákvæmur og ókeypis.

Hvernig það virkar

  1. Fara á síðuna Free.ai Umrita
  2. Hladdu upp japanska hljóð- eða myndskeiðsskránni þinni
  3. AI okkar greinir sjálfkrafa japanska og skrifar það
  4. Sækja afritunarskrá sem texta eða SRT texta

japanska Litur Features

  • ✓Knúið af faster-whisper (MIT leyfi)
  • ✓Sjálfvirk japanska tungumál greining
  • ✓Styður MP3, WAV, MP4, M4A, FLAC og fleira
  • ✓Tímastimpill og textaflutningur (SRT)
  • ✓Engin takmörk á skráarstærð á greiddum áætlunum
  • ✓Einkamál og örugg -- skrám er eytt eftir vinnslu

Upplýsingar um tungumál

Tungumáljapanska
ISO kóðija
AI líkanfaster-whisper
VerðÓkeypis

Fleiri tungumál

Skoða öll tungumál

Algengar spurningar

Whisper stór-v3-turbo lendir í efstu nákvæmni stigi á japanska - undir 7% orð villa hlutfall á venjulegum viðmiðum.Í reynd sem þýðir hreint stúdíó hljóð kemur aftur nánast fullkominn, og samtal hljóð er nothæft með lágmarks hreinsun.(Tier A, under 7% word error rate á viðmiðunarmörkum - við birtum heiðarlega WER tiers frekar en markaðskröfur.)

Já - japanska afritunin dregur úr daglegu ókeypis táknlaug þinni fyrst. Hljóð kostar um 50 tákn á mínútu, þannig að nafnlaus daglegur laug nær yfir nokkrar klukkustundir af hljóði á dag. Innskráðir reikningar fá stærri 30.000 tákn daglega laug. Eftir það er afritunin greidd eins og þú ferð, með táknfyllingar frá $ 1.

japanska afritunar eru skilað í innfæddum skriftu (UTF-8). japanska texti hefur engin bil á milli orða innfæddur; diarization tímastimpill bæta náttúrulegum hléum á ræðumaður snýr.

MP3, WAV, M4A, FLAC, OGG, OPUS og WEBM eru samþykkt beint. Fyrir vídeó (MP4, MOV, MKV) dregum við út hljóðlagið á þjónshlið áður en það er sent til Whisper - þú þarft ekki að breyta neinu sjálfur. Sama leiðsla óháð upprunalegu tungumáli, þar á meðal japanska.

Nafnlaus upphleðsla takmark um það bil 500 MB á skrá. Innskráðir reikningar fara upp í 2 GB. Lengd er ekki harður takmörk - langa skrár eru chunked sjálfkrafa (30 sekúndur glugga með skarast) og saumað aftur í einn afritun með samfelldum tímastimpil. Multi- klukkustund japanska upptökur (podcasts, fullur fyrirlestrar, fundir) virka fínt.

Já - ræðumaður diarization er sjálfgefið á fyrir hvert japanska afritun. Úttak er skipt sem ræðumaður 1 / ræðumaður 2 / ræðumaður 3 með tímastimpil, svo viðtöl, spjallborð umræður, og multi-party fundir koma aftur merktir. Diarization keyrir á sérstökum líkani og virkar eins á öllum tungumálum sem við styðjum.

Já - límdu slóðina inn í /transcribe/youtube/ fyrir YouTube eða /transcribe/podcast/ fyrir podcast (Apple, Spotify, RSS). Við sækjum hljóðin, keyrum þau í gegnum Whisper með language=ja og skilum afrituninni með tímastimpli og ræðumerkjum. Dæmigert japanska efni: Podcasts, fyrirlestrar, viðtöl og langur-form YouTube efni í japanska eru algengustu vinnuálag sem við sjáum.

Whisper kostar um 50 tákn á mínútu af hljóði, þannig að klukkustundar upptöku er ~ 3.000 tákn. Flestir notendur eyða aldrei neinu - ókeypis daglega laug 30.000 tákn nær stuttar hreyfimyndir, raddskýringar og einn-off podcast. Beyond það, afritun er greiða-eins og-þú-fara, með tákn topp-ups frá $ 1.

Já - bæði tímastimpill á hlutastig (á ~10-30 sekúndna fresti) og tímastimpill á orðstigi eru í boði. Orðsstig er sjálfgefið fyrir útflutning á VTT/SRT texta svo textarnir samstillast línu fyrir línu. Á API er sett timestamps="word" í beiðni líkamans. japanska afritunar eru skilað í innfæddum skriftu (UTF-8). japanska texti hefur engin bil á milli orða innfæddur; diarization tímastimpill bæta náttúrulegum hléum á ræðumaður snýr.

Já. POST hljóð (multipart/form-data, field name "file") til /v1/transcribe/ með language=ja - eða slepptu tungumálabreytunni til að leyfa Whisper að finna sjálfkrafa. Skila JSON með uppskriftinni, hlutum, tímastimpli og hátalaramerkjum. Full tilvísun og SDK-sniðið á /api/.

Já - þegar uppskrift lýkur, smelltu á Þýða eða líma textann í /translate/. japanska pör með öllum öðrum tungumálum sem við styðjum (200+). Fyrir fundargerð pípa uppskrift í gegnum /summarize/; fyrir dubbing senda það til /voice/tts/ til að gera hljóð á markmálinu.

Whisper er þjálfað á 680K klukkustundum háværra raunverulegra hljóðs, þannig að japanska uppskrift er öflugur til bakgrunns hávaða, tónlistarrúm og upptökur í síma.Alvarleg klippa eða margar skarast hátalara mun enn meiða nákvæmni.Ef afritunarrit kemur aftur ónýtt, sendu tölvupóst contact@free.ai með skránni - við munum endurgreiða táknin og skoða hvort önnur vél meðhöndli hljóð þitt betur.

Elska Free.ai? Segðu vinum þínum!

Gefa þessari síðu einkunn