Free japonisht Transkriptim
Transkribo audion dhe videon japonisht në tekst me AI. Shpejtë, të saktë dhe pa pagesë.
Si funksionon
- Shko tek Free.ai Transscriber
- Ngarko file audio apo video japonisht
- AI jonë automatikisht zbulon japonisht dhe e transkripton atë
- Shkarko transkriptën si tekst apo subtitra SRT
japonisht Funksionet e transkriptimit
- ✓E mbështetur nga faster-whisper (liçensuar nga MIT)
- ✓Zbulimi automatik i gjuhës japonisht
- ✓Suporton MP3, WAV, MP4, M4A, FLAC dhe më shumë
- ✓Eksporto
- ✓Pa kufizim të madhësisë së file në planet e paguar
- ✓Privat dhe i sigurt -- files eleminohen pas përpunimit
Detaje gjuhësore
| Gjuha | japonisht |
| Kodi ISO | ja |
| Modeli AI | faster-whisper |
| Çmimi | I lirë |
Më shumë gjuhë
Shiko të gjitha gjuhëtFAQ
Whisper large-v3-turbo arrin në nivelin e saktësisë së saj më të lartë në japonisht — nën 7% të gabit të fjalëve në standartet e referencës. Në praktikë kjo do të thotë se audio e pastër studio kthehet pothuajse e përsosur, dhe audio e bisedave është e përdorshme me pastrimin minimal.(Tier A, under 7% word error rate në setët e benchmark - ne publikojmë nivelet e ndershme WER në vend të pretendimeve të marketingut.)
Po - transkriptimi japonisht merr së pari nga token-ët tuaj të lirë të përditshëm. Audio kushton rreth 50 token-ë për minutë, kështu që pool-i i përditshëm anonim mbulon disa orë audio në ditë. Llogaritë e hyra marrin një pool më të madh të përditshëm prej 30,000 token-ësh. Pas kësaj, transkriptimi është i paguar sipas përdorimit, me token-e që fillojnë nga $1.
Transkriptat japonisht kthehen në shkrimin nativ (UTF-8). Teksti japonisht nuk ka hapësirë midis fjalëve; diarization timestamps shtojnë ndërprerje natyrore në rrotullimin e folësit.
MP3, WAV, M4A, FLAC, OGG, OPUS, dhe WEBM pranohen direkt. Për video (MP4, MOV, MKV) nxjerrim audion në server para se ta dërgojmë tek Whisper - nuk duhet të konvertoni asgjë vetë. E njëjta procedurë pavarësisht nga gjuha burimore, duke përfshirë japonisht.
Maksimumi i ngarkimit anonim është rreth 500 MB për file. Llogaritë e hyra arrijnë deri në 2 GB. Kohëzgjatja nuk është një limit i fortë - file të gjatë ndahen automatikisht (dritaret 30 sekonda me mbivendosje) dhe ri-përfshihen në një transkript të vetëm me shenja kohore të vazhdueshme. Regjistrimet japonisht me shumë orë (podcast, leksione të plota, takime) punojnë mirë.
Po - diarization folës është e paracaktuar për çdo japonisht transcript. Output është segmentuar si Folësi 1 / Folësi 2 / Folësi 3 me timestamp, kështu intervistat, panel diskutime, dhe multi-party takime kthehen etiketuar. Diarization është në një model të veçantë dhe punon në të njëjtën mënyrë në të gjitha gjuhët që ne suportojmë.
Po - ngjite URL në /transcribe/youtube/ për YouTube ose /transcribe/podcast/ për podcast feeds (Apple, Spotify, RSS). Shkarkojmë audion, e bëjmë të funksionojë nëpërmjet Whisper me gjuhën=ja, dhe kthejmë transkriptimin me shtyllat e kohës dhe etiketat e folësit. Përmbajtja tipike japonisht: podcasts, leksione, intervistat, dhe forma të gjata të YouTube përmbajtje në japonisht janë më të zakonshmet punë ngarkesa ne shohim.
Whisper kushton rreth 50 token për minutë të audios, kështu që një regjistrim një orësh është ~3,000 token. Shumica e përdoruesve nuk shpenzojnë asgjë - pool i përditshëm i lirë prej 30,000 token mbulon klipe të shkurtra, shënime zëri dhe podcast të një herëshme. Përtej kësaj, transkriptimi është i paguar sipas përdorimit, me token-e nga $1.
Po - janë në dispozicion si markat e kohës në nivel segmenti (çdo ~10-30 sekonda) ashtu edhe në nivel fjale. Niveli i fjalës është i paracaktuar për eksportimin e subtitrimeve VTT/SRT kështu që subtitrat sinkronizohen rresht pas rreshti. Në API vendos timestamps="fjalë" në trupin e kërkesës. Transkriptat japonisht kthehen në shkrimin nativ (UTF-8). Teksti japonisht nuk ka hapësirë midis fjalëve; diarization timestamps shtojnë ndërprerje natyrore në rrotullimin e folësit.
Po. POST audio (multipart/form-data, emri i fushës "file") tek /v1/transcribe/ me gjuhën=ja - ose hiqni parametrin e gjuhës për të lejuar Whisper të zbulojë automatikisht. Kthen JSON me transkriptimin, segmentet, shtyllat e kohës dhe etiketat e folësit. Referenca e plotë dhe fragmentet e SDK në /api/.
Po - pasi të përfundojë transkriptimi, kliko Përkthe ose ngjite tekstin në /translate/. japonisht pajtohet me çdo gjuhë tjetër që suportojmë (200+). Për minutat e takimit, transkriptimi duhet të shkojë nëpër /summarize/; për dyfishim dërgoje tek /voice/tts/ për të prodhuar audion në gjuhën e synuar.
Whisper është trajnuar në 680K orë të zhurmës së botës reale, kështu që transkriptimi japonisht është i fortë ndaj zhurmës së sfondit, shtresave të muzikës dhe regjistrimeve me cilësi telefonike. Prerja e ashpër ose zërat e shumtë të mbivendosur do të dëmtojnë saktësinë.Nëse një transkript kthehet i papërdorshëm, dërgo email contact@free.ai me dosjen - ne do të kthejmë token dhe do të shohim nëse një motor tjetër trajton audion tuaj më mirë.