Laisvas kinų perrašymas
Atsekti kinų garso ir vaizdo tekstą su AI. Greitas, tikslus ir nemokamas.
Kaip tai veikia
- Eikite į Free.ai Transkrastų
- Iškelkite savo kinų garso ar vaizdo failą
- Mūsų AI automatiškai aptinka kinų ir jį perrašo
- Atsisiųskite stenogramą kaip tekstą arba SRT subtitrus
kinų perrašymo savybės
- ✓Galioja faster-whisper (MIT licencijuota)
- ✓Automatinis kinų kalbos aptikimas
- ✓Palaiko MP3, WAV, MP4, M4A, FLAC, ir daugiau
- ✓Laikraščiai ir subtitrai eksportui (SRT)
- ✓Nėra apmokėtų planų failų dydžio ribų
- ✓Privatūs ir saugūs -- failai ištrinami po apdorojimo
Kalbos detalės
| Kalba | kinų |
| ISO kodas | zh |
| AI modelis | faster-whisper |
| Kaina | Laisva |
Daugiau kalbų
Rodyti visas kalbasDUK
Whisper didelis-v3-turbo žemės savo aukščiausio tikslumo pakopoje kinų - iki 7% žodžio klaidų dažnis standartinių etalonų. Praktikoje tai reiškia, kad švari studija garso grįžta beveik tobulas, ir pokalbių garso yra naudojamas su minimaliu valymas.(Tier A, under 7% word error rate etalonų rinkinių - skelbiame sąžiningas WER pakopas, o ne rinkodaros pretenzijas.)
Taip - kinų Transkripcija atkreipiamas iš savo kasdienio nemokamo žetonų baseinas pirmas. Garso kaina apie 50 žetonų per minutę, todėl anoniminis dienos baseinas apima kelias valandas garso per dieną. Pasirašyta-į sąskaitas gauti didesnį 30,000-token dienos baseinas. Praeityje, kad transkripcija yra pay-as-you-go, su žetonų papildymai nuo $ 1.
Pass kalba=zh for Mandarin (numatytasis - supaprastintas arba tradicinis išvedimas priklausomai nuo šaltinio). Cantonese naudoti kalba=yue jei jūsų garso yra Honkongas / Guangzhou kalba; Kantonezas tranzitinis kaip zh bus gaminti Mandarin-ortografijos suderinimo, kad praranda tonus ir slang.
MP3, WAV, M4A, FLAC, OGG, OPS, ir WEBM yra priimti tiesiogiai. Vaizdo (MP4, MOV, MKV) mes ištraukiame garso takelių serverio pusėje prieš siunčiant jį į Whisper - jums nereikia konvertuoti nieko sau. Tas pats vamzdynas nepriklausomai nuo šaltinio kalbos, įskaitant kinų.
Anoniminis įkelia dangtelį maždaug 500 MB vienam failui. Pasirašyta paskyra siekia 2 GB. Trukmė nėra kieta - ilgi failai automatiškai užkabinami (30 sekundžių su susiklostymu) ir surišami atgal į vieną transkriptą su nuolatinėmis žymomis. Daugiavalandės kinų įrašai (podcast, pilnos paskaitos, susitikimai) veikia puikiai.
Taip - garsiakalbis diarizacija yra pagal nutylėjimą kiekvienam kinų transkriptui. Išvedimas yra segmentuojamas kaip garsiakalbis 1 / Garsiakalbis 2 / Garsiakalbis 3 su žymekliais, todėl interviu, skydo diskusijos ir susitikimai su daugeliu šalių susirinkimų sugrąžinti. Diarizavimas vyksta su atskiru modeliu ir veikia taip pat visose palaikomose kalbose.
Taip - įklijuokite URL į / trantractor/ youtube/ YouTube arba / tranctor/podcast/ podcast/ podcast kanalus (Apple, Spotify, RSS). Atsisiųskite garso įrašą, paleiskite jį per Whisper su kalba=zh ir grąžinkite transkripciją su žymomis ir garsiakalbiais. Tipinis kinų turinys: Podcast, paskaitos, interviu, ir ilgai form YouTube turinys kinų yra dažniausiai darbo krūvis matome.
Whisper kainuoja apie 50 žetonų per minutę garso, todėl vienos valandos įrašas yra ~ 3000 žetonų. Dauguma vartotojų niekada išleisti nieko - nemokamas dienos baseinas 30,000 žetonų apima trumpus klipus, balso užrašus ir vienkartinius podcast. Be to, transkripcija yra mokamas kaip jums-go, su simbolių papildymai nuo $ 1.
Taip - galima tiek segmento lygis (kas ~10-30 sekundžių), tiek žodžio lygio žymos. Žodžio lygis yra numatytasis VTT/SRT subtitrai eksportui, todėl antraštės sinchronizuoja eilutę pagal eilę. API set timestamps="word" užklausos institucijoje. kinų stendai grąžinami vietiniais Han simboliais (UTF-8) - supaprastintais arba tradiciniais, priklausomai nuo pradinio garso ir ISO kodo.
Taip. Po garso (daugidalis/ forma-duomenys, lauko pavadinimas "failas") /v1/ trancrate/ su kalba=zh - arba praleisti kalbos parametrą, kad Whisper automatiškai nustatyti. Grįžta JSON su stenograma, segmentais, žymomis ir garsiakalbio etiketėmis. Visas nuorodas ir SDK fragmentus ties /api/.
Taip - kai transkripcija baigiasi, spustelėkite Paspauskite arba įklijuokite tekstą į /translate/. kinų poros su kiekviena kita kalba mes palaikome (200+). Norėdami susitikti minučių stenogramą per /summarize/; dublēti siųsti jį į /balsas/ tts/ garso atvaizdavimui tikslinės kalbos.
Whisper yra mokomas 680K valandas triukšmingo realaus pasaulio garso, todėl kinų transkripcija yra tvirta fono triukšmo, muzikos lovų ir telefono kokybės įrašus. Sunkus kirpimas ar kelis persidengiančius garsiakalbius vis tiek pakenks tikslumui.Jei transkriptas grįžta nenaudingas, elektroniniu paštu contact@free.ai su failu - mes grąžinti simbolius ir pažvelgti, ar kitas variklis veikia jūsų garso geriau.