Fri kinesisk- transskription

Transcribe kinesisk lyd og video til tekst med AI. Rask, nøyaktig og ledig.

Hvordan det fungerer

  1. Gå til Free.ai Transkriber
  2. Last opp kinesisk-lyden din eller videofila
  3. Vår AI oppdager automatisk kinesisk og transkriberer det
  4. Last ned utskrifta din som tekst eller SRT teksting

kinesisk Transskriptorer

  • ✓Drivet av faster-whisper (MIT- lisensert)
  • ✓Automatisk kinesisk språkpåvisning
  • ✓Støtter MP3, WAV, MP4, M4A, FLAC, og mer
  • ✓Tidsstempler og underteksteksport (SRT)
  • ✓Ingen filstørrelsesgrenser for betalte planer
  • ✓Privat og sikker -- filer blir slettet etter behandling

Språkdetaljer

Språkkinesisk
ISO-kodezh
AI- modellfaster-whisper
PrisLedig

Flere språk

Vis alle språk

OSS

Visper large- v3- turbo lander på sitt høyeste nøyaktighetsnivå på kinesisk _ — under 7% ordfeilfrekvens på standard standardverdier. I praksis betyr det at ren studielyd kommer tilbake nær perfekt, og konversasjonslyd kan brukes med minimal opprydding.(Tier A, under 7% word error rate på referansesett - vi publiserer ærlige WER nivåer heller enn markedsføring krav.)

Yes - kinesisk transcription draws from your daily free token pool first. Audio costs about 50 tokens per minute, so the anonymous daily pool covers a few hours of audio per day. Signed-in accounts get a larger 30,000-token daily pool. Past that, transcription is pay-as-you-go, with token top-ups from $1.

Godkjenn språk=zh for Mandarin (standard - forenklet eller tradisjonell utdata avhengig av kilde). For kantonesisk bruk språk=yue hvis lyden din er Hong Kong / Guangzhou tale. Kantonesisk transkribert som zh vil lage en mandarin- ortography tilnærming som mister toner og slang.

MP3, WAV, M4A, FLAC, OGG, OPUS og WEBM godtas direkte. For video (MP4, MOV, MKV) trekker vi ut lydsportjenersiden før du sender den til Whisper - du trenger ikke konvertere noe selv. Samme rørsystem uansett kildespråk, medregnet kinesisk.

Anonyme opplastinger har en cap på omtrent 500 MB per fil. Kontoer med underskrift går opp til 2 GB. Lengden er ikke en hard grense - lange filer blir automatisk brutt (30 sekunders vindu med overlapping) og sydd tilbake i en enkelt utskrift med kontinuerlige tidsstempel. Flertimers opptak av kinesisk (podcasts, fulle forelesninger, møter) virker fint.

Ja - nisjer- arisering er som standard for hver kinesisk utskrift. Utdataene er segmentert som høyttaler 1 / høyttaler 2 / høyttaler 3 med tidsstempler, så intervjuer, paneldrøftelser og flerpartsmøter kommer tilbake merket. Diarisering går på en egen modell og virker det samme på alle språk vi støtter.

Ja - lim inn URL- en i / transcribe/ youutube/ for YouTube eller / transcribe/ podcast/ for podcast- kilder (Apple, Spotify, RSS). Vi laster ned lyden, kjører den gjennom Whisper med språk=zh, og returnerer utskriften med tidsstempler og høyttalernavn. Typisk innhold for kinesisk: Podkaster, foredrag, intervjuer og langtidsformet YouTube-innhold i kinesisk er de vanligste arbeidsbyrdene vi ser.

Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.

Ja, både segment- nivå (hvert ~ 10 - 30 sekund) og tidsmerke for ord- nivå er tilgjengelig. Ord- nivå er standard for eksport av VTT/ SRT- undertekster slik at tekstene synkron tekst for linje. På API- nivået settes tidsstempel=« ord » i forespørsel- kroppen. kinesisk- utskrifter sendes tilbake med egne Han- tegn (UTF- 8) - forenklet eller tradisjonell, avhengig av kildelyd og ISO- kode.

Ja. POST lyd (multipart/ form- data, feltnavn « fil ») til / v1/ transcribe/ med språk=zh - eller utelate språkparameteren for å la Whisper automatisk oppdage. Returnerer JSON med utskrift, segmenter, tidsstempel og høyttaleretiketter. Full referanse og SDK- tekst ved / api /.

Ja - når transkripteringen er ferdig, trykk Oversett eller lim inn teksten i / translate/. kinesisk par med alle andre språk vi støtter (200+). For møteminutter send kopien gjennom / summarize/; for dubbing send den til /voice/tts / for å gjengi lyd på målspråket.

Whisper trener på 680K timer lydlyd i den virkelige verden, så kinesisk transkription er robust til bakgrunnsstøy, musikksenger og telefonkvalitetsopptak. Alvorlig klipping eller flere overlappende høyttalere vil likevel skade nøyaktigheten. If a transcript comes back unusable, email contact@free.ai with the file - we will refund the tokens and look at whether a different engine handles your audio better.

Elsk Free.ai? Fortell vennene dine!

Bedøm denne siden