Gratis kinesisk transcription
Transskribér kinesisk lyd og video til tekst med AI. Hurtig, præcis og gratis.
Hvordan det virker
- Gå til Free.ai Transcriber
- Upload din kinesisk lyd- eller videofil
- Vores AI registrerer automatisk kinesisk og transskriberer det
- Download din udskrift som tekst eller SRT-undertekster
kinesisk transcription funktioner
- ✓Drevet af faster-whisper (MIT licenseret)
- ✓Automatisk kinesisk sprogdetektering
- ✓Understøtter MP3, WAV, MP4, M4A, FLAC og meget mere
- ✓Tidsstempler og eksport af undertekster (SRT)
- ✓Ingen filstørrelsesgrænser for betalte planer
- ✓Privat og sikker -- filer slettes efter behandling
Sprogoplysninger
| Sprog | kinesisk |
| ISO-kode | zh |
| AI-model | faster-whisper |
| Pris | Fri |
Flere sprog
Vis alle sprogOfte stillede spørgsmål
Hviske store-v3-turbo lander i sin top nøjagtighed niveau på kinesisk under 7% ord fejlrate på standard benchmarks. I praksis betyder ren studie lyd kommer tilbage nær-perfekt, og samtalelyd kan bruges med minimal oprydning.(Tier A, under 7% word error rate på benchmark sæt - vi offentliggør ærlige WER niveauer snarere end markedsføring krav.)
Ja - kinesisk transskription trækker fra din daglige gratis token pool først. Lyd koster omkring 50 tokens per minut, så den anonyme daglige pool dækker et par timers lyd om dagen. Underskrevet-in konti får en større 30.000-token daglig pool. Forbi det, transskription er pay-as-you-go, med token top-ups fra $ 1.
Pass language=zh for Mandarin (standard - forenklet eller traditionel output afhængigt af kilden). For kantonesisk brug sprog=yue hvis din lyd er Hong Kong / Guangzhou tale; kantonesisk transskriberet som Zh vil producere en mandarin-orthography tilnærmelse, der mister toner og slang.
MP3, WAV, M4A, FLAC, OGG, OPUS og WEBM accepteres direkte. Til video (MP4, MOV, MKV) udtrækker vi lydsporserveren, før du sender den til Whisper - du behøver ikke at konvertere noget selv. Samme rørledning uanset kildesprog, herunder kinesisk.
Anonym uploads cap på ca. 500 MB pr. fil. Underskrevne konti går op til 2 GB. Varigheden er ikke en hård grænse - lange filer er biddet automatisk (30 sekunders vinduer med overlapning) og syet tilbage i en enkelt udskrift med kontinuerlige tidsstempler. Multi-time kinesisk optagelser (podcasts, fuld forelæsninger, møder) fungerer fint.
Ja - højttaler diarisering er som standard tændt for hver kinesisk udskrift. Udgangen er segmenteret som højttaler 1 / højttaler 2 / højttaler 3 med tidsstempler, så interviews, paneldiskussioner og multi-party møder kommer tilbage mærket. Diarisering kører på en separat model og fungerer det samme på tværs af alle sprog, vi understøtter.
Ja - indsæt URL'en i /transcribe/youtube/ for YouTube eller /transcribe/podcast/ for podcast-feeds (Apple, Spotify, RSS). Vi downloader lyden, kører den gennem Whisper med sprog=zh, og returnerer udskriften med tidsstempler og højttaleretiketter. Typisk kinesisk indhold: podcasts, foredrag, interviews og lang-form YouTube indhold i kinesisk er de mest almindelige arbejdsbyrder, vi ser.
Whisper koster omkring 50 tokens per minut af lyd, så en en-times optagelse er ~ 3,000 tokens. De fleste brugere aldrig bruge noget - den gratis daglige pulje af 30.000 tokens dækker korte klip, stemmen noter, og one-off podcasts. Ud over det, transskription er pay-as-you-go, med token top-ups fra $ 1.
Ja - begge segment- niveau (hver ~ 10-30 sekunder) og ord- niveau tidsstempler er tilgængelige. Word- niveau er standard for VTT / SRT undertekst eksport så billedteksterne synkronisere linje- for- linje. På API sæt tidsstempler="word" i anmodningen organ. kinesisk-udskrifter returneres i indfødte Han-tegn (UTF-8) - forenklet eller traditionel afhængigt af kildelyd og ISO-kode.
Ja. POST lyd (multipart/form- data, feltnavn "fil") til /v1/transcribe/ med sprog=zh - eller udelade sprogparameteren for at lade Whisper auto- detect. Returnerer JSON med udskrift, segmenter, tidsstempler og højttaleretiketter. Fuld reference og SDK uddrag på /api/.
Ja - når transkriptionen er færdig, klik på Oversæt eller indsæt teksten i /translate/. kinesisk par med alle andre sprog vi understøtter (200+). For møde minutter rør udskriften gennem /summarize /; for eftersyn sende det til / stemme / tts / at gøre lyd i målsproget.
Whisper er uddannet på 680K timers støjende real-world lyd, så kinesisk transskription er robust til baggrundsstøj, musik senge og telefon-kvalitet optagelser. Svær klipning eller flere overlappende højttalere vil stadig skade nøjagtigheden.Hvis en udskrift kommer tilbage ubrugelig, e-mail contact@free.ai med filen, vil vi refundere tokens og se på, om en anden motor håndterer din lyd bedre.