Chinesesch Transkriptioun gratis
Transkriptioun Chinesesch Audio a Video op Text mat AI. Schnell, genau an gratis.
Wéi et funktionéiert
- Zu de Free.ai Transkripter
- Är Chinesesch Audio- oder Videodatei erofladen
- Eis KI erkennt automatesch Chinesesch an iwwersetzt et
- Är Transkriptioun als Text oder SRT-Untertitel erofladen
Chinesesch Transkriptiounsfeatures
- ✓D'Lëscht vun de lëtzebuergesche Lidder (Lëscht vun de Lidder)
- ✓Automatesch Chinesesch Sproocherkennung
- ✓Ënnerstëtzt MP3, WAV, MP4, M4A, FLAC, an aner
- ✓Exportéiere vu Dateien
- ✓Keng Dateigréisstlimiten op bezuelte Pläng
- ✓Privat a sécher -- Dateien ginn no der Veraarbechtung geléist
Sproochdetailer
| Sprooch | Chinesesch |
| ISO-Code | zh |
| Modell | faster-whisper |
| Präis | Free |
Sproochen
All SproochenFAQ
Whisper large-v3-turbo läit an der héchster Präzisiounskategorie op Chinesesch — ënner 7% Wierderfehlerquote bei Standard-Benchmarks. An der Praxis heescht dat, datt de Studio-Audio quasi perfekt ass, an de Gespréichs-Audio mat minimaler Opräisung benotzt ka ginn. (Tier A, under 7% word error rate on benchmark sets - we publish honest WER tiers rather than marketing claims.)
Ja - Chinesesch Transkriptioun zielt vun Ärem alldeegleche gratis Token Pool. Audio kascht ongeféier 50 Token pro Minutt, sou datt den anonyme alldeegleche Pool e puer Stonnen Audio pro Dag deckt. Ugemeldete Konts kréien e méi groussen 30.000-Token alldeegleche Pool. Nodeem, Transkriptioun ass pay-as-you-go, mat Token Top-ups vun $1.
Passéiert language=zh fir Mandarin (de Standard - vereinfacht oder traditionell Ausgabe ofhängeg vun der Quell). Fir Kantonesch benotzt language=yue wann Ären Audio Hong Kong / Guangzhou Sprooch ass; Kantonesch transkribt als zh produzéiert eng Mandarin-Orthographie Approximatioun déi Tonen a Slang verléiert.
MP3, WAV, M4A, FLAC, OGG, OPUS, an WEBM ginn direkt akzeptéiert. Fir Videoen (MP4, MOV, MKV) extrahéiere mir d'Audiospur op der Serversäit ier se un Whisper geschéckt gëtt - Dir musst näischt selwer konvertéieren. Déi selwecht Pipeline onofhängeg vun der Quellsprooch, och Chinesesch.
Anonym Uploads sinn op ongeféier 500 MB pro Datei limitéiert. Ugemellt Konts hunn bis zu 2 GB. D'Dauer ass keng strikt Limit - laang Dateien ginn automatesch a Stécker geschnidden (30-Sekonnen-Fënsteren mat Iwwerlappung) an an eng eenzegaarteg Transkriptioun mat kontinuéierleche Zäitstempelen zesummegesat. Méi Stonne laang Chinesesch Opnamen (Podcasts, ganz Virlesungen, Meetings) funktionnéieren gutt.
Ja - Sprecher- Diariséierung ass standardméisseg fir all Chinesesch Transkript aktivéiert. D' Ausgab gëtt segmentéiert als Sprecher 1 / Sprecher 2 / Sprecher 3 mat Zäitstempelen, sou datt Interviewen, Paneldiskussiounen a Multi-Party-Meetings mat Labelen zréckkommen. Diariséierung leeft op engem separate Modell a funktionnéiert déiselwecht fir all Sproochen déi mir ënnerstëtzen.
Ja - fügt d'URL an /transcribe/youtube/ fir YouTube oder /transcribe/podcast/ fir Podcast Feeds (Apple, Spotify, RSS) an. Mir lueden den Audio erof, lafen et duerch Whisper mat language=zh, a ginn d'Transkriptioun mat Zäitstempelen a Sprecherlabelen zréck. Typesche Chinesesch Inhalt: Podcasts, Lectures, Interviewen an YouTube Inhalter an Chinesesch sinn déi meescht üblech Workloads déi mir gesinn.
Whisper kascht ongeféier 50 Token pro Minutt Audio, also ass eng Stonn Opnam ~3.000 Token. Déi meescht Benotzer ginn näischt aus - de gratis alldeegleche Pool vu 30.000 Token deckt kuerz Clips, Stëmmnotizen an eenzeg Podcasts. Dobäi ass Transkriptioun pay-as-you-go, mat Token Top-ups vun $1.
Ja — souwuel Zäitstempel op Segment-Niveau (all ~10-30 Sekonne) wéi och op Wierder-Niveau sinn verfügbar. Wierder-Niveau ass standard fir VTT/SRT Ënnertitelen ze exportéieren, sou datt d'Ënnertitelen Zeil fir Zeil synchroniséiert ginn. Op der API setzt timestamps="word" am Ufro-Körper. Chinesesch Transkriptiounen ginn an nativen Han-Zeechen (UTF-8) zréckginn — vereinfacht oder traditionell, ofhängeg vum Quell-Audio an ISO-Code.
Ja. POST Audio (multipart/form-data, Feldnumm "file") op /v1/transcribe/ mat language=zh - oder läschen de Sproochparameter fir Whisper automatesch ze erfannen. Gitt JSON mat der Transkriptioun, Segmenter, Zäitstempelen, a Speakerlabels zréck. Voll Referenz an SDK Schnëtzele bei /api/.
Ja — wann d'Transkriptioun fäerdeg ass, klickt op Iwwersetzen oder fügt de Text an /translate/. Chinesesch passt mat all anere Sproochen déi mir ënnerstëtzen (200+). Fir Meetingprotokoller gëtt d'Transkriptioun duerch /summarize/ gepippt; fir Synchroniséierung gëtt et un /voice/tts/ geschéckt fir Audio an der Zilsprooch ze maachen.
Whisper ass op 680K Stonnen un lauten realen Audio trainéiert, sou dass Chinesesch Transkriptioun robust ass géint Hannergrondlaut, Musekbetten, an Telefons-Qualitéitsaufnahmen. Ernsthaft Clipping oder méi iwwerlappend Lautsprecher wäerten nach ëmmer d'Genauegkeet beaflossen. If a transcript comes back unusable, email contact@free.ai with the file - we will refund the tokens and look at whether a different engine handles your audio better.