Transcriere chineză GRATUITĂ

Transcrie chineză audio și video în text cu AI. Răspunde, precis și gratuit.

Cum funcţionează

  1. Du-te la Free.ai Transcriere
  2. Încărcă fișierul audio sau video chineză
  3. AI nostru detectează automat chineză și o transcrie
  4. Descarcă transcripta ca text sau SRT subtitrari

chineză Caracteristici de transcriere

  • Alimentat de faster-whisper (MIT licențiat)
  • Detecție automată a limbii chineză
  • Suportează MP3, WAV, MP4, M4A, FLAC și mai multe
  • Selecția de date și exportul subtitolurilor (SRT)
  • Nu există limite de dimensiune a fișierelor privind planurile plătite
  • Fișiere private și sigure -- sunt șterse după prelucrare

Detalii limbii

Limbachineză
Codul ISOzh
Modelul AIfaster-whisper
PrețGratuit

Mai multe limbi

Vizualizați toate limbile

FAQ

Whisper larg-v3-turbo aterizează în gradul său de precizie de top pe chineză - sub 7% rata de eroare a cuvântului pe standard de referință. În practică, înseamnă că audio curat de studio se întoarce aproape perfect, iar audio conversațional este utilizabil cu curățare minimă.(Tier A, under 7% word error rate pe seturi de referință — publicăm niveluri de WER cinstite mai degrabă decât cererile de marketing.)

Da — chineză traducere de la pool zilnic gratuit. Audio costă aproximativ 50 de jetonuri pe minut, astfel încât pool zilnic anonim acoperă câteva ore de audio pe zi. Conturi semnate obține o piscină zilnică mai mare de 30.000 token. În trecut, transcrierea este de pay-as-you-go, cu jet-up de la $1.

Limbajul de trecere=zh pentru Mandarin (defectul – ieșire simplificată sau tradițională în funcție de sursă). Pentru Cantonese folosește limbajul=iue dacă audio-ul dumneavoastră este discursul Hong Kong / Guangzhou; Cantonese transcrise ca zh va produce o apropiere Mandarin-ortografie care pierde tonuri și slang.

MP3, WAV, M4A, FLAC, OGG, OPUS, și WEBM sunt acceptate direct. Pentru video (MP4, MOV, MKV) extragem serverul de piste audio înainte de a-l trimite la Whisper - nu este nevoie pentru a converti nimic singur. Aceeași pipeline indiferent de limba sursă, inclusiv chineză.

Anonim încărcă capac la aproximativ 500 MB pe fișier. Conturile semnate merg până la 2 GB. Durata nu este o limită grea — fișierele lungi sunt împărțite automat (30-secunde ferestre cu suprapunere) și cusut înapoi într-o singură transcriere cu timelor continui. Multi-oră chineză înregistrări (podcasts, lecții complete, meetings) funcționează bine.

Da — diarizarea speakerului este pe deplin pentru fiecare chineză transcript. Ieșirea este segmentată ca Speaker 1 / Speaker 2 / Speaker 3 cu timelor, astfel interviuri, discuții de comitet și reuniuni multipartite vin înapoi marcat. Diarizarea funcționează pe un model separat și funcționează la fel în toate limbile pe care le sprijinim.

Da — cotează URL-ul în /transcribe/youtube/ pentru YouTube sau /transcribe/podcast/ pentru feed-uri de podcast (Apple, Spotify, RSS). Descărcăm audioul, îl rulăm prin Whisper cu limba=zh, și returnează transcriptul cu timelouri și etichete de vorbitor. Tipic chineză conținut: podcast-uri, lecții, interviuri și conținutul YouTube de lungă durată în chineză sunt cele mai frecvente încărcături de muncă pe care le vedem.

Whisper costă aproximativ 50 de jetonuri pe minut de audio, astfel încât o înregistrare de o oră este ~3.000 jetonuri. Majoritatea utilizatorilor nu cheltuiesc nimic — piscina zilnică gratuită de 30.000 jetonuri acoperă clipuri scurte, notițe vocale și podcast-uri unice. Încolo de ea, transcrierea este de pay-as-you-go, cu jet top-up de la $ 1.

Da — atât nivelul segmentului (toate ~10-30 secunde) cât și marca temporală de word-level sunt disponibile. Nivelul Word este implicit pentru exportul de subtitrare VTT/SRT astfel încât titlurile sincronizează linie-a-line. Pe API setează marca temporală="word" în organismul de cerere. chineză transcripții sunt returnate în caractere native Han (UTF-8) – simplificate sau tradiționale în funcție de codul sursă audio și ISO.

Da. Audio POST (multipart/form-data, nume de câmp "file") la /v1/transcribe/ cu limbajul=zh – sau omite parametrul limbajului pentru a permite Whisper auto-detectare. Returnează JSON cu transcripția, segmentele, marca temporală și etichetele speaker. Referință completă și fragmente SDK la /api /.

Da — odată ce transcripția se termină, faceți clic pe Traducerea sau încolarea textului în /translate /. chineză perechi cu orice altă limbă pe care o sprijinim (200+). Pentru minutele de reuniune pipe transcripția prin /summarize /; pentru dubling trimite-o la /voice/tts/ pentru a face audio în limba țintă.

Whisper este instruit pe 680K ore de audio zgomotos din lumea reală, astfel încât chineză transcripție este robust la zgomot de fundal, paturi de muzică, și înregistrări de calitate telefonică. Taieturi severe sau multiple vorbitori suprapunere va răni încă precizie.Dacă o transcriere vine înapoi inutilizabilă, e-mail contact@free.ai cu fișierul — vom returna tokenurile și ne vom uita dacă un motor diferit se descurcă mai bine audio.

Love this tool? Share it!

Ratați această pagină