Free kanton transkripsiya
kanton audio və videonu AI ilə mətnə çevir. Çox sürətli, dəqiq və pulsuz.
İşə başla
- _Göstər Free.ai Transkript
- kanton səs və ya video faylınızı yükləyin
- Bizim AI kanton-i avtomatik olaraq aşkar edir və onu transkriptləşdirir
- Transkriptinizi mətn və ya SRT subtitle olaraq yüklə
kanton Transkripsiya Xüsusiyyətləri
- ✓faster-whisper tərəfindən yaradılmışdır (MIT lisenziyalı)
- ✓Avtomatik kanton dili aşkarlama
- ✓MP3, WAV, MP4, M4A, FLAC və daha çoxunu dəstəkləyir
- ✓Zaman damğaları və altyazılar ixrac et
- ✓Ödənişli planlarda fayl ölçüsünün məhdudiyyəti yoxdur
- ✓Özəl və təhlükəsiz -- fayllar işləmədən sonra silinir
Dil Məlumatları
| Dil | kanton |
| ISO kodu | yue |
| Model | faster-whisper |
| Qiymət | Pulsuz |
Daha çox dil
Bütün Dilləri GöstərFAQ
kanton Whisper üçün az resurslu dildir - large-v3-turbo 25% söz səhv dərəcəsi üzərinə oturur, bəzən çox yuxarıda. Transkript axtarış və gist üçün faydalıdır amma nəşr üçün hazır hesab edilməlidir. Əgər kanton üçün daha yüksək dəqiqlikli mühərrik mövcud olarsa onu avtomatik olaraq daxil edirik.(Tier D, over 25% word error rate on benchmark sets — biz marketinq iddialarından daha çox doğru WER tierlərini yayımlayırıq.)
Bəli - kanton transkripsiya əvvəlcə günlük pulsuz token dəstənizdən istifadə edir. Audio bir dəqiqədə 50 tokenə başa gəlir, buna görə də anonim günlük dəstə gündəlik bir neçə saatlıq audionu əhatə edir. Giriş etmiş hesablar daha böyük 30,000 günlük token dəstəsini əldə edirlər. Bundan sonra transkripsiya $1-dan başlayaraq token yükləmələri ilə istifadə etdiyiniz zaman ödənilir.
kanton transkriptləri standart UTF-8 ilə dil normal orfoqrafiya ilə geri qaytarılır.
MP3, WAV, M4A, FLAC, OGG, OPUS və WEBM formatları doğrudan qəbul edilir. Video üçün (MP4, MOV, MKV) səs çərçivəsini Whisper-a göndərmədən əvvəl server tərəfində çıxarırıq - siz heç nəyi öz əlinizlə çevirməyə ehtiyacınız yoxdur. Mənbə dili ilə bağlı olaraq eyni boru kəməri, kanton daxil olmaqla.
Anonim yükləmələr hər fayl üçün təxminən 500 MB-a qədərdir. Giriş edilmiş hesablar 2 GB-a qədərdir. Uzunluğu məhdudlaşdırmaq mümkün deyil - uzun fayllar avtomatik olaraq parçalanır (30 saniyəlik pəncərələr üst-üstə düşür) və tək bir transkriptə davamlı vaxt damğaları ilə birləşdirilir. Bir neçə saatlıq kanton qeydləri (podkastlar, tam dərslər, görüşlər) yaxşı işləyir.
Bəli - hər kanton transkripti üçün səsləndirici diarizasiya ön qurğulu olaraq işə salınır. Çıxış Speaker 1 / Speaker 2 / Speaker 3 olaraq vaxt damğaları ilə segmentləşdirilir, belə ki müsahibələr, panel müzakirələri və çox tərəfli görüşlər etiketlənmiş olaraq geri gəlir. Diarizasiya ayrı bir model üzərində işləyir və dəstəklədiyimiz bütün dillərdə eyni işləyir.
Bəli - URL-ni YouTube üçün /transcribe/youtube/ və ya podcast feedləri üçün /transcribe/podcast/-ə yapışdırın. Audionu yükləyirik, language=yue ilə Whisper-də işlədirik və vaxt və səsləndirici etiketləri ilə transkripti geri qaytarırıq. Tipik kanton məzmunu: kanton-də dərslər, müsahibələr, səsli qeydlər və YouTube məzmunu bütün işləyir - URL-ni /transcribe/youtube/-a yapışdır ya da faylları doğrudan yüklə.
Whisper costs about 50 tokens per minute of audio, so a one-hour recording is ~3,000 tokens. Most users never spend anything - the free daily pool of 30,000 tokens covers short clips, voice notes, and one-off podcasts. Beyond it, transcription is pay-as-you-go, with token top-ups from $1.
Bəli — həm segment səviyyəli (hər ~10-30 saniyədə) həm də söz səviyyəli vaxt damğaları mövcuddur. Söz səviyyəsi VTT/SRT altyazıları ixrac etmək üçün ön qurğudur, buna görə də altyazılar sətir-sətir sinxronlaşdırılır. API-də tələbin bədənində timestamps="word"-u təyin et. kanton transkriptləri standart UTF-8 ilə dil normal orfoqrafiya ilə geri qaytarılır.
Bəli. Audionu (multipart/form-data, sahənin adı "file") language=yue ilə /v1/transcribe/-a POST et - ya da Whisper-in avtomatik aşkarlamasına imkan vermək üçün dil parametrini burax. Transkript, segmentlər, vaxt damğaları və səsləndirici etiketləri ilə JSON geri qaytarır. /api/-də tam istinad və SDK parçaları.
Bəli - transkripsiya bitdikdən sonra, Tərcümə düyməsini basın və ya mətni /translate/-ə yapışdır. kanton dəstəklədiyimiz hər dillə (200+) uyğun gəlir. Toplantı protokolları üçün transkript /summarize/-ə göndərilir; dublaj üçün /voice/tts/-ə göndərilir ki, məqsəd dili ilə səsi göstərsin.
Whisper-in səsli təlim bu səviyyədə az kömək edir - problem kanton audio Whisper-in təlim zamanı gördüyü səsli miqdarıdır, səsli deyil. Təmiz studio səsi hələ də səsli səsi üstələyir, amma heç biri də yüksək resurslu dildə əldə edəcəyiniz dəqiqliyə çatmayacaq.Əgər transkript istifadə edilməmiş halda geri gəlsə, contact@free.ai ünvanına faylla birlikdə e-poçt göndərin - biz tokenləri geri qaytaracağıq və başqa bir motorun sizin audionuzu daha yaxşı idarə edə biləcəyini görəcəyik.