koreya pulsuz transkripsiya

koreya audio və videonu AI ilə mətnə çevir. Tez, dəqiq və pulsuz.

İşə başla

  1. _Get Free.ai transkriptoru
  2. koreya audio və ya video faylı yüklə
  3. Bizim AI koreya-i avtomatik olaraq aşkar edib onu transkriptləşdirir
  4. Transkriptinizi mətn və ya SRT subtitle olaraq yüklə

koreya transkripsiya xüsusiyyəti

  • faster-whisper tərəfindən yaradılmışdır (MIT lisenziyalı)
  • koreya dilini avtomatik aşkarla
  • MP3, WAV, MP4, M4A, FLAC və daha çoxunu dəstəkləyir
  • Zaman damğaları və altyazılar ixrac et
  • Ödənişli planlarda fayl ölçüsünün məhdudiyyəti yoxdur
  • Özəl və təhlükəsiz -- fayllar işləmədən sonra silinir

Dil Məlumatları

Dilkoreya
ISO koduko
Modelfaster-whisper
QiymətPulsuz

FAQ

Whisper large-v3-turbo koreya-də ən yüksək dəqiqlik səviyyəsinə çatır — standart benchmarklarda 7% söz səhv dərəcəsi altında. Əslində bu, təmiz studiya səsi mükəmməl səviyyədə gəlir və söhbət səsi minimal təmizləmədən istifadə edilə bilər deməkdir.(Tier A, under 7% word error rate on benchmark sets — biz marketinq iddialarından daha çox doğru WER tierlərini yayımlayırıq.)

Bəli — koreya transkripsiya əvvəlcə günlük pulsuz token dəstənizdən istifadə edir. Audio bir dəqiqədə 50 token dəyərindədir, buna görə də anonim günlük dəstə gündəlik bir neçə saat audionu əhatə edir. Giriş etmiş hesablar daha böyük 30,000 günlük token dəstəsini əldə edirlər. Bundan sonra transkripsiya $1-dan başlayaraq token yükləmələri ilə istifadə etdiyiniz zaman ödənilir.

koreya transkriptləri yerli skriptdə (UTF-8) geri qaytarılır. koreya mətni sözlər arasında boşluq saxlamır; diarizasiya vaxt damğaları danışanların dönmələrində təbii fasilələrə əlavə edir.

MP3, WAV, M4A, FLAC, OGG, OPUS və WEBM formatları doğrudan qəbul edilir. Video üçün (MP4, MOV, MKV) səs-təkrarını Whisper-ə göndərmədən əvvəl server tərəfində çıxarırıq - siz heç nəyi öz əlinizlə çevirməyə ehtiyacınız yoxdur. Mənbə dili ilə bağlı olaraq eyni boru kəməri, koreya də daxil olmaqla.

Anonim yükləmələr hər fayl üçün təxminən 500 MB-a qədərdir. Giriş edilmiş hesablar 2 GB-a qədərdir. Uzunluğu məhdudlaşdırmaq mümkün deyil - uzun fayllar avtomatik olaraq parçalanır (30 saniyəlik pəncərələr üst-üstə düşür) və tək bir transkriptə davamlı vaxt damğaları ilə birləşdirilir. Bir neçə saatlıq koreya qeydləri (podkastlar, tam dərslər, görüşlər) yaxşı işləyir.

Bəli — hər bir koreya transkripti üçün səsləndiricinin diarizasiyası ön qurğulu olaraq işə salınıb. Çıxış 1-ci / 2-ci / 3-cü səsləndirici kimi vaxt damğaları ilə segmentləşdirilir, buna görə də müsahibələr, panel müzakirələri və çox tərəfli görüşlər etiketlənmiş olaraq geri gəlir. Diarizasiya ayrı bir model üzərində işləyir və bütün dəstəklədiyimiz dillərdə eyni şəkildə işləyir.

Bəli — URL-i YouTube üçün /transcribe/youtube/ və ya podcast axınları üçün /transcribe/podcast/-ə yapışdırın (Apple, Spotify, RSS). Audionu yükləyirik, language=ko ilə Whisper-dən keçiririk və vaxt işarə və səsləndirici etiketləri ilə transkripti geri qaytarırıq. Tipik koreya məzmunu: koreya-də podcastlar, dərslər, müsahibələr və uzun formalı YouTube məzmunu ən çox rast gəldiyimiz iş yükləridir.

Whisper audionun hər dəqiqəsi üçün 50 token xərcləyir, buna görə də bir saatlıq qeyd ~3000 tokendir. Çox istifadəçi heç nə xərcləmir - 30 tokenlik günlük pulsuz pul qısa kliplər, səs qeydləri və bir dəfəlik podcastləri əhatə edir. Bundan başqa, transkripsiya $1-dan başlayaraq token yükləmələri ilə istifadə etdiyiniz kimi ödəyirsiniz.

Bəli — həm segment səviyyəli (hər ~10-30 saniyədə) həm də söz səviyyəli vaxt damğaları mövcuddur. Söz səviyyəsi VTT/SRT altyazıları ixrac etmək üçün ön qurğudur, buna görə də altyazılar sətir-sətir sinxronlaşdırılır. API-də tələbin bədənində timestamps="word"-u təyin et. koreya transkriptləri yerli skriptdə (UTF-8) geri qaytarılır. koreya mətni sözlər arasında boşluq saxlamır; diarizasiya vaxt damğaları danışanların dönmələrində təbii fasilələrə əlavə edir.

Bəli. Audionu (multipart/form-data, sahənin adı "file") language=ko ilə /v1/transcribe/-ə POST et - ya da Whisper-in avtomatik aşkarlamasına imkan vermək üçün dil parametrini burax. Transkript, segmentlər, vaxt damğaları və səsləndirici etiketləri ilə JSON geri qaytarır. Tam istinad və SDK parçaları /api/-dədir.

Bəli — transkripsiya bitdikdən sonra, Tərcümə düyməsini basın və ya mətni /translate/-ə yapışdırın. koreya dəstəklədiyimiz hər hansı bir dillə uyğun gəlir (200+). Toplantı protokolları üçün transkripsiya /summarize/-ə göndərilir; dublaj üçün isə /voice/tts/-ə göndərilir ki, audio məqsəd dili ilə göstərilsin.

Whisper 680K saatlıq səsli real dünya səsi ilə təlim edilmişdir, buna görə də koreya transkripsiya fon səslərinə, musiqi yataqlarına və telefon keyfiyyətli qeydlərə qarşı güclüdür. Çoxlu kəsmə və ya çoxlu üst-üstə düşən səsləndiricilər dəqiqliyi hələ də pozur.Əgər transkript istifadə edilməmiş halda geri gəlsə, contact@free.ai ünvanına faylla birlikdə e-poçt göndərin — biz sizə tokenləri geri qaytaracağıq və başqa bir motorun sizin audionuzu daha yaxşı idarə edə biləcəyini görəcəyik.

Free.ai-i sevirsiniz? Dostlarınıza deyin!

Bu səhifəni qiymətləndir