Laisvas šonų perrašymas

Perrašyti šonų garso ir vaizdo įrašą į tekstą naudojant AI. Greitas, tikslus ir nemokamas.

Kaip tai veikia

  1. Eikite į Free.ai Transkrastų
  2. Iškelkite šonų garso ar vaizdo failą
  3. Mūsų AI automatiškai aptinka šonų ir perrašo ją
  4. Atsisiųskite stenogramą kaip tekstą arba SRT subtitrus

šonų perrašymo savybės

  • Galioja faster-whisper (MIT licencijuota)
  • Automatinis šonų kalbos nustatymas
  • Palaiko MP3, WAV, MP4, M4A, FLAC, ir daugiau
  • Laikraščiai ir subtitrai eksportui (SRT)
  • Nėra apmokėtų planų failų dydžio ribų
  • Privatūs ir saugūs -- failai ištrinami po apdorojimo

Kalbos detalės

Kalbašonų
ISO kodassn
AI modelisfaster-whisper
KainaLaisva

Daugiau kalbų

Rodyti visas kalbas

DUK

šonų yra mažiau resourced kalba Whisper – didelis-v3-turbo sėdi daugiau kaip 25% žodžio klaidų dažnis, kartais gerokai aukščiau. Tranzitas yra naudingas paieškai ir gist, bet neturėtų būti traktuojamas kaip leidimui paruoštas. Jei yra aukštesnės tikslumo variklio šonų mes laiduojame jį automatiškai.(Tier D, over 25% word error rate lyginamųjų indeksų rinkiniuose – skelbiame sąžiningas WER pakopas, o ne rinkodaros reikalavimus.)

Taip — šonų Transkripcija pirmiausiai patraukia iš savo kasdienio nemokamo žetonų fondo. Garso kaina yra apie 50 žetonų per minutę, todėl anoniminis dienos baseinas apima kelias valandas garso per dieną. Pasirašyta-į sąskaitas gauna didesnį 30,000-token dienos baseinas. Praeityje, kad transkripcija yra pay-as-you-go, su žetonų papildymai nuo $ 1.

šonų transkriptai grąžinami standartinėje UTF-8 su normalia kalbos ortografija.

MP3, WAV, M4A, FLAC, OGG, OPUS, ir WEBM yra priimami tiesiogiai. Vaizdo (MP4, MOV, MKV) ištraukiame garso takelių serverio pusę prieš siunčiame jį į Whisper - jums nereikia konvertuoti nieko sau. Tas pats vamzdynas nepriklausomai nuo šaltinio kalbos, įskaitant šonų.

Anoniminis įkelia dangtelį maždaug 500 MB vienam failui. Pasirašyta paskyra siekia iki 2 GB. Trukmė nėra didelė — ilgi failai automatiškai komplektuojami (30 sekundžių su sutapimu) ir surišti atgal į vieną transkriptą su nuolatinėmis žymomis. Daugiavalandiai šonų įrašai (podcasts, pilnos paskaitos, susitikimai) veikia gerai.

Taip — garsiakalbio diarizacija yra pagal nutylėjimą už kiekvieną šonų transscript. Rezultatas yra segmentuojamas kaip Garsiakalbis 1 / Garsiakalbis 2 / Garsiakalbis 3 su timestamp reikšmėmis, todėl interviu, skydo diskusijos, ir daugiapartijų susitikimai grįžti žymėti. Diarizacija vyksta su atskiru modeliu ir veikia vienodai visose kalbose mes palaikome.

Taip — įklijuokite URL į / transkripcija/ youtube/ YouTube arba / transkripcija/podcast/ podcast/ podcast kanalus (Aplikacija, Spotify, RSS). Atsisiunčiame garsą, paleiskite jį per Whisper kalba=sn ir grąžinkite transkripciją su žymomis ir garsiakalbiais. Tipinis šonų turinys: paskaitos, interviu, balso užrašai, ir "YouTube" turinys šonų visi darbai — įdėti URL į / transliuoti / youtube / arba įkelti failą tiesiogiai.

Whisper kainuoja apie 50 žetonų per minutę garso, todėl vienos valandos įrašas yra ~ 3000 žetonų. Dauguma naudotojų niekada nieko neišleidžia — nemokamas dienos baseinas, kurį sudaro 30,000 žetonų, apima trumpus klipus, balso užrašus ir vienkartinius podcast diskus. Be to, transkripcija yra mokama kaip jums patinkantis, su simboliais papildymais nuo $ 1.

Taip — yra tiek segmento lygis (kas ~10-30 sekundžių), tiek žodžio lygio žymos. Žodžių lygis yra numatytasis VTT/SRT subtitrų eksportui, todėl antraštės sinchronizuoja eilutę pagal eilę. API set žymos="žodis" užklausoje institucijoje. šonų transkriptai grąžinami standartinėje UTF-8 su normalia kalbos ortografija.

Taip. Po garso (daugiadalis/forma-duomenys, lauko pavadinimas "failas") /v1/tractor/ su kalba=sn – arba praleisti kalbos parametrą, kad Whisper automatiškai nustatyti. Grįžta JSON su stenograma, segmentai, žymos, ir garsiakalbio etiketėmis. Visas nuoroda ir SDK fragmentai ties /api/.

Taip — kai transkripcija baigiasi, spustelėkite Paspauskite arba įklijuokite tekstą į /translate/. šonų poros su kiekviena kita kalba, mes palaikome (200+). Norėdami susitikti minučių stenogramą per /summarize/; dubbbing siųsti jį į /balsas/ tts/ padaryti garso tikslinės kalbos.

Whisper's Triukšmo mokymas padeda mažiau šioje pakopoje — pertrauka yra suma šonų Audio Whisper mačiau mokymo metu, o ne triukšmo. Švarus studija audio vis dar dūžta triukšmingas garso, bet taip pat nebus pasiektas tikslumas jums būtų gauti didelio šaltinio kalba.Jei transkriptas grįžta nenaudingas, el. paštas contact@free.ai su failu – mes grąžinti simbolius ir pažvelgti, ar kitas variklis veikia jūsų garso geriau.

Like this tool? Share it!

Įvertinti šį puslapį