Laisvas telugų perrašymas

Atsekti telugų garso ir vaizdo tekstą su AI. Greitas, tikslus ir nemokamas.

Kaip tai veikia

  1. Eikite į Free.ai Transkrastų
  2. Iškelkite savo telugų garso ar vaizdo failą
  3. Mūsų AI automatiškai aptinka telugų ir jį perrašo
  4. Atsisiųskite stenogramą kaip tekstą arba SRT subtitrus

telugų perrašymo savybės

  • ✓Galioja faster-whisper (MIT licencijuota)
  • ✓Automatinis telugų kalbos aptikimas
  • ✓Palaiko MP3, WAV, MP4, M4A, FLAC, ir daugiau
  • ✓Laikraščiai ir subtitrai eksportui (SRT)
  • ✓Nėra apmokėtų planų failų dydžio ribų
  • ✓Privatūs ir saugūs -- failai ištrinami po apdorojimo

Kalbos detalės

Kalbatelugų
ISO kodaste
AI modelisfaster-whisper
KainaLaisva

Daugiau kalbų

Rodyti visas kalbas

DUK

telugų yra vidurinės dalies kalba Whisper - dideliems V3-turbo žemėms 15-25% žodžių klaidų dažnio juostoje. Tranzito turinys yra patikimas; tikėtis pavadinimų klaidų, retkarčiais koduotės ir trumpo ištarimo klaidų. Planuokite žmogaus leidimą leidybai-kokybės.(Tier C, 15-25% word error rate etalonų rinkinių - skelbiame sąžiningas WER pakopas, o ne rinkodaros pretenzijas.)

Taip - telugų Transkripcija atkreipiamas iš savo kasdienio nemokamo žetonų baseinas pirmas. Garso kaina apie 50 žetonų per minutę, todėl anoniminis dienos baseinas apima kelias valandas garso per dieną. Pasirašyta-į sąskaitas gauti didesnį 30,000-token dienos baseinas. Praeityje, kad transkripcija yra pay-as-you-go, su žetonų papildymai nuo $ 1.

telugų rašteliai grąžinami standartiniuose UTF-8 su įprasta kalbos ortografijoje.

MP3, WAV, M4A, FLAC, OGG, OPS, ir WEBM yra priimti tiesiogiai. Vaizdo (MP4, MOV, MKV) mes ištraukiame garso takelių serverio pusėje prieš siunčiant jį į Whisper - jums nereikia konvertuoti nieko sau. Tas pats vamzdynas nepriklausomai nuo šaltinio kalbos, įskaitant telugų.

Anoniminis įkelia dangtelį maždaug 500 MB vienam failui. Pasirašyta paskyra siekia 2 GB. Trukmė nėra kieta - ilgi failai automatiškai užkabinami (30 sekundžių su susiklostymu) ir surišami atgal į vieną transkriptą su nuolatinėmis žymomis. Daugiavalandės telugų įrašai (podcast, pilnos paskaitos, susitikimai) veikia puikiai.

Taip - garsiakalbis diarizacija yra pagal nutylėjimą kiekvienam telugų transkriptui. Išvedimas yra segmentuojamas kaip garsiakalbis 1 / Garsiakalbis 2 / Garsiakalbis 3 su žymekliais, todėl interviu, skydo diskusijos ir susitikimai su daugeliu šalių susirinkimų sugrąžinti. Diarizavimas vyksta su atskiru modeliu ir veikia taip pat visose palaikomose kalbose.

Taip - įklijuokite URL į / trantractor/ youtube/ YouTube arba / tranctor/podcast/ podcast/ podcast kanalus (Apple, Spotify, RSS). Atsisiųskite garso įrašą, paleiskite jį per Whisper su kalba=te ir grąžinkite transkripciją su žymomis ir garsiakalbiais. Tipinis telugų turinys: WhatsApp balso užrašai, "YouTube vlogs", ir trumpo formato vaizdo yra dažniausiai telugų darbo krūviai - įklijuokite URL į / trantracter / youtube / arba įkelkite garso tiesiogiai.

Whisper kainuoja apie 50 žetonų per minutę garso, todėl vienos valandos įrašas yra ~ 3000 žetonų. Dauguma vartotojų niekada išleisti nieko - nemokamas dienos baseinas 30,000 žetonų apima trumpus klipus, balso užrašus ir vienkartinius podcast. Be to, transkripcija yra mokamas kaip jums-go, su simbolių papildymai nuo $ 1.

Taip - galima tiek segmento lygis (kas ~10-30 sekundžių), tiek žodžio lygio žymos. Žodžio lygis yra numatytasis VTT/SRT subtitrai eksportui, todėl antraštės sinchronizuoja eilutę pagal eilę. API set timestamps="word" užklausos institucijoje. telugų rašteliai grąžinami standartiniuose UTF-8 su įprasta kalbos ortografijoje.

Taip. Po garso (daugidalis/ forma-duomenys, lauko pavadinimas "failas") /v1/ trancrate/ su kalba=te - arba praleisti kalbos parametrą, kad Whisper automatiškai nustatyti. Grįžta JSON su stenograma, segmentais, žymomis ir garsiakalbio etiketėmis. Visas nuorodas ir SDK fragmentus ties /api/.

Taip - kai transkripcija baigiasi, spustelėkite Paspauskite arba įklijuokite tekstą į /translate/. telugų poros su kiekviena kita kalba mes palaikome (200+). Norėdami susitikti minučių stenogramą per /summarize/; dublēti siųsti jį į /balsas/ tts/ garso atvaizdavimui tikslinės kalbos.

Whisper triukšmo stiprumas vis dar taikomas telugų, bet šiuo tikslu bet koks papildomas triukšmo lygis sujungia pradinį klaidų lygį. Švarios ausinės garso suteikia pastebimų geresnių rezultatų nei telefonas ar nešiojamieji mac įrašai.Jei transkriptas grįžta nenaudingas, elektroniniu paštu contact@free.ai su failu - mes grąžinti simbolius ir pažvelgti, ar kitas variklis veikia jūsų garso geriau.

Like this tool? Share it!

Įvertinti šį puslapį