Laisvas italų perrašymas
Perrašyti italų garso ir vaizdo įrašą į tekstą naudojant AI. Greitas, tikslus ir nemokamas.
Kaip tai veikia
- Eikite į Free.ai Transkrastų
- Iškelkite italų garso ar vaizdo failą
- Mūsų AI automatiškai aptinka italų ir perrašo ją
- Atsisiųskite stenogramą kaip tekstą arba SRT subtitrus
italų perrašymo savybės
- ✓Galioja faster-whisper (MIT licencijuota)
- ✓Automatinis italų kalbos nustatymas
- ✓Palaiko MP3, WAV, MP4, M4A, FLAC, ir daugiau
- ✓Laikraščiai ir subtitrai eksportui (SRT)
- ✓Nėra apmokėtų planų failų dydžio ribų
- ✓Privatūs ir saugūs -- failai ištrinami po apdorojimo
Kalbos detalės
| Kalba | italų |
| ISO kodas | it |
| AI modelis | faster-whisper |
| Kaina | Laisva |
Daugiau kalbų
Rodyti visas kalbasDUK
Whisper didelis-v3-turbo žemės savo aukščiausio tikslumo pakopoje italų - iki 7% žodžio klaidų dažnis standartinių etalonų. Praktikoje tai reiškia, kad švari studija garso grįžta beveik tobulas, ir pokalbių garso yra naudojamas su minimaliu valymas.(Tier A, under 7% word error rate lyginamųjų indeksų rinkiniuose – skelbiame sąžiningas WER pakopas, o ne rinkodaros reikalavimus.)
Taip — italų Transkripcija pirmiausiai patraukia iš savo kasdienio nemokamo žetonų fondo. Garso kaina yra apie 50 žetonų per minutę, todėl anoniminis dienos baseinas apima kelias valandas garso per dieną. Pasirašyta-į sąskaitas gauna didesnį 30,000-token dienos baseinas. Praeityje, kad transkripcija yra pay-as-you-go, su žetonų papildymai nuo $ 1.
italų transkriptai grąžinami standartinėje UTF-8 su normalia kalbos ortografija.
MP3, WAV, M4A, FLAC, OGG, OPUS, ir WEBM yra priimami tiesiogiai. Vaizdo (MP4, MOV, MKV) ištraukiame garso takelių serverio pusę prieš siunčiame jį į Whisper - jums nereikia konvertuoti nieko sau. Tas pats vamzdynas nepriklausomai nuo šaltinio kalbos, įskaitant italų.
Anoniminis įkelia dangtelį maždaug 500 MB vienam failui. Pasirašyta paskyra siekia iki 2 GB. Trukmė nėra didelė — ilgi failai automatiškai komplektuojami (30 sekundžių su sutapimu) ir surišti atgal į vieną transkriptą su nuolatinėmis žymomis. Daugiavalandiai italų įrašai (podcasts, pilnos paskaitos, susitikimai) veikia gerai.
Taip — garsiakalbio diarizacija yra pagal nutylėjimą už kiekvieną italų transscript. Rezultatas yra segmentuojamas kaip Garsiakalbis 1 / Garsiakalbis 2 / Garsiakalbis 3 su timestamp reikšmėmis, todėl interviu, skydo diskusijos, ir daugiapartijų susitikimai grįžti žymėti. Diarizacija vyksta su atskiru modeliu ir veikia vienodai visose kalbose mes palaikome.
Taip — įklijuokite URL į / transkripcija/ youtube/ YouTube arba / transkripcija/podcast/ podcast/ podcast kanalus (Aplikacija, Spotify, RSS). Atsisiunčiame garsą, paleiskite jį per Whisper kalba=it ir grąžinkite transkripciją su žymomis ir garsiakalbiais. Tipinis italų turinys: Podcast, paskaitos, interviu ir ilgaformis "YouTube" turinys italų yra labiausiai paplitęs darbo krūvis mes matome.
Whisper kainuoja apie 50 žetonų per minutę garso, todėl vienos valandos įrašas yra ~ 3000 žetonų. Dauguma naudotojų niekada nieko neišleidžia — nemokamas dienos baseinas, kurį sudaro 30,000 žetonų, apima trumpus klipus, balso užrašus ir vienkartinius podcast diskus. Be to, transkripcija yra mokama kaip jums patinkantis, su simboliais papildymais nuo $ 1.
Taip — yra tiek segmento lygis (kas ~10-30 sekundžių), tiek žodžio lygio žymos. Žodžių lygis yra numatytasis VTT/SRT subtitrų eksportui, todėl antraštės sinchronizuoja eilutę pagal eilę. API set žymos="žodis" užklausoje institucijoje. italų transkriptai grąžinami standartinėje UTF-8 su normalia kalbos ortografija.
Taip. Po garso (daugiadalis/forma-duomenys, lauko pavadinimas "failas") /v1/tractor/ su kalba=it – arba praleisti kalbos parametrą, kad Whisper automatiškai nustatyti. Grįžta JSON su stenograma, segmentai, žymos, ir garsiakalbio etiketėmis. Visas nuoroda ir SDK fragmentai ties /api/.
Taip — kai transkripcija baigiasi, spustelėkite Paspauskite arba įklijuokite tekstą į /translate/. italų poros su kiekviena kita kalba, mes palaikome (200+). Norėdami susitikti minučių stenogramą per /summarize/; dubbbing siųsti jį į /balsas/ tts/ padaryti garso tikslinės kalbos.
Whisper yra mokoma 680K valandas triukšmingo garso realiame pasaulyje, todėl italų transkripcija yra tvirta fono triukšmo, muzikos lovų ir telefono kokybės įrašus. Sunkus kirpimas ar daug persidengiančių garsiakalbių vis dar pakenks tikslumą.Jei transkriptas grįžta nenaudingas, el. paštas contact@free.ai su failu – mes grąžinti simbolius ir pažvelgti, ar kitas variklis veikia jūsų garso geriau.