Darmowe gruziński Transcription

Transscribe gruziński audio i video do tekstu za pomocą AI. Szybka, dokładna i bezpłatna.

Jak działa

  1. Idź do Free.ai Transkreber
  2. Wyślij plik audio lub wideo gruziński
  3. Nasz AI automatycznie wykrywa gruziński i przepisuje go
  4. Pobierz transkrypcję jako tekst lub napisy SRT

gruziński Właściwości przepisu

  • Zasilane przez faster-whisper (z licencji MIT)
  • Automatyczne wykrywanie języka gruziński
  • Wsparcie MP3, WAV, MP4, M4A, FLAC i więcej
  • Czasy i eksport napisów (SRT)
  • Brak ograniczeń w zakresie wielkości pliku w planach płatnych
  • Prywatne i bezpieczne -- pliki są usuwane po przetwarzaniu

Szczegóły językowe

Językgruziński
Kod ISOka
Model AIfaster-whisper
CenaDarmowe

Więcej języków

Wyświetl wszystkie języki

FAQ

gruziński jest językiem mniej źródłowym dla Whisper — duży-v3-turbo znajduje się powyżej 25% błędów słów, czasami znacznie powyżej. Transkrypcja jest przydatna do wyszukiwania i wyszukiwania, ale nie powinna być traktowana jako gotowa do publikacji. Jeśli silnik wyższej dokładności staje się dostępny dla gruziński my podłączymy go automatycznie.(Tierma D, over 25% word error rate na zestawach porównawczych – publikujemy uczciwe poziomy WER zamiast roszczeń marketingowych.)

Tak — gruziński transkrypcja pobiera najpierw z codziennego bezpłatnego tokena. Audio kosztuje około 50 tokenów na minutę, więc anonimowy dzienny basen obejmuje kilka godzin audio dziennie. Podpisane konta otrzymują większe 30 000 token dzienny basen. Mimo to, transkrypcja jest pay-as-yo-Go, z tokenem top-up z $1.

gruziński transkrypty są zwracane w standardowym UTF-8 z normalną ortografią języka.

MP3, WAV, M4A, FLAC, OGG, OPUS i WEBM są akceptowane bezpośrednio. Dla wideo (MP4, MOV, MKV) wyciągamy ze strony serwera audio przed wysłaniem go do Whisper — nie musisz nic konwertować sam. Ten sam rurociąg niezależnie od języka źródłowego, w tym gruziński.

Anonimowe wysyłanie kapsułki przy przybliżeniu 500 MB za plik. Podpisane konta przechodzą do 2 GB. Czas trwania nie jest twardym ograniczeniem – długie pliki są rozdzielane automatycznie (30-sekundowe okna z nakładem) i zszyte z powrotem do jednego transkryptu z ciągłymi czasami. Wielogodzinne gruziński nagrania (podkasta, pełne wykłady, spotkania) działają dobrze.

Tak — diaryzacja głośnika jest domyślna dla każdego gruziński transkrypt. Wyjście jest segmentowane jako głośnik 1 / głośnik 2 / głośnik 3 z czasowymi symptomy, więc wywiady, dyskusje panelowe i spotkania wielostronne pojawiają się na etykiecie. Diaryzacja działa na odrębnym modelu i pracuje tak samo we wszystkich językach, które wspieramy.

Tak — wklej URL do /transcribe/youtube/ dla YouTube lub /transcribe/podcast/ dla podcast paszy podcast (Apple, Spotify, RSS). Pobieramy audio, uruchamiamy przez Whisper z językiem=ka i zwracamy transkrypcję z etykietami czasowymi i głośnika. Typowa zawartość gruziński: wykłady, wywiady, notatki głosowe i zawartość YouTube w gruziński wszystkie prace — wklej URL do /transcribe/youtube / lub prześlij plik bezpośrednio.

Whisper kosztuje około 50 tokenów na minutę, więc jednogodzinne nagranie to ~3 000 tokenów. Większość użytkowników nigdy nie wydaje nic — bezpłatny dzienny basen z 30 000 tokenów obejmuje krótkie klipy, notatki głosowe i jednorazowe podcasty. Poza tym transkrypcja jest pay-as-yo-go, z tokenem top-up z $1.

Tak — zarówno poziom segmentu (każdy ~10-30 sekund) jak i czasowy poziom słowa są dostępne. Poziom słowa jest domyślnym dla eksportu podtytułów VTT/SRT, tak że podpisy synchronizują się w kolejce po linii. W zestawie API czasowe znaki czasowe=" słowo" w organizmie zapytania. gruziński transkrypty są zwracane w standardowym UTF-8 z normalną ortografią języka.

Tak. audio POST (multipart/form-data, nazwa pola "file") do /v1/transcribe/ z językiem=ka — lub ominąć parametr języka, aby pozwolić Whisper auto-detektować. Zwraca JSON z transkrypcją, segmentami, czasami i etykietami głośnika. Pełne odniesienie i SDK sripets at /api /.

Tak — po zakończeniu transkrypcji kliknij Przetłumacz lub wklej tekst do /Tłumacz /. gruziński pary z każdym innym językiem, który obsługujemy (200+). Na spotkanie minut przelej transkrypcję przez /summarize /; za dubbing wyślij go do /voice/tts /, aby wyświetlić dźwięk w języku docelowym.

Szepczący trening hałasu pomaga mniej na tym poziomie – wąska jest ilością gruziński audio Whisper piłka podczas treningu, a nie hałasu. Czyste studio audio nadal bije głośne dźwięki, ale nie osiągnie dokładności, którą dostaniesz w języku wysokiego źródła.Jeśli transkrypta wróci nieużyteczny, email contact@free.ai z plikiem – zwrócimy tokeny i sprawdzimy, czy inny silnik obsługuje dźwięk lepiej.

Love this tool? Share it!

Oszacuj tę stronę