GOT-OCR v2

Free.ai · ocr · ~500 znaki na page

Przepuść plik tutaj lub kliknij aby przeglądać

~500 znaki na page
Bezpłatnie działa na naszych GPU. Uaktualnij dla GOT-OCR v2 →

GOT-OCR v2 to a Model OCR. Przeprowadzany przez modele zewnętrzne - ~500 tokeny na stronę (50% marking nad kosztami przestrzennymi).

Użyj przez API

Kompatybilny z OpenAI REST API. Generuj klucz i zadzwoń po ten model w sekundach.

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/got-ocr/v2","prompt":"your prompt here"}'
Dokumentacja API Pobierz klucz API

Często zadawane pytania

GOT-OCR v2 wyciąga tekst z obrazów i PDF. Wysyłka skanowanej strony, zrzut ekranu lub zdjęcie dokumentu i GOT-OCR v2 zwraca tekst - zachowanie przerw linii i (na silnikach) tabele, wzory i strukturę.

GOT-OCR v2 obsługuje dziesiątki skryptów - łaciński, cyrylicowy, CJK, arabski, Devanagari i więcej. /okr/ lądowanie posiada pełną listę językową na silnik.

Tak dla czystego pisania w stylu drukowanym; krzywione i skrótowe są trudniejsze. TrOCR i nowoczesne silniki na bazie transformatora są zauważalnie lepsze niż dziedzictwo Teseract na pisemnym.

Silniki świadome układu (GOT-OCR, Marker, Florence-2) zwracają markdown/HTML tabele i LaTeX dla wzorów. Silniki prostego tekstu zwracają tekst bez struktury – sprawdź tryb wyjścia tego modelu.

GOT-OCR v2 jest pręmiem OCR silnika. Około ~500-1,500 tokena na stronę, pokazane na żywo przed tworzeniem. Samorządzony OCR uruchamia się w bezpłatnym basenie 30 000-taken dziennie; premium modele są pay-as-yo-go, z top-up z $1.

PNG, JPG, WebP, HEIC, BMP, plus jednostraniowe i wielostraniowe PDF do 50 MB. Przeklętane lub obracane strony są automatycznie korekcjonowane przed ekstrakcją.

Dokładność znaków jest zwykle > 98% na czystych drukowanych stronach, obniżenie na niskopasmowych zdjęciach, ciężko skanowane skanowanie lub niezwykłe czcionki. Porównaj silniki na /okr/porównaj/ w przypadku dokładności.

Tak - /batch/ akceptuje folder obrazów/PDF. Każda ekstrakcja poławia się w / account /?tab=history. Dla zachowania folderów- drewna używaj API.

Tak - POST Twój plik do /v1/okr/ z modelem=" GOT-OCR v2". Zwraca JSON z tekstem + (jeżeli jest obsługiwany) układ + ramki ramowe. /api/ ma pełne odniesienie.

Samodomowe modele trzymaj pliki na naszych GPU; premium przejść z DPA. Dokumenty są usuwane po oknie share-Window. Nie trenujemy na wejściach.

Tak - Free.ai przyznaje komercyjne wykorzystanie wydobytego tekstu. Potrzebujesz praw do dokumentu źródłowego.

Zazwyczaj 1-5 sekund na stronę. Silniki świadome układu (stoły, matematyka) trwają dłużej. Wielostraniowa skala PDF w przybliżeniu liniowa.

Love Free.ai? Tell your friends!

Oceń tę stronę