PDF OCR

Wykorzystanie handlowe OK 380+ modeli Brak znaku wodnego Nie ma potrzeby rejestracji
Wzór:
+ GPT-5, Claude, Gemini
Włącza skanowany PDF w wybrany, wyszukiwany tekst. Rasterizuje każdą stronę w temperaturze 200 DPI i uruchamia OCR – wybierz Tesseract (szybka, za darmo), GOTE-OCR2 (lepsza dla wielokolumnów + tabeli), lub premium fal OCR (najlepsza dla degradowanych / historycznych skanowania). Wyjście jako.txt,.docx lub tekst z oznakowaniem strony. Masz obrazek, a nie PDF? Użyj /okr / →

Przeciągnij tutaj skanowany PDF lub kliknij, aby wysłać

PDF do 50 MB. Pracuje na skanowanych + PDF tylko obraz. Już do wyboru tekstu? Nie potrzebujesz OCR.

·
Ten PDF posiada już wybrany tekst — może nie potrzebować OCR. Spróbuj Summarizer →
Zabezpieczone hasłem — odblokuj go najpierw. Odblokuj PDF →
Tesseract dla czystych wydrukowanych skanów. GOT-OCR2 dla papierów wielokolumnowych + skryptów azjatyckich. Premium tylko wtedy, gdy każdy piksel ma znaczenie.
Wskazówki językowe Tesseract 2-3× i zwiększa dokładność 30-50% w skryptach nielatyńskich.
Szacunek toku
Kup tokeny
Wyślij PDF, aby zobaczyć dokładny koszt.
Wynik OCR
Pobierz

        

Kiedy używać PDF OCR

faktury + rachunki

Przekształcić stos skanowanych faktur w tekst do edycji dla księgowości, zwrotów kosztów lub automatyzacji AP.

Stare książki + archiwa

Cyfruj pozadrukowe książki, historyczne dokumenty lub archiwa biblioteki w wyszukiwany tekst.

Sprawozdanie prawne + dokumentacja medyczna

Odblokuj tekst w plikach skanowanych spraw, raportach medycznych lub faksowanych dokumentach do odkrycia + eDiscovery workflows.

Przed tłumaczeniem

Uruchom OCR, aby wyciągnąć tekst, a następnie przenieść wynik do /pdf/translator / dla konwersji dowolnego języka.

Free.ai PDF OCR w porównaniu z płatnymi narzędziami

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Cena początkowaDarmowe$19.99/mo$199 one-time$9/mo
Wybierz silnik OCR (3)
Języki100+40+200+20+
Publiczny API
Prace bez rejestracji
Zaawansowane opcje
Wynik
Tokiny się skończyły. Zdobądź więcej tokenów
Chcesz lepsze wyniki? Modele premium (GPT-5, Claude, Gemini) dostarcza wyższej jakości. Widok planów

❤️ Love this tool? Share it!

Zaloguj się aby uzyskać link referencyjny i zarobić 25 000 tokenów na przyjaciela.

Chcesz więcej? Zarejestruj się za darmo za 30K tokeny/dzień + 10K bonus
Zarejestruj się za darmo

Przetwarzam twoją prośbę...

Przełącz skanowane PDF w wybrany, wyszukiwany tekst. Tesseract, GOT-OCR2 i premium OCR silniki. 99 języków. Za darmo.

Jak stosować lek PDF OCR

1
Wprowadź swoje wpisy

Wpisz tekst, wyślij plik lub opisz, czego chcesz. Nie jest potrzebne konto.

2
Kliknij wygenerować

Nasz SI przetwarza Twoją prośbę w sekundach przy użyciu najlepszych modeli open-source.

3
Pobierz & dzielenie

Pobierz, kopiuj lub podziel się swoim wynikiem. Darmowe do użytku osobistego i komercyjnego.

Użyj tego narzędzia przez API

Automatyzuj to narzędzie z własnego kodu. Kompatybilny z OpenAI REST punkt końcowy, Authentic-Bearer-token, nie jest wymagany dodatkowy SDK. Koszty token pasują do interfejsu internetowego.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR — FAQ

Przełącz skanowane PDF (tylko, niewybieralny tekst) na wyszukiwane, kopiowane, czytelne teksty SI. Wysyłka PDF z skanowanych stron — faktury, kontrakty, stare książki, notatki ręcznie – i dostać z powrotem zwykły tekst,.docx lub tekst numerowany stroną.

Około 500 tokenów na stronę na naszej samorządzonej Tesseract OCR (free-tier). GOT-OCR2 kosztuje ~800/stranica i obsługuje złożone układy (multi-kolumny, tabele, równania) lepiej. Premium fal OCR działa ~2,500/stranica dla najwyższej dokładności na degradowanych skanowaniach. 800-taken podłoga na wszystkich trzech, więc 1-stranica przesyłania nie są czyste nadgórze.

Tesseract (domyślnie, bezpłatnie) dla czystych drukowanych skanów. GOT-OCR2 (wolne, wolniej) dla wielokolumnowych dokumentów badawczych, równań naukowych lub dokumentów azjatyckich – ma znacznie lepszy model układu. Premium fal OCR tylko dla degradowanych / niskiej rozdzielczości / historycznych skanów, gdzie każdy piksel ma znaczenie.

Tesseract obsługuje 100+ języków, w tym języki łacińskie, chińskie, japońskie, koreańskie, arabskie, cyrylickie, hebrajskie, hinduskie, tajskie, wietnamskie. Przekaż wskazówkę językową (eng/spa/fra/deu/jpn/chi_sim/ara/etc.) dla 30-50% lepszej dokładności — wykrywanie dzieł, ale jest wolniejsze.

Trzecie:.txt (plain, jeden plik dla całego dokumentu),.docx (Word z przerwami strony zachowane) oraz strona.txt (=== Strona N == nagłówki między stronami, tak aby można było znaleźć w wyjściu określoną stronę).

Na czystym skanowaniu 300-DPI, 99%+ na wydrukowanym skryptie łacińskim. Spadnie do 90-95% na 150-DPI skanowaniach, wyblakłych dokumentach lub pisaniu. Nielatyńskie skrypty (chiński, arabski, hinduski) robią o wiele lepiej z wskazówką językową i GOT-OCR2 zamiast Tesseract.

Ręczne pisanie OCR jest znacznie trudniejsze niż wydrukowany tekst — oczekuj 70-85% dokładności nawet na premium OCR. Dla czystych ręcznie drukowanych formularzy (nie krążące) na białej księgi, Tesseract jest przydatny do użytku. Dla rysowania / bałagan, premium fal OCR z trybem pisania jest bardziej wiarygodny.

Około 1-3 sekundy na stronę Tesseract, 3-5 sekund na GOT-OCR2, 5-10 sekund na fali premium. Skanowana książka 50 stron trwa 1-3 minuty — baner ciężkich zadań pozwala zamknąć zakładkę i dostać wynik e-mailem po zakończeniu.

Nie. Wysłane PDF są rastroryzowane, OCRed strona po stronach, następnie usunięte. Plik wyjściowy jest przechowywany na naszym CDN przez 24 godziny (7 dni w planie płatnym) na odnośniku share.

Nie bezpośrednio. Odblokuj najpierw pod adresem /pdf/unlock/ (jeżeli masz hasło), wracaj. Wykrywamy szyfrowanie przy wysyłaniu i łączymy cię z narzędziem odblokowania.

Free.ai jest bezpłatny, oferuje 3 silniki OCR (wybierz według typu doc), obsługuje 99 języków i stawia publiczny API. Adobe Acrobat Pro (19.99/mo, 1 silnik), ABBYY FineReader (199 raz, bez API), Smallpdf (9/mo, 1 silnik). Nasza jakość OCR na czystym skanowaniu pasuje do Adobe; na historycznych skanowania premium fal rywali ABBYY.

Tak — POST multipart do /v1/pdf/okr/ z plikiem + język + model + wyjściowy_ format. Cytat końcowy punkt końcowy: /v1/pdf/okr-quote /?pages=N&model=M. Pełny przepis w curl w /api /.

Zarejestruj się bezpłatnie na 30 000 tokenów

Utwórz bezpłatne konto

Karta kredytowa nie jest wymagana

Jak mógłbyś ocenić to narzędzie?

Love this tool? Share it!