PDF OCR

Komerční využití OK 380+ modely Žádné vodoznaky. Není třeba se zaregistrovat
Vzor:
+ GPT-5, Claude, Gemini
Proměňte naskenovaný PDF do vybraného, vyhledávaného textu. Rastrizuje každou stránku na 200 DPI a spouští OCR și vybrat Tesseract (rychlé, volné), GOT-OCR2 (lepší pro vícesloupce + tabulky), nebo prémiové Fal OCR (nejlépe pro degradované / historické skeny). Výstup jako.txt,.docx, nebo stránka-značeno text. Máte obrázek, ne PDF? Použít /okr / →

Přetáhněte zde naskenovaný PDF nebo klikněte na nahrát

PDF až do 50 MB. Pracuje na skenovaných PDF pouze pro obraz. Již textově volitelné? Nepotřebujete OCR.

·
Tento PDF již má volitelný text, který nemusíte potřebovat OCR. Zkuste Summarizer →
Nejdřív to odemkněte heslem chráněným heslem. Odemknout PDF →
Teserakt pro čisté tištěné skenování. GOT-OCR2 pro vícesloupné papíry + asijské skripty. Premium pouze v případě, že každý pixel záleží.
Jazykové rychlosti Tesseract 2-3× a zvyšuje přesnost 30-50% na nelatinských skriptech.
Tento odhad je uveden v tabulce 1.
Koupit žetony
Nahrát PDF vidět přesné náklady.
Výsledek OCR
Stáhnout

        

Kdy používat PDF OCR

Faktury + příjmy

Proměňte stoh naskenovaných faktur do editovatelného textu pro účetnictví, proplacení nebo automatizaci AP.

Staré knihy + archivy

Kopírovat mimotiskové knihy, historické dokumenty nebo knihovní archivy do vyhledávaného textu.

Právní + lékařské záznamy

Odemkněte text uvnitř naskenovaných souborů případů, lékařských zpráv nebo faxovaných dokumentů pro objev + eDiscovery pracovní postupy.

Před překladem

Spusťte OCR pro extrahování textu, pak nakrmte výsledek do /pdf/translator/ pro jakoukoliv jazykovou konverzi.

Free.ai PDF OCR vs. placené nástroje

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Vyvolávací cenaVolné$19.99/mo$199 one-time$9/mo
Vyberte OCR motor (3)
Jazyky100+40+200+20+
Veřejné API
Pracuje bez registrace
Pokročilé možnosti
Výsledek
Tokeny docházejí. Získejte více žetonů
Chceš lepší výsledky? Premium modely (GPT-5, Claude, Gemini) poskytovat vyšší kvalitu. Zobrazit plány

Zpracovávám vaši žádost...

Proměňte naskenované PDF do vybraného, vyhledávaného textu. Teserakt, GOT-OCR2, a prémiové OCR motory. 99 jazyků. Zdarma.

Jak se používá PDF OCR

1
Zadejte svůj vstup

Zadejte text, nahrajte soubor nebo popište, co chcete. Žádný účet nepotřebujete.

2
Klikněte na generovat

Naše UI zpracovává váš požadavek během několika sekund pomocí nejlepších open-source modelů.

3
Stáhnout & podíl

Stáhnout, zkopírovat nebo sdílet svůj výsledek. Volný pro osobní a komerční použití.

Použijte tento nástroj přes API

Automatizovat tento nástroj z vašeho vlastního kódu. OpenAI kompatibilní REST koncového bodu, Bearer-token auth, není potřeba žádný SDK navíc. Token náklady odpovídají webové rozhraní.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR — FAQ

Proměňte naskenované PDF (pouze pro obraz, nevybraný text) do prohledatelného, kopírovatelného, UI čitelného textu. Nahrajte PDF naskenovaných stránek, faktur, smluv, starých knih, ručně psaných poznámek a získejte zpět prostý text,.docx, nebo text s číslem stránky.

O 500 žetonů na stránku na naší self-hosted Tesseract OCR (free-tier). GOT-OCR2 náklady ~800/page a zvládá komplexní rozložení (multi-colum, tabulky, rovnice) lépe. Premium fal OCR běží ~2,500/page pro nejvyšší přesnost na degradovaných skenerech. 800-token podlaha na všech třech tak 1-stránkové nahrávky nejsou čisté nad hlavou.

Tesseract (výchozí, zdarma) pro čisté tištěné skeny. GOT-OCR2 (zdarma, pomaleji) pro multi-sloupové výzkumné dokumenty, vědecké rovnice, nebo asijské-jazykové dokumenty díry?, má mnohem lepší rozložení modelu. Premium fal OCR pouze pro degradované / nízké-rozlišování / historické skeny, kde každý pixel záleží.

Tesseract podporuje 100+ jazyků včetně latiny, čínštiny, japonštiny, korejštiny, arabštiny, cyrillic, hebrejštiny, hindštiny, thajštiny, vietnamštiny. Pošlete nápovědu k jazyku (eng/spa/fra/deu/jpn/chi_sim/ara/etc.) pro 30-50% lepší přesnost Auto-detekce díla, ale je pomalejší.

Za třetí:.txt (plain, one file for the whole document),.docx (Word with page breaks reserved), a page-wise.txt (= Page N == headers between page so you can find a specific page in the output).

Na čistých 300-DPI skenech, 99%+ na tištěném latinském skriptu. Drops na 90-95% na 150-DPI skenování, vybledlé dokumenty, nebo rukopis. Non-latin skripty (Čína, Arabština, Hindi) dělat mnohem lépe s jazykovým nápovědou a GOT-OCR2 spíše než Tesseract.

Rukopis OCR je mnohem tvrdší než tištěný text. Očekává se 70-85% přesnost i na prémiovém OCR. Pro čisté ručně tištěné formuláře (nikoli kurzivní) na bílém papíru, Tesseract je použitelný. Pro kurzivní / nepořádné poznámky, prémiový fal OCR s rukopisem režimu je spolehlivější.

Okolo 1-3 sekundy na stránce na Tesseractu, 3-5 sekund na GOT-OCR2, 5-10 sekund na prémiovém fal. 50-stránkový skenovaný kniha trvá 1-3 minuty, těžký-task banner vám umožní zavřít kartu a dostat výsledek e-mailem, když skončí.

Ne. Uploadované PDF jsou rasterizovány, OCRed stránka po stránce, pak smazány. Výstupní soubor je uložen na našem CDN po dobu 24 hodin (7 dní na placeném plánu) na odkaz share.

Ne přímo. Odemkněte ji na /pdf/odemknout/ nejprve (pokud máte heslo), pak se vraťte. Při nahrávání detekujeme šifrování a propojíme vás k odemčenému nástroji.

Free.ai je zdarma, nabízí 3 OCR motory (pick by doc type), podporuje 99 jazyků, a lodě veřejné API. Adobe Acrobat Pro ($19.99/mo, 1 motor), ABBYY FineReader ($199 jednorázově, bez API), Smallpdf ($9/mo, 1 motor). Naše OCR kvalita na čistých skenerech odpovídá Adobe; na historických skenerech prémiové fal rivaly ABBYY.

Ano POST multipart to /v1/pdf/ocr/ with file + language + model + output_format fields. Quote endpoint: /v1/pdf/ocr-quote/?pages=N&model=M. Full curl recept at /api/.

Zaregistrujte se zdarma pro 30 000 žetonů

Vytvořit volný účet

Kreditní karta není nutná

Jak byste ohodnotili tento nástroj?

Love this tool? Share it!