PDF OCR

Komerčné použitie OK 380+ modelov Žiadny vodoznak Nie je potrebná registrácia
Model:
+ GPT-5, Claude, Gemini
Premeňte naskenovaný PDF súbor na text, ktorý môžete vybrať a prehľadávať. Rastruje každú stranu pri rozlíšení 200 DPI a spúšťa OCR – vyberte si Tesseract (rýchly, bezplatný), GOT-OCR2 (lepší pre viacstĺpcové tabuľky) alebo prémiové fal OCR (najlepšie pre degradované / historické skeny). Máte obrázok, nie PDF? Použite /ocr/ →

Pretiahnite naskenovaný PDF súbor sem alebo kliknite na nahratie

PDF do 50 MB. Funguje na naskenovaných PDF + iba s obrázkami. Už je možné vybrať text? Nepotrebujete OCR.

·
Tento dokument PDF už obsahuje text, ktorý je možné vybrať – nemusíte potrebovať OCR. Vyskúšajte Summarizer →
Chránené heslom — najprv ho odomknite. Odomknúť PDF →
Tesseract pre čisté skenované výtlačky. GOT-OCR2 pre viacstĺpcové papiere + ázijské písmo.Premium len vtedy, keď záleží na každom pixeli.
Jazyková nápoveda zrýchľuje Tesseract 2-3× a zvyšuje presnosť o 30-50% na ne-latinských písmach.
Odhad počtu tokenov
Kúpiť žetóny
Nahrajte PDF a pozrite si presnú cenu.
Výsledok OCR
Stiahnuť

        

Kedy používať PDF OCR

Faktúry + príjmy

Premeňte stoh naskenovaných faktúr na upraviteľný text pre účtovníctvo, refundácie alebo automatizáciu AP.

Staré knihy + archívy

Digitalizujte vypredané knihy, historické dokumenty alebo knižničné archívy do prehľadávateľného textu.

Právne a lekárske záznamy

Odomknite text v naskenovaných súboroch prípadov, lekárskych správach alebo faxovaných dokumentoch pre pracovné postupy vyhľadávania a elektronického vyhľadávania.

Pred prekladom

Spustite OCR na extrakciu textu a potom vložte výsledok do /pdf/translator/ pre konverziu z ľubovoľného jazyka do ľubovoľného jazyka.

Free.ai PDF OCR vs platené nástroje

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
100 € Vyvolávací cenaVoľný$19.99/mo$199 one-time$9/mo
Vyberte OCR engine (3)
Jazyky100+40+200+20+
Verejné rozhranie API
Funguje bez registrácie
Rozšírené možnosti
Výsledok
Žetóny sa míňajú. Získať viac žetónov
Chcete lepšie výsledky? Prémiové modely 2018 (GPT-5, Claude, Gemini) poskytujú vyššiu kvalitu. Zobraziť plány

❤️ Milujete Free.ai? Povedzte svojim priateľom!

Zaregistruj sa a získaj odporúčací odkaz a získaj 25 000 žetónov za priateľa.

Chcete viac? Zaregistrujte sa zdarma pre 30K žetónov/deň + 10K bonus
Zaregistrujte sa zdarma

Spracovávam vašu požiadavku...

Premeňte naskenované PDF súbory na vybrateľný text s možnosťou vyhľadávania. Tesseract, GOT-OCR2 a prémiové nástroje OCR. 99 jazykov.

Ako používať PDF OCR

1
Zadajte svoj vstup

Zadajte text, nahrajte súbor alebo popíšte, čo chcete. Nie je potrebné žiadne konto.

2
Kliknite na generovať

Naša UI spracuje vašu požiadavku v priebehu niekoľkých sekúnd pomocou najlepších open-source modelov.

3
Stiahnuť & zdieľať

Stiahnite si, skopírujte alebo zdieľajte svoj výsledok. Zdarma pre osobné a komerčné použitie.

Použite tento nástroj cez API

Automatizujte tento nástroj z vlastného kódu. Koncový bod REST kompatibilný s OpenAI, overenie tokenom nosiča, nie je potrebná žiadna ďalšia súprava SDK.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR — FAQ

Nahrajte PDF súbor naskenovaných strán – faktúr, zmlúv, starých kníh, ručne písaných poznámok – a získajte späť obyčajný text,.docx alebo text s číslovaním strán.

Približne 500 tokenov na stránku na našom vlastnom hosťovanom Tesseract OCR (bezplatná úroveň). GOT-OCR2 stojí ~ 800 / stránku a lepšie zvláda komplexné rozloženia (viac stĺpcov, tabuľky, rovnice). Prémiový fal OCR beží ~ 2 500 / stránku pre najvyššiu presnosť na degradovaných skenoch. 800-tokenový strop na všetkých troch, takže 1-stranové nahrávanie nie je čistá režia.

Tesseract (predvolené, bezplatné) pre čisté tlačené skeny. GOT-OCR2 (bezplatné, pomalšie) pre viacstĺpcové výskumné práce, vedecké rovnice alebo dokumenty v ázijských jazykoch — má oveľa lepší model rozloženia. Prémiové fal OCR len pre degradované / nízke rozlíšenie / historické skeny, kde záleží na každom pixeli.

Tesseract podporuje viac ako 100 jazykov vrátane latinky, čínštiny, japončiny, kórejčiny, arabčiny, cyriliky, hebrejčiny, hindčiny, thajčiny, vietnamčiny.Predajte nápovedu jazyka (eng/spa/fra/deu/jpn/chi_sim/ara/atď.) pre 30-50% lepšiu presnosť - automatická detekcia funguje, ale je pomalšia.

Tri:.txt (jednoduchý, jeden súbor pre celý dokument),.docx (Word so zachovanými zlomami strán) a.txt pre každú stranu (hlavičky ===== Strana N ===== medzi stranami, aby ste mohli nájsť konkrétnu stranu vo výstupe).

Na čistých skenoch s rozlíšením 300 dpi, 99% + na vytlačenom latinskom písme. klesá na 90-95% na skenoch s rozlíšením 150 dpi, vyblednutých dokumentoch alebo rukopise. ne-latinské písmo (čínština, arabčina, hindčina) sa darí oveľa lepšie s jazykovým návodom a GOT-OCR2 ako Tesseract.

OCR rukopisu je oveľa náročnejšie ako tlačený text — očakávajte 70-85% presnosť aj na prémiovom OCR. Pre čisté ručne písané formuláre (nie kurzívou) na bielom papieri je použiteľný Tesseract, pre kurzívu / chaotický poznámky je spoľahlivejší prémiový fal OCR s režimom rukopisu.

Približne 1-3 sekundy na stranu na Tesseract, 3-5 sekúnd na GOT-OCR2, 5-10 sekúnd na prémiovom fal.50-stranová naskenovaná kniha trvá 1-3 minúty - banner pre náročné úlohy vám umožňuje zatvoriť kartu a získať výsledok e-mailom po dokončení.

Nahraté PDF súbory sú rastrované, OCRed stránku po stránke, potom odstránené. Výstupný súbor je uložený na našej CDN po dobu 24 hodín (7 dní na platený plán) na odkaz na zdieľanie.

Nie priamo, najprv ho odomknite na /pdf/unlock/ (ak máte heslo), potom sa vráťte späť. Pri nahrávaní zistíme šifrovanie a odkážeme vás na nástroj na odomknutie.

Free.ai je zadarmo, ponúka 3 OCR motory (vyberte si podľa typu dokumentu), podporuje 99 jazykov a dodáva verejné API. Adobe Acrobat Pro ($ 19,99 / mesiac, 1 motor), ABBYY FineReader ($ 199 jednorazové, bez API), Smallpdf ($ 9 / mesiac, 1 motor).Naša kvalita OCR na čistých skenoch sa zhoduje s Adobe; na historických skenoch prémiové fal súperia ABBYY.

Áno — POST multipart do /v1/pdf/ocr/ s poľami súbor + jazyk + model + výstupný_formát. Citácia koncového bodu: /v1/pdf/ocr-quote/?pages=N&model=M. Kompletný recept na curl v /api/.

Zaregistrujte sa zdarma pre 30 000 žetónov

Vytvoriť bezplatný účet

Kreditná karta nie je potrebná

Ako by ste ohodnotili tento nástroj?

Milujete Free.ai? Povedzte svojim priateľom!