PDF OCR

Komerčné použitie OK Modely 568 Žiadny vodoznak Nie je potrebná registrácia
Model:
+ GPT-5, Claude, Gemini
Premeňte naskenovaný PDF súbor na text, ktorý môžete vybrať a prehľadávať. Rastruje každú stranu pri rozlíšení 200 DPI a spúšťa OCR – vyberte si Tesseract (rýchly, bezplatný), GOT-OCR2 (lepší pre viacstĺpcové tabuľky) alebo prémiové fal OCR (najlepšie pre degradované / historické skeny). Máte obrázok, nie PDF? Použite /ocr/ →

Pretiahnite naskenovaný PDF súbor sem alebo kliknite na nahratie

PDF do 50 MB. Funguje na naskenovaných PDF + iba s obrázkami. Už je možné vybrať text? Nepotrebujete OCR.

-
- · -
Tento dokument PDF už obsahuje text, ktorý je možné vybrať – nemusíte potrebovať OCR. Vyskúšajte Summarizer →
Chránené heslom — najprv ho odomknite. Odomknúť PDF →
Tesseract pre čisté skenované výtlačky. GOT-OCR2 pre viacstĺpcové papiere + ázijské písmo.Premium len vtedy, keď záleží na každom pixeli.
Jazyková nápoveda zrýchľuje Tesseract 2-3× a zvyšuje presnosť o 30-50% na ne-latinských písmach.
Odhad počtu tokenov
-
Kúpiť žetóny
Nahrajte PDF a pozrite si presnú cenu.
Výsledok OCR
Stiahnuť

        

Kedy používať PDF OCR

Faktúry + príjmy

Premeňte stoh naskenovaných faktúr na upraviteľný text pre účtovníctvo, refundácie alebo automatizáciu AP.

Staré knihy + archívy

Digitalizujte vypredané knihy, historické dokumenty alebo knižničné archívy do prehľadávateľného textu.

Právne a lekárske záznamy

Odomknite text v naskenovaných súboroch prípadov, lekárskych správach alebo faxovaných dokumentoch pre pracovné postupy vyhľadávania a elektronického vyhľadávania.

Pred prekladom

Spustite OCR na extrakciu textu a potom vložte výsledok do /pdf/translator/ pre konverziu z ľubovoľného jazyka do ľubovoľného jazyka.

Free.ai PDF OCR vs platené nástroje

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
100 € Vyvolávací cenaVoľný$19.99/mo$199 one-time$9/mo
Vyberte OCR engine (3)---
Jazyky100+40+200+20+
Verejné rozhranie API---
Funguje bez registrácie---
Pokročilé možnosti
Výsledok
Žetóny sa míňajú. Získať viac žetónov
Chcete lepšie výsledky? Prémiové modely (GPT-5, Claude, Gemini) poskytujú vyššiu kvalitu. Zobraziť plány

❤️ Milujete Free.ai? Povedzte svojim priateľom!

Zaregistruj sa a získaj odporúčací odkaz a získaj 25 000 žetónov za priateľa.

Chcete viac? Zaregistrujte sa zdarma: 30 000 žetónov/deň
Zaregistrujte sa zdarma

Spracovávam vašu požiadavku...

Premeňte naskenované PDF súbory na vybrateľný text s možnosťou vyhľadávania. Tesseract, GOT-OCR2 a prémiové nástroje OCR. 99 jazykov.

Ako používať PDF OCR

1
Zadajte svoj vstup

Zadajte text, nahrajte súbor alebo popíšte, čo chcete. Nevyžaduje sa žiadne konto.

2
Kliknite na generovať

Naša AI spracuje vašu požiadavku v priebehu niekoľkých sekúnd pomocou najlepších open-source modelov.

3
Stiahnuť & zdieľať

Stiahnite si, skopírujte alebo zdieľajte svoj výsledok. Zdarma pre osobné a komerčné použitie.

Použite tento nástroj cez API

Automatizujte tento nástroj z vlastného kódu. Koncový bod REST kompatibilný s OpenAI, overenie nosičom tokenu, nie je potrebná žiadna ďalšia súprava SDK.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR - FAQ

Nahrajte PDF naskenovaných strán - faktúry, zmluvy, staré knihy, ručne písané poznámky - a získajte späť obyčajný text,.docx alebo číslovaný text.Vyberte si z viac ako 1000 PDF formátov, ktoré sú k dispozícii.

Približne 500 tokenov na stránku na našom vlastnom hosťovanom Tesseract OCR (bezplatná úroveň). GOT-OCR2 stojí ~ 800 / stránku a lepšie zvláda komplexné rozloženia (viac stĺpcov, tabuľky, rovnice). Prémiový fal OCR beží ~ 2 500 / stránku pre najvyššiu presnosť na degradovaných skenoch. 800-tokenový strop na všetkých troch, takže 1-stranové nahrávanie nie je čistá režia.

Tesseract (predvolené, bezplatné) pre čisté tlačené skeny. GOT-OCR2 (bezplatné, pomalšie) pre viacstĺpcové výskumné práce, vedecké rovnice alebo dokumenty v ázijských jazykoch - má oveľa lepší model rozloženia. Prémiové fal OCR len pre degradované / nízke rozlíšenie / historické skeny, kde každý pixel záleží.

Tesseract podporuje viac ako 100 jazykov vrátane latinky, čínštiny, japončiny, kórejčiny, arabčiny, cyriliky, hebrejčiny, hindčiny, thajčiny, vietnamčiny.Predajte jazykovú nápovedu (eng/spa/fra/deu/jpn/chi_sim/ara/etc.) pre 30-50% lepšiu presnosť - automatická detekcia funguje, ale je pomalšia.

Tri:.txt (jednoduchý, jeden súbor pre celý dokument),.docx (Word so zachovanými zlomami strán) a.txt pre každú stranu (hlavičky ===== Strana N ===== medzi stranami, aby ste mohli nájsť konkrétnu stranu vo výstupe).

Na čistých skenoch s rozlíšením 300 dpi, 99% + na vytlačenom latinskom písme. klesá na 90-95% na skenoch s rozlíšením 150 dpi, vyblednutých dokumentoch alebo rukopise. ne-latinské písmo (čínština, arabčina, hindčina) sa darí oveľa lepšie s jazykovým návodom a GOT-OCR2 ako Tesseract.

OCR rukopisu je oveľa náročnejšie ako OCR tlačeného textu - očakávajte presnosť 70-85% aj na prémiovom OCR. Pre čisté ručne písané formuláre (nie kurzívou) na bielom papieri je použiteľný Tesseract, pre kurzívu / neporiadne poznámky je spoľahlivejší prémiový fal OCR s režimom rukopisu.

Približne 1-3 sekundy na stranu na Tesseract, 3-5 sekúnd na GOT-OCR2, 5-10 sekúnd na prémiové fal.50-stranová naskenovaná kniha trvá 1-3 minúty - heavy-task banner umožňuje zatvoriť kartu a získať výsledok e-mailom, keď je dokončený.

Nahraté PDF súbory sú rastrované, OCRed stránku po stránke, potom odstránené. Výstupný súbor je uložený na našej CDN po dobu 24 hodín (7 dní na platený plán) na odkaz na zdieľanie.

Nie priamo, najprv ho odomknite na /pdf/unlock/ (ak máte heslo), potom sa vráťte späť. Pri nahrávaní zistíme šifrovanie a odkážeme vás na nástroj na odomknutie.

Free.ai je zadarmo, ponúka 3 OCR motory (vyberte si podľa typu dokumentu), podporuje 99 jazykov a dodáva verejné API. Adobe Acrobat Pro ($ 19,99 / mesiac, 1 motor), ABBYY FineReader ($ 199 jednorazové, bez API), Smallpdf ($ 9 / mesiac, 1 motor).Naša kvalita OCR na čistých skenoch sa zhoduje s Adobe; na historických skenoch prémiové fal súperia ABBYY.

Áno - POST multipart do /v1/pdf/ocr/ s poľami súbor + jazyk + model + output_format. Citácia koncového bodu: /v1/pdf/ocr-quote/?pages=N&model=M. Celý curl recept v /api/.

Zaregistrujte sa zdarma: 30 000 žetónov/deň

Vytvoriť bezplatný účet

Kreditná karta nie je potrebná

Ako by ste hodnotili tento nástroj?

Milujete Free.ai? Povedzte svojim priateľom!