PDF OCR

Камерцыйнае выкарыстанне 380+ мадэляў Без вадзянога знака Не патрабуецца рэгістрацыя
Модэль:
+ GPT-5, Claude, Gemini
Ператварэнне сканаванага PDF у тэкст з магчымасцю пошуку. Растэрызацыя кожнай старонкі пры 200 DPI і запуск OCR - выберыце Tesseract (хуткі, бясплатны), GOT-OCR2 (лепшы для шматслупковых табліц) або premium fal OCR (лепшы для сканаваньня з дэградацыяй/ гісторыяй). Вывад у фармаце.txt,.docx або тэксту з пазнакамі старонак. Вы не PDF, а малюнак? Выкарыстоўвайце / ocr / →

Перацягніце сюды сканаваную PDF або націсніце, каб загрузіць

PDF да 50 Мб. Працуе на сканаваных і толькі з малюнкамі PDF. Вы ўжо можаце вылучаць тэкст? Вам не патрэбны OCR.

·
Гэты PDF ужо мае вылучаны тэкст - вам можа не спатрэбіцца OCR. Спроба падсумоўвання →
Захаваны паролем — спачатку разблакаваць. Разблакаваць PDF
Tesseract для чыстай друкаванай скану. GOT- OCR2 для шматслупковых папер + азіяцкіх сцэнароў. Premium толькі калі кожны піксель мае значэнне.
У 2000 годзе 20-30 % насельніцтва мелі англійскую мову, 30-40 % — італьянскую, 30-45 % — нямецкую.
Ацэнка знака
Купіць жетоны
Загрузка PDF для поўнага кошту.
Вынік OCR
Сцягнуць

        

Калі выкарыстоўваць PDF OCR

Справаздачы і рахункі

Пераўтварэньне сканаваных рахункаў-фактур у рэдагуемы тэкст для бухгалтарскага ўліку, кампэнсацыі, або аўтаматызацыі аплаты.

Старыя кнігі і архівы

Цифровизуйте вычарпаныя кнігі, гістарычныя дакументы або бібліятэчныя архівы ў пошукавы тэкст.

Прававыя і медыцынскія запісы

Разблакаваць тэкст у сканаваных файлах, медыцынскіх справаздачах або факсах для пошуку + eDiscovery.

Пераклад

Выканаць OCR для атрымання тэксту, а затым падаць вынік у /pdf/translator/ для перакладу на любую мову.

Free.ai PDF OCR супраць платных інструментаў

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Пачатковая цанаВольна$19.99/mo$199 one-time$9/mo
Выбар рухавіка OCR (3)
Мовы100+40+200+20+
Публічны API
Працуе без рэгістрацыі
Адмысловыя параметры
Вынікі
Не хапае значкоў. Атрымаць больш значкоў
Вы хочаце лепшыя вынікі? Модулі Premium (GPT-5, Claude, Gemini) даюць больш высокую якасць. Прагляд планаў

❤️ Любіце Free.ai? Раскажыце сваім сябрам!

Зарэгіструйцеся, каб атрымаць спасылку і атрымаць 25 000 знакаў на сябра.

Хочаце больш? Зарэгіструйцеся бясплатна на 30K знакаў / дзень + 10K бонус
Зарэгіструйцеся

Апрацоўка запыту...

Пераўтварэньне сканаваных PDF-файлаў у тэкст з магчымасьцю выбару і пошуку. Tesseract, GOT-OCR2 і тэхналёгіі OCR. 99 моваў. Бясплатна.

Як выкарыстоўваць PDF OCR

1
Увядзіце ваш увод

Увядзіце тэкст, загрузіце файл або апісайце, што вы хочаце. Не патрабуецца ўліковы запіс.

2
Націсніце, каб стварыць

Нашы машынныя навучанні апрацоўваюць ваш запыт за секунды, выкарыстоўваючы лепшыя мадэлі з адкрытым зыходным кодам.

3
Сцягнуць і падзяліцца

Сцягнуць, скапіраваць або падзяліцца сваімі вынікамі. Бясплатна для асабістага і камерцыйнага выкарыстання.

Выкарыстоўваць гэтую прыладу праз API

Аўтаматызацыя гэтай інструмента з вашага кода. OpenAI- сумяшчальны REST канец, Bearer- токен аўтарызацыі, не патрабуецца дадатковы SDK. Кошт токенаў адпавядае інтэрфейсу вэб.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR — FAQ

Пераўтварэньне сканаваных PDF-файлаў (толькі малюнкі, не вылучаны тэкст) у тэксты, якія можна шукаць, капіраваць і чытаць. Загрузіце PDF-файл сканаваных старонак — рахункаў, кантрактаў, старых кніг, рукапісных заметак — і атрымайце звычайны тэкст,.docx або нумараваны тэкст.

Прыблізна 500 знакаў на старонку на нашым уласным хостынгу Tesseract OCR (бясплатны ўзровень). GOT- OCR2 каштуе ~ 800/ старонку і лепш працуе са складанымі макетамі (мноства слупкоў, табліцы, раўнанні). Premium fal OCR працуе ~ 2500/ старонку для найвышэйшай дакладнасці на дэградаваных сканах. 800- знакавы падмурак на ўсіх трох, таму 1- старонкавы загрузкі не з' яўляюцца простай накладнай.

Tesseract (па змаўчанні, бясплатна) для чыстай друкаванай скану. GOT- OCR2 (бясплатна, павольней) для шматслупковых даследчых работ, навуковых раўнанняў або азіяцкіх дакументаў - мае значна лепшую мадэль макету. Premium fal OCR толькі для дэградаваных / нізкай раздзяляльнасці / гістарычных скану, дзе кожны піксель мае значэнне.

Tesseract падтрымлівае больш за 100 моваў, уключаючы лацінскую, кітайскую, японскую, карэйскую, арабскую, кирилліцу, іўрыт, хіндзі, тайскую, в'етнамскую. Дадайце падказку мовы (англ./spa/fra/deu/jpn/chi_sim/ara/etc.) для 30-50% большай дакладнасці - аўтаматычнае выяўленне працуе, але павольней.

Тры:.txt (звычайны, адзін файл для ўсяго дакумента),.docx (Word з захаванымі разрывамі старонак) і.txt па старонках (===== Page N ===== загалоўкі паміж старонкамі, каб вы маглі знайсці пэўную старонку ў вывадзе).

Пры чыстай 300- DPI скану, 99% + на друкаваных лацінскіх шрыфтах. Паніжаецца да 90- 95% пры 150- DPI скану, выцвітаючых дакументах або рукапісе. Нелацінскія шрыфты (кітайская, арабская, хіндзі) працуюць значна лепш з падказкай мовы і GOT- OCR2, чым Tesseract.

Распазнанне рукапісу значна складаней, чым друкаванага тэксту - чакайце дакладнасці 70- 85% нават пры выкарыстанні OCR- праграмы. Для чыстай рукапіснай формы (не курсіўнай) на белай паперы можна выкарыстоўваць Tesseract. Для курсіўных / нечытаных заметак лепш выкарыстоўваць OCR- праграму з рэжымам рукапісу.

Прыблізна 1- 3 секунды на старонку на Tesseract, 3- 5 секунд на GOT- OCR2, 5- 10 секунд на premium fal. 50- старонкавая сканаваная кніга займае 1- 3 хвіліны - баннер для цяжкіх задач дазваляе вам закрыць картку і атрымаць вынік па электроннай пошце, калі ён скончыцца.

Не. Выцягнутыя PDF- файлы растравыя, OCRed старонка за старонкай, а затым выдаляюцца. Вывадны файл захоўваецца ў нашай CDN на працягу 24 гадзін (7 дзён пры плацежным плане) на спасылцы абмену.

Непасрэдна. Спачатку разбярыце яго ў / pdf/ unlock/ (калі ў вас ёсць пароль), а затым вярніцеся. Мы выяўляем шыфраванне пры загрузкі і спасылаем вас на інструмент разбярэння.

Free.ai бясплатны, прапануе 3 рухавікі OCR (выбірайце па тыпу дакумента), падтрымлівае 99 моў і пастаўляецца з публічным API. Adobe Acrobat Pro ($19.99/месяц, 1 рухавік), ABBYY FineReader ($199 аднаразова, без API), Smallpdf ($9/месяц, 1 рухавік). Наша якасць OCR на чыстых сканах адпавядае Adobe; на гістарычных сканах прэміум-фаль сутыкаецца з ABBYY.

Так — POST multipart to /v1/pdf/ocr/ з файлам + мовай + мадэллю + полямі output_format.

Зарэгіструйцеся бясплатна на 30 000 знакаў

Стварыць новы рахунак

Крэдытная карта не патрабуецца

Як вы ацэньваеце гэтую прыладу?

Любіце Free.ai? Раскажыце сваім сябрам!