PDF OCR

Камерцыйнае выкарыстанне Модулі 567 Без вадзянога знака Не патрабуецца рэгістрацыя
Модэль:
+ GPT-5, Claude, Gemini
Ператварэнне сканаванага PDF у тэкст з магчымасцю пошуку. Растэрызацыя кожнай старонкі пры 200 DPI і запуск OCR - выберыце Tesseract (хуткі, бясплатны), GOT-OCR2 (лепшы для шматслупковых табліц) або premium fal OCR (лепшы для сканаваньня з дэградацыяй/ гісторыяй). Вывад у фармаце.txt,.docx або тэксту з пазнакамі старонак. Вы не PDF, а малюнак? Выкарыстоўвайце / ocr / →

Перацягніце сюды сканаваную PDF або націсніце, каб загрузіць

PDF да 50 Мб. Працуе на сканаваных і толькі з малюнкамі PDF. Вы ўжо можаце вылучаць тэкст? Вам не патрэбны OCR.

-
- · -
Гэты PDF ужо мае вылучаны тэкст - вам можа не спатрэбіцца OCR. Спроба падсумоўвання →
Захаваны паролем — спачатку разблакаваць. Разблакаваць PDF
Tesseract для чыстай друкаванай скану. GOT- OCR2 для шматслупковых папер + азіяцкіх сцэнароў. Premium толькі калі кожны піксель мае значэнне.
У 2000 годзе 20-30 % насельніцтва мелі англійскую мову, 30-40 % — італьянскую, 30-45 % — нямецкую.
Ацэнка знака
-
Купіць маркі
Загрузка PDF для поўнага кошту.
Вынік OCR
Сцягнуць

        

Калі выкарыстоўваць PDF OCR

Справаздачы і рахункі

Пераўтварэньне сканаваных рахункаў-фактур у рэдагуемы тэкст для бухгалтарскага ўліку, кампэнсацыі, або аўтаматызацыі аплаты.

Старыя кнігі і архівы

Цифровизуйте вычарпаныя кнігі, гістарычныя дакументы або бібліятэчныя архівы ў пошукавы тэкст.

Прававыя і медыцынскія запісы

Разблакаваць тэкст у сканаваных файлах, медыцынскіх справаздачах або факсах для пошуку + eDiscovery.

Пераклад

Выканаць OCR для атрымання тэксту, а затым падаць вынік у /pdf/translator/ для перакладу на любую мову.

Free.ai PDF OCR супраць платных інструментаў

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Пачатковая цанаВольна$19.99/mo$199 one-time$9/mo
Выбар рухавіка OCR (3)---
Мовы100+40+200+20+
Публічны API---
Працуе без рэгістрацыі---
Адмысловыя налады
Вынік
Не хапае значкоў. Атрымаць больш значкоў
Вы хочаце лепшыя вынікі? Модулі Premium (GPT-5, Claude, Gemini) даюць больш высокую якасць. Прагляд планаў

❤️ Любіце Free.ai? Раскажыце сваім сябрам!

Зарэгіструйцеся, каб атрымаць спасылку і атрымаць 25 000 знакаў на сябра.

Хочаце больш? Зарэгіструйцеся бясплатна: 30 000 знакаў/дзень
Зарэгіструйцеся

Апрацоўка вашага запыту...

Пераўтварэньне сканаваных PDF-файлаў у тэкст з магчымасьцю выбару і пошуку. Tesseract, GOT-OCR2 і тэхналёгіі OCR. 99 моваў. Бясплатна.

Як выкарыстоўваць PDF OCR

1
Увядзіце ваш увод

Увядзіце тэкст, загрузіце файл або апісайце тое, што вы хочаце. Не патрэбны рахунак.

2
Націсніце, каб стварыць

Нашы машынныя навучанні апрацоўваюць ваш запыт за секунды, выкарыстоўваючы лепшыя мадэлі адкрытага кода.

3
Сцягнуць і падзяліцца

Спампаваць, скапіраваць або падзяліцца сваімі вынікамі. Бясплатна для асабістага і камерцыйнага выкарыстаньня.

Выкарыстаць гэтую прыладу праз API

Аўтаматызаваць гэтую праграму з вашага кода. OpenAI- сумяшчальны REST канец пункту, Bearer- токен аўтэнтыфікацыі, не патрабуецца дадатковы SDK. Кошт токенаў адпавядае інтэрфейсу вэб.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR - FAQ

Пераўтварэньне сканаваных PDF-файлаў (толькі малюнкі, не вылучаны тэкст) у пошукавую, скапіраваную, AI-чытальную форму тэксту. Загрузіце PDF-файл сканаваных старонак - рахункаў, кантрактаў, старых кніг, рукапісных заметак - і атрымайце звычайны тэкст,.docx або нумараваны тэкст.

Прыблізна 500 знакаў на старонку на нашым уласным хостынгу Tesseract OCR (бясплатны ўзровень). GOT- OCR2 каштуе ~ 800/ старонку і лепш працуе са складанымі макетамі (мноства слупкоў, табліцы, раўнанні). Premium fal OCR працуе ~ 2500/ старонку для найвышэйшай дакладнасці на дэградаваных сканах. 800- знакавы падмурак на ўсіх трох, таму 1- старонкавы загрузкі не з' яўляюцца простай накладнай.

Tesseract (па змаўчанні, бясплатна) для чыстай друкаванай скану. GOT- OCR2 (бясплатна, павольней) для шматслупковых даследчых работ, навуковых раўнанняў або дакументаў на азіяцкай мове - мае значна лепшую мадэль раскладу. Premium fal OCR толькі для дэградаваных / нізкай раздзяляльнасці / гістарычных сканаў, дзе кожны піксель мае значэнне.

Tesseract падтрымлівае больш за 100 моваў, уключаючы лацінскую, кітайскую, японскую, каралеўскую, арабскую, кірыліцу, габрэйскую, хіндзі, тайскую, в'етнамскую. Перадайце падказку мовы (англ./spa/fra/deu/jpn/chi_sim/ara/etc.) для 30-50% большай дакладнасці - аўтаматычнае выяўленне працуе, але павольней.

Тры:.txt (звычайны, адзін файл для ўсяго дакумента),.docx (Word з захаванымі разрывамі старонак) і.txt па старонках (===== Page N ===== загалоўкі паміж старонкамі, каб вы маглі знайсці пэўную старонку ў вывадзе).

Пры чыстай 300- DPI скану, 99% + на друкаваных лацінскіх шрыфтах. Паніжаецца да 90- 95% пры 150- DPI скану, выцвітаючых дакументах або рукапісе. Нелацінскія шрыфты (кітайская, арабская, хіндзі) працуюць значна лепш з падказкай мовы і GOT- OCR2, чым Tesseract.

Адзнака рукапісу складаней, чым друкаванага тэксту - чакайце 70- 85% дакладнасці нават пры выкарыстанні OCR- праграмы. Для чыстай рукапіснай формы (не курсіўнай) на белай паперы можна выкарыстоўваць Tesseract. Для курсіўных/ непрафесійных заметак лепш выкарыстоўваць OCR- праграму з рэжымам рукапісу.

Прыблізна 1- 3 секунды на старонку ў Tesseract, 3- 5 секунд у GOT- OCR2, 5- 10 секунд у premium fal. 50- старонкавая сканаваная кніга займае 1- 3 хвіліны - значок для цяжкіх задач дазваляе закрыць картку і атрымаць вынік па электроннай пошце.

Не. Выцягнутыя PDF- файлы растравыя, OCRed старонка за старонкай, а затым выдаляюцца. Вывадны файл захоўваецца ў нашай CDN на працягу 24 гадзін (7 дзён пры плацежным плане) на спасылцы абмену.

Непасрэдна. Спачатку разбярыце яго ў / pdf/ unlock/ (калі ў вас ёсць пароль), а затым вярніцеся. Мы выяўляем шыфраванне пры загрузкі і спасылаем вас на інструмент разбярэння.

Free.ai бясплатны, прапануе 3 рухавікі OCR (выбірайце па тыпу дакумента), падтрымлівае 99 моў і пастаўляецца з публічным API. Adobe Acrobat Pro ($19.99/месяц, 1 рухавік), ABBYY FineReader ($199 аднаразова, без API), Smallpdf ($9/месяц, 1 рухавік). Наша якасць OCR на чыстых сканах адпавядае Adobe; на гістарычных сканах прэміум-фаль сутыкаецца з ABBYY.

Так — POST multipart to /v1/pdf/ocr/ з файлам + мовай + мадэллю + полямі output_format.

Зарэгіструйцеся бясплатна: 30 000 знакаў/дзень

Стварыць новы рахунак

Крэдытная карта не патрабуецца

Як вы ацэньваеце гэтую праграму?

Любіце Free.ai? Раскажыце сваім сябрам!