ОЦР PDF

Коммерческое использование разрешено 380+ моделей Нет водяного знака Нет необходимости в регистрации
Модель:
+ GPT-5, Claude, Gemini
Преобразовать отсканированный PDF в подходящий для поиска текст. Распространяет каждую страницу на 200 ДОИ и запускает OCR — выбирайте тессеракт (быстрый, бесплатный), GOT-OCR2 (лучше для многоколонн + таблиц) или премиальное Fal OCR (лучшее для деградировавших/исторических сканеров). Выпуск как.txt,.docx, или текст, помеченный страницами. Есть картинка, а не PDF?

Перетащите отсканированный PDF здесь или щёлкните, чтобы загрузить

PDF до 50 MB. Работает над сканированными и только снимками PDF. Уже текстовые? Вам не нужен OCR.

·
Этот PDF уже имеет отбираемый текст — вам может не понадобиться OCR. Попробуй обобщать
Защищенный паролем — сначала открой. Разблокировать PDF
Тессеракта для чистых отпечатанных снимков. GOT-OCR2 для многоколумбовых документов + азиатских сценариев. Премиум только тогда, когда каждый пиксель имеет значение.
Скорость подсказки на языке Tesseract 2-3× и повышает точность 30-50% на нелатинских скриптах.
Расчетная сумма
Покупайте токены
Загрузить PDF, чтобы увидеть точную стоимость.
Результат OCR
Загрузка

        

Когда использовать PDF OCR

Счета-фактуры + квитанции

Преобразовать стопку отсканированных счетов-фактур в поддающийся редактированию текст для бухгалтерского учета, возмещения или автоматизации AP.

Старые книги + архивы

Перенести внепечатные книги, исторические документы или библиотечные архивы в поисковый текст.

Юридическая + медицинская документация

Отключить текст в отсканированных файлах дел, медицинских заключениях или факсимильных документах для обнаружения + eDiscovery works.

Перед переводом

Запустить OCR для извлечения текста, затем ввести результат в /pdf/translator/ для преобразования любого языка в любой язык.

Free.ai PDF OCR против платных инструментов

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Начальная ценаСвободные$19.99/mo$199 one-time$9/mo
Выбрать двигатель OCR (3)
Знание языков100+40+200+20+
Общественный АПИ
Работает без регистрации
Дополнительные варианты
Результат
Токены кончаются. Возьмите больше токенов
Хочешь получить результаты получше? Модели премиума (GPT-5, Claude, Gemini) обеспечивает более высокое качество. Планы просмотра

❤️ Love this tool? Share it!

Подпишитесь , чтобы получить ссылку на направление и заработать 25 000 символов на друга.

Хочешь еще? Бесплатно подписывайтесь за 30K символов/день + 10K бонус
Регистрация бесплатно

Обработка вашей просьбы...

Переключить отсканированные PDF в подходящий для поиска текст. Тессеракт, GOT-OCR2 и премиальные двигатели OCR. 99 языков. Свободно.

Как пользоваться ОЦР PDF

1
Введите свой вход

Введите текст, загрузите файл или опишите, что вам нужно.

2
Нажмите на генератор

Наша АИ обрабатывает ваш запрос в секунды с использованием лучших моделей с открытым исходным кодом.

3
Загрузить & долю

Загружайте, копируете или делитесь результатами. Бесплатно для личного и коммерческого использования.

Использовать этот инструмент через API

Автоматизировать этот инструмент из своего собственного кода. OpenAI-совместимый REST конечный пункт, Bearer-Tken Auth, не требуется дополнительных SDK. Затраты соответствуют веб-интерфейсу.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

ОЦР PDF — FAQ

Переключить отсканированные PDF (только изображаемый, невыбираемый текст) в поисковый, копируемый, считываемый с АИ текст. Загрузить PDF с отсканированными страницами — счетами, контрактами, старыми книгами, рукописными записями — и вернуть простой текст,.docx, или текст с нумерациями страниц.

Около 500 символов на страницу на нашей самостоятельной ОЦР Тессеракта (свободно-уровень). ГОТ-ОКР2 стоит ~ 800 страниц и лучше обрабатывает сложные макеты (многоколонны, таблицы, уравнения). Премий Fal OCR работает ~2500/страница для обеспечения максимальной точности на деградировавших сканированиях. 800 забитых этажах на всех трех страницах, так что одностраничные загрузки не являются чистыми накладными расходами.

Тессеракт (по умолчанию, бесплатно) для чистых печатных сканировок. GOT-OCR2 (свободно, медленнее) для многоколумбовых исследовательских работ, научных уравнений или документов на азиатском языке — он имеет гораздо более совершенную модель компоновки. OCR Premium fal только для деградировавших/низкоразрешений/исторических сканеров, когда каждый пиксел имеет значение.

Тессеракт поддерживает язык 100+, включая латинский, китайский, японский, корейский, арабский, кириллический, иврит, хинди, тайский, вьетнамский.

Три:.txt (Play, один файл для всего документа),.docx (Word with page breaks) и page wise.txt (=== Страница N ===== Заголовки между страницами, чтобы вы могли найти конкретную страницу в выводе).

На чистых 300-DPI снимках 99%+ на отпечатанном латинском шрифте. Опускается до 90-95% на 150-DPI сканировании, стертых документах или почерке. Нелатинские скрипты (китайский, арабский, хинди) гораздо лучше работают с подсказкой на языке и GOT-OCR2, а не с тессерактом.

ОКР для рукописей гораздо сложнее, чем печатный текст, — ожидается, что 70-85% точности даже в премиальных ОЦР. Для чистых отпечатанных от руки форм (а не прописных) на белой бумаге используется Tesseract. Для прописных/грязных записей, премиальная ОЦР с режимом почерка более надежна.

Около 1-3 секунды на страницу на Tesseract, 3-5 секунд на GOT-OCR2, 5-10 секунд на премию. 50 страниц сканированной книги занимает 1-3 минуты — тяжелый баннер позволяет закрыть вкладку и получить результат по электронной почте, когда она заканчивается.

Нет. Загруженные PDF рестеризируются, OCR размещается по страницам, а затем удаляется. Выпускной файл хранится в нашем CDN в течение 24 часов (7 дней по оплаченному плану) на канале обмена.

Не напрямую. Разблокируйте его на /pdf/unlock/ сначала (если у вас есть пароль), затем вернитесь. Мы обнаруживаем шифрование при загрузке и связываем вас с отпирающим устройством.

Free.ai является бесплатным, предлагает 3 двигателя OCR (выбрать по типу дока), поддерживает 99 языков, а корабли - общественный API. Adobe Acrobat Pro (19,99/mo, 1 двигатель), ABBY FineReader (199 раз, без API), Smallpdf (9/mo, 1 двигатель). Качество OCR на чистых сканах соответствует Adobe; на исторических сканерах премиальные Fal конкуренты ABBYY.

Да — POST многочастотно — /v1/pdf/ocr/ с файлом + язык + модель + вывод_format поля.

Запишитесь бесплатно за 30 000 токенов.

Создать свободный счет

Кредитная карта не требуется

Как бы вы оценили этот инструмент?

Love this tool? Share it!