ОЦР PDF

Коммерческое использование разрешено Модели 567 Нет водяного знака Нет необходимости в регистрации
Модель:
+ GPT-5, Claude, Gemini
Преобразовать отсканированный PDF в подходящий для поиска текст. Распространяет каждую страницу на 200 ДОИ и запускает OCR — выбирайте тессеракт (быстрый, бесплатный), GOT-OCR2 (лучше для многоколонн + таблиц) или премиальное Fal OCR (лучшее для деградировавших/исторических сканеров). Выпуск как.txt,.docx, или текст, помеченный страницами. Есть картинка, а не PDF?

Перетащите отсканированный PDF здесь или щёлкните, чтобы загрузить

PDF до 50 MB. Работает над сканированными и только снимками PDF. Уже текстовые? Вам не нужен OCR.

-
- · -
Этот PDF уже имеет отбираемый текст — вам может не понадобиться OCR. Попробуй обобщать
Защищенный паролем — сначала открой. Разблокировать PDF
Тессеракта для чистых отпечатанных снимков. GOT-OCR2 для многоколумбовых документов + азиатских сценариев. Премиум только тогда, когда каждый пиксель имеет значение.
Скорость подсказки на языке Tesseract 2-3× и повышает точность 30-50% на нелатинских скриптах.
Расчетная сумма
-
Покупка символов
Загрузить PDF, чтобы увидеть точную стоимость.
Результат OCR
Загрузка

        

Когда использовать PDF OCR

Счета-фактуры + квитанции

Преобразовать стопку отсканированных счетов-фактур в поддающийся редактированию текст для бухгалтерского учета, возмещения или автоматизации AP.

Старые книги + архивы

Перенести внепечатные книги, исторические документы или библиотечные архивы в поисковый текст.

Юридическая + медицинская документация

Отключить текст в отсканированных файлах дел, медицинских заключениях или факсимильных документах для обнаружения + eDiscovery works.

Перед переводом

Запустить OCR для извлечения текста, затем ввести результат в /pdf/translator/ для преобразования любого языка в любой язык.

Free.ai PDF OCR против платных инструментов

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
Начальная ценаСвободные$19.99/mo$199 one-time$9/mo
Выбрать двигатель OCR (3)---
Знание языков100+40+200+20+
Общественный АПИ---
Работает без регистрации---
Дополнительные варианты
Результат
Токены закончились. Возьмите больше токенов
Хочешь получить результаты получше? Модели премиум (GPT-5, Claude, Gemini) обеспечивает более высокое качество. Планы просмотра

❤️ Love Free.ai? Tell your friends!

Подпишитесь , чтобы получить ссылку на направление и заработать 25 000 символов на друга.

Хочешь еще? Бесплатно подписывайтесь: 30 000 жетонов в день
Не подписываться

Обработка вашей просьбы...

Переключить отсканированные PDF в подходящий для поиска текст. Тессеракт, GOT-OCR2 и премиальные двигатели OCR. 99 языков. Свободно.

Как пользоваться ОЦР PDF

1
Введите в себя

Наберите текст, загрузите файл или опишите, что вам нужно.

2
Нажмите на жёлтый набор

Наша АИ обрабатывает ваш запрос в секунды с использованием лучших моделей с открытым исходным кодом.

3
Загрузка & доли

Загрузить, скопировать или поделиться результатами.

Использовать этот инструмент через API

Автоматизировать этот инструмент из своего собственного кода. OpenAI-совместимый конечный пункт REST, Bearer-Tken Auth, не требуется дополнительных SDK. Токен расценки соответствует веб-интерфейсу.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

ОЦР PDF - FAQ

Переключить отсканированные PDF (только для изображения, невыбираемый текст) в поисковый, копируемый, считываемый с АИ текст. Загрузить PDF с отсканированных страниц - счета-фактуры, контракты, старые книги, рукописные заметки - и вернуть простой текст,.docx или текст с нумерациями страниц.

Около 500 символов на страницу на нашей самостоятельной ОЦР Тессеракта (свободно-уровень). ГОТ-ОКР2 стоит ~ 800 страниц и лучше обрабатывает сложные макеты (многоколонны, таблицы, уравнения). Премий Fal OCR работает ~2500/страница для обеспечения максимальной точности на деградировавших сканированиях. 800 забитых этажах на всех трех страницах, так что одностраничные загрузки не являются чистыми накладными расходами.

Тессеракт (по умолчанию, бесплатно) для чистых печатных сканировок. GOT-OCR2 (свободный, медленнее) для многоколебаний исследовательских работ, научных уравнений или документов на азиатском языке - он имеет гораздо более совершенную модель макета. Премиум фал OCR только для деградировавших/низких сканировок/исторических сканировок, когда каждый пиксел имеет значение.

Tesseract supports 100+ languages including Latin, Chinese, Japanese, Korean, Arabic, Cyrillic, Hebrew, Hindi, Thai, Vietnamese. Pass a language hint (eng/spa/fra/deu/jpn/chi_sim/ara/etc.) for 30-50% better accuracy - auto-detect works but is slower.

Три:.txt (Play, один файл для всего документа),.docx (Word with page breaks) и page wise.txt (=== Страница N ===== Заголовки между страницами, чтобы вы могли найти конкретную страницу в выводе).

На чистых 300-DPI снимках 99%+ на отпечатанном латинском шрифте. Опускается до 90-95% на 150-DPI сканировании, стертых документах или почерке. Нелатинские скрипты (китайский, арабский, хинди) гораздо лучше работают с подсказкой на языке и GOT-OCR2, а не с тессерактом.

ОКР для рукописей гораздо сложнее, чем печатный текст, - ожидается, что 70-85% точности даже на особом ОЦР. Для чистых отпечатанных вручную форм (а не прописных) на белой бумаге, тессеракт используется. Для прописных/грязных нот, премиальные ОЦР с режимом рукописи более надёжны.

Примерно 1-3 секунды на страницу на Tesseract, 3-5 секунд на GOT-OCR2, 5-10 секунд на премию. 50-страничный сканированный журнал занимает 1-3 минуты - тяжелый баннер позволяет закрыть вкладку и получить результат по электронной почте, когда он закончится.

Нет. Загруженные PDF рестеризируются, OCR размещается по страницам, а затем удаляется. Выпускной файл хранится в нашем CDN в течение 24 часов (7 дней по оплаченному плану) на канале обмена.

Не напрямую. Разблокируйте его на /pdf/unlock/ сначала (если у вас есть пароль), затем вернитесь. Мы обнаруживаем шифрование при загрузке и связываем вас с отпирающим устройством.

Free.ai является бесплатным, предлагает 3 двигателя OCR (выбрать по типу дока), поддерживает 99 языков, а корабли - общественный API. Adobe Acrobat Pro (19,99/mo, 1 двигатель), ABBY FineReader (199 раз, без API), Smallpdf (9/mo, 1 двигатель). Качество OCR на чистых сканах соответствует Adobe; на исторических сканерах премиальные Fal конкуренты ABBYY.

Да - POST многочастотно в /v1/pdf/ocr/ с файлом + язык + модель + вывод_format поля. Квот конечная точка: /v1/pdf/ocr-tote/?pages=N&model=M. Полный рецепт кёрла на /api/.

Бесплатно подписывайтесь: 30 000 жетонов в день

Создать свободный Аккаунт

Кредитная карта не требуется

Как бы вы оценили этот инструмент?

Love Free.ai? Tell your friends!