GOT-OCR v2
Free.ai
·
ocr
·
~500 символы в расчете на page
GOT-OCR v2 - a Модель УКР. Проход через внешние модели - ~500 на страницу (50% от стоимости на входе).
Использование через API
OpenAI-совместимый REST API. Создайте ключ и вызовите эту модель за секунды.
curl -X POST https://api.free.ai/v1/ocr/ \
-H "Authorization: Bearer sk-free-..." \
-H "Content-Type: application/json" \
-d '{"model":"premium/got-ocr/v2","prompt":"your prompt here"}'
Документация API
Выбрать ключ API
Часто задаваемые вопросы
GOT-OCR v2 выдерживает текст из изображений и PDF. Загрузить отсканированную страницу, скриншот или фото документа, и GOT-OCR v2 возвращает текст - сохранить строки разрыва и (на способных двигателях) таблицы, формулы и структуру.
GOT-OCR v2 занимается десятками сценариев - латинским, кириллическим, CJK, арабским, деванагари и т.д. /оr/ имеет полный список языков на двигатель.
Да, для чистого печатного почерка; сурсив и короткая рука тяжелее. TrOCR и современные двигатели на основе трансформатора заметно лучше, чем наследие Тессеракта на почерке.
Двигатели, построенные на модели (GOT-OCR, Marker, Florence-2), возвращают таблицы Маркдауна/HTML и LaTeX для формул. Текст возврата простых текстов двигателей без структуры - проверьте выходной режим этой модели.
GOT-OCR v2 - это премиальный двигатель OCR. Около 500-1500 символов на страницу, показываемых в прямом эфире до того, как вы создадите. Самозанятая OCR работает бесплатно на вашем 30 000-битном ежедневном пуле; премиальные модели платят как распределительные, с сверху с 1 доллара.
PNG, JPG, WebP, HEIC, BMP, плюс одностраничные PDF до 50 MB. Перед извлечением скайд или поворачиваемый лист.
Точность символов обычно составляет >98% на чистых печатных страницах, опускается на низкорежимные фотографии, сильно искажается сканирование или необычные шрифты. Сравните двигатели на/окр/компар/, когда точность важна.
Да - / batch/ принимает папку изображений/ PDF. Каждая добыча приземлится в /account/?tab=историю. Для сохранения папок-три используют API.
Да - POST ваш файл в /v1/ocr/ с моделью = "GOT-OCR v2". Возвращает JSON с текстом + (при поддержке) макет + графы, ограничивающие слово. /api/ имеет полную ссылку.
Самозанятые модели хранят ваш файл в наших GPU, премиальные проходят через DPA. Документы удаляются после промежутка. Мы не тренируемся по вашим вложениям.
Да - Free.ai предоставляет коммерческое использование извлекаемого текста. Вам нужны права на исходный документ.
1-5 секунд на страницу обычно. Двигатели, построенные на модели (таблицы, математика), занимают больше времени. Многостраничный диапазон PDF примерно линейно.