GOT-OCR v2
Free.ai
·
ocr
·
~500 символы в расчете на page
GOT-OCR v2 является {article_freahi_ph} Категория __. Путь через внешние модели — ~ 500 токены на страницу (50% от стоимости вверх по течению).
Использование через API
OpenAI-совместимый REST API. Создайте ключ и вызовите эту модель за секунды.
curl -X POST https://api.free.ai/v1/ocr/ \
-H "Authorization: Bearer sk-free-..." \
-H "Content-Type: application/json" \
-d '{"model":"premium/got-ocr/v2","prompt":"your prompt here"}'
Документация API
Выбрать ключ API
Часто задаваемые вопросы
GOT-OCR v2 выводит текст из изображений и PDF. Загрузить отсканированную страницу, скриншот или фотографию документа и GOT-OCR v2 возвратит текст — сохраняя разрыв строк и (на способных двигателях) таблицы, формулы и структуру.
GOT-OCR v2 обрабатывает десятки скриптов — латинский, кириллический, CJK, арабский, Деванагари и т.д.
Да, для чистого почерка в печатном виде; сурсивы и короткая рукоятка тяжелее. TrOCR, а современные двигатели на основе трансформатора заметно лучше, чем наследие Tesseract в почерке.
Формально-показательные двигатели (GOT-OCR, Маркер, Florence-2) возвращают таблицы отметки/HTML и LaTeX для формул. Текст возврата простых текстов двигателей без структуры - проверьте выходной режим этой модели.
GOT-OCR v2 — премиальный двигатель OCR. Около 500-1500 символов на страницу, показываемый в прямом эфире до того, как вы создадите. Самозанятая OCR работает бесплатно на вашем 30 000-битном ежедневном пуле; премиальные модели платят по мере поступления, с сверху 1 долл.
PNG, JPG, WebP, HEIC, BMP, плюс одностраничные и многостраничные PDF до 50 MB. Перед извлечением свернутые или поворачиваемые страницы корректируются автоматически.
Точность символов, как правило, составляет >98% на чистых печатных страницах, опускается на низкорежимные фотографии, сильно искажается сканирование или необычные шрифты. Сравните двигатели на /ocr/compare/, когда точность важна.
Да — /batch/ принимает папку изображений/PDF. Каждая добыча приземлится в /account/?tab=историю. Для сохранения папок-три используют API.
Да — POST ваш файл в /v1/ocr/ с моделью=" GOT-OCR v2 Возвращает JSON с текстом + (когда поддерживается) макетом + в графах на уровне слов. /api/ имеет полную ссылку.
Самодельные модели хранят ваш файл в наших GPU; премиальные проходят через DPA. Документы удаляются после совместного окна. Мы не тренируемся на ваших входных данных.
Да — Free.ai человек предоставляет коммерческое использование извлеченного текста, и вам нужны права на исходный документ.
1-5 секунд на страницу, как правило. Формально-показательные двигатели (таблицы, математика) занимают больше времени. Многостраничные PDF масштабируют примерно линейно.