TrOCR Base

Free.ai (self-hosted) · ocr · ~300 Тоглоомын тэмдэгт page

Файл татаж авах эсвэл хайх

~300 Тоглоомын тэмдэгт page

TrOCR Base нь a ОРС загвар нь Microsoft-ийн бүтээсэн. Хамгийн хүчтэй нь Handwritten documents, low-resource scripts.. Free.ai GPU дээр өөрийн хосттой — таны өдөр тутмын токен нөөц (300 токен хуудас бүрт)-ийн эсрэг үнэгүй ажиллана. MIT - Free.ai дээр худалдааны зорилгоор ашиглах зөвшөөрөлтэй.

API- ээр ашиглах

OpenAI-тай нийцсэн REST API. түлхүүр үүсгэж, энэ загварыг секундэд дуудна.

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"trocr-base","prompt":"your prompt here"}'
Тохиргооны баримт бичиг API түлхүүрийг авах

Ижил төстэй загварууд

Заримдаа асуудаг асуултууд

TrOCR Base нь зураг болон PDF-ээс текстийг гаргаж авдаг. Скан хийсэн хуудас, дэлгэцийн зураг эсвэл баримтын зураг татаж аваад TrOCR Base нь текстийг - мөрний төгсгөл, (хүчтэй хөдөлгүүртэй) хүснэгт, формул, бүтэц зэргийг хадгалсан байдлаар буцааж өгнө.

TrOCR Base нь олон тооны бичлэгийг - Латин, Кирилл, CJK, Араб, Деванагари, гэх мэтийг ашигладаг. / ocr / - ийн цонх нь хөдөлгүүр бүрийн хэлний жагсаалтыг агуулдаг.

Зүгээр, цэвэр хэвлэгдсэн гарын үсэг; курсив болон товчлол нь илүү хэцүү. TrOCR болон шинэ трансформатор дээр суурилсан хөдөлгүүрүүд нь гарын үсэг дээр хуучин Tesseract-аас илүү сайн.

Хуудасны загварыг мэддэг хөдөлгүүрүүд (GOT-OCR, Marker, Florence-2) Markdown/HTML хүснэгт болон формулын LaTeX-ийг эргүүлэн өгдөг. Жинхэнэ текст хөдөлгүүрүүд бүтэцгүй текстийг эргүүлэн өгдөг - энэ загварыг гаргах горимыг шалгана уу.

TrOCR Base нь таны өдөр тутмын үнэгүй нөөцөөс бидний GPU дээр ажиллана; $5 → 200,000 төлсөн токен дараа. ~300 токен хуудас бүрт.

PNG, JPG, WebP, HEIC, BMP, 50 MB хүртэлх нэг болон олон хуудастай PDF файлууд. Хуваагдсан эсвэл эргэсэн хуудасуудыг татахаасаа өмнө автоматаар засдаг.

Тодорхойлолт нь цэвэр хэвлэгдсэн хуудас, бага нягтралтай зураг, маш их гажсан скан, эсвэл онцгой үсгийн хувьд >98% байдаг. Тодорхойлолт чухал бол /ocr/compare/ дээрх харьцуулалтын системийг ашиглаарай.

Тийм ээ - /batch/ нь зураг/PDF-ийн нэг хавтсыг хүлээн авдаг. Бүх татан авахууд /account/?tab=history-д ордог. Бусад хавтсыг хадгалахдаа API-г ашиглана уу.

Тийм ээ - файлаа "TrOCR Base" загвартай /v1/ ocr/ руу POST хий. JSON текст + (хүргэгдсэн бол) дүрслэл + үгийн түвшний хязгаарлах хайрцгуудаар буцаана. /api/ нь бүрэн холбоостой.

Өөрийн сервертэй загварууд таны файлыг график процессор дээр хадгална; үнэтэй загварууд DPA-тай дамжуулна. Хуулийг хуваалцах цонхны дараа устгана. Бид таны оруулсан мэдээллийг ашиглахгүй.

Тийм ээ - Free.ai нь түүвэрлэсэн текстийг бизнесийн зорилгоор ашиглах эрх олгодог. Та эх сурвалж баримт бичгийн эрхийг авах шаардлагатай.

Нэг хуудсанд 1-5 секунд. Хуудасны бүтэцтэй холбоотой програмууд (хүснэгт, математик) илүү удаан хугацаа шаардана. Олон хуудсан PDF файлууд ойролцоогоор шугаман хэмжээгээр хэмжээгээ өөрчлөх болно.

Free.ai-ийг хайрладаг уу? Найзуудаа хэлж өгөөрэй!

Энэ хуудсыг үнэл