Unlimited-OCR 3B

Free.ai (self-hosted) · ocr · ~300 tokens per page

Lasciari un file cciù o cliccari pi sfogliari

~300 tokens per page

Unlimited-OCR 3B is a Modellu OCR built by Baidu. U più forti in Image / scan to structured Markdown, complex layouts, tables, multi-page documents.. Auto-ospitatu in Free.ai GPU - corre gratuitamente contr'à u vostru pool di token giornalieru (300 tokens per pagina). Rilasciatu sutta MIT - usu cummerciali permessu sutta Free.ai.

Uso via API

API REST compatibili OpenAI. Genera una chiave è chiama stu mudellu in uni pochi di siconni.

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"unlimited-ocr","prompt":"your prompt here"}'
Documentazione Otteni a chiavi API

Dumande frequenti

Unlimited-OCR 3B estrae testu da immagini e PDF. Carica una pagina scannata, una schermata, o una foto di un documentu e Unlimited-OCR 3B ritorna u testu - preservannu i salti di linea e (in motori capaci) tavule, formule, e struttura.

Unlimited-OCR 3B gestisci decine di script - latinu, cirillicu, CJK, arabbu, Devanagari, è di più. U / ocr / landing hà a lista completa di lingue per u motore.

Sì pi na scrittura a manu pulita, stampata; u cursivu e l'abbreviatu sunnu cchiù difficili. TrOCR e li muturi muderni basati supra li trasformatori sunnu notevolmenti megghiu ca lu Tesseract legacy pi a scrittura a manu.

Li motori ca si cunnisciunu a la disposizione (GOT-OCR, Marker, Florence-2) riturnanu tavuli Markdown/HTML e LaTeX pi li formuli. Li motori di testu chiaru riturnanu testu senza struttura - verificate lu modu di uscita di stu mudellu.

Unlimited-OCR 3B corre nantu à i nostri GPU da u vostru pool gratuitu quotidianu; $ 5 → 200,000 tokens pagati dopu. ~ 300 tokens per pagina.

PNG, JPG, WebP, HEIC, BMP, più PDF di una sola pagina è multi-pagina finu à 50 MB. Pagine inclinate o girate sò auto-corrette prima di l'estrazione.

La precisioni di li carattari è tipicamenti >98% supra pagine stampati puliti, caduti supra foto a vascia risuluzzioni, scansioni severamenti distorti, o fonts inusuali. Comparate i motori in /ocr/compare/ quannu la precisioni conta.

Sì - /batch/ accitta una cartella di immagini/PDF. Ogni estratta finisci in /account/?tab=history. Pi la priservazzioni di l'arbulu di cartelle usa l'API.

Sì - POST u vostru fugliali a /v1/ocr/ cu model="Unlimited-OCR 3B". Ritorna JSON cu testu + (quandu supportatu) layout + caselle di cunfini a livellu di parola. /api/ hà u rifirimentu cumpletu.

Li mudelli auto-ospitati mantèninu u vostru fugliali supra li nostri GPU; i mudelli premium passanu attraversu cu un DPA. I documenti sunnu cancellati dopu a finestra di cunnizzioni. Noi nun ci addemu a basa di i vostri input.

Sì - Free.ai cunzenti l'usu cummerciali di testu estrattu. Avete bisognu di li diritti supra lu documentu di sorgenti.

1-5 siconni pi pagina, tipicamenti. I motori cunsapevoli di u layout (tavuli, matimàtichi) pigghianu cchiù tempu. I PDF multi-pagina scalanu approssimativamenti linearmenti.

Amuri Free.ai? Dì i vostri amichi!

Valuta sta pàggina