PaddleOCR-VL

Free.ai (self-hosted) · ocr · ~300 tokens per page

Lasciari un file cciù o cliccari pi sfogliari

~300 tokens per page

PaddleOCR-VL is a Modellu OCR built by PaddlePaddle. U più forti in Fast multilingual image / scan to Markdown; tables, formulas, charts; 109 languages.. Auto-ospitatu in Free.ai GPU - corre gratuitamente contr'à u vostru pool di token giornalieru (300 tokens per pagina). Rilasciatu sutta Apache 2.0 - usu cummerciali permessu sutta Free.ai.

Uso via API

API REST compatibili OpenAI. Genera una chiavi è chiama stu mudellu in siconni.

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"paddleocr-vl","prompt":"your prompt here"}'
Documentazione Otteni a chiavi API

Dumande frequenti

PaddleOCR-VL estrae testu da immagini e PDF. Carica una pagina scannata, una schermata, o una foto di un documentu e PaddleOCR-VL ritorna u testu - preservannu i salti di linea e (in motori capaci) tavule, formule, e struttura.

PaddleOCR-VL gestisci decine di script - latinu, cirillicu, CJK, arabbu, Devanagari, è di più. U / ocr / landing hà a lista completa di lingue per u motore.

Sì pi na scrittura a manu pulita, stampata; u cursivu e l'abbreviatu sunnu cchiù difficili. TrOCR e li muturi muderni basati supra li trasformatori sunnu notevolmenti megghiu ca lu Tesseract legacy pi a scrittura a manu.

Li motori ca si cunnisciunu a la disposizione (GOT-OCR, Marker, Florence-2) riturnanu tavuli Markdown/HTML e LaTeX pi li formuli. Li motori di testu chiaru riturnanu testu senza struttura - verificate lu modu di uscita di stu mudellu.

PaddleOCR-VL corre nantu à i nostri GPU da u vostru pool gratuitu quotidianu; $ 5 → 200,000 tokens pagati dopu. ~ 300 tokens per pagina.

PNG, JPG, WebP, HEIC, BMP, più PDF di una sola pagina è multi-pagina finu à 50 MB. Pagine inclinate o girate sò auto-corrette prima di l'estrazione.

La precisioni di li carattari è tipicamenti >98% supra pagine stampati puliti, caduti supra foto a vascia risuluzzioni, scansioni severamenti distorti, o fonts inusuali. Comparate i motori in /ocr/compare/ quannu la precisioni conta.

Sì - /batch/ accitta una cartella di immagini/PDF. Ogni estratta finisci in /account/?tab=history. Pi la priservazzioni di l'arbulu di cartelle usa l'API.

Sì - POST u vostru fugliali a /v1/ocr/ cu model="PaddleOCR-VL". Ritorna JSON cu testu + (quandu supportatu) layout + caselle di cunfini a livellu di parola. /api/ hà u rifirimentu cumpletu.

Li mudelli auto-ospitati mantèninu u vostru fugliali supra li nostri GPU; i mudelli premium passanu attraversu cu un DPA. I documenti sunnu cancellati dopu a finestra di cunnizzioni. Noi nun ci addemu a basa di i vostri input.

Sì - Free.ai cunzenti l'usu cummerciali di testu estrattu. Avete bisognu di li diritti supra lu documentu di sorgenti.

1-5 siconni pi pagina, tipicamenti. I motori cunsapevoli di u layout (tavuli, matimàtichi) pigghianu cchiù tempu. I PDF multi-pagina scalanu approssimativamenti linearmenti.

Amuri Free.ai? Dì i vostri amichi!

Valuta sta pàggina