GOT-OCR v2

Free.ai · ocr · ~500 tokens per page

Lasciari un file cciù o cliccari pi sfogliari

~500 tokens per page
Funziona liberamenti supra li nostri GPU. Aggiornamentu pi GOT-OCR v2 →

GOT-OCR v2 is a Modellu OCR. Routed attraversu modelli esterni - ~500 tokens per pagina (50% markup supra u costu upstream).

Uso via API

API REST compatibili OpenAI. Genera una chiave è chiama stu mudellu in uni pochi di siconni.

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"premium/got-ocr/v2","prompt":"your prompt here"}'
Documentazione Otteni a chiavi API

Dumande frequenti

GOT-OCR v2 estrae testu da immagini e PDF. Carica una pagina scannata, una schermata, o una foto di un documentu e GOT-OCR v2 ritorna u testu - preservannu i salti di linea e (in motori capaci) tavule, formule, e struttura.

GOT-OCR v2 gestisci decine di script - latinu, cirillicu, CJK, arabbu, Devanagari, è di più. U / ocr / landing hà a lista completa di lingue per u motore.

Sì pi na scrittura a manu pulita, stampata; u cursivu e l'abbreviatu sunnu cchiù difficili. TrOCR e li muturi muderni basati supra li trasformatori sunnu notevolmenti megghiu ca lu Tesseract legacy pi a scrittura a manu.

Li motori ca si cunnisciunu a la disposizione (GOT-OCR, Marker, Florence-2) riturnanu tavuli Markdown/HTML e LaTeX pi li formuli. Li motori di testu chiaru riturnanu testu senza struttura - verificate lu modu di uscita di stu mudellu.

GOT-OCR v2 hè un mutore OCR premium. Circa ~ 500-1,500 tokens per pagina, mostrati in diretta prima di generà. L'OCR auto-ospitatu corre gratuitamente nantu à u vostru pool di 30,000 tokens ogni ghjornu; i mudelli premium sò pay-as-you-go, cù top-ups da $ 1.

PNG, JPG, WebP, HEIC, BMP, più PDF di una sola pagina è multi-pagina finu à 50 MB. Pagine inclinate o girate sò auto-corrette prima di l'estrazione.

La precisioni di li carattari è tipicamenti >98% supra pagine stampati puliti, caduti supra foto a vascia risuluzzioni, scansioni severamenti distorti, o fonts inusuali. Comparate i motori in /ocr/compare/ quannu la precisioni conta.

Sì - /batch/ accitta una cartella di immagini/PDF. Ogni estratta finisci in /account/?tab=history. Pi la priservazzioni di l'arbulu di cartelle usa l'API.

Sì - POST u vostru fugliali a /v1/ocr/ cu model="GOT-OCR v2". Ritorna JSON cu testu + (quandu supportatu) layout + caselle di cunfini a livellu di parola. /api/ hà u rifirimentu cumpletu.

Li mudelli auto-ospitati mantèninu u vostru fugliali supra li nostri GPU; i mudelli premium passanu attraversu cu un DPA. I documenti sunnu cancellati dopu a finestra di cunnizzioni. Noi nun ci addemu a basa di i vostri input.

Sì - Free.ai cunzenti l'usu cummerciali di testu estrattu. Avete bisognu di li diritti supra lu documentu di sorgenti.

1-5 siconni pi pagina, tipicamenti. I motori cunsapevoli di u layout (tavuli, matimàtichi) pigghianu cchiù tempu. I PDF multi-pagina scalanu approssimativamenti linearmenti.

Amuri Free.ai? Dì i vostri amichi!

Valuta sta pàggina