GOT-OCR v2
Free.ai
·
ocr
·
~500 märgid per page
GOT-OCR v2 on an OMT mudel. Läbi suunatud välised mudelid - ~500 tokens lehekülje kohta (50% hinnalisand üle eelmise etapi kulud).
Kasutamine API kaudu
OpenAI ühilduv REST API. Genereeri võti ja kutsu seda mudelit sekundites.
curl -X POST https://api.free.ai/v1/ocr/ \
-H "Authorization: Bearer sk-free-..." \
-H "Content-Type: application/json" \
-d '{"model":"premium/got-ocr/v2","prompt":"your prompt here"}'
API dokumentatsioon
API võtme hankimine
Korduma kippuvad küsimused
GOT-OCR v2 võtab teksti välja piltidelt ja PDF- telt. Laadi üles skaneeritud lehekülg, pilt või foto dokumendist ja GOT-OCR v2 tagastab teksti - säilitab rea katkestused ja (võimekate mootorite puhul) tabelid, valemid ja struktuuri.
GOT-OCR v2 tegeleb kümnete skriptidega - ladina, kirillitsa, CJK, araabia, Devanagari ja muuga. /ocr/ maandumine on täiskeeles nimekiri mootori kohta.
Jah puhta trükitud käekirja jaoks, kursiivne ja lühikäsi on raskem. TrOCR ja kaasaegsed trafol põhinevad mootorid on märgatavalt paremad kui pärand Tesseract käekirja kirjutamisel.
Paigutus-vara mootorid (GOT-OCR, Marker, Florence-2) tagastab Markdown / HTML tabelid ja LaTeX valemid. Plain- tekst mootorid tagasi teksti ilma struktuuri - kontrollida selle mudeli väljundrežiimi.
GOT-OCR v2 on premium OCR mootor. Umbes ~500-1500 märgid lehe kohta, näidatud otse enne kui genereerite. Isehostitud OCR jookseb tasuta oma 30000-token päevas bassein; premium mudelid on tasu-nagu-you-go, koos lisatööd alates $1.
PNG, JPG, WebP, HEIC, BMP, pluss ühe- ja mitmeleheküljelised PDF-id kuni 50 MB. Keerutatud või pööratud lehekülgi on automaatselt korrigeeritud enne väljavõtmist.
Märkide täpsus on tavaliselt >98% puhastel trükilehekülgedel, langedes madala re- fotodele, tugevalt viltu jäänud skaneeritud või ebatavalisi fonte. Võrdle mootoreid /ocr/ compare/, kui täpsus on oluline.
Jah - / batch/ a kaust / PDFs iga väljatõmbamine asukohas / konto /. tab=ajaloo. Kaustade/ puude säilitamiseks kasuta API.
Jah - postita fail /v1/ocr/ mudeliga="GOT-OCR v2". Tagastab JSON- i teksti + (kui seda toetab) paigutuse + sõnataseme piiramise kastidega. /api/ on olemas täielik viide.
Isehostitud mudelid hoiavad teie faili meie GPU-s; premium läbib DPA. Dokumendid kustutatakse pärast aktsiaakent. Me ei treeni teie sisendeid.
Jah - Free.ai annab väljavõtetud teksti kaubandusliku kasutamise. Vajad lähtedokumendi õigusi.
1-5 sekundit lehe kohta tavaliselt. Paigutus-teadlikud mootorid (tabelid, matemaatika) võtavad kauem aega. Mitmeleheküljelised PDF-id skaalal umbes lineaarselt.