GOT-OCR 2.0

Free.ai (self-hosted) · ocr · ~300 token/s page

Arrastatu fitxategi bat hona edo egin klik arakatzeko

~300 token/s page

GOT-OCR 2.0 an OCR modeloa da, Alibaba Cloud-ek eraikia. Strongest at Advanced OCR for documents, tables, equations. Free.ai GPUtan auto-ostatua — zure eguneroko token pool-aren aurka doan exekutatzen da (300 tokens orrialde bakoitzeko). Apache 2.0 lizentziapean argitaratua - erabilera komertziala Free.ai lizentziapean baimenduta.

Erabili API bidez

OpenAI-rekin bateragarria den REST APIa. Sortu gako bat eta deitu eredu honi segundotan.

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"got-ocr2","prompt":"your prompt here"}'
API dokumentazioa Eskuratu API gakoa

Maiz egiten diren galderak

GOT-OCR 2.0-ek testua ateratzen du irudietatik eta PDFetatik. Kargatu eskaneatutako orrialde bat, pantaila-argazki bat edo dokumentu baten argazki bat, eta GOT-OCR 2.0-ek testua itzuliko du - lerro-jauziak eta (gaitasun-motorretan) taulak, formulak eta egitura mantenduz.

GOT-OCR 2.0-ek dozenaka idazkera kudeatzen ditu - latina, zirilikoa, CJK, arabiera, Devanagari eta beste batzuk. /ocr/ helmugak motor bakoitzeko hizkuntza zerrenda osoa du.

Bai, eskuz idatzitako estilo garbirako; kurtsiboa eta laburdura zailagoak dira. TrOCR eta transformadoreetan oinarritutako motor modernoak nabarmen hobeak dira eskuz idatzita Tesseract zaharra baino.

Diseinu-jakintsu motorrek (GOT-OCR, Marker, Florence-2) Markdown/HTML taulak eta LaTeX formulak itzultzen dituzte. Testu arrunteko motorrek egiturarik gabeko testua itzultzen dute - egiaztatu eredu honen irteera-modua.

GOT-OCR 2.0 gure GPUetan exekutatzen da zure eguneroko pool libretik; $5 → 200.000 ordaindutako token ondoren. ~300 token orri bakoitzeko.

PNG, JPG, WebP, HEIC, BMP, eta orri bakarreko eta orri anitzeko PDFak, 50 MB arte. Orri okerrak edo biraturiko orrialdeak automatikoki zuzentzen dira erauzteko aurretik.

Karaktereen zehaztasuna %98 baino handiagoa da orri garbietan, bereizmen txikiko argazkietan, eskaneatze oso okerretan edo letra-tipo arraroetan. Konparatu /ocr/compare/-ko motorrak zehaztasuna garrantzitsua denean.

Bai - /batch/-ek irudi/PDF karpeta bat onartzen du. Erauzketa bakoitza /account/?tab=history-n geratuko da. Karpeta-zuhaitza gordetzeko, erabili APIa.

Bai - POST zure fitxategia /v1/ocr/-ra model="GOT-OCR 2.0"-rekin. JSON itzultzen du testuarekin + (onartzen denean) diseinua + hitz-mailako muga-laukiak. /api/-k erreferentzia osoa du.

Auto-ostatutako modeloek zure fitxategia gure GPUetan gordetzen dute; premium-ek DPA-rekin igarotzen dute. Dokumentuak partekatze-leihoaren ondoren ezabatzen dira. Ez dugu zure sarrerak entrenatzen.

Bai - Free.ai-ek erauzitako testua erabiltzeko baimena ematen du. Iturburu-dokumentuaren eskubideak behar dituzu.

1-5 segundo orrialde bakoitzeko normalean. Diseinua kontuan hartzen duten motorrek (taulak, matematika) denbora gehiago behar dute. Orrialde anitzeko PDFak gutxi gorabehera linealki eskalatzen dira.

Maite duzu Free.ai? Esan lagunei!

Balioetsi orrialde hau