GOT-OCR v2
Free.ai
·
ocr
·
~500 Token pro page
D'Fréijoer ass d'Joer vum 5. bis den 15. D'Spill ass op 3D-Grafiken baséiert, déi mat 50% (oder 100% wann et méi wéi 500 Säiten sinn) eropgeluede kënne ginn.
D'API
OpenAI-kompatibel REST API. Generéiert e Schlëssel an rufft dat Modell an e puer Sekonnen op.
curl -X POST https://api.free.ai/v1/ocr/ \
-H "Authorization: Bearer sk-free-..." \
-H "Content-Type: application/json" \
-d '{"model":"premium/got-ocr/v2","prompt":"your prompt here"}'
Dokumentatioun
API Schlëssel
Häufig gestallte Froen
GOT-OCR v2 extrahéiert Text aus Biller a PDFen. Laden Sie eine gescannte Seite, einen Screenshot oder eine Foto eines Dokuments hoch und GOT-OCR v2 gibt den Text zurück — mit Erhalt von Zeilenabschnitten und (a fähigen Enginen) Tabellen, Formeln und Struktur.
GOT-OCR v2 schafft mat Dutzende vu Schrëfte - laténgesch, kyrillesch, CJK, Arabisch, Devanagari, a méi. D' /ocr/-Landesäit huet d'ganz Sprooche-Lëscht pro Motor.
Et ass e relativ klengt Stärebild, dat sech aus 12 Stären zesummesetzt, déi an enger ronn Form an der Mëtt vun der Spektralklass A12 läit.
Layout-aware Engines (GOT-OCR, Marker, Florence-2) ginn Markdown/HTML-Tabellen zréck an LaTeX fir Formelen. Plain-Text-Engines ginn Text ouni Struktur zréck - kontrolléiert den Ausgabemodus vun dësem Modell.
GOT-OCR v2 ass eng Premium-OCR-Engine. Ëm ~500-1500 Token pro Säit, live gewisen ier Dir generéiert. Self-hosted OCR leeft gratis op Ärem 30.000-Token-Dagpool; Premium-Modeller sinn no Gebrauch bezuelbar, mat Top-ups vu $1.
PNG, JPG, WebP, HEIC, BMP, plus eenzesäiteg a méisäiteg PDFen bis zu 50 MB. Schief oder gedréit Säite ginn automatesch korrigéiert ier se extrahéiert ginn.
D'Zeechepräzisioun ass normalerweis >98% op sauberen gedréite Säiten, fällt op Fotoen mat niddriger Opléisung, staark verzerrte Scans oder ongewéinlech Schrëfte. Vergläichsmotoren op /ocr/compare/ wann d'Präzisioun wichteg ass.
Ja — /batch/ akzeptéiert en Ordner mat Biller/PDFen. All Extraktioun fält an /account/?tab=history. Fir d'Erhale vum Ordnerbaum benotzt d'API.
D'Sprooch ass eng vun de gréisste Sproochen op der Welt. /tʃ/ gëtt als /tʃ/ ausgeschwat, /tʃ/ als /tʃ/, /tʃ/ als /tʃ/, /tʃ/ als /tʃ/, /tʃ/ als /tʃ/.
Self-hosted Modeller halen Är Datei op eise GPUen; Premium passt mat engem DPA duerch. Dokumenter ginn no dem Share-Fenster geléist. Mir trainéieren net op Är Inputen.
Ja — Free.ai erlaabt eng kommerziell Benotzung vum extrahéierte Text. Dir braucht d'Recht op d'Quelldokument.
Normalerweis 1-5 Sekonnen pro Säit. Layout-sensitiv Engineen (Tabellen, Mathematik) daueren méi laang. PDFe mat méi Säiten skaléieren ongeféier linear.