Unlimited-OCR 3B

Free.ai (self-hosted) · ocr · ~300 Ցուցադրել page

Թափել ֆայլը այստեղ կամ սեղմել ՝ ընթերցելու համար

~300 Ցուցադրել page

Unlimited-OCR 3B is an OCR մոդել built by Baidu. Strongest at Image / scan to structured Markdown, complex layouts, tables, multi-page documents.. Free.ai GPU-ների վրա ինքնուրույն տեղադրված — աշխատում է անվճար ձեր օրական token pool-ի դեմ (300 tokens էջ). Հրապարակված է MIT - առևտրային օգտագործման թույլտվությամբ Free.ai.

Օգտագործել API- ի միջոցով

OpenAI-ի հետ համընկնող REST API-ն է։ Գործարկեք կոդը և մի քանի վայրկյանում զանգահարեք այս մոդելին։

curl -X POST https://api.free.ai/v1/ocr/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model":"unlimited-ocr","prompt":"your prompt here"}'
API փաստաթղթավորում Գրանցվել API կոդով

Հաճախակի տրվող հարցեր

Unlimited-OCR 3B-ը տեքստը դուրս է բերում պատկերներից և PDF-ներից։ Բեռնեք սկանավորված էջ, նկար կամ փաստաթղթի լուսանկար և Unlimited-OCR 3B-ը կվերադարձնի տեքստը՝ պահպանելով տողանցումները և (կարող ռեսուրսների դեպքում) աղյուսակներ, ձևանմուշներ և կառուցվածք։

Unlimited-OCR 3B-ը բաշխում է տասնյակ գրառումներ՝ լատիներեն, կիրիլին, CJK, արաբերեն, դեվանագարի և այլն։ /ocr/ էջում կարող եք գտնել յուրաքանչյուր բառի համար լեզվի ամբողջական ցանկը։

Ճիշտ է, մաքրության համար տպագրված ոճով ձեռքի գրառում; կուրսիվան և սեղմագրությունը ավելի դժվար են։ TrOCR և ժամանակակից փոխակերպիչների վրա հիմնված մեքենաները զգալիորեն ավելի լավ են, քան Tesseract-ի ձեռքի գրառումը։

Տեսակների մասին տեղեկացված ռեժիմները (GOT-OCR, Marker, Florence-2) վերադարձնում են Markdown/HTML աղյուսակներ և LaTeX ձևաչափեր։ Պարզ տեքստի ռեժիմները վերադարձնում են տեքստը առանց կառուցվածքի՝ ստուգելով այս մոդելի ելքի ռեժիմը։

Unlimited-OCR 3B runs on our GPUs from your daily free pool; $5 → 200,000 paid tokens after. ~300 tokens per page.

PNG, JPG, WebP, HEIC, BMP, ինչպես նաև մեկ կամ մի քանի էջից բաղկացած PDF-ներ մինչև 50 ՄԲ։ Չափից դուրս երկար կամ պտտված էջերը ինքնաբերաբար ուղղվում են հանման ժամանակ։

Սիմվոլների ճշգրտությունը սովորաբար >98% է մաքուր տպված էջերի դեպքում, ցածր ճանաչողական լուսանկարների, ծանրաբեռնված սկանների կամ անսովոր տառատեսակների դեպքում։ Համեմատեք /ocr/compare/-ի սարքեր, երբ ճշգրտությունը կարևոր է։

Այո - /batch/-ը ընդունում է պատկերների/PDF-ների պանակ։ Յուրաքանչյուր դուրսբերում կատարվում է /account/?tab=history պանակում։ Ծառի պահպանման համար օգտագործեք API-ն։

Այո - POST Ձեր ֆայլը /v1/ocr/-ին model="Unlimited-OCR 3B"-ով: Վերադարձնում է JSON-ը տեքստի + (եթե աջակցվում է) դասավորության + բառային մակարդակի սահմանափակման տուփերի հետ: /api/-ն ունի ամբողջական հղում։

Իրենց վրա աշխատող մոդելները պահում են ձեր ֆայլը մեր GPU-ներում, premium-ը անցնում է DPA-ով։ Դիտարկվող փաստաթղթերը ջնջվում են կիսում-պատուհանի բացումից հետո։ Մենք չենք սովորեցնում ձեր մուտքագրումները։

Այո - Free.ai- ը թույլ է տալիս արտահանված տեքստը օգտագործել առևտրային նպատակներով: Դուք պետք է ունեք սկզբնական փաստաթղթի իրավունքներ:

Ընդհանուր առմամբ 1-5 վայրկյան էջը մեկ։ Համակարգչային ծրագրերը (հարցման ձևեր, մաթեմատիկա) ավելի երկար են պահանջում։ Բազմաէջ PDF-ները մոտավորապես գծային են մեծանում։

Սիրում ես Free.ai-ը, ասա ընկերներիդ։

Առաջարկել այս էջը