AI OCR në Markdown

Përdorimi komercial OK 380+ modele Pa shenjë uji Nuk është e nevojshme regjistrimi
Modeli:
+ GPT-5, Claude, Gemini
Hidhe një imazh, ekranfoto, ose skanoje dhe kthehu tek Markdown i pastër — titujt mbeten tituj, tabelat mbeten tabela, listat mbeten lista. Shpejtësohet nga modeli jonë i vetë-hostuar i palimit OCR, i rregulluar për analizimin e dokumenteve të vetëdijshëm për strukturën në vend të një dëmtimi të thjeshtë teksti. Më e mira për faqet e strukturuara: letra, fatura, formularë, raporte.
Pikëpamja e lartë për faqet e dendur / komplekse; e shpejtë për skanimet e përditshme dhe më shumë gjuhë.

Lëviz figurën për t'a konvertuar në Markdown

PNG, JPG, WebP deri në 10MB - një faqe për figurë

Pamja e parë
~800 tokens
Markdown output

        

Për çfarë është e mirë

Tabelat dhe formularët

Fakturat, fletat e specifikimit dhe raportet kthehen si tabela të vërteta Markdown në vend të një muri të përzier të numrave - ngjiten drejtpërdrejt në një dokument ose një tubacion RAG.

Artikull

Titujt, seksionet dhe listat mbajnë strukturën e tyre, kështu që një raport i skanuar bëhet Markdown i ndryshueshëm që mund të hidhet në një faqe dokumentesh ose të ushqehet në një LLM.

Shumëgjuhësh

Modeli është i ndërtuar për faqe të dendur, komplekse dhe trajton kinezisht, anglisht dhe më shumë - të dobishme ku një motorr i thjeshtë OCR garbles layouts e ngushtë.

Mundësitë e avancuara
Rezultati
Tokenët po i mbaron. Merr më shumë token
Dëshiron rezultate më të mira? Modelet Premium (GPT-5, Claude, Gemini) ofrojnë cilësi më të lartë. Shiko Planet

❤️ Të pëlqen Free.ai?

Regjistrohu për të marrë një lidhje referuese dhe fiton 30,000 token për mik.

Do më shumë? Regjistrohu falas për 30K token/ditë + 10K bonus
Regjistrohu

Duke përpunuar kërkesën tuaj...

Kthe çdo figurë, screenshot apo skanim në Markdown të pastër me OCR të AI të lirë. Ruan titujt, tabelat dhe listat — mbështetur nga modeli i vetë-hostuar i palimituar OCR.

Si të përdorësh AI OCR në Markdown

1
Shkruaj

Shkruaj tekst, ngarko një file, ose përshkruaj atë që do. Nuk duhet asnjë llogari.

2
Kliko për të krijuar

AI jonë e përpunon kërkesën tuaj në sekonda duke përdorur modelet më të mira të burimit të hapur.

3
Shkarko dhe nda

Shkarko, kopjo ose ndaje rezultatin tënd. Pa pagesë për përdorim personal dhe komercial.

Përdor këtë instrument nëpërmjet API

Automatizo këtë instrument nga kodi juaj. Pika e fundit e përshtatshme OpenAI-REST, autentifikimi me token e bartësit, nuk kërkohet SDK shtesë. Kostot e token-it përputhen me ndërfaqen web.

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

AI OCR në Markdown - FAQ

Ngarko një imazh, ekranfoto, ose skano dhe ktheje Markdown të pastër — titujt, tabelat dhe listat mbajnë strukturën e tyre në vend që të shkatërrohen në një tekst të thjeshtë. Kjo është e mbështetur nga Unlimited-OCR, një model 3B i vetë-hostuar i përshtatur për analizimin e dokumenteve të njohura nga hapësirat, kështu që rezultati është gati për t'u ngjitur në një site dokumentesh, një aplikim shënimi, ose një LLM pipeline.

OCR i thjeshtë (instrumenti ynë /ocr/, Tesseract) ju jep fjalët e papërpunuara në rendin e leximit - i mirë për kopjimin e shpejtë dhe ngjitjen, por tabelat shtrihen dhe titujt humbin hierarkinë e tyre. OCR për Markdown kupton strukturën e faqes dhe e rindërton atë: një tabelë bëhet një tabelë Markdown pipe-table, një titull mbetet një titull, një listë me pikë mbetet një listë. Përdor OCR të thjeshtë për shpejtësi, këtë për strukturë.

Ju zgjedhni motorin — të dyja funksionojnë lirisht në GPU-të tona, asgjë nuk dërgohet tek një API e të tretës. "Praktësi e lartë" është OCR i pa kufizuar (baidu, MIT, 3B, DeepSeek-OCR-bazuar), më i forti në strukturën e dendur dhe komplekse. "Shpejtë" është PaddleOCR-VL (PaddlePaddle, Apache 2.0, ~1B), më i lehtë dhe më i shpejtë me 109 gjuhë të mbuluara dhe analizimin e diagrameve. Të dyja janë të ndërtuara për analizimin e dokumenteve në vend të njohjes së tekstit me një rresht.

Po - tabelat kthehen si tabela të duhura Markdown pipe, që është qëllimi i përdorimit të kësaj mbi OCR të thjeshtë. Tabelat shumë komplekse të vendosura ose me shumë kollona përplasen më agresivisht (një kufizim bazë Markdown), por faturat standarde, fletat e specifikimeve dhe tabelat e raporteve konvertohen pa probleme.

Është shumëgjuhësh me mbështetje të veçantë të fortë për kinezisht dhe anglisht, dhe trajton shumë shkrime të tjera. Saktësia është më e mirë në faqet e qarta, me rezolucion të lartë; rezolucioni shumë i ulët ose teksti i stilizuar është më i vështirë, si me çdo OCR.

Kjo mjet merr një PDF të tërë dhe kryen IBM Granite-Docling faqe për faqe — më mirë kur keni një PDF me shumë faqe. Kjo mjet merr një figurë të vetme ose një screenshot dhe kryen modelin më të madh të palimit të OCR, që është më i fortë në faqe të dendura ose komplekse. Përdor instrumentin PDF për dokumentet që ke si PDF; përdor këtë për screenshot, fotografi të faqes dhe skanime individuale.

Kjo mjet merr një figurë (PNG / JPG / WebP) në një kohë - një faqe për figurë. Për PDF-të me shumë faqe, përdor /document/pdf-to-markdown/ (whole-PDF Markdown) ose /ocr/document/ (searchable-PDF / text). Nëse keni vetëm një faqe PDF, eksportoni apo merrni një kopje të faqes dhe lëshoni këtu.

Nëse nuk dëshironi strukturën Markdown, vetëm tekstin e papërpunuar në rendin e leximit, zgjidhni Tekst i thjeshtë. Modeli pastaj ekzekutohet në modalitetin e drejtpërdrejtë OCR dhe kthen fjalët pa tituj, tabela apo formatimin e listës. Markdown është i paracaktuar sepse është ajo që e bën këtë instrument të veçantë.

Punon me fotot e letres të telefonuara, por konvertimi më i mirë bëhet me fotografi të pastra, të rrafshta dhe të ndriçuara mirë. Shfaqjet, shtrirja e madhe dhe hijet dëmtojnë saktësinë. Nëse një foto del keq, ri-fotografoje me dritë të barabartë ose skanoje me 200+ DPI.

Figurat përpunohen në GPU-të tona dhe hiqen — nuk trajnojmë mbi ngarkimet tuaja. Ne regjistrojmë vetëm një stampë kohe dhe koston e token për faturimin, kurrë përmbajtjen e dokumentit. Përdoruesit e regjistruar marrin një hyrje të historisë së krijimit (një parashikim të shkurtër) që mund ta eleminoni në çdo kohë nga /account/?tab=history. Politika e privatësisë në /privacy/.

Pa pagesë në poolin e token-ëve të përditshëm (~800 token-ë për faqe) — pa kredit-kartë. Konvertimet tuaja të para punojnë pa një llogari; regjistrimi zbulon poolin e përditshëm të plotë, historinë dhe hyrjen në të gjitha 400+ instrumentet e Free.ai.

Po. POST multipart në /v1/ocr/ me imazhin tuaj, model=unlimited-ocr, dhe output_format=markdown (ose i thjeshtë). Përgjigjia JSON ka një fushë teksti me Markdown. Autentifikimi i bartësit, 10K tokens/muaj pa pagesë. /api/ ka shembullin e curl.

Regjistrohu falas — 30,000 tokens/day

Krijo një profil të ri

Nuk kërkohet karta e kreditit

Si do ta vlerësoni këtë mjet?

Të pëlqen Free.ai?