PDF ба Markdown

Истифодаи тиҷоратӣ Намунаҳои 567 Бе ишораи обӣ Бақайдгирӣ лозим нест
& Намуна:
+ GPT-5, Claude, Gemini
Гузаронидани PDF — AI онро ба Markdown-и тозаи GitHub-и бо унвонҳо, абзацҳо, рӯйхатҳо, ҷадвалҳо ва блокҳои рамзгузорӣ нигоҳ медорад. Бо IBM Granite-Docling-258M (Apache 2.0) кор мекунад. Тезтар + боақлтар аз баровардани матни оддӣ.

Барои боркунӣ ба ин ҷо пахш кунед

5000♠200 миллион нафар.

- -
Баровардани Markdown-и бо тарҳшиносӣ шинос… ~5-10 сония/саҳифа
Боргирии Markdown (.md)
Интихобҳои иловагӣ
Натиҷа
Шумо натиҷаҳои беҳтар мехоҳед? Намунаҳои Premium (GPT-5, Claude, Gemini) сифати баландтарро таъмин мекунанд. Намоиши нақшаҳо

❤️ Шумо дӯст медоред Free.ai? Ба дӯстонатон бигӯед!

Register барои гирифтани пайвандҳои тавсияшаванда ва 30,000 нишондиҳанда барои ҳар як дӯст.

Боз ҳам мехоҳед? Бақайдгирии ройгон: 30,000 нишонаҳо/рӯз
Бақайдгирӣ

Коркарди дархости шумо...

Ҳар як PDF-ро ба Markdown-и тозаи GitHub-и бо сарлавҳаҳо, ҷадвалҳо, рӯйхатҳо ва блокҳои рамзҳо нигоҳ дошташуда табдил диҳед. Бо IBM Granite-Docling кор мекунад. Бепул, бемаҳдуд, бе қайд.

Чӣ тавр истифода бурдани PDF ба Markdown

1
Вводите свой ввод

Матнро ворид кунед, файлро бор кунед ё он чиро, ки мехоҳед, тавсиф кунед. Ҳисоби корбарӣ лозим нест.

2
Сохтани клик

Ин раванди гузариш аз як шакли раванди ибтидоӣ ба шакли раванди раванди ниҳоӣ ном дорад.

3
Боркунӣ ва тақсимкунӣ

Боргирӣ, нусха бардоред ё натиҷаи худро мубодила кунед. Барои истифодаи шахсӣ ва тиҷоратӣ ройгон аст.

Истифодаи ин асбоб тавассути API

Ин асбобро аз коди худ худкор созед. Нуқтаи охирини REST-и мувофиқи OpenAI, аутентификатсияи Bearer-token, SDK-и иловагӣ лозим нест. Нархҳои Token ба интерфейси веб мувофиқат мекунанд.

curl -X POST https://api.free.ai/v1/chat/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"model": "qwen7b", "messages": [{"role": "user", "content": "Use the PDF ба Markdown tool on: ..."}]}'

PDF ба Markdown - FAQ

Дар ягон PDF- ро кашола кунед ва AI онро ба Markdown- и тозаи GitHub- и лаззатбахш табдил медиҳад - сарлавҳаҳо сарлавҳаҳо мемонанд, ҷадвалҳо ҷадвалҳо мемонанд, рӯйхатҳо рӯйхатҳо мемонанд, блокҳои код блокҳои код мемонанд. Аз беруни матни оддӣ берун меравад; иерархияҳои сохтории ҳуҷҷат нигоҳ дошта мешаванд, то ки шумо тавонед хурӯҷро ба сайти docs, LLM RAG pipeline ё индекси ҷустуҷӯ кашола кунед.

IBM Granite- Docling- 258M (Apache 2.0). Намунаи хурди визуалӣ- ба- раванд барои табдилдиҳии ҳуҷҷати шинос бо тарҳ - pdftotext- ро мекушояд + хеле тезтар + боақлтар аз иҷрои намунаи умумии визуалӣ- забони ҳар як саҳифа.

pdftotext як дафъи ғафс аст - абзацҳо ва ҷадвалҳо ба девори калимаҳо меафтанд. Adobe Export to Word тарҳбандиро нигоҳ медорад, аммо.docx + арзиши ~ $15/mo. Docling сохтори SEMANTIC-ро нигоҳ медорад (дараҷаҳои сарлавҳа, рӯйхатҳо ҳамчун рӯйхатҳо, ҷадвалҳо ҳамчун ҷадвалҳои Markdown) ва формати LLM-ро бароварда, асбобҳои dev-ро метавонанд ҳам истеъмол кунанд.

LlamaParse ва unstructured ҳарду дараҷаҳои ройгон доранд, аммо саҳифаҳои / моҳро маҳдуд мекунанд ва калиди API-ро талаб мекунанд. Docling-258M дар GPU-и мо дар сатҳи маҳаллӣ кор мекунад + Apache 2.0-и пурра худидоракунӣ, бе ҳисобкунии ҳар як саҳифа, бе қайди калид. Сифати рақобатпазир бо LlamaParse дар ҳуҷҷатҳои стандартӣ.

Бале — ҷадвалҳо ҳамчун ҷадвалҳои канали Markdown-и мувофиқ бармегарданд. Ҷадвалҳои мураккаби бисёрсутунӣ / дарунсохт бо усули бештари фишурдакунӣ (маҳдудияти асосӣ дар Markdown, на хатои модел) фишурда мешаванд. Барои дақиқии комили ҷадвал, мо инчунин 'format=html'-ро тавассути API, ки rowspan/colspan-ро нигоҳ медорад, дастгирӣ мекунем.

Granite- Docling қадами OCR- ро худаш иҷро мекунад — дар PDF- ҳои рақамӣ ва сканшуда яксон кор мекунад. Сканшуда бо DPI- и паст (< 150) баъзе дақиқии матнро аз даст медиҳад; барои натиҷаҳои беҳтарин бо DPI- и 200+ дубора скан кунед.

Бисёри равияҳои LaTeX- и тасвиршуда ҳамчун матнҳои матнии `$... $` ба даст меоянд. Барои мақолаҳои илмӣ бо матнҳои матнӣ мо инчунин абзори ҷудокунии мақолаи илмӣ (Nougat) - ро пешниҳод мекунем, ки махсусан барои равияҳо ва иқтибосҳо танзим шудааст.

Дар бораи 5-10 сония дар як саҳифа дар H200 мо. Хабари 30-саҳифа ~ 3-5 дақиқа аст. Модели хурд маънои онро дорад, ки гурӯҳҳои хурди PDF-ҳо дар маҷмӯи рӯзона озоданд.

200 нишона дар ҳар саҳифа, бо 500- нишона дар замина. 5- саҳифа шартнома = 1000 нишона. 30- саҳифа ҳисобот = 6000 нишона. 30K рӯзона озод захираи истифодаи бештар оддӣ.

PDF — ҳардуи рақамӣ ва сканшуда дастгирӣ карда мешаванд. Боркунии максималии 50 МБ. Дигар форматҳои ҳуҷҷат (DOCX, EPUB, HTML ва ғайра) дар нақша ҳастанд; барои ҳол, аввал боркунӣ ва табдилдиҳӣ бо асбоби табдилдиҳии pdf.

Дарҳол коркард карда мешавад, хурӯҷи Markdown нигоҳ дошта мешавад (24 соат бе ном / 7 рӯз бо пардохти пайванди пайванд), манбаъ PDF баъди баровардани он нобуд карда мешавад. Ҳеҷ гоҳ барои омӯзиш истифода набаред. / privacy / барои сиёсати пурра.

Бале — POST як қисми бисёри `файл` ба /v1/document/pdf-to-markdown/. Бармегардад {markdown_url, саҳифаҳо, пешнамоиш, нишонаҳо, share_url}. Автентикатсияи соҳиб (sk-free-…) 10K нишонаҳои ройгон/моҳро медиҳад. /api/ мисоли curl дорад.

Бақайдгирии ройгон: 30,000 нишонаҳо/рӯз

Сохтани ҳисоб

Корти кредитӣ лозим нест

Шумо ин асбобро чӣ гуна баҳо медиҳед?

Шумо дӯст медоред Free.ai? Ба дӯстонатон бигӯед!