PDF OCR
商用OK
380+モデル
透かしなし
登録は不要
モデル:
+ GPT-5, Claude, Gemini
スキャンした PDF を選択可能な検索可能なテキストに変換します。各ページを 200 DPI でラスター化し、OCR を実行します。Tesseract (高速、無料)、GOT-OCR2 (多列と表に適しています)、またはプレミアム fal OCR (劣化した/履歴のあるスキャンに適しています)を選択してください。出力は.txt、.docx、またはページラベル付きテキストです。
PDF ではなく画像がある場合は /ocr/ を使ってください。
OCR 結果
PDF OCR を使うとき
請求書+領収書
会計管理、返金、AP自動化のためにスキャンした請求書の積み重ねを編集可能なテキストに変換します。
古書・古文書
廃盤の本、歴史的文書、図書館のアーカイブを検索可能なテキストにデジタル化します。
法律と医療記録
検索とeDiscoveryワークフローのためにスキャンしたケースファイル、医療報告書、またはファクス文書の内部のテキストをロック解除します。
翻訳前
テキストを抽出するために OCR を実行し、結果を /pdf/translator/ に送信して、どの言語にも変換する。
Free.ai PDF OCR と有料ツール
| Free.ai | Adobe Acrobat Pro | ABBYY FineReader | Smallpdf | |
|---|---|---|---|---|
| 出品価格 | 自由 | $19.99/mo | $199 one-time | $9/mo |
| Pick OCRエンジン | (3) | — | — | — |
| 言語 | 100+ | 40+ | 200+ | 20+ |
| パブリックAPI | — | — | — | |
| 登録なしで動作 | — | — | — |
追加オプション
結果
証券が足りない
もっとトークンを取得
もっと欲しい?
無料登録で1日30Kトークン+10Kボーナス
無料登録
ご要望を処理中...
スキャンした PDF を選択可能な検索可能なテキストに変換します。Tesseract、GOT-OCR2、およびプレミアム OCR エンジン。99 言語。無料。
使い方 PDF OCR
1
入力を入力
テキストを入力、ファイルをアップロード、または必要なことを記述します。アカウントは必要ありません。
2
クリックして生成
私たちのAIは、最良のオープンソースモデルを使って、あなたの要求を数秒で処理します。
3
ダウンロードと共有
結果をダウンロード、コピー、共有できます。個人的、商業的な使用は無料です。
関連するフリーAIツール
PDF OCR — FAQ
スキャンしたPDF(画像のみ、選択できないテキスト)を検索可能、コピー可能、AIで読めるテキストに変換します。スキャンしたページのPDF(請求書、契約書、古本、手書きのメモ)をアップロードして、プレーンテキスト、.docx、ページ番号付きテキストを取り戻します。
私たちのセルフホストの Tesseract OCR (フリー・ティア) では、ページ当たり約 500 個のトークンを使用します。GOT-OCR2 はページ当たり約 800 個のトークンを使用し、複雑なレイアウト (多列、表、方程式) をよりよく扱います。プレミアム fal OCR は、劣化したスキャンの最高精度を得るためにページ当たり約 2500 個のトークンを使用します。3 つのオプションは、800 個のトークンを使用します。1 ページのアップロードは純粋なオーバーヘッドではありません。
Tesseract (デフォルト、無料) は清潔な印刷スキャンに使用できます。GOT-OCR2 (無料、遅い) は多列の研究論文、科学的方程式、アジア語文書に使用できます。レイアウトモデルがはるかに良いです。Premium fal OCRは、劣化した/低解像度/歴史的なスキャンにのみ使用できます。
Tesseract はラテン語、中国語、日本語、韓国語、アラビア語、キリル文字、ヘブライ文字、ヒンディー語、タイ語、ベトナム語など100以上の言語をサポートします。30-50% の正確さを得るには、言語ヒント (eng/spa/fra/deu/jpn/chi_sim/ara/etc.) を送信してください。自動検出は機能しますが、遅い。
3つ目は、.txt(単純な、文書全体のファイル)、.docx(ページ切れを保存したWord)、ページごとの.txt(ページ間のヘッダを付けて出力で特定のページを見つける)。
300 DPI のクリーンスキャンでは、印刷されたラテン文字の場合は 99%+。150 DPI のスキャン、消えた文書、手書きの場合は 90-95% に下がります。非ラテン文字 (中国語、アラビア語、ヒンディー語) は Tesseract よりも言語ヒントと GOT-OCR2 でよりよく動作します。
手書きの OCR は印刷テキストよりも難しい。プレミアム OCR でも 70-85% の正確さを期待してください。白紙に清潔な手書きのフォーム (イタリックではありません) の場合は Tesseract が使えます。イタリック/混乱したメモの場合は、手書きモードを備えたプレミアム fal OCR がより信頼できます。
テッセラクトではページ当たり1-3秒、GOT-OCR2では3-5秒、プレミアムfalでは5-10秒です。50ページのスキャンされた本は1-3分かかります。重いタスクのバナーはタブを閉じて、終わったら結果をメールで受け取ることができます。
アップロードされた PDF はラスター化され、ページごとに OCRed され、その後削除されます。出力ファイルは共有リンクで CDN 上で 24 時間(有料プランでは 7 日)保存されます。
直接ではありません。まず /pdf/unlock/ でロック解除してください。その後、戻ってください。アップロード時に暗号化を検出し、ロック解除ツールにリンクします。
Free.aiは無料で、3つのOCRエンジンを提供し、99の言語をサポートし、公開APIを提供しています。Adobe Acrobat Pro(月額19.99ドル、エンジン1つ)、ABBYY FineReader(月額199ドル、APIなし)、Smallpdf(月額9ドル、エンジン1つ)です。クリーンスキャンのOCR品質はAdobeに匹敵し、歴史的スキャンのプライムファルはABBYYに競合しています。
ファイル + 言語 + モデル + output_format フィールドを含む多重部分を /v1/pdf/ocr/ に POST します。引用終端点: /v1/pdf/ocr-quote/?pages=N&model=M。 /api/ に curl の全レシピがあります。
このツールをどう評価しますか?