PDF OCR

商用OK 567 models 透かしなし 登録は不要
モデル:
+ GPT-5, Claude, Gemini
スキャンした PDF を選択可能な検索可能なテキストに変換します。各ページを 200 DPI でラスター化し、OCR を実行します。Tesseract (高速、無料)、GOT-OCR2 (多列と表に適しています)、またはプレミアム fal OCR (劣化した/履歴のあるスキャンに適しています)を選択してください。出力は.txt、.docx、またはページラベル付きテキストです。 PDF ではなく画像がある場合は /ocr/ を使ってください。

スキャンした PDF をここにドラッグまたはクリックしてアップロード

PDF は 50 MB まで。スキャンした PDF と画像のみの PDF で動作します。テキスト選択が可能ですか? OCR は必要ありません。

-
- · -
この PDF には既に選択可能なテキストが含まれています。OCR は必要ありません。 要約を試してみる→
パスワードで保護されています。ロック解除してください。 PDF をロック解除
テッセラクトは清潔な印刷スキャンに、GOT-OCR2は多列紙とアジア文字に適しています。 プリミアムはピクセルごとに重要な場合にのみ使用できます。
言語ヒントはテッセラクトを2〜3倍速くし,非ラテン文字の正確度を30〜50%向上させる。
トークン推定
-
買いトークン
詳細はPDFをアップロードしてください。
OCR 結果
ダウンロード

        

PDF OCR を使うとき

請求書+領収書

会計管理、返金、AP自動化のためにスキャンした請求書の積み重ねを編集可能なテキストに変換します。

古書・古文書

廃盤の本、歴史的文書、図書館のアーカイブを検索可能なテキストにデジタル化します。

法律と医療記録

検索とeDiscoveryワークフローのためにスキャンしたケースファイル、医療報告書、またはファクス文書の内部のテキストをロック解除します。

翻訳前

テキストを抽出するために OCR を実行し、結果を /pdf/translator/ に送信して、どの言語にも変換する。

Free.ai PDF OCR と有料ツール

Free.aiAdobe Acrobat ProABBYY FineReaderSmallpdf
出品価格自由$19.99/mo$199 one-time$9/mo
Pick OCRエンジン (3)---
言語100+40+200+20+
パブリックAPI---
登録なしで動作---
詳細オプション
結果
トークンが足りない もっとトークンを取得
もっと良い結果が欲しいのか? プレミアムモデル また,高品質の画像を得るためには,画像の解像度を高くする必要がある。 プランを表示

❤️ Love Free.ai? Tell your friends!

登録 推薦リンクを得る 友達1人当たり30,000トークンを得る

もっと欲しい? Sign up free: 30,000 tokens/day
無料登録

要求を処理中...

スキャンした PDF を選択可能な検索可能なテキストに変換します。Tesseract、GOT-OCR2、およびプレミアム OCR エンジン。99 言語。無料。

使い方 PDF OCR

1
入力を入力

テキストを入力し、ファイルをアップロードし、または要望を記述します。アカウントは必要ありません。

2
クリックして生成

私たちのAIは、最良のオープンソースモデルを使って、数秒であなたの要求を処理します。

3
ダウンロードと共有

結果をダウンロード、コピー、共有できます。個人的、商業的な使用は無料です。

API を使ってこのツールを使用

あなたのコードからこのツールを自動化します。OpenAI 互換の REST エンドポイント、ベアートークン認証、追加の SDK が必要ありません。トークンコストはウェブインターフェースと一致します。

curl -X POST https://api.free.ai/v1/pdf/extract/ \
  -H "Authorization: Bearer sk-free-..." \
  -H "Content-Type: application/json" \
  -d '{"file": "@document.pdf"}'

PDF OCR - FAQ

スキャンしたPDF(画像のみ、選択できないテキスト)を検索可能、コピー可能、AI読み取り可能なテキストに変換します。スキャンしたページのPDF(請求書、契約書、古本、手書きメモ)をアップロードして、普通のテキスト、.docx、ページ番号付きテキストを返します。

私たちのセルフホストの Tesseract OCR (フリー・ティア) では、ページ当たり約 500 個のトークンを使用します。GOT-OCR2 はページ当たり約 800 個のトークンを使用し、複雑なレイアウト (多列、表、方程式) をよりよく扱います。プレミアム fal OCR は、劣化したスキャンの最高精度を得るためにページ当たり約 2500 個のトークンを使用します。3 つのオプションは、800 個のトークンを使用します。1 ページのアップロードは純粋なオーバーヘッドではありません。

Tesseract (標準、無料) は清潔な印刷スキャンに使用できます。GOT-OCR2 (無料、遅い) は多列の研究論文、科学的方程式、アジア語文書に使用できます。レイアウトモデルがはるかに良いものです。Premium fal OCR は、劣化した/低解像度/歴史的なスキャンにのみ使用できます。

Tesseract はラテン語、中国語、日本語、韓国語、アラビア語、キリル文字、ヘブライ語、ヒンディー語、タイ語、ベトナム語など100以上の言語をサポートします。30-50% の正確度を得るために言語ヒント (eng/spa/fra/deu/jpn/chi_sim/ara/etc.) を送信してください。自動検出は機能しますが遅い。

3つ目は、.txt(単純な、文書全体のファイル)、.docx(ページ切れを保存したWord)、ページごとの.txt(ページ間のヘッダを付けて出力で特定のページを見つける)。

300 DPI のクリーンスキャンでは、印刷されたラテン文字の場合は 99%+。150 DPI のスキャン、消えた文書、手書きの場合は 90-95% に下がります。非ラテン文字 (中国語、アラビア語、ヒンディー語) は Tesseract よりも言語ヒントと GOT-OCR2 でよりよく動作します。

手書きの OCR は印刷テキストよりも難しい。プレミアム OCR でも 70-85% の正確さを期待してください。白紙に清潔な手書きのフォーム (カリグラフィではなく) を作成するには Tesseract が使えます。カリグラフィや混乱したノートの場合は、プレミアム fal OCR と手書きモードがより信頼できます。

テッセラクトではページ当たり1-3秒、GOT-OCR2では3-5秒、プレミアムfalでは5-10秒です。50ページのスキャン本は1-3分かかります。重いタスクのバナーはタブを閉じ、終了時に結果をメールで送ります。

アップロードされた PDF はラスター化され、ページごとに OCRed され、その後削除されます。出力ファイルは共有リンクで CDN 上で 24 時間(有料プランでは 7 日)保存されます。

直接ではありません。まず /pdf/unlock/ でロック解除してください。その後、戻ってください。アップロード時に暗号化を検出し、ロック解除ツールにリンクします。

Free.aiは無料で、3つのOCRエンジンを提供し、99の言語をサポートし、公開APIを提供しています。Adobe Acrobat Pro(月額19.99ドル、エンジン1つ)、ABBYY FineReader(月額199ドル、APIなし)、Smallpdf(月額9ドル、エンジン1つ)です。クリーンスキャンのOCR品質はAdobeに匹敵し、歴史的スキャンのプライムファルはABBYYに競合しています。

ファイル + 言語 + モデル + output_format フィールドを含む /v1/pdf/ocr/ に多数の部分を POST します。引用終端点: /v1/pdf/ocr-quote/?pages=N&model=M。全ての curl レシピは /api/ にあります。

Sign up free: 30,000 tokens/day

無料アカウントを作成

クレジットカードは必要ありません

このツールを評価するには?

Love Free.ai? Tell your friends!