OCR PDF

スキャンした PDF に本物のテキストレイヤーを追加し、テキストの検索、選択、コピーを可能にします。認識処理はすべてお使いのデバイス上で行われ、文書がデバイスから離れることはありません。

  • アップロード不要
  • ローカル実行
  • 登録不要

このセッションでアップロードされたファイルデータ: 0 B

ファイルはブラウザ内でローカル処理されます。アップロードされるものはありません。

PDF を OCR する方法

  1. スキャンした PDF をアップロードエリアにドラッグするか、クリックして選択します(最大 100 MB)。
  2. 認識品質を選びます。「標準(200 DPI)」はほとんどの文書に適し、「高精細(300 DPI)」は小さな文字に有効で、「高速(150 DPI)」は最も速く処理できます。
  3. 「OCR PDF」をクリックします。初回のみ認識エンジンがダウンロードされ、以降は即座に起動します。
  4. 検索可能な PDF(同じページに本物のテキストレイヤーが追加されたもの)をダウンロードするか、抽出されたテキストだけを取得します。

どこにも送信せずに機密スキャンを OCR

スキャン文書は、往々にして機密性の高いものです。署名済みの契約書、医療記録、身分証のコピー、古い手紙。ほとんどのオンライン OCR サービスでは、まずそれらをアップロードさせられます。CoolPDF は、認識エンジン(WebAssembly にコンパイルされた Tesseract)をブラウザのタブ内で実行します。文書はお使いのマシン上で読み込まれて処理され、その 1 バイトもネットワークを横断しません。処理中にブラウザのネットワークパネルで確かめられます。作業を担うサーバーがないため、ページ数のクォータも 1 日の上限もありません。制限を決めるのはあなたのデバイスだけです。

よくある質問

どの言語を認識できますか?

現在は英語(ラテンアルファベット)のみです。 他の言語にはそれぞれ専用の学習データファイルが必要で、このビルドには含まれていません。多言語対応は計画されています。アクセント記号やヨーロッパ圏の一般的な句読点は問題なく処理されます。

すでにテキストがある PDF でも使えますか?

このツールはテキストレイヤーのないスキャンや画像向けです。 PDF にすでに選択可能なテキストがある場合、OCR は不要です。「PDF → Markdown 変換」ツールでテキストを直接抽出できます。

なぜ初回は時間がかかるのですか?

初回の認識では OCR エンジンと言語データ(約 7 MB)がダウンロードされます。 どちらも以降はデバイスにキャッシュされるため、2 回目以降はオフラインでも即座に起動します。

OCR のために文書はアップロードされますか?

いいえ。 認識は完全にブラウザ内で、お使いのデバイスのプロセッサー上で行われます。どのサーバーにも何も送信されません。上のアップロードデータカウンターは処理中もゼロのままです。

利用回数の制限はありますか?

ありません。 すべてのツールは無料で無制限に利用できます。1日の上限やクォータ、登録は不要です。処理はお使いのデバイス上で行われるため、サーバーコストを転嫁する必要がありません。安定性のため、ツールごとに十分余裕のあるファイルサイズ上限(ツールにより50〜150 MB)を設けていますが、日常の文書には十分すぎる大きさです。

CoolPDF は無料のブラウザベース PDF ツールキットです。従来のオンライン PDF ツールとは異なり、CoolPDF は WebAssembly を使用してユーザーのデバイス上ですべてのファイルをローカルに処理します。ファイルがサーバーにアップロードされることはありません。ツールはアカウント、メール、登録が一切不要で、使用制限のない完全無料です。そのため CoolPDF は契約書、医療記録、財務諸表などの機密文書に適しています。