メインコンテンツへ移動

文字認識(OCR)

スキャンが文字データになります。解析はお使いのパソコン上で行われます。

ファイルがお使いのデバイスの外に出ることはありません

ここにPDFまたは画像をドロップ

スキャンしたPDFまたは写真 — JPG、PNG

スキャンしたPDFの文字を認識する(OCR)手順

OCR(文字認識)は、認識エンジンをブラウザー内に直接読み込んで、スキャンを使えるテキストにします。ドキュメントがオンラインに送信されることは、ありません。

  1. スキャンしたPDFまたは写真をドロップする

    PDFまたはJPG/PNGの画像を、ドロップ領域にドラッグするか、クリックして選びます。

  2. ドキュメントの言語を選ぶ

    「ドキュメントの言語」で選びます。最初にサイトの言語が並び、そのあとに100を超えるほかの言語が続きます。その言語のモデルは、初回の使用時にダウンロードされます。選んだ言語が実際のテキストと合っていないと、認識の信頼性は、大きく下がります。「第2言語」は、2か国語のドキュメント向けです。

  3. ファイルがPDFなら、ページ範囲を絞る

    欄には、「1-3, 5, 8-10」のような範囲を入力できます。空欄なら、すべてのページが解析されます。

  4. 「文字認識を開始」をクリックする

    認識エンジン(約4 MB)は、当社のサーバーから、言語モデルと一緒に、1回だけダウンロードされます。サイトに含まれていない言語では、開始する前に、モデルのサイズが知らされます。解析そのものは、そのあと、すべてお使いのデバイス上で行われます。

  5. 結果と信頼度を確認する

    認識されたテキストが、単語数と平均の信頼度とともに表示されます。信頼度が低い場合は、スキャンが傾いているか、品質が悪い可能性が高いことを示します。

  6. テキスト、または検索できるテキスト付きのPDFをダウンロードする

    .txtファイルには、プレーンテキストが入ります。検索できるテキスト付きのPDFは、元のレイアウトを保ったまま、その上に見えないテキストレイヤーを重ねます。これにより、ドキュメントのテキストを選択でき、キーワードで検索できるようになります。

検索できるPDFでは、スキャンしたページは、元の画像を保ち、ギリシャ文字、キリル文字、アラビア文字、中国語を含む、すべての文字体系に有効な、見えないテキストレイヤーが付きます。すでにテキストのあったページは、2つのレイヤーが残らないよう、画像として組み直されます。

よくある質問

VellumPDFのOCRは、PDFと写真の両方に対応していますか?

はい。スキャンしたPDF、またはJPGやPNG形式の画像を、そのままドロップできます。どちらの場合も、ツールは、テキストを選択してコピーできる、検索可能なPDFを作ります。

文字認識は、どの言語で使えますか?

100を超える言語です。サイトの言語は含まれており、VellumPDFが提供します。ほかの言語(チェコ語、ギリシャ語、ヘブライ語、ペルシア語など)は、同じ「ドキュメントの言語」の一覧から選び、そのモデルは、初回の使用時に1回だけダウンロードされます。「第2言語」は、2か国語のドキュメントを扱います。正しい言語を選ぶと、結果の信頼性が大きく上がります。

スキャンしたドキュメントは、オンラインの人工知能サービスに送られますか?

いいえ。認識エンジンは、お使いのブラウザー内で動きます。サイトの言語については、ファイルはVellumPDFのドメインから届きます。ほかの言語では、そのモデルだけが、画面に通知が出たあとで、Tesseractプロジェクトの公開リポジトリであるraw.githubusercontent.comからダウンロードされます。このダウンロードは一方向です。ドキュメントがデバイスの外に出ることはなく、人工知能のサービスが呼び出されることもありません。

認識モデルは、使うたびにダウンロードされますか? サイズはどのくらいですか?

言語ごとに、専用のモデルがあります。VellumPDFがホスティングするサイトの言語は、言語により圧縮時に0.4〜3 MBです(フランス語で約700 KB、英語で約3 MB)。ブラウザーの通常のキャッシュにより、再ダウンロードは避けられます。ほかの言語は、言語により0.4〜12 MBで、開始する前にサイズが表示されます。ダウンロードしたモデルは、ブラウザーに保管され、2回目以降は、何もダウンロードされません。

たとえば傾いた、または画質の悪いスキャンで、結果が信頼できるかどうかは、どうやってわかりますか?

認識されたすべての単語をもとに計算した、平均の信頼度のパーセンテージが、結果と一緒に表示されます。70%を下回ると、認識が不確かで、スキャンが傾いているか、画質が低い可能性があるという警告が出ます。得られたテキストを信用するのではなく、スキャンし直すべき合図です。

パスワードで保護されたPDFをドロップすると、どうなりますか?

認識はすぐに拒否され、暗号化されたPDFにはOCRを実行できないことを説明するメッセージが表示されます。先に、ドキュメントの保護を外してから、ここにドロップする必要があります。