文字認識(OCR)
スキャンが文字データになります。解析はお使いのパソコン上で行われます。
ファイルがお使いのデバイスの外に出ることはありませんここにPDFまたは画像をドロップ
スキャンしたPDFまたは写真 — JPG、PNG
スキャンしたPDFの文字を認識する(OCR)手順
OCR(文字認識)は、認識エンジンをブラウザー内に直接読み込んで、スキャンを使えるテキストにします。ドキュメントがオンラインに送信されることは、ありません。
スキャンしたPDFまたは写真をドロップする
PDFまたはJPG/PNGの画像を、ドロップ領域にドラッグするか、クリックして選びます。
ドキュメントの言語を選ぶ
「ドキュメントの言語」で選びます。最初にサイトの言語が並び、そのあとに100を超えるほかの言語が続きます。その言語のモデルは、初回の使用時にダウンロードされます。選んだ言語が実際のテキストと合っていないと、認識の信頼性は、大きく下がります。「第2言語」は、2か国語のドキュメント向けです。
ファイルがPDFなら、ページ範囲を絞る
欄には、「1-3, 5, 8-10」のような範囲を入力できます。空欄なら、すべてのページが解析されます。
「文字認識を開始」をクリックする
認識エンジン(約4 MB)は、当社のサーバーから、言語モデルと一緒に、1回だけダウンロードされます。サイトに含まれていない言語では、開始する前に、モデルのサイズが知らされます。解析そのものは、そのあと、すべてお使いのデバイス上で行われます。
結果と信頼度を確認する
認識されたテキストが、単語数と平均の信頼度とともに表示されます。信頼度が低い場合は、スキャンが傾いているか、品質が悪い可能性が高いことを示します。
テキスト、または検索できるテキスト付きのPDFをダウンロードする
.txtファイルには、プレーンテキストが入ります。検索できるテキスト付きのPDFは、元のレイアウトを保ったまま、その上に見えないテキストレイヤーを重ねます。これにより、ドキュメントのテキストを選択でき、キーワードで検索できるようになります。
検索できるPDFでは、スキャンしたページは、元の画像を保ち、ギリシャ文字、キリル文字、アラビア文字、中国語を含む、すべての文字体系に有効な、見えないテキストレイヤーが付きます。すでにテキストのあったページは、2つのレイヤーが残らないよう、画像として組み直されます。
よくある質問
VellumPDFのOCRは、PDFと写真の両方に対応していますか?
はい。スキャンしたPDF、またはJPGやPNG形式の画像を、そのままドロップできます。どちらの場合も、ツールは、テキストを選択してコピーできる、検索可能なPDFを作ります。
文字認識は、どの言語で使えますか?
100を超える言語です。サイトの言語は含まれており、VellumPDFが提供します。ほかの言語(チェコ語、ギリシャ語、ヘブライ語、ペルシア語など)は、同じ「ドキュメントの言語」の一覧から選び、そのモデルは、初回の使用時に1回だけダウンロードされます。「第2言語」は、2か国語のドキュメントを扱います。正しい言語を選ぶと、結果の信頼性が大きく上がります。
スキャンしたドキュメントは、オンラインの人工知能サービスに送られますか?
いいえ。認識エンジンは、お使いのブラウザー内で動きます。サイトの言語については、ファイルはVellumPDFのドメインから届きます。ほかの言語では、そのモデルだけが、画面に通知が出たあとで、Tesseractプロジェクトの公開リポジトリであるraw.githubusercontent.comからダウンロードされます。このダウンロードは一方向です。ドキュメントがデバイスの外に出ることはなく、人工知能のサービスが呼び出されることもありません。
認識モデルは、使うたびにダウンロードされますか? サイズはどのくらいですか?
言語ごとに、専用のモデルがあります。VellumPDFがホスティングするサイトの言語は、言語により圧縮時に0.4〜3 MBです(フランス語で約700 KB、英語で約3 MB)。ブラウザーの通常のキャッシュにより、再ダウンロードは避けられます。ほかの言語は、言語により0.4〜12 MBで、開始する前にサイズが表示されます。ダウンロードしたモデルは、ブラウザーに保管され、2回目以降は、何もダウンロードされません。
たとえば傾いた、または画質の悪いスキャンで、結果が信頼できるかどうかは、どうやってわかりますか?
認識されたすべての単語をもとに計算した、平均の信頼度のパーセンテージが、結果と一緒に表示されます。70%を下回ると、認識が不確かで、スキャンが傾いているか、画質が低い可能性があるという警告が出ます。得られたテキストを信用するのではなく、スキャンし直すべき合図です。
パスワードで保護されたPDFをドロップすると、どうなりますか?
認識はすぐに拒否され、暗号化されたPDFにはOCRを実行できないことを説明するメッセージが表示されます。先に、ドキュメントの保護を外してから、ここにドロップする必要があります。