PDFをExcelに変換
PDFの表が、再び使えるデータになります。
ファイルがお使いのデバイスの外に出ることはありませんここにPDFをドロップ
またはクリックしてファイルを選択
PDFをExcelに変換する手順
VellumPDFは、ページ上のテキストの位置から表を見つけます。規則的な格子はうまく変換されますが、そろっていないドキュメントは、1行ずつ取り出されます。
PDFを送る
必要なら、解析するページ範囲を指定します。パスワードで保護されたファイルは、拒否されます。
表示される注意書きを読む
表は、行から行へ繰り返される空白から再構成されます。結合セル、2行にまたがる行、間隔が規則的でない表は、正しく分割されないことがあります。
「表を検出」をクリックする
テキストを取り出せない場合(スキャンしたPDFの場合)、ツールは、エラーメッセージとともに止まります。
ページごとに、プレビューを確認する
各ページに、検出された行数と列数が表示されます。空白が十分に規則的でない場合は、「表は検出されませんでした」と表示されます。
役に立つなら、「表のないページも含める」にチェックを入れる
このオプションは、表のあるページとないページが混在するときにだけ表示されます。それ以外のページのテキストを、1行ずつ追加します。
形式を選んで、ダウンロードする
Excel(.xlsx)またはCSVです。CSVでは、区切り文字にセミコロンかカンマを選べます。
作成されるファイルでは、数式は再現されず、値だけになります。スキャンしたPDFでは、先にOCRを行ってください。「PDFをWordに変換」ツールと違って、ここでは、エラーメッセージに直接のリンクはありませんが、同じ解決策が当てはまります。
よくある質問
VellumPDFは、PDFの表を、どうやって検出しますか?
ツールは、ページ上のテキストの位置から、とくに行から行へ繰り返される空白の通り道から、列を見つけます。ダウンロードの前に、検出された行がプレビューに表示され、結果を確認できます。
Excelファイルの代わりに、CSVファイルを得られますか?
はい。PDFの1ページにつき1シートのExcelブック(.xlsx)か、スイスでExcelが想定するセミコロン区切りのCSVファイルを選べます。1’234.50のようなスイス式の書き方の値は、数値として認識されます。
PDFに、きれいにそろった線のある本物の表がない場合は、どうなりますか?
規則的な格子のないドキュメントは、正確な列ではなく、1行ずつ書き出されることがあります。結果がどうであれ、検出はローカルで、無料で、ファイルがサーバーに送られることはありません。
取り出したい表が、スキャンしたPDFのものだった場合は、どうなりますか?
PDFに選択できるテキストがまったくない(画像で構成されたスキャン)場合、解析は、それを示すメッセージとともに止まります。テキストのレイヤーがなければ、データは何も取り出せません。先にドキュメントを文字認識(OCR)に通してから、検索可能になったPDFで、ここに戻ってください。
結合セルや、2行にまたがって書かれた行は、結果に影響しますか?
はい。列は、同じ位置の揃いが、ページの行の少なくとも30%で繰り返されたときに認識されます。数ポイントの許容があります。結合セルは、その繰り返しを崩し、2行のテキストにまたがる記録は、書き出しで2つの別々の行になります。ダウンロードの前のプレビューは、まさにこの種の分割に気づくためにあります。
表が検出されなかったページも、書き出しに含められますか?
表が認識されたページと、そうでないページが混在する場合に、後者を書き出しに加えるチェックボックスが表示されます。それらは、列ではなく、1行ずつ読み取られます。そのチェックを入れなければ、表が検出されたページだけが書き出されます。