メインコンテンツへ移動

PDFをExcelに変換

PDFの表が、再び使えるデータになります。

ファイルがお使いのデバイスの外に出ることはありません

ここにPDFをドロップ

またはクリックしてファイルを選択

PDFをExcelに変換する手順

VellumPDFは、ページ上のテキストの位置から表を見つけます。規則的な格子はうまく変換されますが、そろっていないドキュメントは、1行ずつ取り出されます。

  1. PDFを送る

    必要なら、解析するページ範囲を指定します。パスワードで保護されたファイルは、拒否されます。

  2. 表示される注意書きを読む

    表は、行から行へ繰り返される空白から再構成されます。結合セル、2行にまたがる行、間隔が規則的でない表は、正しく分割されないことがあります。

  3. 「表を検出」をクリックする

    テキストを取り出せない場合(スキャンしたPDFの場合)、ツールは、エラーメッセージとともに止まります。

  4. ページごとに、プレビューを確認する

    各ページに、検出された行数と列数が表示されます。空白が十分に規則的でない場合は、「表は検出されませんでした」と表示されます。

  5. 役に立つなら、「表のないページも含める」にチェックを入れる

    このオプションは、表のあるページとないページが混在するときにだけ表示されます。それ以外のページのテキストを、1行ずつ追加します。

  6. 形式を選んで、ダウンロードする

    Excel(.xlsx)またはCSVです。CSVでは、区切り文字にセミコロンかカンマを選べます。

作成されるファイルでは、数式は再現されず、値だけになります。スキャンしたPDFでは、先にOCRを行ってください。「PDFをWordに変換」ツールと違って、ここでは、エラーメッセージに直接のリンクはありませんが、同じ解決策が当てはまります。

よくある質問

VellumPDFは、PDFの表を、どうやって検出しますか?

ツールは、ページ上のテキストの位置から、とくに行から行へ繰り返される空白の通り道から、列を見つけます。ダウンロードの前に、検出された行がプレビューに表示され、結果を確認できます。

Excelファイルの代わりに、CSVファイルを得られますか?

はい。PDFの1ページにつき1シートのExcelブック(.xlsx)か、スイスでExcelが想定するセミコロン区切りのCSVファイルを選べます。1’234.50のようなスイス式の書き方の値は、数値として認識されます。

PDFに、きれいにそろった線のある本物の表がない場合は、どうなりますか?

規則的な格子のないドキュメントは、正確な列ではなく、1行ずつ書き出されることがあります。結果がどうであれ、検出はローカルで、無料で、ファイルがサーバーに送られることはありません。

取り出したい表が、スキャンしたPDFのものだった場合は、どうなりますか?

PDFに選択できるテキストがまったくない(画像で構成されたスキャン)場合、解析は、それを示すメッセージとともに止まります。テキストのレイヤーがなければ、データは何も取り出せません。先にドキュメントを文字認識(OCR)に通してから、検索可能になったPDFで、ここに戻ってください。

結合セルや、2行にまたがって書かれた行は、結果に影響しますか?

はい。列は、同じ位置の揃いが、ページの行の少なくとも30%で繰り返されたときに認識されます。数ポイントの許容があります。結合セルは、その繰り返しを崩し、2行のテキストにまたがる記録は、書き出しで2つの別々の行になります。ダウンロードの前のプレビューは、まさにこの種の分割に気づくためにあります。

表が検出されなかったページも、書き出しに含められますか?

表が認識されたページと、そうでないページが混在する場合に、後者を書き出しに加えるチェックボックスが表示されます。それらは、列ではなく、1行ずつ読み取られます。そのチェックを入れなければ、表が検出されたページだけが書き出されます。