Ir para o conteúdo principal

PDF para Excel

As tabelas dos seus PDF voltam a ser dados utilizáveis.

Seus arquivos nunca saem do seu dispositivo

Solte o seu PDF aqui

ou clique para procurar seus arquivos

Como converter um PDF em Excel, passo a passo

O Vellum localiza as tabelas pela posição do texto na página: uma grade regular se converte bem, um documento sem alinhamento é recuperado linha por linha.

  1. Envie o PDF

    Indique, se necessário, um intervalo de páginas a analisar; um arquivo protegido por senha é recusado.

  2. Leia o aviso exibido

    As tabelas são reconstruídas a partir dos espaços que se repetem de uma linha para outra: células mescladas, registros em duas linhas ou tabelas sem espaçamento regular podem ser mal divididos.

  3. Clique em «Detectar as tabelas»

    Se nenhum texto puder ser extraído — caso de um PDF digitalizado —, a ferramenta para com uma mensagem de erro.

  4. Confira a pré-visualização página por página

    Cada página mostra o número de linhas e colunas detectadas, ou «Nenhuma tabela detectada» se os espaços em branco não forem regulares o suficiente.

  5. Marque «Incluir as páginas sem tabela», se for útil

    Essa opção só aparece se algumas páginas tiverem uma tabela e outras não; ela acrescenta o texto das demais, linha por linha.

  6. Escolha o formato e baixe

    Excel (.xlsx) ou CSV, com separador ponto e vírgula ou vírgula para o CSV.

Nenhuma fórmula é recriada no arquivo produzido, só os valores. Em um PDF digitalizado, faça primeiro o OCR: ao contrário da ferramenta PDF para Word, aqui a mensagem de erro não oferece um link direto, mas a mesma solução se aplica.

Perguntas frequentes

Como o Vellum detecta as tabelas em um PDF?

A ferramenta identifica as colunas a partir da posição dos textos na página, em especial os corredores que se repetem de uma linha para outra. Uma pré-visualização mostra as linhas detectadas antes do download, para conferir o resultado.

Posso obter um arquivo CSV em vez de um arquivo Excel?

Sim, você pode escolher entre uma pasta de trabalho Excel (.xlsx), com uma planilha por página do PDF, ou um arquivo CSV que usa o ponto e vírgula esperado pelo Excel na Suíça. Os valores escritos no padrão suíço, como 1’234.50, são reconhecidos como números.

O que acontece se o meu PDF não tiver uma tabela de verdade, com linhas bem alinhadas?

Um documento sem uma grade regular pode ser exportado linha por linha em vez de em colunas precisas. A detecção continua local, gratuita e sem envio do arquivo a um servidor, qualquer que seja o resultado obtido.

O que acontece se a tabela que quero extrair vier de um PDF digitalizado?

Se o PDF não tiver nenhum texto selecionável — uma digitalização composta de imagens —, a análise para com uma mensagem que indica isso: nenhum dado pode ser extraído sem uma camada de texto. É preciso passar antes o documento pelo reconhecimento de texto (OCR) e depois voltar aqui com o PDF já pesquisável.

Uma célula mesclada ou uma linha escrita em duas linhas pode alterar o resultado?

Sim: as colunas são reconhecidas quando um mesmo alinhamento se repete em pelo menos 30 % das linhas da página, com uma tolerância de alguns pontos. Uma célula mesclada quebra essa repetição, e um registro que se estende por duas linhas de texto vira duas linhas distintas na exportação — a pré-visualização antes do download serve justamente para perceber esse tipo de divisão.

Posso incluir na exportação as páginas em que nenhuma tabela foi detectada?

Quando algumas páginas contêm uma tabela reconhecida e outras não, aparece uma caixa para acrescentar estas últimas à exportação, lidas linha por linha em vez de em colunas. Sem marcar essa caixa, só as páginas com uma tabela detectada são exportadas.