Naar de hoofdinhoud

PDF naar Excel

De tabellen uit uw PDF’s worden weer bruikbare gegevens.

Uw bestanden verlaten nooit uw apparaat

Sleep uw PDF hierheen

of klik om uw bestanden te doorzoeken

Hoe u een PDF omzet in Excel, stap voor stap

VellumPDF vindt tabellen op basis van de positie van de tekst op de pagina: een regelmatig rooster wordt goed omgezet, een document zonder uitlijning wordt regel voor regel teruggehaald.

  1. Stuur de PDF

    Geef indien nodig een te analyseren paginabereik op; een met wachtwoord beveiligd bestand wordt geweigerd.

  2. Lees de weergegeven waarschuwing

    De tabellen worden opnieuw opgebouwd aan de hand van de spaties die zich van regel tot regel herhalen: samengevoegde cellen, records over twee regels of tabellen zonder regelmatige afstand kunnen verkeerd worden opgesplitst.

  3. Klik op «Tabellen detecteren»

    Kan geen enkele tekst worden geëxtraheerd — het geval bij een gescande PDF — dan stopt de tool met een foutmelding.

  4. Controleer de voorvertoning pagina voor pagina

    Elke pagina toont het aantal gedetecteerde rijen en kolommen, of «Geen tabel gedetecteerd» als de witruimtes niet regelmatig genoeg zijn.

  5. Vink «Pagina’s zonder tabel opnemen» aan, indien nuttig

    Deze optie verschijnt alleen als sommige pagina’s wel een tabel hebben en andere niet; ze voegt de tekst van de overige pagina’s toe, regel voor regel.

  6. Kies het formaat en download

    Excel (.xlsx) of CSV, met puntkomma of komma als scheidingsteken voor de CSV.

Er wordt geen enkele formule opnieuw gemaakt in het geproduceerde bestand, alleen de waarden. Doe bij een gescande PDF eerst de OCR: in tegenstelling tot de tool PDF naar Word biedt de foutmelding hier geen directe link, maar dezelfde oplossing is van toepassing.

Veelgestelde vragen

Hoe detecteert VellumPDF de tabellen in een PDF?

De tool identificeert de kolommen op basis van de positie van de tekst op de pagina, met name de tussenruimtes die zich van regel tot regel herhalen. Een voorvertoning toont de gedetecteerde regels vóór het downloaden, zodat u het resultaat kunt controleren.

Kan ik een CSV-bestand krijgen in plaats van een Excel-bestand?

Ja, u kunt kiezen tussen een Excel-werkboek (.xlsx), met één werkblad per pagina van de PDF, of een CSV-bestand dat de puntkomma gebruikt die Excel in Zwitserland verwacht. Waarden geschreven in de Zwitserse notatie, zoals 1’234.50, worden als getallen herkend.

Wat gebeurt er als mijn PDF geen echte tabel heeft, met goed uitgelijnde regels?

Een document zonder regelmatig rooster kan regel voor regel worden geëxporteerd in plaats van in nauwkeurige kolommen. De detectie blijft lokaal, gratis en zonder het bestand naar een server te sturen, ongeacht het verkregen resultaat.

Wat gebeurt er als de tabel die ik wil extraheren uit een gescande PDF komt?

Heeft de PDF geen enkele selecteerbare tekst — een scan bestaande uit afbeeldingen —, dan stopt de analyse met een bericht dat dit aangeeft: zonder tekstlaag kunnen geen gegevens worden geëxtraheerd. Laat het document eerst door de tekstherkenning (OCR) gaan en kom daarna terug met de al doorzoekbare PDF.

Kan een samengevoegde cel of een over twee regels geschreven regel het resultaat veranderen?

Ja: kolommen worden herkend wanneer dezelfde uitlijning zich herhaalt in minstens 30% van de regels van de pagina, met een tolerantie van enkele punten. Een samengevoegde cel doorbreekt die herhaling, en een gegeven dat over twee tekstregels loopt, wordt in de export twee afzonderlijke regels — de voorvertoning vóór het downloaden dient juist om dit soort splitsing op te merken.

Kan ik de pagina’s waarop geen tabel is gedetecteerd, in de export opnemen?

Wanneer sommige pagina’s een herkende tabel bevatten en andere niet, verschijnt een vakje om de laatste ook aan de export toe te voegen, gelezen regel voor regel in plaats van in kolommen. Zonder dit vakje aan te vinken, worden alleen de pagina’s met een gedetecteerde tabel geëxporteerd.