Naar de hoofdinhoud

PDF naar tekst

De inhoud van uw PDF, als herbruikbare platte tekst.

Uw bestanden verlaten nooit uw apparaat

Sleep hier uw PDF naartoe

De tekst wordt automatisch geëxtraheerd zodra u het bestand loslaat

Hoe u de tekst uit een PDF haalt, stap voor stap

De tool haalt de tekst terug die daadwerkelijk in het bestand aanwezig is, pagina voor pagina, om deze elders te herlezen of te hergebruiken. Er verlaat niets uw browser.

  1. Stuur de PDF

    Sleep het bestand naar het invoervak, of klik om uw bestanden te doorzoeken. De extractie begint meteen, zonder dat u op een knop hoeft te klikken.

  2. Laat VellumPDF elke pagina doorlopen

    De tekst van elke pagina wordt teruggehaald en met de volgende verbonden door een markering «———— Pagina n ————», in de volgorde waarin ze in het bestand voorkomen.

  3. Herlees het weergegeven resultaat

    De volledige tekst verschijnt in een scrollbaar kader, met het aantal tekens en woorden erboven.

  4. Download of kopieer de tekst

    «.txt downloaden» slaat een tekstbestand op met dezelfde naam als de oorspronkelijke PDF; «Kopiëren» plaatst het resultaat op het klembord om het elders te plakken.

Een met wachtwoord beveiligde PDF wordt meteen geweigerd, met een eigen melding: verwijder eerst de beveiliging met de ontgrendeltool voordat u hierheen terugkeert.

Veelgestelde vragen

Hoe wordt de uit een PDF geëxtraheerde tekst gepresenteerd?

De tekst wordt geleverd in een .txt-bestand, per pagina georganiseerd, herbruikbaar in een tekstverwerker of elke andere tool. Het gaat om de tekst die daadwerkelijk in het bestand aanwezig is, zonder opmaak.

Werkt de tool met een gescande PDF?

Nee, de extractie is alleen gebaseerd op de tekst die al in het PDF-bestand aanwezig is, niet op beeldherkenning. Is het document een scan zonder onderliggende tekst, dan komt er geen tekst uit: laat het document eerst door de OCR-tool van VellumPDF gaan.

Is deze dienst gratis en wordt het document online verzonden?

Ja, de tool is gratis en zonder gebruikslimiet. De extractie gebeurt volledig in uw browser, zonder de PDF naar een server te sturen.

Blijft de opmaak van de geëxtraheerde tekst behouden?

Nee, en dat is inherent aan het formaat: u krijgt de tekst, niet de opmaak. Kolommen worden na elkaar uitgevouwen, tabellen verliezen hun rasterindeling. Is de structuur belangrijk, dan behoudt de export naar Markdown ten minste de titels; is de opmaak belangrijk, dan moet u de export naar Word gebruiken.

In welke volgorde komt de tekst van een pagina met twee kolommen eruit?

In de volgorde waarin ze in het bestand is vastgelegd, wat meestal de natuurlijke leesvolgorde volgt, maar niet altijd. In een folder of een krant komt soms een kader midden in een alinea terecht. Een korte controle achteraf volstaat om dit op te merken.

Waarom levert de extractie bij sommige bestanden niets op?

Omdat het document geen tekstlaag heeft: het is een afbeelding van een pagina, doorgaans een scan of een foto. Er valt dan letterlijk niets te extraheren. Laat het bestand eerst door de tekstherkenning gaan, die deze laag toevoegt, en voer de extractie daarna opnieuw uit.