PDF naar Markdown
Uw PDF wordt gestructureerde tekst, klaar voor een Markdown-editor.
Uw bestanden verlaten nooit uw apparaatSleep hier uw PDF naartoe
De conversie start automatisch zodra u het bestand loslaat
Hoe u een PDF omzet in Markdown, stap voor stap
De tekst van de PDF wordt herbouwd in Markdown op basis van de visuele opmaak — lettergroottes, opsommings- of genummerde lijsten — rechtstreeks in uw browser.
Stuur de PDF
Sleep het bestand naar het invoervak, of klik om uw bestanden te doorzoeken. De omzetting begint automatisch, pagina na pagina.
Volg de voortgang
Een melding toont de pagina die wordt verwerkt («Pagina n van totaal») terwijl VellumPDF de tekst groepeert in titels, lijsten en alinea’s.
Beslis of u de pagina’s scheidt
Het vakje «Pagina’s scheiden met een lijn ---», standaard aangevinkt, voegt een scheidingslijn in tussen elke pagina; vink het uit voor een doorlopend document, zonder paginamarkering.
Herlees de weergegeven Markdown
Het resultaat verschijnt in een scrollbaar kader, met het aantal tekens erboven.
Download of kopieer het resultaat
«.md downloaden» slaat een Markdown-bestand op; «Kopiëren» plaatst het op het klembord.
Net als bij de eenvoudige tekstextractie wordt een met wachtwoord beveiligde PDF meteen geweigerd: verwijder eerst de beveiliging met de ontgrendeltool.
Veelgestelde vragen
Hoe bepaalt VellumPDF de titels in het Markdown-bestand?
De tool analyseert de lettergroottes van de PDF om een visuele hiërarchie te detecteren en daaruit titels van niveau 1, 2 of 3 af te leiden. Bij een document zonder duidelijke typografische hiërarchie blijft het resultaat gewone tekst.
Blijven tabellen en indelingen met kolommen behouden?
Nee, tabellen worden niet in Markdown gereconstrueerd, en een indeling met meerdere kolommen kan in een onverwachte volgorde worden gelezen, omdat de analyse regel voor regel gebeurt en niet per gebied van de pagina. Het resultaat leent zich beter voor een document met een eenvoudige, doorlopende tekststroom.
Wat gebeurt er als mijn PDF een gescand document is?
Kan er geen tekst worden geëxtraheerd, dan bestaat de PDF waarschijnlijk uit afbeeldingen afkomstig van een scan. U moet het document dan eerst door de OCR-tool van VellumPDF laten gaan voordat u het naar Markdown converteert. De conversie zelf is gratis en gebeurt in uw browser.
Aan welke signalen worden de titels herkend?
Een PDF geeft nooit aan “dit is een titel”: dat moet worden geraden. De tool vertrouwt slechts op één signaal, de lettergrootte, vergeleken met de dominante grootte van de hoofdtekst in het hele document. Duidelijk grotere groottes (minstens 15% meer) vormen titelniveaus: de grootste wordt een titel van niveau 1, de volgende van niveau 2, alle andere van niveau 3. De tool let noch op het lettergewicht, noch op de positie op de pagina, noch op woorden zoals “Hoofdstuk” of “Artikel”.
Kan ik de voorgestelde hiërarchie corrigeren?
Niet binnen de tool: VellumPDF produceert de Markdown in één keer, zonder titellijst om vóór de export bij te werken. De detectie biedt een uitgangspunt, en de correctie gebeurt daarna in elke gewenste teksteditor — dat is nu net het voordeel van dit formaat. De conversie start automatisch zodra het bestand is geplaatst; de enige beschikbare instelling, getoond zodra het resultaat klaar is, is het vakje dat een lijn --- tussen de pagina’s toevoegt of verwijdert.
Waarvoor dient het exporteren van een PDF naar Markdown?
Om de tekst terug te krijgen op een manier die de structuur behoudt en overal opnieuw kan worden gelezen: een coderepository, een notitieblok, een sitegenerator, een taalmodel. In tegenstelling tot een export naar platte tekst blijven titels titels, waardoor de opbouw van het document behouden blijft.