PDF a Markdown
Su PDF se convierte en texto estructurado, listo para un editor Markdown.
Sus archivos nunca salen de su dispositivoArrastre su PDF aquí
La conversión empieza automáticamente en cuanto lo suelte
Cómo convertir un PDF a Markdown, paso a paso
El texto del PDF se reconstruye en Markdown a partir de su formato visual — tamaños de fuente, listas con viñetas o numeradas — directamente en su navegador.
Suba el PDF
Arrastre el archivo a la zona de depósito, o haga clic para explorar sus archivos. La conversión empieza automáticamente, página tras página.
Siga el progreso
Un mensaje indica la página en curso de procesamiento («Página n de total») mientras Vellum agrupa el texto en títulos, listas y párrafos.
Decida si separa las páginas
La casilla «Separar las páginas con una línea ---», marcada por defecto, inserta una línea de separación entre cada página; desmárquela para un documento continuo, sin marca de página.
Relea el Markdown mostrado
El resultado aparece en un cuadro desplazable, con el número de caracteres justo encima.
Descargue o copie el resultado
«Descargar .md» guarda un archivo Markdown; «Copiar» lo coloca en el portapapeles.
Al igual que en la extracción de texto simple, un PDF protegido con contraseña se rechaza de inmediato: retire primero la protección con la herramienta de desbloqueo.
Preguntas frecuentes
¿Cómo determina Vellum los títulos en el archivo Markdown?
La herramienta analiza el tamaño de las fuentes del PDF para detectar una jerarquía visual y deducir de ella títulos de nivel 1, 2 o 3. En un documento sin jerarquía tipográfica clara, el resultado sigue siendo texto plano.
¿Se conservan las tablas y las maquetaciones a columnas?
No, las tablas no se reconstruyen en Markdown y una maquetación a varias columnas puede leerse en un orden imprevisto, porque el análisis se hace línea por línea y no por región de página. El resultado conviene mejor a un documento con un flujo de texto simple.
¿Qué ocurre si mi PDF es un documento escaneado?
Si no se puede extraer ningún texto, probablemente el PDF esté compuesto de imágenes provenientes de un escaneo. Hay que pasarlo primero por la herramienta OCR de Vellum antes de convertirlo a Markdown. La conversión en sí es gratuita y se hace en su navegador.
¿Con qué señales se reconocen los títulos?
Un PDF nunca declara «esto es un título»: hay que adivinarlo. La herramienta solo se fía de una señal, el tamaño de fuente, comparado con el tamaño dominante del cuerpo de texto en todo el documento. Los tamaños netamente mayores (al menos un 15 % más) forman niveles de título: el mayor se convierte en un título de nivel 1, el siguiente de nivel 2, todos los demás de nivel 3. La herramienta no observa ni el grosor, ni la posición en la página, ni palabras como «Capítulo» o «Artículo».
¿Puedo corregir la jerarquía propuesta?
No dentro de la herramienta: Vellum produce el Markdown en una sola pasada, sin lista de títulos que retocar antes de la exportación. La detección da un punto de partida, y la corrección se hace después en cualquier editor de texto — es precisamente la ventaja del formato. La conversión se inicia automáticamente en cuanto se deposita el archivo; el único ajuste existente, mostrado una vez listo el resultado, es la casilla que añade o retira una línea --- entre las páginas.
¿Para qué sirve exportar un PDF a Markdown?
Para recuperar el texto en una forma que conserve la estructura y se pueda releer en cualquier parte: un repositorio de código, un cuaderno de notas, un generador de sitios, un modelo de lenguaje. A diferencia de una exportación a texto plano, los títulos siguen siendo títulos, así que el esquema del documento sobrevive.