Ir al contenido principal

PDF a texto

El contenido de su PDF, en texto sin formato reutilizable.

Sus archivos nunca salen de su dispositivo

Arrastre su PDF aquí

El texto se extrae automáticamente al depositar el archivo

Cómo extraer el texto de un PDF, paso a paso

La herramienta recupera el texto realmente presente en el archivo, página por página, para volver a leerlo o reutilizarlo en otro lugar. Nada sale de su navegador.

  1. Suba el PDF

    Arrastre el archivo a la zona de depósito, o haga clic para explorar sus archivos. La extracción empieza de inmediato, sin necesidad de hacer clic en ningún botón.

  2. Deje que Vellum recorra cada página

    El texto de cada página se recupera y se enlaza con el siguiente mediante una marca «———— Página n ————», en el orden en que aparece en el archivo.

  3. Relea el resultado mostrado

    El texto completo aparece en un cuadro desplazable, con el número de caracteres y de palabras justo encima.

  4. Descargue o copie el texto

    «Descargar .txt» guarda un archivo de texto con el mismo nombre que el PDF original; «Copiar» coloca el resultado en el portapapeles para pegarlo en otro lugar.

Un PDF protegido con contraseña se rechaza de inmediato, con un mensaje dedicado: primero debe retirar la protección con la herramienta de desbloqueo antes de volver aquí.

Preguntas frecuentes

¿Cómo se presenta el texto extraído de un PDF?

El texto se entrega en un archivo .txt, organizado página por página, reutilizable en un procesador de textos o cualquier otra herramienta. Es el texto realmente presente en el archivo el que se recupera, sin formato.

¿Funciona la herramienta con un PDF escaneado?

No, la extracción se basa únicamente en el texto ya presente en el archivo PDF, no en un reconocimiento de imagen. Si el documento es un escaneo sin texto subyacente, no saldrá ningún texto: páselo primero por la herramienta OCR de Vellum.

¿Este servicio es gratuito y se envía el documento en línea?

Sí, la herramienta es gratuita y sin límite de uso. La extracción se desarrolla enteramente en su navegador, sin enviar el PDF a un servidor.

¿El texto extraído conserva la maquetación?

No, y eso es propio del formato: recupera el texto, no la maquetación. Las columnas se despliegan una tras otra, las tablas pierden su cuadrícula. Si la estructura importa, la exportación a Markdown conserva al menos los títulos; si lo que importa es la maquetación, hay que usar la exportación a Word.

¿En qué orden sale el texto de una página a dos columnas?

En el orden en que está declarado en el archivo, que en general sigue la lectura natural pero no siempre. En un folleto o un periódico, a veces un recuadro se intercala en medio de un párrafo. Una relectura rápida basta para detectarlo.

¿Por qué la extracción no devuelve nada en algunos archivos?

Porque el documento no tiene una capa de texto: es una imagen de página, típicamente un escaneo o una foto. Entonces no hay literalmente nada que extraer. Pase primero el archivo por el reconocimiento de caracteres, que añade esa capa, y luego relance la extracción.