Reconocimiento de texto (OCR)
Sus escaneos se convierten en texto — el análisis permanece en su equipo.
Sus archivos nunca salen de su dispositivoSuelte aquí un PDF o una imagen
PDF escaneado o foto — JPG, PNG
Cómo reconocer el texto de un PDF escaneado (OCR), paso a paso
El OCR convierte un escaneo en texto utilizable, cargando un motor de reconocimiento directamente en su navegador: el documento nunca se envía en línea.
Suelte un PDF escaneado o una foto
Arrastre un PDF o una imagen JPG/PNG a la zona de depósito, o haga clic para buscarla.
Elija el idioma del documento
Seleccione francés, alemán, italiano, inglés, español o portugués: el reconocimiento es claramente menos fiable si el idioma elegido no corresponde al texto real.
Limite el intervalo de páginas, si el archivo es un PDF
El campo acepta un intervalo como «1-3, 5, 8-10»; dejado en blanco, se analizan todas las páginas.
Haga clic en «Iniciar el reconocimiento»
El motor de reconocimiento (unos 4 MB) se descarga una sola vez desde nuestros servidores; el análisis en sí se desarrolla después íntegramente en su dispositivo.
Lea el resultado y su nivel de confianza
El texto reconocido se muestra con el número de palabras y una confianza media; una confianza baja indica un escaneo probablemente torcido o de mala calidad.
Descargue el texto o el PDF con texto buscable
El archivo .txt contiene el texto puro; el PDF con texto buscable conserva la maquetación original con una capa de texto invisible encima, que hace el documento seleccionable y buscable por palabras clave.
En el PDF con texto buscable, solo se incluyen en la capa de texto invisible los caracteres que la fuente estándar puede representar; un carácter raro fuera de ese rango sigue presente en el archivo .txt descargado.
Preguntas frecuentes
¿El OCR de Vellum acepta tanto PDF como fotos?
Sí, puede depositar un PDF escaneado o directamente una imagen en formato JPG o PNG. En ambos casos, la herramienta produce un PDF buscable cuyo texto puede seleccionarse y copiarse.
¿En qué idiomas funciona el reconocimiento de texto?
Elige el idioma del documento entre francés, alemán, italiano, inglés, español y portugués antes de lanzar el reconocimiento. Seleccionar el idioma correcto mejora notablemente la fiabilidad del resultado.
¿Se envía mi documento escaneado a un servicio de inteligencia artificial en línea?
No, el motor de reconocimiento se ejecuta en su navegador, con sus archivos alojados en el dominio de Vellum. No se llama a ningún servicio externo y el documento no sale de su dispositivo.
¿Se descarga el modelo de reconocimiento en cada uso, y cuánto pesa eso?
Cada idioma tiene su propio modelo, alojado en los servidores de Vellum en lugar de en un CDN externo: unos 700 KB comprimidos para el francés, 850 KB para el alemán, 1,3 MB para el italiano, 2,1 MB para el español, 1,4 MB para el portugués y casi 3 MB para el inglés. Se crea un nuevo motor de reconocimiento en cada lanzamiento, sin caché interna dedicada: solo la caché habitual de su navegador evita una redescarga completa real de un uso a otro.
¿Cómo saber si el resultado es fiable, por ejemplo en un escaneo torcido o de mala calidad?
Se muestra un porcentaje de confianza medio junto con el resultado, calculado sobre el conjunto de palabras reconocidas. Por debajo del 70 %, una advertencia señala que el reconocimiento es incierto y que el escaneo quizás esté inclinado o sea de baja calidad — es la señal para volver a escanear en lugar de confiar en el texto obtenido.
¿Qué ocurre si deposito un PDF protegido con contraseña?
El reconocimiento se rechaza de inmediato, con un mensaje que explica que un PDF cifrado no puede someterse a OCR. Primero hay que retirar la protección del documento antes de depositarlo aquí.