Aller au contenu principal

Rechercher dans des PDF

Un nom, un montant, une date : trouvés dans des centaines de PDF, sans rien envoyer.

Vos fichiers ne quittent jamais votre appareil

Déposez un dossier entier de PDF : Vellum lit le texte de chaque page et le range dans un index sur cet appareil, puis vous cherchez un nom, un montant ou une date dans tous les documents à la fois.

Déposez vos PDF ici

ou glissez plusieurs fichiers à la fois

Votre armoire

L’index reste dans ce navigateur, sur cet appareil, jusqu’à ce que vous l’effaciez. Rien n’est envoyé.

Questions fréquentes

Les PDF eux-mêmes sont-ils envoyés quelque part pour être indexés ?

Non. Chaque page est lue par votre navigateur (pdf.js) et seul le texte qui en ressort est enregistré, dans IndexedDB, une base de données intégrée au navigateur. Le fichier PDF n’est jamais transmis, ni même copié ailleurs sur votre appareil.

Pourquoi l’aperçu d’un résultat n’apparaît-il pas toujours ?

Parce que l’index ne garde que le texte, pas le fichier — c’est ce qui lui permet de rester minuscule face à un dossier de plusieurs centaines de PDF. Tant que le fichier reste ouvert dans l’onglet en cours, son aperçu s’affiche ; après un rechargement de la page, il faut le redéposer pour le revoir.

La recherche tient-elle compte des accents et de la casse ?

Non, volontairement : chercher « geneve » retrouve « Genève », « GENÈVE » ou « genève ». Plusieurs mots dans la même recherche doivent tous se trouver sur la même page, dans n’importe quel ordre.

Un montant comme 1’200 se retrouve-t-il en tapant simplement 1200 ?

Oui. La recherche retire l’apostrophe suisse et l’espace insécable qui séparent les milliers avant de comparer, donc « 1’200 », « 1 200 » et « 1200 » se retrouvent mutuellement, aussi bien dans le texte du document que dans ce que vous tapez.

Que se passe-t-il pour un PDF scanné, sans texte ?

Une page sans aucun texte détecté est comptée et signalée dans le résumé après l’indexation — elle ne provoque pas d’erreur, mais elle restera introuvable par la recherche tant qu’elle n’aura pas été traitée par l’outil de reconnaissance de texte, qui lui ajoute une couche de texte.