Assistant PDF local
Un assistant qui lit votre document sans jamais le faire sortir de votre appareil.
Vos fichiers ne quittent jamais votre appareilQuestions fréquentes
Le contenu de mon PDF part-il sur un serveur pour que l’assistant réponde ?
Non. Le modèle de langue tourne dans votre navigateur, sur la carte graphique de votre appareil, une fois téléchargé. Le témoin réseau affiché sous chaque réponse le montre : 0 octet envoyé pendant que l’assistant répond. Seul le téléchargement initial du modèle, annoncé avant votre clic, provient d’un autre site (huggingface.co).
Pourquoi faut-il télécharger quelque chose avant de commencer ?
Le modèle de langue lui-même (environ 850 Mo par défaut, ou 2,2 Go pour l’option « plus précis ») n’est pas inclus dans Vellum : il se télécharge une fois, à votre clic, et reste ensuite dans le cache de votre navigateur. Un bouton « Supprimer le modèle de cet appareil » l’efface quand vous le souhaitez.
Que se passe-t-il si mon navigateur ne prend pas en charge WebGPU ?
Le panneau l’explique et ne propose aucun bouton de chargement : il n’y a pas de repli sur un serveur. WebGPU est disponible sur les versions récentes de Chrome, Edge et Firefox, et sur Safari à partir de la version 26.
Les résumés et réponses de l’assistant sont-ils fiables à 100 % ?
Non, et l’interface le rappelle en permanence : c’est un petit modèle qui tourne sur votre appareil, capable d’un résumé fidèle mais pas d’un avis de juriste. Vérifiez toujours les éléments importants dans le document lui-même, en particulier les montants et les dates extraits.
Comment l’assistant traite-t-il un document trop long pour tenir dans une seule requête ?
Le texte est découpé par pages en tranches d’environ 2 400 jetons. Un résumé au-delà d’une tranche se fait en deux passes — résumé de chaque partie, puis résumé de ces résumés — et l’interface le dit en une phrase. Pour une question, le modèle, sur votre appareil, ne lit que les deux tranches les plus pertinentes.