Passare al contenuto principale

Assistente PDF locale

Un assistente che legge il Suo documento senza mai farlo uscire dal Suo dispositivo.

I Suoi file non lasciano mai il Suo dispositivo

Domande frequenti

Il contenuto del mio PDF viene inviato a un server perché l’assistente possa rispondere?

No. Il modello linguistico gira nel Suo browser, sulla scheda grafica del Suo dispositivo, una volta scaricato. Il testimone di rete mostrato sotto ogni risposta lo dimostra: 0 byte inviati mentre l’assistente risponde. Solo il download iniziale del modello, annunciato prima del clic, proviene da un altro sito (huggingface.co).

Perché occorre scaricare qualcosa prima di iniziare?

Il modello linguistico in sé (circa 850 MB per l’opzione predefinita, o 2,2 GB per l’opzione «più precisa») non è incluso in Vellum: si scarica una sola volta, al Suo clic, e resta poi nella cache del Suo browser. Un pulsante «Eliminare il modello da questo dispositivo» lo cancella quando lo desidera.

Cosa succede se il mio browser non supporta WebGPU?

Il pannello lo spiega e non propone alcun pulsante di caricamento: non esiste un ripiego su un server. WebGPU è disponibile nelle versioni recenti di Chrome, Edge e Firefox, e in Safari a partire dalla versione 26.

I riassunti e le risposte dell’assistente sono affidabili al 100%?

No, e l’interfaccia lo ricorda costantemente: è un piccolo modello che gira sul Suo dispositivo, capace di un riassunto fedele ma non di un parere legale. Verifichi sempre gli elementi importanti nel documento stesso, in particolare gli importi e le date estratti.

Come tratta l’assistente un documento troppo lungo per stare in un’unica richiesta?

Il testo viene suddiviso, pagina per pagina, in parti di circa 2400 token. Un riassunto oltre una singola parte avviene in due fasi — riassunto di ogni parte, poi riassunto di questi riassunti — e l’interfaccia lo comunica in una frase. Per una domanda, il modello, sul Suo dispositivo, legge solo le due parti più pertinenti.