Lokaler PDF-Assistent
Ein Assistent, der Ihr Dokument liest, ohne es je Ihr Gerät verlassen zu lassen.
Ihre Dateien verlassen nie Ihr GerätHäufige Fragen
Verlässt der Inhalt meines PDF meinen Rechner, damit der Assistent antworten kann?
Nein. Das Sprachmodell läuft, einmal heruntergeladen, in Ihrem Browser auf der Grafikkarte Ihres Geräts. Der Netzwerk-Zeuge unter jeder Antwort zeigt es: 0 Byte gesendet, während der Assistent antwortet. Nur der anfängliche Download des Modells, vor Ihrem Klick angekündigt, stammt von einer anderen Seite (huggingface.co).
Warum muss vor dem Start etwas heruntergeladen werden?
Das Sprachmodell selbst (rund 850 MB in der Standardeinstellung, oder 2,2 GB für die Option «präziser») ist nicht in Vellum enthalten: Es wird einmal, mit Ihrem Klick, heruntergeladen und bleibt danach im Cache Ihres Browsers. Eine Schaltfläche «Modell von diesem Gerät entfernen» löscht es, wenn Sie es wünschen.
Was passiert, wenn mein Browser WebGPU nicht unterstützt?
Das Panel erklärt es und bietet keine Lade-Schaltfläche an: Es gibt keinen Rückgriff auf einen Server. WebGPU ist in aktuellen Versionen von Chrome, Edge und Firefox verfügbar, sowie in Safari ab Version 26.
Sind die Zusammenfassungen und Antworten des Assistenten zu 100 % zuverlässig?
Nein, und die Oberfläche erinnert ständig daran: Es handelt sich um ein kleines Modell auf Ihrem Gerät, fähig zu einer wortgetreuen Zusammenfassung, aber nicht zu einer juristischen Einschätzung. Prüfen Sie wichtige Angaben stets im Dokument selbst, insbesondere extrahierte Beträge und Daten.
Wie geht der Assistent mit einem Dokument um, das zu lang für eine einzelne Anfrage ist?
Der Text wird seitenweise in Abschnitte von rund 2400 Token aufgeteilt. Eine Zusammenfassung über einen Abschnitt hinaus erfolgt in zwei Durchgängen — Zusammenfassung jedes Teils, dann Zusammenfassung dieser Zusammenfassungen — und die Oberfläche sagt dies in einem Satz. Bei einer Frage liest das Modell auf Ihrem Gerät nur die zwei relevantesten Abschnitte.