Перейти к основному содержимому

Поиск по PDF

Имя, сумма, дата: найдены среди сотен PDF, и ничего не отправляется.

ваши файлы никогда не покидают ваше устройство

Загрузите целую папку с PDF: VellumPDF прочитает текст каждой страницы и поместит его в индекс на этом устройстве, после чего вы ищете имя, сумму или дату сразу во всех документах.

Перетащите сюда ваши PDF

или перетащите сразу несколько файлов

ваш архив

Индекс остаётся в этом браузере, на этом устройстве, пока вы его не очистите. Ничего не отправляется.

Как найти слово в нескольких PDF, шаг за шагом

Архив документов создаётся один раз: текст каждой страницы индексируется на вашем устройстве, а затем по нему мгновенно выполняется поиск.

  1. Выберите папку или файлы PDF

    Перетащите их или воспользуйтесь «Выбрать папку» / «Выбрать файлы PDF». VellumPDF индексирует текст каждой страницы.

  2. Следите за индексированием

    Индикатор хода выполнения показывает текущий файл и страницу; защищённые, нечитаемые файлы и файлы без текста подсчитываются и отмечаются отдельно.

  3. Введите запрос

    Начиная с двух символов, результаты появляются автоматически, по всем документам сразу.

  4. Просмотрите результаты

    Каждый показывает имя файла, номер страницы, число вхождений и фрагмент с выделенным словом.

  5. Нажмите на результат, чтобы увидеть страницу

    Просмотр показывается, если файл ещё находится в памяти на этой вкладке; иначе сообщение предлагает загрузить его заново.

Индекс — это текст, но никогда не сами файлы — остаётся на этом устройстве, пока вы его не очистите. Если IndexedDB заблокирован (например, в приватном режиме), архив всё равно работает, но после закрытия вкладки ничего не сохраняется.

Частые вопросы

Отправляются ли сами PDF куда-либо для индексирования?

Нет. Каждая страница читается вашим браузером (pdf.js), а сохраняется только полученный из неё текст — в IndexedDB, базе данных, встроенной в браузер. Файл PDF никогда не передаётся и даже не копируется в другое место на вашем устройстве.

Почему предварительный просмотр результата появляется не всегда?

Потому что индекс хранит только текст, а не файл, — именно это позволяет ему оставаться крошечным даже для папки из нескольких сотен PDF. Пока файл остаётся открытым на текущей вкладке, его просмотр показывается; после перезагрузки страницы его нужно загрузить заново, чтобы увидеть снова.

Учитывает ли поиск диакритические знаки и регистр?

Нет, намеренно: поиск «geneve» находит «Genève», «GENÈVE» или «genève». Несколько слов в одном запросе должны все встретиться на одной странице, в любом порядке.

Находится ли сумма вроде 1’200, если просто набрать 1200?

Да. Поиск убирает швейцарский апостроф и неразрывный пробел, разделяющие тысячи, прежде чем сравнивать, поэтому «1’200», «1 200» и «1200» находят друг друга — как в тексте документа, так и в том, что вы вводите.

Что происходит с отсканированным PDF без текста?

Страница, на которой текст не обнаружен, подсчитывается и отмечается в сводке после индексирования — она не вызывает ошибки, но останется недоступной для поиска, пока её не обработает инструмент распознавания текста, который добавит ей текстовый слой.