Поиск по PDF
Имя, сумма, дата: найдены среди сотен PDF, и ничего не отправляется.
ваши файлы никогда не покидают ваше устройствоЗагрузите целую папку с PDF: VellumPDF прочитает текст каждой страницы и поместит его в индекс на этом устройстве, после чего вы ищете имя, сумму или дату сразу во всех документах.
Перетащите сюда ваши PDF
или перетащите сразу несколько файлов
ваш архив
Индекс остаётся в этом браузере, на этом устройстве, пока вы его не очистите. Ничего не отправляется.
Как найти слово в нескольких PDF, шаг за шагом
Архив документов создаётся один раз: текст каждой страницы индексируется на вашем устройстве, а затем по нему мгновенно выполняется поиск.
Выберите папку или файлы PDF
Перетащите их или воспользуйтесь «Выбрать папку» / «Выбрать файлы PDF». VellumPDF индексирует текст каждой страницы.
Следите за индексированием
Индикатор хода выполнения показывает текущий файл и страницу; защищённые, нечитаемые файлы и файлы без текста подсчитываются и отмечаются отдельно.
Введите запрос
Начиная с двух символов, результаты появляются автоматически, по всем документам сразу.
Просмотрите результаты
Каждый показывает имя файла, номер страницы, число вхождений и фрагмент с выделенным словом.
Нажмите на результат, чтобы увидеть страницу
Просмотр показывается, если файл ещё находится в памяти на этой вкладке; иначе сообщение предлагает загрузить его заново.
Индекс — это текст, но никогда не сами файлы — остаётся на этом устройстве, пока вы его не очистите. Если IndexedDB заблокирован (например, в приватном режиме), архив всё равно работает, но после закрытия вкладки ничего не сохраняется.
Частые вопросы
Отправляются ли сами PDF куда-либо для индексирования?
Нет. Каждая страница читается вашим браузером (pdf.js), а сохраняется только полученный из неё текст — в IndexedDB, базе данных, встроенной в браузер. Файл PDF никогда не передаётся и даже не копируется в другое место на вашем устройстве.
Почему предварительный просмотр результата появляется не всегда?
Потому что индекс хранит только текст, а не файл, — именно это позволяет ему оставаться крошечным даже для папки из нескольких сотен PDF. Пока файл остаётся открытым на текущей вкладке, его просмотр показывается; после перезагрузки страницы его нужно загрузить заново, чтобы увидеть снова.
Учитывает ли поиск диакритические знаки и регистр?
Нет, намеренно: поиск «geneve» находит «Genève», «GENÈVE» или «genève». Несколько слов в одном запросе должны все встретиться на одной странице, в любом порядке.
Находится ли сумма вроде 1’200, если просто набрать 1200?
Да. Поиск убирает швейцарский апостроф и неразрывный пробел, разделяющие тысячи, прежде чем сравнивать, поэтому «1’200», «1 200» и «1200» находят друг друга — как в тексте документа, так и в том, что вы вводите.
Что происходит с отсканированным PDF без текста?
Страница, на которой текст не обнаружен, подсчитывается и отмечается в сводке после индексирования — она не вызывает ошибки, но останется недоступной для поиска, пока её не обработает инструмент распознавания текста, который добавит ей текстовый слой.