Перейти к основному содержимому

Распознавание текста (OCR)

Ваши сканы становятся текстом, а анализ остаётся на вашем устройстве.

ваши файлы никогда не покидают ваше устройство

Перетащите сюда PDF или изображение

Отсканированный PDF или фото — JPG, PNG

Как распознать текст в отсканированном PDF, шаг за шагом

OCR превращает скан в пригодный для работы текст, загружая движок распознавания прямо в ваш браузер: документ никогда не уходит в сеть.

  1. Перетащите отсканированный PDF или фото

    Перетащите PDF или изображение JPG/PNG в область загрузки или нажмите, чтобы выбрать его.

  2. Выберите язык документа

    Выберите его в «Язык документа»: сначала языки сайта, затем более сотни других, модель которых загружается при первом использовании. Распознавание заметно менее надёжно, если выбранный язык не соответствует реальному тексту; «Второй язык» нужен для двуязычных документов.

  3. Ограничьте диапазон страниц, если файл — PDF

    Поле принимает диапазон вроде «1-3, 5, 8-10»; если оставить его пустым, анализируются все страницы.

  4. Нажмите «Запустить распознавание»

    Движок распознавания (около 4 МБ) загружается один раз с наших серверов вместе с моделью языка; для языка, не входящего в набор, размер модели объявляется перед запуском. Сам анализ затем полностью выполняется на вашем устройстве.

  5. Прочтите результат и уровень достоверности

    Распознанный текст отображается с числом слов и средней достоверностью; низкая достоверность указывает на скан, скорее всего, наклонный или плохого качества.

  6. Скачайте текст или PDF с поиском

    Файл .txt содержит простой текст; PDF с поиском сохраняет исходную вёрстку с невидимым текстовым слоем поверх, благодаря которому документ можно выделять и искать по ключевым словам.

В PDF с поиском отсканированная страница сохраняет своё исходное изображение и получает невидимый текстовый слой, пригодный для всех письменностей, включая греческую, кириллицу, арабскую или китайскую; страница, которая уже содержала текст, заново собирается как изображение, чтобы не нести два слоя.

Частые вопросы

Принимает ли OCR VellumPDF и PDF, и фотографии?

Да, можно загрузить отсканированный PDF или сразу изображение в формате JPG или PNG. В обоих случаях инструмент создаёт PDF с поиском, текст в котором можно выделять и копировать.

На каких языках работает распознавание текста?

Более чем на ста языках. Языки сайта включены и отдаются самим VellumPDF; остальные (чешский, греческий, иврит, персидский…) выбираются в том же списке «Язык документа», а их модель загружается один раз, при первом использовании. «Второй язык» обрабатывает двуязычный документ. Выбор правильного языка заметно повышает надёжность результата.

Отправляется ли мой отсканированный документ в онлайн-службу искусственного интеллекта?

Нет. Движок распознавания работает в вашем браузере. Для языков сайта его файлы берутся с домена VellumPDF; для другого языка с raw.githubusercontent.com, публичного репозитория проекта Tesseract, загружается только его модель — после объявления на экране. Эта загрузка идёт только в одну сторону: документ не покидает ваше устройство, и никакая служба искусственного интеллекта не вызывается.

Загружается ли модель распознавания при каждом использовании и сколько она весит?

У каждого языка своя модель. Для языков сайта, которые размещены у VellumPDF: от 0,4 до 3 МБ в сжатом виде в зависимости от языка (около 700 КБ для французского, почти 3 МБ для английского); обычный кэш браузера избавляет от повторной загрузки. Для остальных языков — от 0,4 до 12 МБ в зависимости от языка, размер показывается перед запуском; после загрузки модель хранится браузером, и при втором использовании ничего больше не загружается.

Как понять, надёжен ли результат, например на скане, наклонном или плохого качества?

Вместе с результатом показывается средний процент достоверности, вычисленный по всем распознанным словам. Ниже 70 % предупреждение сообщает, что распознавание ненадёжно, а скан, возможно, наклонён или низкого качества — это сигнал переделать сканирование, а не доверять полученному тексту.

Что будет, если загрузить PDF, защищённый паролем?

Распознавание сразу отклоняется с сообщением о том, что зашифрованный PDF нельзя распознать. Сначала нужно снять защиту с документа, а затем загрузить его сюда.

Можно ли выполнить OCR для нескольких документов за один раз?

Нет, инструмент обрабатывает один файл за раз — отсканированный PDF или изображение. Для нескольких документов операцию нужно повторить для каждого из них.