Распознавание текста (OCR)
Ваши сканы становятся текстом, а анализ остаётся на вашем устройстве.
ваши файлы никогда не покидают ваше устройствоПеретащите сюда PDF или изображение
Отсканированный PDF или фото — JPG, PNG
Как распознать текст в отсканированном PDF, шаг за шагом
OCR превращает скан в пригодный для работы текст, загружая движок распознавания прямо в ваш браузер: документ никогда не уходит в сеть.
Перетащите отсканированный PDF или фото
Перетащите PDF или изображение JPG/PNG в область загрузки или нажмите, чтобы выбрать его.
Выберите язык документа
Выберите его в «Язык документа»: сначала языки сайта, затем более сотни других, модель которых загружается при первом использовании. Распознавание заметно менее надёжно, если выбранный язык не соответствует реальному тексту; «Второй язык» нужен для двуязычных документов.
Ограничьте диапазон страниц, если файл — PDF
Поле принимает диапазон вроде «1-3, 5, 8-10»; если оставить его пустым, анализируются все страницы.
Нажмите «Запустить распознавание»
Движок распознавания (около 4 МБ) загружается один раз с наших серверов вместе с моделью языка; для языка, не входящего в набор, размер модели объявляется перед запуском. Сам анализ затем полностью выполняется на вашем устройстве.
Прочтите результат и уровень достоверности
Распознанный текст отображается с числом слов и средней достоверностью; низкая достоверность указывает на скан, скорее всего, наклонный или плохого качества.
Скачайте текст или PDF с поиском
Файл .txt содержит простой текст; PDF с поиском сохраняет исходную вёрстку с невидимым текстовым слоем поверх, благодаря которому документ можно выделять и искать по ключевым словам.
В PDF с поиском отсканированная страница сохраняет своё исходное изображение и получает невидимый текстовый слой, пригодный для всех письменностей, включая греческую, кириллицу, арабскую или китайскую; страница, которая уже содержала текст, заново собирается как изображение, чтобы не нести два слоя.
Частые вопросы
Принимает ли OCR VellumPDF и PDF, и фотографии?
Да, можно загрузить отсканированный PDF или сразу изображение в формате JPG или PNG. В обоих случаях инструмент создаёт PDF с поиском, текст в котором можно выделять и копировать.
На каких языках работает распознавание текста?
Более чем на ста языках. Языки сайта включены и отдаются самим VellumPDF; остальные (чешский, греческий, иврит, персидский…) выбираются в том же списке «Язык документа», а их модель загружается один раз, при первом использовании. «Второй язык» обрабатывает двуязычный документ. Выбор правильного языка заметно повышает надёжность результата.
Отправляется ли мой отсканированный документ в онлайн-службу искусственного интеллекта?
Нет. Движок распознавания работает в вашем браузере. Для языков сайта его файлы берутся с домена VellumPDF; для другого языка с raw.githubusercontent.com, публичного репозитория проекта Tesseract, загружается только его модель — после объявления на экране. Эта загрузка идёт только в одну сторону: документ не покидает ваше устройство, и никакая служба искусственного интеллекта не вызывается.
Загружается ли модель распознавания при каждом использовании и сколько она весит?
У каждого языка своя модель. Для языков сайта, которые размещены у VellumPDF: от 0,4 до 3 МБ в сжатом виде в зависимости от языка (около 700 КБ для французского, почти 3 МБ для английского); обычный кэш браузера избавляет от повторной загрузки. Для остальных языков — от 0,4 до 12 МБ в зависимости от языка, размер показывается перед запуском; после загрузки модель хранится браузером, и при втором использовании ничего больше не загружается.
Как понять, надёжен ли результат, например на скане, наклонном или плохого качества?
Вместе с результатом показывается средний процент достоверности, вычисленный по всем распознанным словам. Ниже 70 % предупреждение сообщает, что распознавание ненадёжно, а скан, возможно, наклонён или низкого качества — это сигнал переделать сканирование, а не доверять полученному тексту.
Что будет, если загрузить PDF, защищённый паролем?
Распознавание сразу отклоняется с сообщением о том, что зашифрованный PDF нельзя распознать. Сначала нужно снять защиту с документа, а затем загрузить его сюда.
Можно ли выполнить OCR для нескольких документов за один раз?
Нет, инструмент обрабатывает один файл за раз — отсканированный PDF или изображение. Для нескольких документов операцию нужно повторить для каждого из них.