Przejdź do treści głównej

OCR — rozpoznawanie tekstu

Skany zamieniają się w tekst — analiza pozostaje na Twoim urządzeniu.

Pliki nigdy nie opuszczają urządzenia

Upuść tutaj plik PDF lub obraz

Zeskanowany plik PDF lub zdjęcie — JPG, PNG

Jak rozpoznać tekst zeskanowanego pliku PDF (OCR), krok po kroku

OCR zamienia skan w użyteczny tekst, wczytując silnik rozpoznawania bezpośrednio w Twojej przeglądarce: dokument nigdy nie jest wysyłany online.

  1. Upuść zeskanowany plik PDF albo zdjęcie

    Przeciągnij plik PDF albo obraz JPG/PNG do strefy upuszczania albo kliknij, aby go wyszukać.

  2. Wybierz język dokumentu

    Wybierz go w polu „Język dokumentu”: najpierw języki serwisu, potem ponad sto innych, których model jest pobierany przy pierwszym użyciu. Rozpoznawanie jest znacznie mniej wiarygodne, jeśli wybrany język nie odpowiada prawdziwemu tekstowi; „Drugi język” służy do dokumentów dwujęzycznych.

  3. Jeśli plik jest plikiem PDF, ogranicz zakres stron

    Pole akceptuje zakres taki jak „1-3, 5, 8-10”; puste oznacza analizę wszystkich stron.

  4. Kliknij „Rozpocznij rozpoznawanie”

    Silnik rozpoznawania (około 4 MB) jest pobierany tylko raz z naszych serwerów, razem z modelem języka; dla języka niewbudowanego waga modelu jest podawana przed rozpoczęciem. Sama analiza odbywa się potem całkowicie na Twoim urządzeniu.

  5. Przeczytaj wynik i poziom pewności

    Rozpoznany tekst jest wyświetlany z liczbą słów i średnią pewnością; niska pewność wskazuje na prawdopodobnie przekrzywiony lub słabej jakości skan.

  6. Pobierz tekst albo plik PDF z przeszukiwalnym tekstem

    Plik .txt zawiera czysty tekst; plik PDF z przeszukiwalnym tekstem zachowuje oryginalny układ z niewidoczną warstwą tekstu na wierzchu, która czyni dokument zaznaczalnym i przeszukiwalnym pod kątem słów kluczowych.

W przeszukiwalnym pliku PDF zeskanowana strona zachowuje oryginalny obraz i otrzymuje niewidoczną warstwę tekstu ważną dla wszystkich pism, w tym greckiego, cyrylicy, arabskiego czy chińskiego; strona, która już miała tekst, jest składana na nowo jako obraz, aby nie mieć dwóch warstw.

Najczęściej zadawane pytania

Czy OCR VellumPDF akceptuje zarówno pliki PDF, jak i zdjęcia?

Tak, możesz umieścić zeskanowany plik PDF albo bezpośrednio obraz w formacie JPG lub PNG. W obu przypadkach narzędzie tworzy przeszukiwalny plik PDF, którego tekst można zaznaczyć i skopiować.

W jakich językach działa rozpoznawanie tekstu?

W ponad stu językach. Języki serwisu są dołączone i obsługiwane przez VellumPDF; pozostałe (czeski, grecki, rosyjski, ukraiński, arabski, hebrajski, chiński, japoński, koreański…) wybiera się z tej samej listy „Język dokumentu”, a ich model jest pobierany raz, przy pierwszym użyciu. „Drugi język” obsługuje dokument dwujęzyczny. Wybór właściwego języka znacznie poprawia wiarygodność wyniku.

Czy mój zeskanowany dokument jest wysyłany do internetowej usługi sztucznej inteligencji?

Nie. Silnik rozpoznawania działa w Twojej przeglądarce. Dla języków serwisu pliki pochodzą z domeny VellumPDF; dla innego języka pobierany jest tylko jego model z raw.githubusercontent.com, publicznego repozytorium projektu Tesseract, po ostrzeżeniu na ekranie. To pobieranie jest jednokierunkowe: dokument nie opuszcza Twojego urządzenia i żadna usługa sztucznej inteligencji nie jest wywoływana.

Czy model rozpoznawania jest pobierany przy każdym użyciu i ile waży?

Każdy język ma swój własny model. Dla języków serwisu, hostowanych przez VellumPDF: od 0,4 do 3 MB po kompresji, zależnie od języka (około 700 KB dla francuskiego, niemal 3 MB dla angielskiego); zwykły cache przeglądarki pozwala uniknąć ponownego pobierania. Dla pozostałych języków od 0,4 do 12 MB zależnie od języka, waga wyświetlana przed rozpoczęciem; po pobraniu model zostaje zapisany w przeglądarce, a drugie użycie już niczego nie pobiera.

Jak sprawdzić, czy wynik jest wiarygodny, na przykład przy przekrzywionym lub słabej jakości skanie?

Wyświetlana jest średnia wartość procentowa pewności wraz z wynikiem, obliczona na podstawie wszystkich rozpoznanych słów. Poniżej 70% pojawia się ostrzeżenie, że rozpoznanie jest niepewne i że skan może być przekrzywiony albo niskiej jakości — to sygnał, by zeskanować ponownie zamiast ufać uzyskanemu tekstowi.

Co się dzieje, jeśli umieszczę plik PDF zabezpieczony hasłem?

Rozpoznawanie jest natychmiast odrzucane, z komunikatem wyjaśniającym, że zaszyfrowany plik PDF nie może przejść przez OCR. Najpierw trzeba usunąć zabezpieczenie dokumentu, zanim się go tu umieści.