PDF na tekst
Treść Twojego pliku PDF, jako zwykły tekst gotowy do ponownego użycia.
Pliki nigdy nie opuszczają urządzeniaPrzeciągnij tutaj swój plik PDF
Tekst jest wyodrębniany automatycznie po upuszczeniu pliku
Jak wyodrębnić tekst z pliku PDF, krok po kroku
Narzędzie odzyskuje tekst rzeczywiście obecny w pliku, strona po stronie, aby ponownie go przeczytać lub wykorzystać gdzie indziej. Nic nie opuszcza Twojej przeglądarki.
Wyślij plik PDF
Przeciągnij plik do strefy upuszczania albo kliknij, aby przeszukać swoje pliki. Wyodrębnianie zaczyna się od razu, bez potrzeby klikania żadnego przycisku.
Pozwól VellumPDF przejrzeć każdą stronę
Tekst każdej strony jest odzyskiwany i łączony z następną znacznikiem „———— Strona n ————”, w kolejności, w jakiej pojawia się w pliku.
Przeczytaj wyświetlony wynik
Pełny tekst pojawia się w przewijanym oknie, z liczbą znaków i słów tuż powyżej.
Pobierz albo skopiuj tekst
„Pobierz .txt” zapisuje plik tekstowy pod tą samą nazwą co oryginalny PDF; „Kopiuj” umieszcza wynik w schowku, aby wkleić go gdzie indziej.
Plik PDF zabezpieczony hasłem jest odrzucany od razu, z własnym komunikatem: najpierw usuń zabezpieczenie narzędziem odblokowania, zanim tu wrócisz.
Najczęściej zadawane pytania
Jak jest prezentowany tekst wyodrębniony z pliku PDF?
Tekst jest dostarczany w pliku .txt, uporządkowanym strona po stronie, gotowym do ponownego użycia w edytorze tekstu lub w dowolnym innym narzędziu. Odzyskiwany jest tekst rzeczywiście obecny w pliku, bez formatowania.
Czy narzędzie działa z zeskanowanym plikiem PDF?
Nie, wyodrębnianie opiera się wyłącznie na tekście już obecnym w pliku PDF, a nie na rozpoznawaniu obrazu. Jeśli dokument jest skanem bez leżącego pod spodem tekstu, żaden tekst nie zostanie zwrócony: przepuść go najpierw przez narzędzie OCR VellumPDF.
Czy ta usługa jest darmowa, a dokument wysyłany online?
Tak, narzędzie jest darmowe i bez limitu użycia. Wyodrębnianie odbywa się w całości w Twojej przeglądarce, bez wysyłania pliku PDF na serwer.
Czy wyodrębniony tekst zachowuje układ strony?
Nie, i to jest właściwość tego formatu: odzyskujesz tekst, a nie układ. Kolumny rozwijają się jedna po drugiej, tabele tracą siatkę. Jeśli struktura ma znaczenie, eksport do Markdown zachowuje przynajmniej nagłówki; jeśli liczy się układ, trzeba użyć eksportu do Worda.
W jakiej kolejności wychodzi tekst strony w dwóch kolumnach?
W kolejności, w jakiej jest zapisany w pliku, co zwykle odpowiada naturalnemu czytaniu, ale nie zawsze. W ulotce albo gazecie czasem ramka wstawia się w środek akapitu. Szybkie ponowne przeczytanie wystarczy, by to zauważyć.
Dlaczego wyodrębnianie niczego nie zwraca w niektórych plikach?
Ponieważ dokument nie ma warstwy tekstu: to obraz strony, zwykle skan albo zdjęcie. Wtedy dosłownie nie ma nic do wyodrębnienia. Przepuść najpierw plik przez rozpoznawanie znaków, które dodaje tę warstwę, a potem wykonaj wyodrębnianie ponownie.