PDF na Excel
Tabele z Twoich plików PDF znów stają się użytecznymi danymi.
Pliki nigdy nie opuszczają urządzeniaUpuść tutaj swój plik PDF
albo kliknij, aby wybrać plik
Jak przekonwertować plik PDF na Excel, krok po kroku
VellumPDF lokalizuje tabele według pozycji tekstu na stronie: regularna siatka konwertuje się dobrze, dokument bez wyrównania jest odzyskiwany wiersz po wierszu.
Wyślij plik PDF
W razie potrzeby wskaż zakres stron do przeanalizowania; plik zabezpieczony hasłem jest odrzucany.
Przeczytaj wyświetlone ostrzeżenie
Tabele są odtwarzane na podstawie odstępów powtarzających się z wiersza na wiersz: scalone komórki, rekordy zawijane w dwie linie albo tabele bez regularnych odstępów mogą zostać źle podzielone.
Kliknij „Wykryj tabele”
Jeśli nie da się wyodrębnić żadnego tekstu — przypadek zeskanowanego pliku PDF — narzędzie zatrzymuje się z komunikatem błędu.
Sprawdź podgląd strona po stronie
Każda strona pokazuje liczbę wykrytych wierszy i kolumn, albo „Nie wykryto tabeli”, jeśli puste odstępy nie są wystarczająco regularne.
Zaznacz „Uwzględnij strony bez tabeli”, jeśli to przydatne
Ta opcja pojawia się tylko wtedy, gdy niektóre strony mają tabelę, a inne nie; dodaje tekst pozostałych, wiersz po wierszu.
Wybierz format i pobierz
Excel (.xlsx) albo CSV, z separatorem średnik albo przecinek dla CSV.
W wygenerowanym pliku nie odtwarza się żadna formuła, tylko wartości. W zeskanowanym pliku PDF wykonaj najpierw OCR: w przeciwieństwie do narzędzia PDF na Word, tutaj komunikat błędu nie oferuje bezpośredniego linku, ale to samo rozwiązanie ma zastosowanie.
Najczęściej zadawane pytania
Jak VellumPDF wykrywa tabele w pliku PDF?
Narzędzie identyfikuje kolumny na podstawie pozycji tekstów na stronie, zwłaszcza powtarzających się przerw między wierszami. Podgląd pokazuje wykryte wiersze przed pobraniem, aby sprawdzić wynik.
Czy mogę uzyskać plik CSV zamiast pliku Excel?
Tak, możesz wybrać między skoroszytem Excel (.xlsx), z jednym arkuszem na stronę pliku PDF, a plikiem CSV używającym średnika oczekiwanego przez polski Excel. Wartości zapisane w polskim standardzie, jak 1 234,50, są rozpoznawane jako liczby.
Co się dzieje, jeśli mój plik PDF nie ma prawdziwej tabeli, z dobrze wyrównanymi wierszami?
Dokument bez regularnej siatki może zostać wyeksportowany wiersz po wierszu zamiast w precyzyjnych kolumnach. Wykrywanie pozostaje lokalne, darmowe i bez wysyłania pliku na serwer, niezależnie od uzyskanego wyniku.
Co się dzieje, jeśli tabela, którą chcę wyodrębnić, pochodzi z zeskanowanego pliku PDF?
Jeśli plik PDF nie ma żadnego zaznaczalnego tekstu — skan złożony z obrazów — analiza zatrzymuje się z komunikatem informującym o tym: żadne dane nie mogą zostać wyodrębnione bez warstwy tekstu. Trzeba najpierw przepuścić dokument przez rozpoznawanie tekstu (OCR), a potem wrócić tu z już przeszukiwalnym plikiem PDF.
Czy scalona komórka albo wiersz zapisany w dwóch liniach może zmienić wynik?
Tak: kolumny są rozpoznawane, gdy to samo wyrównanie powtarza się w co najmniej 30% wierszy strony, z tolerancją kilku punktów. Scalona komórka przerywa tę powtarzalność, a rekord rozciągnięty na dwie linie tekstu staje się dwoma osobnymi wierszami w eksporcie — podgląd przed pobraniem służy właśnie do zauważenia tego typu podziału.
Czy mogę uwzględnić w eksporcie strony, na których nie wykryto żadnej tabeli?
Gdy niektóre strony zawierają rozpoznaną tabelę, a inne nie, pojawia się pole umożliwiające dodanie tych ostatnich do eksportu, odczytanych wiersz po wierszu zamiast w kolumnach. Bez zaznaczenia tego pola eksportowane są tylko strony z wykrytą tabelą.