Przejdź do treści głównej

PDF na Markdown

Twój plik PDF staje się uporządkowanym tekstem, gotowym dla edytora Markdown.

Pliki nigdy nie opuszczają urządzenia

Przeciągnij tutaj swój plik PDF

Konwersja rozpoczyna się automatycznie zaraz po upuszczeniu pliku

Jak przekonwertować plik PDF na Markdown, krok po kroku

Tekst pliku PDF jest odtwarzany jako Markdown na podstawie jego wizualnego formatowania — rozmiarów czcionek, list punktowanych lub numerowanych — bezpośrednio w Twojej przeglądarce.

  1. Wyślij plik PDF

    Przeciągnij plik do strefy upuszczania albo kliknij, aby przeszukać swoje pliki. Konwersja zaczyna się automatycznie, strona po stronie.

  2. Śledź postęp

    Komunikat wskazuje przetwarzaną stronę („Strona n z całkowitej liczby”), podczas gdy VellumPDF grupuje tekst w nagłówki, listy i akapity.

  3. Zdecyduj, czy rozdzielić strony

    Pole „Rozdziel strony linią ---”, domyślnie zaznaczone, wstawia linię rozdzielającą między każdą stroną; odznacz je dla ciągłego dokumentu, bez oznaczeń stron.

  4. Przeczytaj wyświetlony Markdown

    Wynik pojawia się w przewijanym oknie, z liczbą znaków tuż powyżej.

  5. Pobierz albo skopiuj wynik

    „Pobierz .md” zapisuje plik Markdown; „Kopiuj” umieszcza go w schowku.

Podobnie jak przy zwykłym wyodrębnianiu tekstu, plik PDF zabezpieczony hasłem jest odrzucany od razu: najpierw usuń zabezpieczenie narzędziem odblokowania.

Najczęściej zadawane pytania

Jak VellumPDF ustala nagłówki w pliku Markdown?

Narzędzie analizuje rozmiar czcionek w pliku PDF, aby wykryć wizualną hierarchię i wywnioskować z niej nagłówki poziomu 1, 2 lub 3. W dokumencie bez wyraźnej hierarchii typograficznej wynik pozostaje zwykłym tekstem.

Czy tabele i układy w kolumnach są zachowywane?

Nie, tabele nie są odtwarzane w Markdown, a układ w kilku kolumnach może zostać odczytany w nieoczekiwanej kolejności, ponieważ analiza jest wykonywana wiersz po wierszu, a nie według obszaru strony. Wynik lepiej sprawdza się w dokumencie o prostym przepływie tekstu.

Co się dzieje, jeśli mój plik PDF jest zeskanowanym dokumentem?

Jeśli żaden tekst nie może zostać wyodrębniony, plik PDF prawdopodobnie składa się z obrazów pochodzących ze skanu. Trzeba go najpierw przepuścić przez narzędzie OCR VellumPDF, zanim przekonwertuje się go na Markdown. Sama konwersja jest darmowa i odbywa się w Twojej przeglądarce.

Po jakich sygnałach rozpoznawane są nagłówki?

Plik PDF nigdy nie deklaruje „to jest nagłówek”: trzeba to odgadnąć. Narzędzie opiera się tylko na jednym sygnale, rozmiarze czcionki, porównanym z dominującym rozmiarem tekstu głównego w całym dokumencie. Wyraźnie większe rozmiary (co najmniej 15% więcej) tworzą poziomy nagłówków: największy staje się nagłówkiem poziomu 1, kolejny poziomu 2, wszystkie pozostałe poziomu 3. Narzędzie nie bierze pod uwagę ani grubości czcionki, ani pozycji na stronie, ani słów typu „Rozdział” czy „Artykuł”.

Czy mogę poprawić zaproponowaną hierarchię?

Nie w samym narzędziu: VellumPDF tworzy Markdown w jednym przebiegu, bez listy nagłówków do poprawienia przed eksportem. Wykrywanie daje punkt wyjścia, a poprawka jest robiona potem w dowolnym edytorze tekstu — to właśnie zaleta tego formatu. Konwersja zaczyna się automatycznie, gdy tylko plik zostanie umieszczony; jedyne istniejące ustawienie, widoczne po przygotowaniu wyniku, to pole dodające lub usuwające linię --- między stronami.

Do czego służy eksportowanie pliku PDF do Markdown?

Do odzyskania tekstu w formie, która zachowuje strukturę i może zostać ponownie odczytana wszędzie: repozytorium kodu, notatniku, generatorze stron, modelu językowym. W przeciwieństwie do eksportu w zwykłym tekście, nagłówki pozostają nagłówkami, więc schemat dokumentu przetrwa.