PDF у Markdown
Ваш PDF стає структурованим текстом, готовим для редактора Markdown.
Ваші файли ніколи не залишають Вашого пристроюПеретягніть сюди Ваш PDF
Конвертація починається автоматично, щойно Ви перетягнете файл
Як конвертувати PDF у Markdown, крок за кроком
Текст PDF відтворюється в Markdown за його візуальним форматуванням (розмірами шрифтів, маркованими чи нумерованими списками) безпосередньо у Вашому браузері.
Перетягніть PDF
Перетягніть файл у зону перетягування або натисніть, щоб вибрати файли. Конвертація починається автоматично, сторінка за сторінкою.
Стежте за прогресом
Повідомлення вказує сторінку, що обробляється («Сторінка n із total»), поки VellumPDF групує текст у заголовки, списки й абзаци.
Оберіть, чи розділяти сторінки
Прапорець «Розділяти сторінки рядком ---», позначений за замовчуванням, вставляє розділювальний рядок між кожною сторінкою; зніміть його для суцільного документа без позначок сторінок.
Перечитайте показаний Markdown
Результат зʼявляється в рамці з прокручуванням, із кількістю символів безпосередньо над нею.
Завантажте або скопіюйте результат
«Завантажити .md» зберігає файл Markdown; «Копіювати» поміщає його в буфер обміну.
Як і для витягнення простого тексту, PDF, захищений паролем, відхиляється одразу: спершу зніміть захист інструментом розблокування.
Поширені запитання
Як VellumPDF визначає заголовки у файлі Markdown?
Інструмент аналізує розміри шрифтів PDF, щоб виявити візуальну ієрархію й вивести з неї заголовки рівня 1, 2 чи 3. У документі без чіткої типографської ієрархії результат залишається плоским текстом.
Чи зберігаються таблиці та верстка з колонками?
Ні, таблиці не відтворюються в Markdown, а верстка з кількома колонками може читатися в непередбачуваному порядку, адже аналіз виконується рядок за рядком, а не за ділянками сторінки. Результат краще підходить для документа з простим потоком тексту.
Що буде, якщо мій PDF є відсканованим документом?
Якщо жодного тексту не вдалося витягти, імовірно, PDF складений із зображень зі скану. Спершу його треба пропустити через інструмент OCR VellumPDF, а потім конвертувати в Markdown. Сама конвертація безкоштовна й відбувається у Вашому браузері.
За якими сигналами розпізнаються заголовки?
PDF ніколи не оголошує «це заголовок»: це доводиться вгадувати. Інструмент спирається лише на один сигнал, розмір шрифту, порівняний із домінівним розміром основного тексту в усьому документі. Розміри, помітно більші (щонайменше на 15 %), утворюють щаблі заголовків: найбільший стає заголовком рівня 1, наступний рівня 2, усі інші рівня 3. Інструмент не дивиться ні на насиченість, ні на положення на сторінці, ні на слова на кшталт «Розділ» чи «Стаття».
Чи можна виправити запропоновану ієрархію?
Не в інструменті: VellumPDF створює Markdown за один прохід, без списку заголовків, які треба підкоригувати перед експортом. Виявлення дає відправну точку, а виправлення потім робиться в будь-якому текстовому редакторі: саме в цьому й сенс формату. Конвертація починається автоматично щойно файл перетягнуто; єдине наявне налаштування, що зʼявляється, коли результат готовий, — це прапорець, який додає чи прибирає рядок --- між сторінками.
Навіщо експортувати PDF у Markdown?
Щоб відновити текст у формі, що зберігає структуру й читається всюди: репозиторій коду, блокнот нотаток, генератор сайтів, мовна модель. На відміну від експорту в простий текст, заголовки залишаються заголовками, отже, план документа зберігається.