PDF в Excel
Таблиці Ваших PDF знову стають придатними для використання даними.
Ваші файли ніколи не залишають Вашого пристроюПеретягніть сюди Ваш PDF
або натисніть, щоб вибрати файли
Як конвертувати PDF в Excel, крок за кроком
VellumPDF знаходить таблиці за положенням тексту на сторінці: регулярна сітка конвертується добре, документ без вирівнювання відновлюється рядок за рядком.
Перетягніть PDF
За потреби вкажіть діапазон сторінок для аналізу; файл, захищений паролем, відхиляється.
Прочитайте показане попередження
Таблиці відтворюються за проміжками, що повторюються від рядка до рядка: обʼєднані комірки, рядки у два рядки чи таблиці без регулярних проміжків можуть бути розділені неправильно.
Натисніть «Виявити таблиці»
Якщо жодного тексту не вдалося витягти (випадок відсканованого PDF), інструмент зупиняється з повідомленням про помилку.
Перевірте попередній перегляд сторінка за сторінкою
Кожна сторінка показує кількість виявлених рядків і стовпців або «таблицю не виявлено», якщо проміжки недостатньо регулярні.
За потреби позначте «Включити сторінки без таблиці»
Ця опція зʼявляється лише тоді, коли таблицю містять тільки деякі сторінки; вона додає текст решти, рядок за рядком.
Оберіть формат і завантажте
Excel (.xlsx) чи CSV, із роздільником «крапка з комою» або «кома» для CSV.
У створеному файлі жодна формула не відтворюється, лише значення. Для відсканованого PDF спершу виконайте OCR: на відміну від інструмента «PDF у Word», повідомлення про помилку тут не пропонує прямого посилання, але діє те саме рішення.
Поширені запитання
Як VellumPDF виявляє таблиці в PDF?
Інструмент знаходить стовпці за положенням текстів на сторінці, зокрема за проміжками, що повторюються від рядка до рядка. Попередній перегляд показує виявлені рядки перед завантаженням, щоб перевірити результат.
Чи можна отримати файл CSV замість файлу Excel?
Так, Ви обираєте між книгою Excel (.xlsx), із одним аркушем на сторінку PDF, або файлом CSV із крапкою з комою, якої очікує Excel у Швейцарії. Суми, записані за швейцарським стандартом, як 1’234.50, розпізнаються як числа.
Що буде, якщо мій PDF не містить справжньої таблиці з добре вирівняними рядками?
Документ без регулярної сітки можна експортувати рядок за рядком, а не точними стовпцями. Виявлення залишається локальним, безкоштовним і без надсилання файлу на сервер, незалежно від отриманого результату.
Що буде, якщо таблиця, яку я хочу витягти, походить із відсканованого PDF?
Якщо PDF не містить жодного тексту, придатного для виділення (скан, складений із зображень), аналіз зупиняється з повідомленням про це: жодних даних не можна витягти без текстового шару. Спершу треба пропустити документ через розпізнавання тексту (OCR), а потім повернутися сюди з PDF, що став придатним для пошуку.
Чи може обʼєднана комірка або запис у два рядки зіпсувати результат?
Так: стовпці розпізнаються, коли те саме вирівнювання повторюється принаймні на 30 % рядків сторінки, із допуском у кілька пунктів. Обʼєднана комірка порушує це повторення, а запис, що переходить на два рядки тексту, стає двома окремими рядками в експорті: попередній перегляд перед завантаженням слугує саме для того, щоб помітити такий поділ.
Чи можна включити в експорт сторінки, на яких таблицю не виявлено?
Коли деякі сторінки містять розпізнану таблицю, а інші ні, зʼявляється прапорець, щоб додати останні до експорту, перенесені рядок за рядком, а не стовпцями. Без цього прапорця експортуються лише сторінки з виявленою таблицею.