Kiểm kê PDF
Số trang, dung lượng, khổ giấy, tác giả, mã hóa và tệp đính kèm của từng tệp, chỉ trong nháy mắt.
Tệp của bạn không bao giờ rời khỏi thiết bị của bạnThả tệp PDF của bạn vào đây
Phân tích nhiều tệp cùng lúc, không giới hạn số lượng.
Cách tạo bảng kiểm kê PDF, từng bước
Công cụ này phân tích nhiều tệp PDF cùng một lúc và tạo ra một bảng có thể xuất ra, gồm số trang, dung lượng, siêu dữ liệu và các đặc điểm riêng của chúng — không giới hạn số lượng tệp.
Thả các tệp PDF của bạn vào
Kéo một hoặc nhiều tệp vào, hoặc thêm nữa sau đó: chúng sẽ được bổ sung vào bảng đã có thay vì thay thế nó.
Chờ quá trình phân tích
Mỗi tệp lần lượt được mở và đọc; tiến trình được hiển thị trong khi xử lý.
Xem lại bảng
Tên, dung lượng, số trang, khổ giấy, tiêu đề, tác giả, ngày tạo, mã hóa, sự hiện diện của văn bản và số lượng tệp đính kèm xuất hiện dưới dạng các cột; biểu tượng thùng rác loại bỏ một hàng không nên xuất hiện trong bản xuất.
Xuất ra CSV hoặc Excel
Cả hai định dạng đều có đúng các cột như nhau; tệp CSV mở được ở mọi nơi, tệp Excel (.xlsx) phù hợp hơn để sắp xếp trực tiếp trong một ứng dụng bảng tính.
Một tệp không đọc được hoặc được bảo vệ bằng mật khẩu vẫn xuất hiện trong bảng, cùng tên và dung lượng của nó: các cột khác của nó để trống thay vì bị đoán mò.
Câu hỏi thường gặp
Tôi có thể phân tích bao nhiêu tệp cùng một lúc?
Bao nhiêu tùy ý, không có giới hạn nào do công cụ áp đặt — chỉ có bộ nhớ của thiết bị mới giới hạn số lượng tệp bạn thả vào cùng một lúc. Bạn cũng có thể thêm tệp thành nhiều đợt: chúng sẽ được bổ sung vào bảng đã có.
Khác biệt giữa CSV và Excel là gì?
Cả hai đều chứa đúng các cột như nhau. Tệp CSV mở được ở mọi nơi, kể cả trong một ứng dụng bảng tính không phải của Microsoft; tệp Excel (.xlsx) tiện lợi nếu bạn muốn sắp xếp hoặc định dạng bảng trực tiếp trong Excel hoặc LibreOffice.
Khổ trang (A4, Letter…) được xác định như thế nào?
Dựa trên kích thước của trang đầu tiên, so sánh với các khổ chuẩn phổ biến nhất (A4, A3, A5, Letter, Legal), bao gồm cả hướng dọc hay ngang. Một kích thước không khớp với chuẩn nào sẽ được hiển thị nguyên trạng, theo đơn vị point.
Việc có lớp văn bản hay không được kiểm tra như thế nào?
Công cụ xem xét vài trang đầu của tệp để tìm văn bản có thể chọn được. Một tài liệu hoàn toàn gồm hình ảnh đã scan, chưa qua nhận dạng ký tự, sẽ hiện «Văn bản: Không» — dấu hiệu cho thấy nên chạy OCR trước khi khai thác nội dung.
Điều gì xảy ra với một tệp không đọc được hoặc được bảo vệ bằng mật khẩu?
Tệp đó vẫn xuất hiện trong bảng, cùng tên và dung lượng của nó. Số trang, tiêu đề và các siêu dữ liệu khác để trống, vì không thể đọc được. Cột «Đã mã hóa» chỉ hiện «Có» khi tệp thực sự được bảo vệ bằng mật khẩu: một tệp chỉ đơn giản bị hỏng hoặc không hợp lệ sẽ hiện «Không» ở đó, dù vẫn không đọc được. Không có gì bị bỏ qua âm thầm: với một bộ hồ sơ hai trăm tài liệu, bạn sẽ thấy chính xác những tệp nào không mở được.
Bảng xuất ra chứa những cột nào?
Tên tệp, dung lượng, số trang, khổ trang, tiêu đề, tác giả, ngày tạo, đã mã hóa hay không, có lớp văn bản hay không, và số lượng tệp đính kèm. Đủ để sắp xếp cả một kho tài liệu và nhận ra ngay những bản scan nào vẫn cần chạy nhận dạng ký tự.
Tiêu đề và tác giả có lấy từ tên tệp không?
Không, chúng lấy từ siêu dữ liệu nội bộ của tệp PDF. Đó là lý do vì sao chúng thường để trống, hoặc vẫn mang tên của một tài liệu trước đó khi tệp được tạo ra từ một mẫu có sẵn. Trước khi lưu trữ, cột tác giả đáng để kiểm tra lại.