PDF를 텍스트로
PDF의 내용을 다시 쓸 수 있는 일반 텍스트로 받으세요.
파일은 기기 밖으로 나가지 않습니다PDF를 여기로 끌어다 놓으세요
파일을 놓으면 텍스트가 자동으로 추출됩니다
PDF에서 텍스트를 추출하는 방법, 단계별 안내
도구는 파일에 실제로 들어 있는 텍스트를 페이지별로 가져와 다시 읽거나 다른 곳에서 다시 쓸 수 있게 합니다. 아무것도 브라우저를 떠나지 않습니다.
PDF를 올리세요
파일을 놓는 영역으로 끌어다 놓거나, 클릭하여 파일을 찾아보세요. 버튼을 클릭할 필요 없이 추출이 바로 시작됩니다.
VellumPDF가 각 페이지를 훑게 하세요
각 페이지의 텍스트가 가져와져, 파일에 나타나는 순서대로 「———— n페이지 ————」 표시로 다음 페이지와 이어집니다.
표시된 결과를 다시 읽어 보세요
전체 텍스트가 스크롤할 수 있는 상자에 나타나며, 바로 위에 글자 수와 단어 수가 표시됩니다.
텍스트를 내려받거나 복사하세요
「.txt 내려받기」는 원본 PDF와 같은 이름의 텍스트 파일을 저장하고, 「복사」는 결과를 클립보드에 넣어 다른 곳에 붙여넣을 수 있게 합니다.
비밀번호로 보호된 PDF는 전용 메시지와 함께 즉시 거부됩니다. 이곳으로 돌아오기 전에 먼저 잠금 해제 도구로 보호를 해제하세요.
자주 묻는 질문
PDF에서 추출한 텍스트는 어떤 형태로 제공되나요?
텍스트는 페이지별로 정리된 .txt 파일로 제공되어 텍스트 편집기나 다른 어떤 도구에서도 다시 쓸 수 있습니다. 서식 없이, 파일에 실제로 들어 있는 텍스트가 그대로 복구됩니다.
이 도구는 스캔한 PDF에서도 작동하나요?
아니요, 추출은 이미지 인식이 아니라 PDF 파일에 이미 들어 있는 텍스트만을 기반으로 합니다. 문서가 바탕 텍스트가 없는 스캔본이라면 텍스트가 나오지 않으니, 먼저 VellumPDF의 OCR 도구로 처리하세요.
이 서비스는 무료이며 문서가 온라인으로 전송되나요?
네, 도구는 무료이며 사용 제한이 없습니다. 추출은 PDF를 서버로 보내지 않고 전적으로 브라우저에서 이루어집니다.
추출한 텍스트는 레이아웃을 유지하나요?
아니요. 형식 자체의 특성입니다. 텍스트를 복구하는 것이지 레이아웃을 복구하는 것이 아닙니다. 단은 차례로 펼쳐지고 표는 격자를 잃습니다. 구조가 중요하다면 Markdown으로 내보내면 적어도 제목은 유지되며, 레이아웃이 중요하다면 Word로 내보내야 합니다.
두 단으로 된 페이지의 텍스트는 어떤 순서로 나오나요?
파일에 선언된 순서대로 나오며, 보통은 자연스러운 읽기 순서를 따르지만 항상 그렇지는 않습니다. 안내 책자나 신문에서는 문단 한가운데에 박스가 끼어들기도 합니다. 빠르게 다시 읽어 보면 알 수 있습니다.
어떤 파일에서는 추출 결과가 아무것도 나오지 않는 이유는 무엇인가요?
문서에 텍스트 레이어가 없기 때문입니다. 보통 스캔본이나 사진인 페이지 이미지입니다. 그러면 추출할 것이 말 그대로 없습니다. 먼저 문자 인식으로 파일을 처리하여 텍스트 레이어를 추가한 다음, 추출을 다시 실행하세요.