본문으로 건너뛰기

텍스트 인식(OCR)

스캔한 문서가 텍스트로 바뀝니다. 분석은 사용자의 컴퓨터에서 이루어집니다.

파일은 기기 밖으로 나가지 않습니다

PDF 또는 이미지를 여기에 놓으세요

스캔한 PDF 또는 사진 — JPG, PNG

스캔한 PDF의 텍스트를 인식하는 방법(OCR), 단계별 안내

OCR은 브라우저에서 인식 엔진을 직접 불러와 스캔본을 활용할 수 있는 텍스트로 바꿉니다. 문서는 온라인으로 전송되지 않습니다.

  1. 스캔한 PDF 또는 사진을 놓으세요

    PDF 또는 JPG/PNG 이미지를 놓는 영역으로 끌어다 놓거나 클릭하여 찾아보세요.

  2. 문서 언어를 선택하세요

    「문서 언어」에서 선택하세요. 먼저 사이트가 지원하는 언어, 그다음 100개가 넘는 다른 언어가 나오며, 그 모델은 처음 사용할 때 내려받습니다. 선택한 언어가 실제 텍스트와 맞지 않으면 인식 신뢰도가 크게 떨어집니다. 「두 번째 언어」는 이중 언어 문서용입니다.

  3. 파일이 PDF라면 필요에 따라 페이지 범위를 제한하세요

    입력란은 「1-3, 5, 8-10」 같은 범위를 받으며, 비워 두면 모든 페이지를 분석합니다.

  4. 「인식 시작」을 클릭하세요

    인식 엔진(약 4 MB)은 언어 모델과 함께 저희 서버에서 한 번만 내려받습니다. 포함되지 않은 언어는 시작하기 전에 모델 용량이 안내됩니다. 이후 분석 자체는 전적으로 사용자의 기기에서 이루어집니다.

  5. 결과와 신뢰도를 확인하세요

    인식된 텍스트가 단어 수와 평균 신뢰도와 함께 표시됩니다. 신뢰도가 낮으면 스캔본이 비뚤어졌거나 품질이 낮을 가능성이 높다는 뜻입니다.

  6. 텍스트 또는 검색 가능한 텍스트가 있는 PDF를 내려받으세요

    .txt 파일에는 순수한 텍스트가 들어 있습니다. 검색 가능한 PDF는 원래 레이아웃을 유지하면서 그 위에 보이지 않는 텍스트 레이어를 얹어 문서를 선택하고 키워드로 검색할 수 있게 합니다.

검색 가능한 PDF에서 스캔한 페이지는 원본 이미지를 유지하고, 그리스어, 키릴 문자, 아랍어, 중국어를 포함한 모든 문자 체계에서 유효한 보이지 않는 텍스트 레이어를 받습니다. 이미 텍스트가 있던 페이지는 레이어가 두 겹이 되지 않도록 이미지로 다시 구성됩니다.

자주 묻는 질문

VellumPDF의 OCR은 PDF와 사진을 모두 지원하나요?

네, 스캔한 PDF를 올리거나 JPG 또는 PNG 형식의 이미지를 바로 올릴 수 있습니다. 두 경우 모두 도구가 텍스트를 선택하고 복사할 수 있는 검색 가능한 PDF를 만듭니다.

텍스트 인식은 어떤 언어를 지원하나요?

100개가 넘는 언어를 지원합니다. 사이트가 지원하는 언어는 포함되어 있으며 VellumPDF가 직접 제공합니다. 나머지(체코어, 그리스어, 히브리어, 페르시아어 등)는 같은 「문서 언어」 목록에서 선택하며, 해당 모델은 처음 사용할 때 한 번 내려받습니다. 「두 번째 언어」는 이중 언어 문서를 처리합니다. 올바른 언어를 선택하면 결과의 신뢰도가 크게 높아집니다.

스캔한 문서가 온라인 인공지능 서비스로 전송되나요?

아니요. 인식 엔진은 사용자의 브라우저에서 실행됩니다. 사이트가 지원하는 언어의 파일은 VellumPDF의 도메인에서 오고, 다른 언어는 화면에 안내가 표시된 뒤 Tesseract 프로젝트의 공개 저장소인 raw.githubusercontent.com에서 해당 모델만 내려받습니다. 이 내려받기는 한 방향으로만 이루어집니다. 문서는 기기 밖으로 나가지 않으며 어떤 인공지능 서비스도 호출되지 않습니다.

인식 모델은 사용할 때마다 내려받나요? 용량은 얼마나 되나요?

언어마다 고유한 모델이 있습니다. VellumPDF가 호스팅하는 사이트 지원 언어는 언어에 따라 압축 상태로 0.4~3 MB입니다(프랑스어는 약 700 KB, 영어는 거의 3 MB). 브라우저의 일반 캐시가 다시 내려받는 일을 막아 줍니다. 그 밖의 언어는 언어에 따라 0.4~12 MB이며 시작하기 전에 용량이 표시됩니다. 한 번 내려받은 모델은 브라우저에 보관되므로 두 번째 사용부터는 아무것도 내려받지 않습니다.

비뚤어졌거나 화질이 나쁜 스캔본에서 결과를 믿을 수 있는지 어떻게 알 수 있나요?

결과와 함께 인식된 모든 단어에서 계산한 평균 신뢰도(%)가 표시됩니다. 70 % 미만이면 인식이 불확실하며 스캔본이 기울어졌거나 화질이 낮을 수 있다는 경고가 나타납니다. 얻은 텍스트를 믿는 대신 다시 스캔하라는 신호입니다.

비밀번호로 보호된 PDF를 올리면 어떻게 되나요?

인식이 즉시 거부되며, 암호화된 PDF는 OCR을 실행할 수 없다는 메시지가 나타납니다. 이곳에 올리기 전에 먼저 문서의 보호를 해제해야 합니다.