본문으로 건너뛰기
ezyPDF
PDF 변환완전 지원
브라우저에서 처리

‘브라우저에서 처리’의 의미

  • 파일은 서버로 전송되지 않습니다.
  • 처리 내용은 브라우저 메모리에만 존재합니다.
  • 페이지를 새로 고치거나 닫으면 작업 데이터가 사라집니다.
  • 다운로드한 결과 파일은 사용자 기기에 남습니다.
  • 광고와 사이트 리소스 요청은 파일 전송과 별개이며, 파일을 실어 보내지 않습니다.

PDF 텍스트 추출 — 본문만 뽑아내기

PDF에서 본문을 복사하려고 드래그하면 줄이 이상하게 잘리거나 순서가 뒤엉키는 경우가 많습니다. 이 도구는 문서에 저장된 텍스트 레이어를 페이지 순서대로 정리해 텍스트 파일로 저장합니다.

텍스트 추출은 전적으로 브라우저에서 이루어집니다. 문서도, 뽑아낸 글자도 서버로 전송되지 않습니다.

도구를 불러오는 중…

이것은 문자 인식(OCR)이 아닙니다. 스캔한 문서는 글자 그림만 담고 있어 뽑아낼 텍스트가 없습니다. 그런 문서를 조용히 빈 파일로 돌려주지 않고, 스캔본으로 보인다고 명확히 알려 드립니다.

사용 방법

  1. 1

    PDF 선택

    텍스트를 뽑을 문서를 고릅니다. 문서는 브라우저 안에서만 열립니다.

  2. 2

    구분 방식 정하기

    페이지마다 구분선을 넣을지, 빈 줄로 나눌지, 아예 이어 붙일지 고릅니다. 줄바꿈을 그대로 둘지 문단으로 합칠지도 선택합니다.

  3. 3

    결과 확인 후 저장

    앞부분 미리보기로 결과를 확인한 뒤 .txt 파일로 내려받습니다. UTF-8로 저장되므로 한글이 깨지지 않습니다.

주요 특징

  • 페이지 구분 선택

    ‘--- 3페이지 ---’ 형태의 구분선을 넣으면 나중에 어느 쪽에서 나온 문장인지 추적할 수 있습니다.

  • 줄바꿈 처리 선택

    PDF의 줄을 그대로 옮기거나, 이어지는 줄을 한 문단으로 합칠 수 있습니다. 한글처럼 단어 중간에서 줄이 바뀌는 언어도 불필요한 공백 없이 처리합니다.

  • UTF-8 저장

    한글·일본어·특수문자를 그대로 보존합니다. 메모장, VS Code, 스프레드시트 어디서 열어도 깨지지 않습니다.

  • 스캔본 감지

    페이지 수에 비해 글자가 지나치게 적으면 스캔본으로 판단해 결과 화면에서 알려 줍니다.

이 도구의 한계

  • 문자 인식(OCR)이 아닙니다. 스캔한 이미지 PDF에서는 아무것도 나오지 않습니다.
  • 표는 줄 단위 텍스트로 풀려 나옵니다. 표 구조가 중요하면 PDF → Excel 도구를 사용하세요.
  • 다단 편집(2단 조판) 문서는 좌우 단이 섞여 읽히는 경우가 있습니다.
  • 글꼴에 유니코드 정보가 없는 PDF는 추출한 글자가 깨질 수 있습니다. 이 경우 뷰어에서 복사해도 똑같이 깨집니다.

이럴 때 사용하세요

  • 본문 검색과 인용

    보고서 본문을 텍스트로 뽑아 필요한 문장을 검색하고 인용합니다.

  • 번역 준비

    번역 도구에 넣기 좋은 형태로 본문을 정리합니다.

  • 데이터 정리

    일정한 형식으로 반복되는 문서에서 값을 뽑아 다른 도구로 넘깁니다.

파일은 어떻게 처리되나요?

텍스트 추출은 전적으로 브라우저에서 이루어집니다. 문서도, 뽑아낸 글자도 서버로 전송되지 않습니다.

선택한 파일은 브라우저 메모리에서만 열리며, 처리 결과 역시 저장 시점에 여러분의 기기로 바로 전달됩니다. 탭을 닫으면 남아 있던 데이터도 함께 사라집니다. 자세한 내용은 개인정보처리방침과 파일 보관 정책에서 확인하실 수 있습니다.

PDF → 텍스트 자주 묻는 질문

스캔한 문서에서도 글자를 뽑을 수 있나요?
없습니다. 스캔본은 글자 그림만 담고 있어 문자 인식(OCR)이 필요하지만, 아직 제공하지 않습니다. OCR 도구 페이지에 검토 상황을 정리해 두었습니다.
표가 있는 문서는 어떻게 되나요?
칸 구분 없이 줄 단위 텍스트로 나옵니다. 표를 표로 살리려면 PDF → Excel 도구를 사용해 보세요.
글자가 깨져서 나옵니다.
PDF에 포함된 글꼴에 유니코드 매핑이 없으면 생기는 문제입니다. 같은 문서를 PDF 뷰어에서 복사해도 깨진다면 원인이 같습니다. 원본 문서를 구하는 편이 빠릅니다.
페이지 일부만 뽑을 수 있나요?
현재는 전체 페이지를 대상으로 합니다. 필요한 쪽만 먼저 페이지 추출 도구로 뽑은 뒤 텍스트를 추출하면 같은 결과를 얻을 수 있습니다.