1. 홈
  2. PDF
  3. PDF 텍스트 추출

PDF 텍스트 추출

PDF의 글자를 페이지별로 뽑아 복사하거나 TXT로 저장합니다.

내 브라우저에서 처리 · 업로드 없음 오프라인 동작

사용 방법

  1. PDF 파일을 끌어다 놓거나 눌러서 고릅니다. 고르는 즉시 모든 페이지의 글자를 뽑기 시작합니다.
  2. 암호가 걸린 PDF는 열기 암호를 입력하면 이어서 추출합니다.
  3. 필요하면 페이지 구분선 넣기, 문단 안 줄바꿈 합치기를 켜고 끕니다. 결과는 바로 바뀝니다.
  4. 복사 버튼으로 전체를 복사하거나 TXT로 받기로 파일을 저장합니다.

어떤 PDF에서 글자를 뽑을 수 있나

PDF 안의 글자는 두 가지로 들어 있습니다. 워드·한글·PPT에서 저장한 PDF는 글자 정보(텍스트 레이어)가 있어 그대로 뽑을 수 있고, 스캔하거나 사진으로 만든 PDF는 페이지 전체가 그림이라 뽑을 글자가 없습니다.

PDF 종류 결과
문서 프로그램에서 저장·인쇄한 PDF 글자가 그대로 추출됨
스캐너·휴대폰 스캔 앱으로 만든 PDF 글자 없음 — OCR(문자 인식) 필요
스캔 후 OCR까지 거친 PDF OCR이 인식한 글자가 추출됨 (인식 정확도에 따름)
복사가 제한된 PDF 작성자 설정을 존중해 추출하지 않음

쪽당 평균 10자도 안 나오면 스캔본으로 보고 안내합니다. 이 도구는 OCR을 하지 않습니다.

옵션 예시

PDF는 화면의 줄 끝마다 줄바꿈이 들어가 있어, 그대로 붙여 넣으면 문장이 중간에서 끊깁니다.

옵션 결과
기본 계약 기간은 2026년 1월 1일부터⏎12월 31일까지로 한다.
문단 안 줄바꿈 합치기 계약 기간은 2026년 1월 1일부터 12월 31일까지로 한다.
페이지 구분선 넣기 각 페이지 앞에 --- 3쪽 / 전체 12쪽 --- 줄 추가

빈 줄로 나뉜 문단 구분은 합치기를 켜도 그대로 남습니다.

주의할 점

  • 추출은 브라우저 안에서만 이뤄지고 파일은 업로드되지 않습니다.
  • 글자는 PDF에 기록된 순서대로 나옵니다. 2단 편집이나 표는 읽는 순서와 다르게 섞여 나올 수 있습니다.
  • 글꼴에 유니코드 정보가 빠진 PDF는 글자가 깨져 나올 수 있습니다. 이 경우 원본 문서에서 PDF를 다시 저장하면 대개 해결됩니다.
  • 작성자가 내용 복사를 막아 둔 PDF는 추출하지 않습니다. 권한 암호를 알고 있다면 PDF 암호 해제로 제한을 먼저 푸세요.

자주 묻는 질문

뽑은 글자수를 세고 싶어요

결과 위에 공백 포함·제외 글자수가 나옵니다. 더 자세한 통계는 텍스트를 복사해 글자수 세기에 붙여 넣으세요.

페이지 모양 그대로 보관하고 싶다면?

글자만 필요한 게 아니라면 PDF JPG 변환으로 페이지를 이미지로 저장하세요.

준비 중인 도구

필요한 도구가 없나요?

어떤 작업을 하고 싶은지 적어 주세요. 요청이 많은 도구부터 만듭니다.