사용 방법
- PDF 파일을 끌어다 놓거나 눌러서 고릅니다. 고르는 즉시 모든 페이지의 글자를 뽑기 시작합니다.
- 암호가 걸린 PDF는 열기 암호를 입력하면 이어서 추출합니다.
- 필요하면 페이지 구분선 넣기, 문단 안 줄바꿈 합치기를 켜고 끕니다. 결과는 바로 바뀝니다.
- 복사 버튼으로 전체를 복사하거나 TXT로 받기로 파일을 저장합니다.
어떤 PDF에서 글자를 뽑을 수 있나
PDF 안의 글자는 두 가지로 들어 있습니다. 워드·한글·PPT에서 저장한 PDF는 글자 정보(텍스트 레이어)가 있어 그대로 뽑을 수 있고, 스캔하거나 사진으로 만든 PDF는 페이지 전체가 그림이라 뽑을 글자가 없습니다.
| PDF 종류 | 결과 |
|---|---|
| 문서 프로그램에서 저장·인쇄한 PDF | 글자가 그대로 추출됨 |
| 스캐너·휴대폰 스캔 앱으로 만든 PDF | 글자 없음 — OCR(문자 인식) 필요 |
| 스캔 후 OCR까지 거친 PDF | OCR이 인식한 글자가 추출됨 (인식 정확도에 따름) |
| 복사가 제한된 PDF | 작성자 설정을 존중해 추출하지 않음 |
쪽당 평균 10자도 안 나오면 스캔본으로 보고 안내합니다. 이 도구는 OCR을 하지 않습니다.
옵션 예시
PDF는 화면의 줄 끝마다 줄바꿈이 들어가 있어, 그대로 붙여 넣으면 문장이 중간에서 끊깁니다.
| 옵션 | 결과 |
|---|---|
| 기본 | 계약 기간은 2026년 1월 1일부터⏎12월 31일까지로 한다. |
| 문단 안 줄바꿈 합치기 | 계약 기간은 2026년 1월 1일부터 12월 31일까지로 한다. |
| 페이지 구분선 넣기 | 각 페이지 앞에 --- 3쪽 / 전체 12쪽 --- 줄 추가 |
빈 줄로 나뉜 문단 구분은 합치기를 켜도 그대로 남습니다.
주의할 점
- 추출은 브라우저 안에서만 이뤄지고 파일은 업로드되지 않습니다.
- 글자는 PDF에 기록된 순서대로 나옵니다. 2단 편집이나 표는 읽는 순서와 다르게 섞여 나올 수 있습니다.
- 글꼴에 유니코드 정보가 빠진 PDF는 글자가 깨져 나올 수 있습니다. 이 경우 원본 문서에서 PDF를 다시 저장하면 대개 해결됩니다.
- 작성자가 내용 복사를 막아 둔 PDF는 추출하지 않습니다. 권한 암호를 알고 있다면 PDF 암호 해제로 제한을 먼저 푸세요.
자주 묻는 질문
뽑은 글자수를 세고 싶어요
결과 위에 공백 포함·제외 글자수가 나옵니다. 더 자세한 통계는 텍스트를 복사해 글자수 세기에 붙여 넣으세요.
페이지 모양 그대로 보관하고 싶다면?
글자만 필요한 게 아니라면 PDF JPG 변환으로 페이지를 이미지로 저장하세요.