PDF OCR — 스캔 문서를 TXT로
선택할 수 있는 글자가 없는 스캔 PDF를 이미지로 읽어 텍스트 파일로 옮깁니다. 각 페이지를 두 배 크기로 렌더링한 뒤 Tesseract 문자 인식을 수행하며 검색 가능한 PDF를 만드는 기능은 아닙니다.
- 브라우저에서 실행
- 업로드되지 않음
- 가입 없음, 기기 성능에 따라 제한될 수 있음
사용 방법과 입력
PDF와 문서에 맞는 한국어, 영어 또는 두 언어 조합을 선택하세요. 기울어진 스캔이나 작은 글자는 오류가 늘 수 있고, 이 화면에는 암호 입력 항목이 없으므로 접근 가능한 문서가 필요합니다.
결과 해설과 예제
출력 TXT에서 이름, 금액, 날짜와 표의 읽는 순서를 원본과 대조하세요. 페이지 구분은 남지만 원래 배치와 서식은 유지되지 않으며, 인식 결과를 검토 없이 공식 문서 내용으로 사용하면 안 됩니다.
입력·결과 예시
영어로 스캔한 영수증 PDF는 eng를 골라 페이지 구분이 있는 TXT로 인식합니다. 한영 계약서 스캔은 eng+kor를 선택하고 날짜·금액·이름을 원문과 한 글자씩 대조하세요.
한계와 주의사항
- 검색 가능한 PDF를 만드는 기능이 아니라 인식 결과 TXT를 출력합니다.
- 표 구조·손글씨·흐린 스캔은 틀릴 수 있으며 비밀번호 입력 옵션이 없습니다.
입력 항목
| 항목 | 설명·제약 |
|---|---|
| 언어팩 | 영어 / 한국어 / 영어 + 한국어 |
데이터 처리
처리는 현재 브라우저 탭에서 수행되며, 도구 입력을 계산 목적으로 서버에 업로드하지 않습니다.
근거 출처
자주 묻는 질문
원본에 검색 텍스트가 추가되나요?
아닙니다. 별도의 텍스트 파일을 만듭니다.
한글과 영어가 섞이면 어떤 언어인가요?
English + Korean을 선택하되 중요 값은 수동 확인하세요.
관련 도구
처음부터 다시 할 필요는 없습니다. 다음 단계에 맞는 도구로 자연스럽게 이어가세요.
이미지 OCR — 사진 속 글자를 TXT로 | 입력·변환·주의사항
Tesseract 엔진으로 이미지에서 선택 언어의 글자를 인식해 텍스트 파일로 내보냅니다. 한영 영수증을 혼합 언어로 인식한 뒤 0과 O, 1과 I, 소수점을 원본과 대조하여 비용 기록에 옮깁니다.
PDF를 TXT로 변환 — 텍스트 추출
PDF의 기존 텍스트 레이어를 읽어 페이지 구분이 있는 TXT 파일을 만듭니다. 복사할 수 있는 문장을 모으는 데 적합하며, 사진 속 글자를 인식하거나 원래 문서 서식을 유지하는 기능은 아닙니다.
PDF 용량 줄이기 — 무료, 업로드 없음 | 입력·변환·주의사항
Ghostscript의 screen·ebook·printer 프리셋으로 PDF의 이미지 해상도와 압축 수준을 조정합니다.