PDF를 TXT로 변환 — 텍스트 추출
PDF의 기존 텍스트 레이어를 읽어 페이지 구분이 있는 TXT 파일을 만듭니다. 복사할 수 있는 문장을 모으는 데 적합하며, 사진 속 글자를 인식하거나 원래 문서 서식을 유지하는 기능은 아닙니다.
- 브라우저에서 실행
- 업로드되지 않음
- 가입 없음, 기기 성능에 따라 제한될 수 있음
사용 방법과 입력
본문 글자를 직접 선택할 수 있는 PDF를 준비하세요. 여러 단이나 표가 있는 문서는 추출 순서를 점검해야 하고, 스캔 이미지로만 이루어진 문서는 별도의 OCR 작업이 필요합니다.
결과 해설과 예제
텍스트 파일의 페이지 표시를 기준으로 원문과 대조하세요. 글자의 표시 순서가 읽는 순서와 다를 수 있으며, 글꼴과 표 테두리, 이미지 및 클릭 가능한 링크는 TXT에 포함되지 않습니다.
입력·결과 예시
텍스트 선택이 되는 4쪽 안내문은 --- page 1 --- 같은 구분자가 있는 TXT로 추출합니다. 추출한 계약서에서 금액을 검색하되 두 단의 문장이 섞이지 않았는지 원본 순서를 확인하세요.
한계와 주의사항
- 이미지로 스캔한 글자에는 별도 PDF OCR 도구가 필요합니다.
- 표·다단 편집·글자 배치 순서는 보이는 읽기 순서와 다를 수 있습니다.
입력 항목
| 항목 | 설명·제약 |
|---|---|
| 필요 시 비밀번호 | 화면의 단위와 입력 형식을 확인하세요. |
데이터 처리
처리는 현재 브라우저 탭에서 수행되며, 도구 입력을 계산 목적으로 서버에 업로드하지 않습니다.
근거 출처
자주 묻는 질문
글자가 비어 있는데 파일 오류인가요?
선택 가능한 텍스트 층이 없는 스캔일 수 있습니다.
글꼴과 굵기도 유지하나요?
TXT에는 글꼴·서식·이미지가 들어가지 않습니다.
관련 도구
처음부터 다시 할 필요는 없습니다. 다음 단계에 맞는 도구로 자연스럽게 이어가세요.
PDF를 마크다운으로 변환 — MD 추출
PDF에 저장된 텍스트를 문서 제목과 페이지별 소제목이 있는 Markdown 초안으로 옮깁니다. 표나 본문 제목의 의미를 자동 복원하는 변환기가 아니라 텍스트 추출 결과에 간단한 구조를 붙이는…
PDF OCR — 스캔 문서를 TXT로
선택할 수 있는 글자가 없는 스캔 PDF를 이미지로 읽어 텍스트 파일로 옮깁니다. 각 페이지를 두 배 크기로 렌더링한 뒤 Tesseract 문자 인식을 수행하며 검색 가능한 PDF를 만드는…
PDF 페이지 추출 — 무료, 업로드 없음 | 입력·변환·주의사항
PDF의 페이지 범위를 입력해 그 범위만 포함하는 별도 PDF 파일을 만듭니다. 열 쪽 자료에서 1-3,7을 입력하면 첫 세 쪽과 일곱 번째 쪽을 담은 네 쪽 PDF를 얻습니다.