이미지 OCR — 사진 속 글자를 TXT로 | 입력·변환·주의사항
Tesseract 엔진으로 이미지에서 선택 언어의 글자를 인식해 텍스트 파일로 내보냅니다. 한영 영수증을 혼합 언어로 인식한 뒤 0과 O, 1과 I, 소수점을 원본과 대조하여 비용 기록에 옮깁니다.
- 브라우저에서 실행
- 업로드되지 않음
- 가입 없음, 기기 성능에 따라 제한될 수 있음
사용 방법과 입력
글자가 충분히 크고 대비가 높은 이미지를 선택하며, 내용 언어에 맞는 OCR 언어를 고르세요. 한영 영수증을 혼합 언어로 인식한 뒤 0과 O, 1과 I, 소수점을 원본과 대조하여 비용 기록에 옮깁니다.
결과 해설과 예제
추출 텍스트의 숫자, 줄바꿈, 고유명사를 원본 이미지와 대조해 교정한 뒤 사용하세요. 선택한 언어 모델로 텍스트를 추정하므로 인명·금액·날짜와 흐릿한 글자는 원본 대조가 필수입니다.
입력·결과 예시
한영 영수증을 혼합 언어로 인식한 뒤 0과 O, 1과 I, 소수점을 원본과 대조하여 비용 기록에 옮깁니다.
한계와 주의사항
- 선택한 언어 모델로 텍스트를 추정하므로 인명·금액·날짜와 흐릿한 글자는 원본 대조가 필수입니다.
- 출력은 TXT이며 원래 문서의 표 구조나 글꼴 배치를 보존하는 편집 파일이 아닙니다.
입력 항목
| 항목 | 설명·제약 |
|---|---|
| 언어팩 | 영어 / 한국어 / 영어 + 한국어 |
데이터 처리
처리는 현재 브라우저 탭에서 수행되며, 도구 입력을 계산 목적으로 서버에 업로드하지 않습니다.
근거 출처
자주 묻는 질문
한국어와 영어가 섞인 영수증은 무엇을 고르나요?
혼합 언어 옵션을 선택하고 숫자와 상품명을 사진과 대조하세요.
공백이나 표가 어긋나면 오류인가요?
TXT는 시각적 표 구조를 보장하지 않으므로 열과 줄을 직접 정리해야 합니다.
관련 도구
처음부터 다시 할 필요는 없습니다. 다음 단계에 맞는 도구로 자연스럽게 이어가세요.
PDF OCR — 스캔 문서를 TXT로
선택할 수 있는 글자가 없는 스캔 PDF를 이미지로 읽어 텍스트 파일로 옮깁니다. 각 페이지를 두 배 크기로 렌더링한 뒤 Tesseract 문자 인식을 수행하며 검색 가능한 PDF를 만드는…
PDF를 TXT로 변환 — 텍스트 추출
PDF의 기존 텍스트 레이어를 읽어 페이지 구분이 있는 TXT 파일을 만듭니다. 복사할 수 있는 문장을 모으는 데 적합하며, 사진 속 글자를 인식하거나 원래 문서 서식을 유지하는 기능은 아닙니다.
이미지 크기·형식 보기 — 로컬 | 입력·변환·주의사항
이미지의 파일 이름·바이트 크기·MIME 유형과 디코딩된 가로·세로 크기를 나열합니다. 촬영 날짜·카메라·GPS를 분석하는 EXIF 도구가 아니므로 게시 이미지의 기본 규격 확인에 사용하세요.