🔍이미지 OCR (광학 문자 인식)
사진 속 글자를 텍스트로 추출합니다. Tesseract.js 한국어 모델 사용. 영수증 입력, 책·문서 사진 디지털화, 화면 캡처 글자 복사, 명함 정보 추출에 자주 쓰입니다.
🔒 브라우저에서 처리✓ 워터마크 없음✓ 가입 불필요
사용 방법
- 1글자가 있는 이미지를 업로드합니다.
- 2언어를 선택합니다 (한국어 / 영어 / 한+영 / 일본어 등).
- 3OCR 시작 버튼을 누릅니다.
- 4인식된 텍스트를 복사하거나 .txt로 저장합니다.
자주 묻는 질문
정확도는 어느 정도?+
고해상도·인쇄체 한국어 문서는 90%+ 정확도. 손글씨·기울어진 사진·저해상도는 50~70%로 떨어집니다. 신뢰도 점수가 함께 표시됩니다.
처음 사용 시 왜 느려요?+
첫 사용 시 한국어 학습 데이터(~10MB)를 다운로드합니다. 이후엔 브라우저 캐시되어 빨라집니다.
PDF 안의 글자도 추출?+
PDF는 이 도구로 직접 처리되지 않습니다. [PDF → 이미지] 도구로 변환 후 OCR을 적용하세요. 단, 디지털 PDF는 [PDF 텍스트 추출]이 OCR보다 정확합니다.
여러 장을 한 번에?+
현재는 한 장씩 처리됩니다. 일괄 OCR은 처리 시간이 길어 데스크톱 도구가 적합합니다.
한자·일본어도 지원?+
일본어, 중국어 간체·번체 모델을 선택할 수 있습니다. 한자는 일본어 또는 중국어 모델 사용 권장.
이미지가 외부로 가나요?+
아니요. Tesseract.js는 WebAssembly로 브라우저 안에서 처리되며 이미지·결과 모두 외부로 전송되지 않습니다.
OCR이 잘 되는 이미지?+
(1) 글자 크기 12pt 이상, (2) 배경과 글자 대비 뚜렷, (3) 똑바로 촬영, (4) 흔들림 없는 사진. 책 페이지를 평평하게 펴고 위에서 찍는 게 가장 정확합니다.