본문 바로가기
바로킷

🔍이미지 OCR (광학 문자 인식)

사진 속 글자를 텍스트로 추출합니다. Tesseract.js 한국어 모델 사용. 영수증 입력, 책·문서 사진 디지털화, 화면 캡처 글자 복사, 명함 정보 추출에 자주 쓰입니다.

🔒 브라우저에서 처리워터마크 없음가입 불필요

사용 방법

  1. 1글자가 있는 이미지를 업로드합니다.
  2. 2언어를 선택합니다 (한국어 / 영어 / 한+영 / 일본어 등).
  3. 3OCR 시작 버튼을 누릅니다.
  4. 4인식된 텍스트를 복사하거나 .txt로 저장합니다.

자주 묻는 질문

정확도는 어느 정도?+

고해상도·인쇄체 한국어 문서는 90%+ 정확도. 손글씨·기울어진 사진·저해상도는 50~70%로 떨어집니다. 신뢰도 점수가 함께 표시됩니다.

처음 사용 시 왜 느려요?+

첫 사용 시 한국어 학습 데이터(~10MB)를 다운로드합니다. 이후엔 브라우저 캐시되어 빨라집니다.

PDF 안의 글자도 추출?+

PDF는 이 도구로 직접 처리되지 않습니다. [PDF → 이미지] 도구로 변환 후 OCR을 적용하세요. 단, 디지털 PDF는 [PDF 텍스트 추출]이 OCR보다 정확합니다.

여러 장을 한 번에?+

현재는 한 장씩 처리됩니다. 일괄 OCR은 처리 시간이 길어 데스크톱 도구가 적합합니다.

한자·일본어도 지원?+

일본어, 중국어 간체·번체 모델을 선택할 수 있습니다. 한자는 일본어 또는 중국어 모델 사용 권장.

이미지가 외부로 가나요?+

아니요. Tesseract.js는 WebAssembly로 브라우저 안에서 처리되며 이미지·결과 모두 외부로 전송되지 않습니다.

OCR이 잘 되는 이미지?+

(1) 글자 크기 12pt 이상, (2) 배경과 글자 대비 뚜렷, (3) 똑바로 촬영, (4) 흔들림 없는 사진. 책 페이지를 평평하게 펴고 위에서 찍는 게 가장 정확합니다.

관련 도구