본문으로 건너뛰기
툴허브

이미지 텍스트 추출 (OCR)

이미지에서 텍스트를 자동 인식하여 추출합니다. 한국어, 영어, 일본어, 중국어를 지원합니다.

이미지는 서버로 전송되지 않고 내 브라우저 안에서만 처리됩니다.

이미지 업로드

인식 언어

이미지 보정

흑백 변환·대비 강화, 작은 이미지는 2배 확대, 어두운 배경은 자동 반전합니다. 대부분의 경우 권장.

결과 정리

이미지를 올리면 바로 인식을 시작합니다. 언어·보정·회전을 바꿨다면 다시 인식을 눌러 주세요.

인식 결과

이미지를 먼저 업로드하세요

인식된 텍스트가 여기에 표시됩니다

사용 가이드

이미지 텍스트 추출(OCR)이란?

이미지 OCR 도구는 사진, 스캔 문서, 스크린샷 등 이미지 파일에 포함된 텍스트를 자동으로 인식하여 편집 가능한 텍스트로 변환해주는 도구입니다. Tesseract.js 엔진을 활용하여 한국어, 영어, 일본어, 중국어 등 다국어를 지원하며, 이미지를 서버에 전송하지 않고 브라우저에서 모든 처리가 이루어집니다.

사용 방법

  • •이미지를 올리거나, 캡처한 화면을 Ctrl+V로 붙여넣습니다. 휴대폰에서는 카메라로 바로 찍을 수 있습니다.
  • •올리는 즉시 한국어+영어로 인식이 시작됩니다. 여러 장을 올리면 순서대로 처리됩니다.
  • •기울어진 이미지는 회전 버튼으로 바로잡고, 인식률이 낮으면 이미지 보정 방식을 바꾼 뒤 다시 인식합니다.
  • •노란 상자로 표시된 낮은 신뢰도 단어를 확인해 고친 뒤 복사하거나 TXT로 저장합니다.

주요 기능

  • •한국어·영어·일본어·중국어(간체/번체) 인식, 여러 언어 동시 선택
  • •인식 전 자동 보정: 흑백 변환, 대비 강화, 작은 이미지(긴 변 1,600px 미만) 2배 확대, 다크모드 캡처 자동 반전
  • •한글 음절 사이에 잘못 들어간 띄어쓰기 자동 정리, 줄바꿈 합치기 옵션
  • •여러 이미지 한 번에 처리, 전체 복사·TXT 다운로드
  • •신뢰도가 낮은 단어를 이미지 위에 표시해 빠르게 검수
  • •모든 처리는 브라우저 안에서만 — 이미지가 서버로 전송되지 않음

팁

  • •글자가 작으면 화면을 확대한 상태로 캡처하세요. 글자 높이 20px 이상에서 인식률이 크게 오릅니다.
  • •스크린샷·스캔 문서는 '흑백 이진화', 그림자가 있는 사진은 '흑백 보정'이 잘 맞습니다.
  • •필요 없는 부분(메뉴·광고 등)은 잘라내고 올리면 더 정확합니다.
  • •인식할 언어만 고르세요. 쓰지 않는 언어를 켜 두면 오히려 오인식이 늘 수 있습니다.
  • •처음 한 번은 언어 데이터를 내려받느라 시간이 걸리지만, 이후에는 바로 시작됩니다.

자주 묻는 질문

인식률을 높이려면 어떻게 해야 하나요?

글자가 크고 선명할수록, 배경과 대비가 클수록 정확합니다. 기울어진 이미지는 회전으로 바로잡고, 보정 방식을 바꿔 다시 인식해 보세요. 고딕체 인쇄 글자가 가장 잘 인식됩니다.

한글 사이에 띄어쓰기가 이상하게 들어가요.

OCR 엔진(Tesseract)이 한글 음절 사이에 공백을 넣는 경우가 많습니다. '한글 글자 사이 잘못된 띄어쓰기 붙이기' 옵션을 켜면 한 글자씩 떨어진 부분을 자동으로 붙입니다.

이미지가 서버로 전송되나요?

아니요. 인식은 브라우저 안에서 실행되며 이미지와 결과는 어디에도 업로드되지 않습니다. 인터넷은 처음에 인식 엔진과 언어 데이터를 내려받을 때만 사용합니다.

손글씨도 인식할 수 있나요?

인쇄체보다 정확도가 낮습니다. 또박또박 쓴 글씨는 어느 정도 인식되지만, 흘림체는 결과를 꼭 확인해 주세요.

처음 실행이 느린 이유는 무엇인가요?

처음에는 선택한 언어의 인식 데이터(언어당 수 MB)를 내려받아야 합니다. 한 번 받으면 브라우저에 저장되어 다음부터는 바로 시작됩니다.

이미지 OCR(광학 문자 인식)이란?

OCR(Optical Character Recognition, 광학 문자 인식)은 이미지나 사진 속에 있는 텍스트를 컴퓨터가 읽고 편집 가능한 텍스트로 변환하는 기술입니다. 이 도구는 100개 이상의 언어를 지원하는 Tesseract.js 엔진으로 브라우저에서 직접 한국어, 영어, 일본어, 중국어(간체·번체)를 인식합니다. 서버에 이미지를 전송하지 않아 개인정보 보호에 안전합니다.

이미지 텍스트 추출 활용 팁

  • 스캔 문서 디지털화: 종이 문서를 촬영하거나 스캔한 이미지에서 텍스트를 추출하여 편집 가능한 디지털 파일로 변환하세요.
  • 영수증·명함 정보 추출: 영수증 금액, 명함의 연락처 등을 직접 타이핑하지 않고 OCR로 빠르게 추출할 수 있습니다.
  • 인식률 향상 방법: 이미지가 기울어진 경우 회전 보정 기능을 사용하고, 해상도는 300dpi 이상을 권장합니다.
  • 다국어 혼합 문서: 한국어와 영어가 섞인 문서는 다중 언어 모드(kor+eng)를 선택하면 인식률이 향상됩니다.
  • 손글씨 주의: OCR은 인쇄 텍스트에 최적화되어 있으며 손글씨는 인식률이 낮을 수 있습니다.