도구상자FREE ONLINE TOOLS
← 모든 도구

이미지 OCR · 글자 추출

사진·스캔·캡처 이미지 속 글자를 인식해 편집 가능한 텍스트로 추출합니다.

이미지를 끌어다 놓거나 클릭해서 선택
JPG · PNG · WebP 등 · 한 장씩
선택한 이미지 미리보기
사용법
  1. 글자가 들어있는 이미지를 끌어다 놓거나 클릭해 선택합니다.
  2. 인식 언어를 고릅니다. 영어 문서라면 「영어만」이 더 빠르고 정확합니다.
  3. 글자 추출을 누르면 인식이 시작됩니다(첫 실행은 데이터 내려받기로 시간이 걸립니다).
  4. 인식된 텍스트를 확인·수정한 뒤 텍스트 복사로 가져갑니다.
OCR이 잘 되는 이미지와 잘 안 되는 이미지

OCR(광학 문자 인식)은 픽셀의 명암 패턴에서 글자 모양을 추론하는 기술입니다. 그래서 같은 내용이라도 어떻게 담겼느냐에 따라 인식률이 크게 달라집니다.

  • 화면 캡처·스크린샷: 글자가 또렷한 디지털 텍스트라 인식률이 가장 높습니다. PDF·웹페이지·앱 화면을 캡처해 넣으면 거의 그대로 추출됩니다.
  • 스캔 문서·인쇄물: 평평하게 스캔하고 글자가 수평이면 잘 인식됩니다. 그림자·구겨짐·기울어짐이 있으면 오인식이 늘어납니다.
  • 사진 속 글자: 간판·표지판처럼 큰 인쇄 글자는 괜찮지만, 손글씨·흘림체·장식 글꼴·복잡한 배경 위 글자는 인식률이 떨어집니다.

인식이 잘 안 되면 먼저 사진 글자 추출 가이드의 촬영·전처리 요령을 참고해 이미지를 다듬어 보세요.

활용 팁
  • 선명할수록 정확합니다: 글자가 수평이고 또렷할수록 인식률이 올라갑니다. 비스듬히 찍힌 사진은 미리 똑바로 회전·자르기 해서 넣으면 결과가 좋아집니다.
  • 언어를 맞추세요: 한글이 없는 문서에 「한국어+영어」를 쓰면 오히려 오인식이 늘 수 있습니다. 내용에 맞는 언어를 선택하는 것이 정확도에 유리합니다.
  • 결과는 검토가 필수: OCR은 비슷한 글자(0/O, 1/l, 받침 등)를 헷갈릴 수 있으니, 숫자·고유명사는 원본과 한 번 대조하세요.
자주 묻는 질문
Q. 어떤 글자를 잘 인식하나요?

한국어와 영어로 인쇄된 글자를 지원합니다. 스캔 문서, 캡처 화면, 또렷하게 찍은 간판·표지판처럼 글자가 선명하고 수평인 이미지에서 정확도가 높습니다. 손글씨, 흘림체, 심하게 기울었거나 흐릿한 사진, 복잡한 배경 위의 글자는 인식률이 떨어질 수 있습니다.

Q. 처음 실행할 때 왜 시간이 걸리나요?

글자 인식 엔진과 선택한 언어의 학습 데이터(수 MB)를 최초 한 번 내려받기 때문입니다. 진행률이 표시되며, 한 번 받은 데이터는 브라우저에 캐시되어 다음부터는 더 빠르게 시작됩니다. 한국어는 영어보다 데이터가 커서 첫 인식이 조금 더 오래 걸립니다.

Q. 올린 이미지가 서버로 전송되나요?

아니요. 글자 인식은 모두 사용자의 브라우저 안에서 이뤄지며 이미지는 서버로 전송되거나 저장되지 않습니다. 다만 인식 엔진과 언어 데이터 파일은 최초 1회 공개 CDN에서 내려받습니다. 이미지 자체가 외부로 나가지는 않습니다.

Q. 표나 여러 칸으로 나뉜 글자도 인식되나요?

글자 자체는 인식되지만 표의 칸 구조나 정렬은 그대로 복원되지 않습니다. OCR은 글자를 위에서 아래로, 왼쪽에서 오른쪽으로 읽어 한 덩어리의 텍스트로 내보내므로, 표는 셀 경계가 사라지고 줄바꿈만 남는 경우가 많습니다. 추출 후 직접 칸을 맞춰 정리해야 합니다.

Q. 줄바꿈이나 띄어쓰기가 이상하게 나옵니다.

OCR은 이미지의 줄 위치를 기준으로 줄바꿈을 넣기 때문에, 원문이 두 칼럼이거나 글자 간격이 넓으면 의도와 다르게 끊길 수 있습니다. 결과 텍스트를 복사한 뒤 공백·줄바꿈 정리 도구로 불필요한 줄바꿈과 중복 공백을 한 번에 다듬으면 깔끔해집니다.

함께 보면 좋은 도구