문서 도구
OCR은 어떻게 사진 속 글자를 인식할까
OCR(Optical Character Recognition, 광학 문자 인식)은 이미지 속에 있는 글자를 컴퓨터가 읽을 수 있는 텍스트로 변환하는 기술입니다. 스캔한 문서나 사진 속 간판, 영수증의 글자를 복사하거나 편집 가능한 형태로 바꿔주는 것이 대표적인 활용 사례입니다.
전통적인 OCR은 이미지에서 글자 영역을 찾아낸 뒤, 각 글자의 모양(외곽선, 곡선, 획의 방향 등)을 미리 학습된 글자 패턴과 비교해 가장 유사한 문자를 찾는 방식으로 동작했습니다. 최근에는 딥러닝 기반 AI 모델이 이 역할을 대체하면서 인식률이 크게 향상되었습니다. AI 모델은 개별 글자뿐 아니라 문맥까지 함께 고려하기 때문에, 흐릿하거나 일부가 가려진 글자도 앞뒤 단어를 참고해 더 정확하게 추측할 수 있습니다.
다만 OCR의 인식률은 원본 이미지의 품질에 크게 좌우됩니다. 인식률을 높이고 싶다면 다음 몇 가지를 신경 쓰는 것이 좋습니다. 첫째, 조명이 고르게 비치도록 촬영해 그림자나 반사광을 피합니다. 둘째, 문서를 최대한 평평하게 펴고 카메라를 문서와 수직으로 맞춰 촬영합니다. 셋째, 손글씨보다는 인쇄체가 인식률이 훨씬 높으므로, 손글씨 문서는 결과를 반드시 검토하는 것이 좋습니다. 넷째, 해상도가 너무 낮은 이미지는 글자 획이 뭉개져 인식이 어려우므로 가능한 선명한 이미지를 사용합니다.
OCR로 인식한 텍스트를 문서로 변환할 때는 원본의 구조(제목, 표, 목록 등)를 얼마나 잘 살리느냐도 중요합니다. 이 사이트의 이미지 OCR 문서 변환 도구는 '#'으로 시작하는 줄을 제목으로, '|'로 구분된 줄을 표로 자동 인식해 Word, Excel, PowerPoint, PDF 등 원하는 형식으로 바로 내보낼 수 있도록 지원합니다.
OCR은 완벽하지 않은 기술이지만, 문서를 다시 타이핑하는 수고를 크게 줄여주는 유용한 도구입니다. 인식 결과를 그대로 신뢰하기보다는, 중요한 문서일수록 한 번 더 검토하는 습관을 들이는 것을 권장합니다.