이미지 글자 추출 (OCR)
캡처한 공지문, 사진으로 찍은 서류, 스캔한 PDF. 글자를 다시 타이핑하지 마세요. 넣기만 하면 글자를 읽어 복사할 수 있게 만들어 드려요.
처음 한 번은 글자 인식 엔진(약 6MB)을 내려받느라 시간이 걸려요. 결과는 고칠 수 있으니 틀린 글자는 바로 수정하세요.
이 도구는 브라우저 안에서만 작동해요. 넣은 파일과 글은 어떤 서버에도 올라가지 않아요.
마지막 점검: · 만든 곳 손끝공방
이렇게 쓰세요
- 1
읽을 언어(한국어+영어 / 영어만)를 고르세요.
- 2
사진·캡처·스캔 PDF를 상자에 놓거나, 캡처 화면을 Ctrl+V로 붙여넣으세요.
- 3
처음 한 번은 인식 엔진을 내려받느라 10~30초쯤 걸려요. 진행 막대를 확인하세요.
- 4
오른쪽 칸에서 틀린 글자를 고친 뒤 전체 복사나 TXT로 받기를 누르세요.
인식이 잘 되는 사진, 안 되는 사진
| 잘 돼요 | 잘 안 돼요 |
|---|---|
| 화면 캡처, 스캔한 인쇄물 | 손글씨, 흘림체·장식 글꼴 |
| 밝고 반듯하게 찍은 문서 | 비스듬하거나 그림자 진 사진 |
| 또렷한 검은 글자 + 흰 바탕 | 사진 위에 얹힌 글자, 아주 작은 글씨 |
정확도를 높이려면 필요한 부분만 이미지 자르기로 잘라서 넣으세요. 글자 영역만 있으면 엔진이 덜 헷갈려요.
파일을 올리지 않는 OCR
대부분의 무료 OCR 사이트는 사진을 서버로 보내 처리해요. 이 도구는 공개 OCR 엔진인 Tesseract를 브라우저 안에서 직접 돌려요. 처음 쓸 때 엔진과 한글 데이터(약 6MB)를 한 번 내려받고, 그다음부터는 브라우저에 저장된 걸 다시 써서 빨라요. 계약서, 진료비 영수증처럼 남에게 보이기 싫은 문서도 안심하고 넣으세요.
결과는 꼭 한 번 확인하세요
OCR은 '0'과 'O', '1'과 'l'처럼 비슷한 글자를 헷갈릴 수 있어요. 금액, 계좌번호, 전화번호처럼 틀리면 안 되는 숫자는 원본과 꼭 비교하세요.
자주 묻는 질문
사진이 서버로 올라가나요?
아니요. 글자 인식까지 모두 내 컴퓨터의 브라우저 안에서 이루어져요.
한글 띄어쓰기가 이상해요.
글자 사이 간격이 넓은 글꼴은 띄어쓰기가 더 들어갈 수 있어요. 결과 칸에서 바로 고치거나, 필요하면 텍스트 정리로 공백을 정리하세요.
스캔 PDF는 몇 쪽까지 되나요?
한 번에 앞의 30쪽까지 읽어요. 더 길면 PDF 나누기로 나눠서 넣으세요. 쪽마다 수 초씩 걸려요.
휴대폰에서도 되나요?
돼요. 다만 휴대폰은 컴퓨터보다 인식 속도가 느릴 수 있어요.