PDF 텍스트 추출
PDF에서 글을 드래그해 복사하면 줄이 엉망이 되거나 한 쪽씩밖에 안 되죠. 파일을 넣으면 모든 쪽의 글을 한 번에 꺼내 드려요.
이 도구는 브라우저 안에서만 작동해요. 넣은 파일과 글은 어떤 서버에도 올라가지 않아요.
마지막 점검: · 만든 곳 손끝공방
이렇게 쓰세요
- 1
글을 꺼낼 PDF를 상자에 놓으세요.
- 2
쪽마다 구분선을 넣을지, 문장 중간에 끊긴 줄을 이을지 고르세요.
- 3
전체 복사하거나 TXT 파일로 받기를 누르세요.
글자가 안 나온다면 — 스캔 PDF예요
PDF에는 두 종류가 있어요. 한글·워드에서 저장한 PDF는 글자 정보가 들어 있어서 바로 꺼낼 수 있지만, 스캐너나 휴대폰으로 찍은 PDF는 글자 모양의 사진일 뿐이에요. 이 경우 결과가 거의 비어 나오고, 화면에 안내가 뜨면 이미지 글자 추출(OCR)에 같은 PDF를 넣으세요. 그림 속 글자를 읽어 드려요.
줄이 이상하게 끊긴다면
PDF는 글을 '줄' 단위로 저장해서, 꺼내면 문장 중간에 줄바꿈이 들어가요. 문장 중간 줄바꿈 이어붙이기를 켜면 마침표로 끝나지 않는 줄을 다음 줄과 이어 줘요. 더 꼼꼼히 다듬으려면 텍스트 정리를 함께 쓰세요.
표나 2단 편집은요?
표는 칸 순서대로, 2단 편집은 PDF를 만든 프로그램이 저장한 순서대로 나와요. 순서가 섞이면 필요한 부분만 골라 복사하는 게 빨라요.
자주 묻는 질문
파일이 서버로 올라가나요?
아니요. PDF.js로 브라우저 안에서 읽어요.
복사 방지된 PDF도 되나요?
열기 암호가 없는 PDF라면 대부분 글자를 꺼낼 수 있어요. 다만 저작권이 있는 자료는 개인 학습 등 허용된 범위에서만 쓰세요.
한글이 깨져서 나와요.
글꼴 정보를 엉터리로 저장한 PDF는 글자가 깨져 나올 수 있어요. 이럴 땐 OCR로 읽는 게 더 정확해요.