PDF OCR 텍스트 추출
광학 문자 인식(OCR)으로 스캔한 PDF에서 텍스트를 추출합니다.
PDF 파일을 드래그하거나 클릭해서 선택하세요
PDF 파일을 지원합니다
사용 예시
스캔한 종이 문서에서 텍스트 꺼내기
스캐너나 사진으로 찍은 문서를 PDF로 만든 뒤, 그 안의 글자를 인식해서 복사·편집 가능한 텍스트로 바꿀 수 있습니다.
텍스트 레이어가 없는 PDF 읽어오기
pdf-to-text로는 추출되지 않는, 이미지로만 이루어진 PDF도 OCR로 내용을 꺼내올 수 있습니다.
여러 언어로 된 문서 인식하기
영어, 한국어, 일본어 등 원하는 언어를 선택해 해당 언어 문서의 인식 정확도를 높일 수 있습니다.
자주 묻는 질문
업로드한 PDF가 서버로 전송되나요?
아니요. PDF를 이미지로 변환하고 글자를 인식하는 모든 과정은 브라우저 안에서만 이루어지며, 업로드한 PDF나 그 내용은 서버로 전송되지 않습니다. 다만 선택한 언어의 인식 모델 파일은 최초 1회 공개 CDN에서 내려받습니다 — 이건 일반적인 프로그램 파일일 뿐, 여러분의 문서 내용과는 무관합니다.
이미 텍스트가 있는 일반 PDF에도 쓸 수 있나요?
쓸 수는 있지만, 이미 텍스트 레이어가 있는 PDF라면 더 빠르고 정확한 'PDF를 텍스트로' 도구를 사용하는 것을 추천합니다. OCR은 스캔본처럼 이미지로만 이루어진 PDF를 위한 기능입니다.
인식 정확도는 어느 정도인가요?
스캔 품질, 글꼴, 선명도에 따라 달라집니다. 해상도가 높고 또렷한 문서일수록 정확도가 높으며, 손글씨나 흐릿한 스캔본은 정확도가 떨어질 수 있습니다.
페이지가 많은 PDF는 얼마나 걸리나요?
페이지마다 순차적으로 인식하기 때문에 페이지 수에 비례해 시간이 걸립니다. 페이지가 많다면 처리 중 취소 버튼으로 언제든 중단할 수 있습니다.