PDF OCR
이 OCR 세션을 더 이상 사용할 수 없습니다
스캔한 PDF 선택
PDF만 · 20 MB · 40 페이지
또는 PDF 하나를 여기에 놓으세요
PDF에 선택 가능한 글자가 아니라 스캔한 페이지 이미지가 들어 있을 때 사용하는 도구입니다. 브라우저에서 페이지를 렌더링하고 광학 문자 인식(OCR)을 실행한 뒤, 인식된 일반 텍스트를 검토하거나 복사하거나 .txt 파일로 저장할 수 있습니다. 원본 PDF는 기기에 그대로 남습니다. 검색 가능한 PDF를 만들거나 페이지 레이아웃을 보존하지 않으며, OCR 결과에는 오류가 있을 수 있습니다.
스캔 PDF에서 텍스트를 추출하는 방법
-
1
문서 언어 선택
인쇄된 본문의 주 언어를 선택하세요. 이 선택에 따라 브라우저에서 사용할 OCR 모델이 정해집니다.
-
2
PDF 열기
최대 20 MB, 40페이지인 PDF를 선택하세요. 원본 파일은 브라우저에 남으며 서버로 전송되지 않습니다.
-
3
인식 완료 기다리기
브라우저가 각 페이지를 렌더링하고 선택한 OCR 모델로 읽습니다. 인식을 시작하기 전에 모델 파일을 다운로드해야 할 수 있습니다.
-
4
결과 확인
이름, 숫자, 중요한 내용을 원본 페이지와 대조하세요. OCR 출력은 초안으로 보고 원본과 비교해 확인해야 합니다.
-
5
텍스트 복사 또는 다운로드
복사하면 결과가 브라우저에 남습니다. TXT 로컬 다운로드는 업로드 없이 일반 텍스트 파일을 저장합니다. 보호된 다운로드 페이지 만들기는 별도의 선택 기능입니다.
이 도구가 만드는 결과
출력은 일반 텍스트이며, 각 페이지에서 인식된 텍스트 앞에 페이지 표시가 붙습니다. 다음 작업은 하지 않습니다.
- PDF에 숨겨진 텍스트 레이어 추가
- 단, 표, 양식 또는 원래 글꼴 재현
- 시각적인 페이지 배치 보존
- 문서 번역
- 인식된 텍스트의 정확성 검증
스캔한 페이지를 유지하면서 검색할 수 있는 PDF가 필요하다면 검색 가능한 PDF를 지원하는 전용 프로그램이나 데스크톱 OCR 앱을 사용하세요.
인식하기 좋은 문서
OCR은 인쇄된 텍스트를 대상으로 합니다. 똑바르고 선명하며 대비가 충분한 스캔은 흐린 사진, 빛바랜 팩스, 손상된 페이지보다 인식하기 쉽습니다. 장식 글꼴, 손글씨, 수식, 빽빽한 다단 구성, 복잡한 표에서는 글자가 틀리거나 순서가 뒤섞일 수 있습니다.
최대 20 MB, 40페이지인 PDF를 처리할 수 있습니다. 인식은 한 페이지씩 진행되며, 크거나 해상도가 높은 페이지에서는 메모리를 많이 사용할 수 있습니다. 브라우저 메모리가 부족하면 PDF를 더 작은 파일로 나누어 각각 처리하세요.
지원하는 OCR 언어
영어, 스페인어, 프랑스어, 독일어, 이탈리아어, 포르투갈어, 네덜란드어, 러시아어, 일본어, 중국어 간체, 한국어, 아랍어를 선택할 수 있습니다.
파일을 열기 전에 문서의 주 언어를 선택하세요. 여러 언어나 문자 체계가 섞인 페이지는 언어별로 따로 처리해야 할 수 있으며, 그래도 모양이 비슷한 글자를 혼동할 수 있습니다.
인식된 텍스트 검토
결과를 사용하기 전에 항상 원본 PDF와 대조하세요. 특히 다음 내용을 주의해서 확인해야 합니다.
- 이름, 주소, 식별 번호
- 날짜, 금액, 소수점, 빼기 기호
- 법률, 의료, 금융 또는 안전 지침
- 다단 문서의 페이지 구분과 읽는 순서
중요한 문서의 공식 사본으로 OCR 출력을 사용하지 마세요.
파일 처리 및 다운로드
원본 PDF는 브라우저에서 로컬로 읽습니다. 작업 URL에 포함되거나 서버로 전송되지 않습니다. 브라우저는 PDF 렌더링 및 OCR 라이브러리와 선택한 언어 모델을 네트워크로 다운로드할 수 있습니다.
복사는 인식된 텍스트를 브라우저에 유지하면서 클립보드에 씁니다. TXT 로컬 다운로드는 파생된 .txt 파일을 업로드하지 않고 저장합니다. 다운로드 페이지 만들기를 선택한 경우에만 해당 텍스트 파일을 업로드하여 보호된 결과 링크를 만들며, 파일은 최대 7일 동안 보관될 수 있습니다. 이 선택적 업로드가 실패해도 로컬 다운로드는 계속 사용할 수 있습니다.
자주 묻는 질문
아니요. 페이지를 렌더링하고 인식하는 동안 원본 PDF는 브라우저에 남습니다. 브라우저는 필요한 PDF 렌더링 및 OCR 라이브러리와 선택한 언어 모델을 다운로드할 수 있습니다. 복사와 TXT 로컬 다운로드는 인식된 텍스트도 업로드하지 않습니다. 별도의 다운로드 페이지 만들기를 선택할 때만 파생된 일반 텍스트 파일이 업로드됩니다.
아니요. 결과는 페이지별로 구분된 일반 텍스트입니다. 원본 PDF를 수정하거나 숨겨진 텍스트 레이어를 추가하거나 레이아웃을 보존하지 않습니다.
원본 페이지와 대조해야 합니다. OCR은 글자를 혼동하거나 텍스트를 누락하거나 읽는 순서를 바꿀 수 있습니다. 법률, 의료, 금융, 안전 등 중요한 업무에 사용하기 전에 모든 세부 정보를 확인하세요.
인쇄된 텍스트용으로 설계되었습니다. 손글씨, 수식, 장식 글꼴은 제대로 인식되지 않을 수 있습니다. 표 안의 글자는 인식할 수 있어도 행과 열 구조는 일반 텍스트 결과에 보존되지 않습니다.
영어, 스페인어, 프랑스어, 독일어, 이탈리아어, 포르투갈어, 네덜란드어, 러시아어, 일본어, 중국어 간체, 한국어, 아랍어입니다. PDF를 열기 전에 주 언어를 선택하세요.
PDF는 최대 20 MB, 40페이지까지 가능합니다. 크거나 세부 정보가 많은 페이지는 브라우저에서 사용할 수 있는 메모리를 초과할 수 있으므로, 처리하기 어려운 문서는 더 작은 파일로 나누면 도움이 됩니다.
TXT 로컬 다운로드는 인식된 텍스트로 .txt 파일을 만들고 업로드 없이 저장합니다. 다운로드 페이지 만들기를 선택하면 파생 파일이 보호된 결과 링크로 업로드되어 최대 7일 동안 보관될 수 있습니다. 이 선택적 업로드가 실패해도 로컬 다운로드는 계속 사용할 수 있습니다.
관련 도구
PDF에서 페이지 삭제
PDF에서 선택한 페이지나 페이지 범위를 삭제하세요. 2, 5-7처럼 번호를 입력하고, 최소 1페이지를 남긴 뒤 줄어든 PDF를 다운로드할 수 있습니다.
PDF JPG 변환기
PDF 페이지를 원하는 해상도와 품질의 JPG 이미지로 변환합니다. 한 페이지만 받거나 전체 페이지를 ZIP 파일로 다운로드할 수 있습니다.
Excel-PDF 변환기
XLSX, XLS, CSV 파일을 브라우저에서 가로 A4 PDF로 변환합니다. 각 워크시트가 깔끔한 표 페이지로 만들어져 다운로드됩니다.
PDF 편집
브라우저에서 PDF에 텍스트, 강조 표시, 직사각형, 흰색 상자를 추가하세요. 소프트웨어 설치 없이 새 PDF로 내보낼 수 있습니다.
PDF 압축
브라우저에서 PDF 페이지를 JPEG 기반의 더 작은 PDF로 다시 렌더링해 공유와 업로드가 쉬운 크기로 압축합니다.
PNG PDF 변환기
PNG 스크린샷, 스캔본, 디자인 내보내기 파일을 하나의 PDF로 합칩니다. 다운로드 전에 A4 또는 Letter, 방향, 여백을 선택하세요.