검색 가능한 PDF 만들기
이 OCR 세션을 더 이상 사용할 수 없습니다
스캔한 PDF 선택
PDF만 · 10 MB
PDF만 가능, 최대 10 MB 및 10페이지
스캔한 PDF는 사실 PDF 컨테이너에 담긴 이미지 더미일 뿐이라, 글자를 강조하거나 복사하거나 검색할 수 없습니다. 이 도구는 각 페이지에 대해 브라우저 안에서 광학 문자 인식(OCR)을 수행하고, 결과를 원본 페이지에 맞춘 보이지 않는 텍스트 레이어로 추가합니다. 원본 페이지의 시각적 내용은 유지되며 Ctrl+F와 텍스트 선택으로 인식된 단어를 사용할 수 있습니다. 인식에는 오류가 있을 수 있고 이 결과물은 태그된 접근성 PDF가 아니므로, 중요한 텍스트는 스캔본과 대조하세요.
스캔한 PDF에 OCR 하는 방법
-
1
스캔 업로드하기
스캔한 PDF(계약서, 청구서, 보관된 보고서)를 끌어다 놓습니다. 인쇄된 글자가 가장 잘 되고, 손글씨는 되지 않습니다.
-
2
언어 선택하기
문서 언어(영어, 스페인어, 프랑스어, 독일어, 이탈리아어, 포르투갈어 또는 네덜란드어)를 선택하면 OCR 엔진이 알맞은 문자 모델을 불러옵니다.
-
3
인식 실행하기
각 페이지는 브라우저에서 고해상도로 렌더링되어 OCR 엔진으로 전달됩니다. 긴 문서는 몇 분이 걸릴 수 있습니다.
-
4
텍스트 레이어 삽입
인식된 단어를 원본 페이지에 맞춘 보이지 않는 레이어로 배치하므로 각 페이지의 겉모습은 그대로입니다.
-
5
새 PDF 내려받기
원본 스캔을 그대로 유지하면서 최신 뷰어에서 검색할 수 있게 된 PDF를 받습니다.
OCR이 잘될 때(그리고 안 될 때)
OCR 품질은 스캔 상태에 따라 달라집니다. 중요한 이름, 숫자, 법률 문구는 항상 원본 페이지와 대조하세요.
| 입력 | 예상할 수 있는 결과 |
|---|---|
| 깨끗한 인쇄 스캔 | 좋은 결과가 흔하지만, 중요한 텍스트는 교정하세요. |
| 인쇄 페이지 사진 | 초점, 조명, 페이지 각도에 따라 결과가 달라집니다. |
| 오래된 책이나 바랜 타자기 인쇄 | 인식된 텍스트를 주의 깊게 검토하세요. |
| 손글씨나 필기체 | 안정적으로 지원하지 않습니다. |
| 영수증이나 감열 프린터 출력 | 숫자와 희미한 문자를 주의 깊게 확인하세요. |
| 뒷면 비침이 심한 글자 | 결과가 불완전하거나 부정확할 수 있습니다. |
검색 가능한 PDF와 이미지 전용 PDF
- 이미지 전용 PDF: 순수 비트맵으로 글자가 없습니다. 스캐너가 기본으로 만드는 형식입니다.
- 검색 가능한 PDF: 비트맵에 보이지 않는 텍스트 레이어를 더한 것(이 도구의 출력)입니다. 겉모습은 똑같고 Ctrl+F가 작동합니다.
- PDF/A: 글꼴을 내장하고 외부 자원을 금지하는 PDF의 보관용 하위 규격으로, 법원과 기록관에서 자주 요구합니다. 이 도구는 일반 검색 가능한 PDF를 만들 뿐, 인증된 PDF/A가 아닙니다. 업무에 PDF/A가 필요하면 전용 PDF/A 도구로 변환하고 검증하세요.
최상의 결과를 위한 팁
- 약 300 DPI부터 시작하세요. 읽을 수 있는 세부 정보와 처리 시간 사이에서 유용한 균형이 되는 경우가 많습니다. 해상도가 높을수록 시간과 메모리를 더 사용합니다.
- OCR 전에 기울기를 바로잡으세요. 대부분의 스캐너는 자동 회전을 제공합니다. 약간의 기울기도 인식 품질을 낮출 수 있습니다.
- 한 번에 한 언어. 엔진은 한 번에 한 언어만 인식하므로 주된 언어를 고르세요. 두 언어가 섞인 문서는 언어별로 한 번씩 돌리고 더 나은 결과를 남기세요.
- 원본은 항상 보관하세요. OCR은 작은 오류를 냅니다. 보이지 않는 레이어는 편의를 위한 것이지 증거가 아닙니다.
자주 묻는 질문
원본 페이지 내용은 보존됩니다. 인식된 텍스트는 그에 맞춘 보이지 않는 레이어로 추가되므로 페이지의 겉모습은 달라지지 않아야 합니다. 정확한 시각적 충실도가 중요하다면 결과를 확인하세요.
라틴 문자 7개 언어입니다: 영어, 스페인어, 프랑스어, 독일어, 이탈리아어, 포르투갈어, 네덜란드어. 문서에 맞는 언어를 고르세요. 키릴 문자, 아랍 문자, CJK(중국어·일본어·한국어) 같은 문자는 이 도구에서 사용할 수 없습니다.
안정적으로 읽을 수 없습니다. 이 도구는 인쇄된 텍스트용입니다. 손글씨 인식은 다른 기술이므로, 손글씨 자료는 별도로 검토하거나 옮겨 적으세요.
아니요. 결과물은 일반 검색 가능한 PDF입니다: 원본 페이지 이미지에 보이지 않는 OCR 텍스트 레이어를 더한 것입니다. 인증된 보관용 PDF/A 파일이 아닙니다. 업무에 PDF/A가 필요하면 전용 PDF/A 도구로 결과를 변환하고 검증하세요.
OCR은 전적으로 브라우저에서 실행되므로 원본 PDF는 인식을 위해 서버로 전송되지 않습니다. 일반 로컬 다운로드도 기기에 남습니다. 다운로드 페이지 만들기를 선택한 경우에만 완성된 검색 가능한 PDF가 당사 서버에 업로드됩니다. 원본 PDF는 로컬에 남으며 업로드된 결과는 최대 7일간 보관됩니다.
관련 도구
PDF에서 페이지 삭제
PDF에서 선택한 페이지나 페이지 범위를 삭제하세요. 2, 5-7처럼 번호를 입력하고, 최소 1페이지를 남긴 뒤 줄어든 PDF를 다운로드할 수 있습니다.
PDF JPG 변환기
PDF 페이지를 원하는 해상도와 품질의 JPG 이미지로 변환합니다. 한 페이지만 받거나 전체 페이지를 ZIP 파일로 다운로드할 수 있습니다.
Excel-PDF 변환기
XLSX, XLS, CSV 파일을 브라우저에서 가로 A4 PDF로 변환합니다. 각 워크시트가 깔끔한 표 페이지로 만들어져 다운로드됩니다.
PDF 편집
브라우저에서 PDF에 텍스트, 강조 표시, 직사각형, 흰색 상자를 추가하세요. 소프트웨어 설치 없이 새 PDF로 내보낼 수 있습니다.
PDF 압축
브라우저에서 PDF 페이지를 JPEG 기반의 더 작은 PDF로 다시 렌더링해 공유와 업로드가 쉬운 크기로 압축합니다.
PNG PDF 변환기
PNG 스크린샷, 스캔본, 디자인 내보내기 파일을 하나의 PDF로 합칩니다. 다운로드 전에 A4 또는 Letter, 방향, 여백을 선택하세요.