검색 가능한 PDF 만들기
스캔한 PDF는 사실 PDF 컨테이너에 담긴 이미지 더미일 뿐이라, 글자를 강조하거나 복사하거나 검색할 수 없습니다. 이 도구는 각 페이지에 대해 브라우저 안에서 광학 문자 인식(OCR)을 수행하고, 결과를 원본 페이지에 맞춘 보이지 않는 텍스트 레이어로 추가합니다. 원본 페이지의 시각적 내용은 유지되며 Ctrl+F와 텍스트 선택으로 인식된 단어를 사용할 수 있습니다. 인식에는 오류가 있을 수 있고 이 결과물은 태그된 접근성 PDF가 아니므로, 중요한 텍스트는 스캔본과 대조하세요.
스캔한 PDF에 OCR 하는 방법
-
1
스캔 업로드하기
스캔한 PDF(계약서, 청구서, 보관된 보고서)를 끌어다 놓습니다. 인쇄된 글자가 가장 잘 되고, 손글씨는 되지 않습니다.
-
2
언어 선택하기
문서 언어(영어, 스페인어, 프랑스어, 독일어, 이탈리아어, 포르투갈어 또는 네덜란드어)를 선택하면 OCR 엔진이 알맞은 문자 모델을 불러옵니다.
-
3
인식 실행하기
각 페이지는 브라우저에서 고해상도로 렌더링되어 OCR 엔진으로 전달됩니다. 긴 문서는 몇 분이 걸릴 수 있습니다.
-
4
텍스트 레이어 삽입
인식된 단어를 원본 페이지에 맞춘 보이지 않는 레이어로 배치하므로 각 페이지의 겉모습은 그대로입니다.
-
5
새 PDF 내려받기
원본 스캔을 그대로 유지하면서 최신 뷰어에서 검색할 수 있게 된 PDF를 받습니다.
OCR이 잘될 때(그리고 안 될 때)
OCR 품질은 스캔 상태에 따라 달라집니다. 중요한 이름, 숫자, 법률 문구는 항상 원본 페이지와 대조하세요.
| 입력 | 예상할 수 있는 결과 |
|---|---|
| 깨끗한 인쇄 스캔 | 좋은 결과가 흔하지만, 중요한 텍스트는 교정하세요. |
| 인쇄 페이지 사진 | 초점, 조명, 페이지 각도에 따라 결과가 달라집니다. |
| 오래된 책이나 바랜 타자기 인쇄 | 인식된 텍스트를 주의 깊게 검토하세요. |
| 손글씨나 필기체 | 안정적으로 지원하지 않습니다. |
| 영수증이나 감열 프린터 출력 | 숫자와 희미한 문자를 주의 깊게 확인하세요. |
| 뒷면 비침이 심한 글자 | 결과가 불완전하거나 부정확할 수 있습니다. |
검색 가능한 PDF와 이미지 전용 PDF
- 이미지 전용 PDF: 순수 비트맵으로 글자가 없습니다. 스캐너가 기본으로 만드는 형식입니다.
- 검색 가능한 PDF: 비트맵에 보이지 않는 텍스트 레이어를 더한 것(이 도구의 출력)입니다. 겉모습은 똑같고 Ctrl+F가 작동합니다.
- PDF/A: 글꼴을 내장하고 외부 자원을 금지하는 PDF의 보관용 하위 규격으로, 법원과 기록관에서 자주 요구합니다. 이 도구는 일반 검색 가능한 PDF를 만들 뿐, 인증된 PDF/A가 아닙니다. 업무에 PDF/A가 필요하면 전용 PDF/A 도구로 변환하고 검증하세요.
최상의 결과를 위한 팁
- 약 300 DPI부터 시작하세요. 읽을 수 있는 세부 정보와 처리 시간 사이에서 유용한 균형이 되는 경우가 많습니다. 해상도가 높을수록 시간과 메모리를 더 사용합니다.
- OCR 전에 기울기를 바로잡으세요. 대부분의 스캐너는 자동 회전을 제공합니다. 약간의 기울기도 인식 품질을 낮출 수 있습니다.
- 한 번에 한 언어. 엔진은 한 번에 한 언어만 인식하므로 주된 언어를 고르세요. 두 언어가 섞인 문서는 언어별로 한 번씩 돌리고 더 나은 결과를 남기세요.
- 원본은 항상 보관하세요. OCR은 작은 오류를 냅니다. 보이지 않는 레이어는 편의를 위한 것이지 증거가 아닙니다.
자주 묻는 질문
원본 페이지 내용은 보존됩니다. 인식된 텍스트는 그에 맞춘 보이지 않는 레이어로 추가되므로 페이지의 겉모습은 달라지지 않아야 합니다. 정확한 시각적 충실도가 중요하다면 결과를 확인하세요.
라틴 문자 7개 언어입니다: 영어, 스페인어, 프랑스어, 독일어, 이탈리아어, 포르투갈어, 네덜란드어. 문서에 맞는 언어를 고르세요. 키릴 문자, 아랍 문자, CJK(중국어·일본어·한국어) 같은 문자는 이 도구에서 사용할 수 없습니다.
안정적으로 읽을 수 없습니다. 이 도구는 인쇄된 텍스트용입니다. 손글씨 인식은 다른 기술이므로, 손글씨 자료는 별도로 검토하거나 옮겨 적으세요.
아니요. 결과물은 일반 검색 가능한 PDF입니다: 원본 페이지 이미지에 보이지 않는 OCR 텍스트 레이어를 더한 것입니다. 인증된 보관용 PDF/A 파일이 아닙니다. 업무에 PDF/A가 필요하면 전용 PDF/A 도구로 결과를 변환하고 검증하세요.
OCR은 전적으로 브라우저에서 실행되므로 원본 PDF는 인식을 위해 서버로 전송되지 않습니다. 일반 로컬 다운로드도 기기에 남습니다. 다운로드 페이지 만들기를 선택한 경우에만 완성된 검색 가능한 PDF가 당사 서버에 업로드됩니다. 원본 PDF는 로컬에 남으며 업로드된 결과는 최대 7일간 보관됩니다.
관련 도구
PDF OCR
브라우저 OCR로 PDF의 인쇄된 스캔 이미지에서 일반 텍스트를 추출하세요. 12개 언어와 최대 20 MB, 40페이지 파일을 지원합니다.
HTML을 PDF로 변환
기본 HTML과 인라인 CSS를 브라우저에서 A4, Letter 또는 Legal 크기의 래스터 PDF로 변환합니다. 소스와 결과 파일은 업로드하지 않습니다.
MD에서 PDF로 변환하기
마크다운 문서를 코드 강조, 표, 이미지 및 사용자 정의 페이지 여백을 포함한 스타일화된 PDF로 변환합니다. 기본적으로는 GitHub 스타일 테마가 적용됩니다.
PDF에서 이미지 추출
PDF 파일에 포함된 모든 이미지를 추출하여 원본 해상도를 그대로 유지한 상태로 개별적으로 또는 단일 ZIP 파일 형태로 다운로드할 수 있습니다.
로컬 PDF 가림 처리
민감한 영역을 직접 가리고 기기에서 페이지 JPEG 이미지로 새 PDF를 만드세요. 파일은 업로드되지 않습니다. 결과의 모든 페이지는 검색하거나 선택할 수 없는 이미지가 됩니다.
PDF 양식
기존 AcroForm 필드를 로컬에서 작성하고, 미리 입력된 값을 보존하며, 대화형 사본이나 명시적으로 평면화한 사본을 다운로드하세요.
이 도구는 다른 언어로도 제공됩니다
- 検索可能なPDF作成 [JA]
- Skapa sökbar PDF [SV]
- Doorzoekbare PDF maken [NL]
- Pembuat PDF Bisa Dicari [ID]
- Durchsuchbares PDF erstellen [DE]
- أداة إنشاء PDF قابل للبحث [AR]
- Criador de PDF pesquisável [PT]
- Creador de PDF con búsqueda [ES]
- Kreator przeszukiwalnego PDF [PL]
- ตัวสร้าง PDF ที่ค้นหาได้ [TH]
- Trình tạo PDF tìm kiếm được [VI]
- Créateur de PDF interrogeable [FR]
- Searchable PDF Maker [EN]
- Creatore di PDF ricercabili [IT]
- Создание PDF с поиском [RU]
- Aranabilir PDF Oluşturucu [TR]
- 可搜索 PDF 制作工具 [ZH]