PDF 텍스트 변환기
PDF에서 글자를 꺼내는 가장 빠른 방법입니다. 이 도구는 PDF에 이미 저장된 텍스트 레이어를 페이지 단위로 읽어, 복사하거나 .txt 파일로 저장할 수 있는 일반 텍스트를 돌려줍니다. 모든 처리가 브라우저 안에서 이루어지므로 문서가 업로드되는 일은 없습니다. 미리 알아둘 점이 하나 있습니다. 이 도구는 파일 안에 이미 있는 글자를 읽기 때문에, 스캔하거나 촬영한 문서(텍스트 레이어가 없는 이미지)는 빈 결과로 나옵니다. 그런 경우에는 대신 OCR 도구를 사용하세요.
PDF에서 텍스트를 추출하는 방법
-
1
PDF 업로드
끌어다 놓거나 클릭해서 선택하세요. 파일은 기기에 남으며 서버로 전송되지 않습니다.
-
2
텍스트 추출
도구가 각 페이지의 텍스트 레이어를 읽어 이어 붙이고, 페이지마다 앞에 표시를 넣습니다.
-
3
결과 확인
추출된 텍스트가 상자에 페이지 순서대로 표시되어 바로 확인할 수 있습니다.
-
4
복사 또는 다운로드
클립보드에 복사하거나 .txt 파일로 저장해 다른 곳에서 다시 사용하세요.
이 도구가 읽을 수 있는 것과 읽을 수 없는 것
| PDF 종류 | 결과 |
|---|---|
| Word, Google Docs, 브라우저, 디자인 도구에서 내보낸 것 | 전체 텍스트를 깔끔하고 빠짐없이 추출 |
| 제대로 된 텍스트 레이어가 있는 디지털 PDF | 페이지 단위로 텍스트 추출 |
| PDF로 저장한 스캔본이나 사진(이미지만) | 비었거나 거의 비어 있음: 읽을 텍스트가 없음 |
| 비밀번호로 보호된 PDF | 먼저 잠금을 풀기 전까지 읽을 수 없음 |
여기에는 OCR이 없습니다: 스캔본에는 알맞은 도구를
이 추출기는 OCR(광학 문자 인식)을 실행하지 않습니다. PDF 안에 이미 있는 글자를 복사할 뿐, 픽셀을 읽지는 않습니다. 파일이 스캔본이라 아무것도 나오지 않으면, 먼저 OCR 도구에 통과시키세요. 이미지를 진짜 텍스트 레이어로 바꿔 주며, 그다음에 추출할 수 있습니다.
텍스트가 배치되는 방식
각 페이지는 --- Page N --- 표시로 구분되어, 한 페이지가 끝나고 다음이 시작되는 지점을 볼 수 있습니다. 텍스트는 PDF에 저장된 순서대로 가져옵니다. 대부분의 문서는 자연스럽게 읽히지만, 흔치 않은 다단 레이아웃의 일부는 단이 뒤섞일 수 있습니다. 도구가 읽기 경로를 추측하지 않고 PDF에 저장된 순서를 따르기 때문입니다.
자주 쓰는 용도
- AI 모델에 입력하기. 언어 모델은 PDF가 아니라 일반 텍스트를 받습니다. 먼저 추출해 두면 처리가 더 빠르고 예측 가능해집니다.
- 인용과 검색. PDF 뷰어의 선택 기능과 씨름하지 않고 한 대목을 복사하세요.
- 콘텐츠 재사용. 다시 입력하지 않고 텍스트를 문서, 이메일, 메모로 옮기세요.
자주 묻는 질문
아니요. 이 도구는 내장된 텍스트 레이어를 읽는데, 스캔본은 텍스트 레이어가 없는 이미지일 뿐이라 빈 결과로 나옵니다. 스캔하거나 촬영한 문서에는 OCR 도구를 사용한 다음 텍스트를 추출하세요.
아니요. 추출은 전적으로 여러분의 브라우저, 여러분 자신의 기기에서 이루어집니다. PDF는 서버로 전송되지 않으며 아무것도 저장되지 않습니다.
일부 PDF, 특히 다단 레이아웃은 읽는 순서와 다른 순서로 텍스트를 저장합니다. 도구는 PDF에 저장된 순서를 따르므로 단이 뒤섞일 수 있습니다. 워드프로세서에서 내보낸 문서는 거의 항상 올바르게 나옵니다.
잠겨 있는 동안에는 안 됩니다. 먼저 PDF 잠금 해제 도구로 비밀번호를 제거한 다음 텍스트를 추출하세요.
관련 도구
PDF OCR
브라우저 OCR로 PDF의 인쇄된 스캔 이미지에서 일반 텍스트를 추출하세요. 12개 언어와 최대 20 MB, 40페이지 파일을 지원합니다.
PDF에서 이미지 추출
PDF 파일에 포함된 모든 이미지를 추출하여 원본 해상도를 그대로 유지한 상태로 개별적으로 또는 단일 ZIP 파일 형태로 다운로드할 수 있습니다.
로컬 PDF 가림 처리
민감한 영역을 직접 가리고 기기에서 페이지 JPEG 이미지로 새 PDF를 만드세요. 파일은 업로드되지 않습니다. 결과의 모든 페이지는 검색하거나 선택할 수 없는 이미지가 됩니다.
검색 가능한 PDF 만들기
보이지 않는 OCR 텍스트 레이어를 추가해 스캔한 PDF를 검색·선택 가능한 문서로 바꿉니다. 전적으로 브라우저에서 처리; 라틴 문자 7개 언어 지원.
PDF 양식
기존 AcroForm 필드를 로컬에서 작성하고, 미리 입력된 값을 보존하며, 대화형 사본이나 명시적으로 평면화한 사본을 다운로드하세요.
문서 사진을 PDF로 변환
JPEG, PNG, WebP 문서 사진을 브라우저에서 하나의 PDF로 만드세요. 세로 A4 또는 US Letter를 고르고 사진을 업로드하지 않은 채 다운로드할 수 있습니다.
이 도구는 다른 언어로도 제공됩니다
- Konverter PDF ke Teks [ID]
- Conversor de PDF para texto [PT]
- PDF-zu-Text-Konverter [DE]
- PDF テキスト変換ツール [JA]
- ตัวแปลง PDF เป็นข้อความ [TH]
- محوّل PDF إلى نص [AR]
- Konwerter PDF na tekst [PL]
- PDF till text-konverterare [SV]
- Công cụ chuyển PDF sang văn bản [VI]
- Conversor de PDF a texto [ES]
- Convertisseur PDF en texte [FR]
- PDF-naar-tekst-converter [NL]
- PDF to Text Converter [EN]
- Convertitore da PDF a testo [IT]
- Конвертер PDF в текст [RU]
- PDF'den Metne Dönüştürücü [TR]
- PDF 转文本转换器 [ZH]