PDF에서 이미지 추출
PDF 파일을 업로드하면 내장된 모든 이미지를 원래 해상도로 복원할 수 있습니다. 추출 도구는 PDF 객체 트리를 순회하여 /XObject /Image 항목을 찾아내고, 각 이미지를 PNG 형식으로 출력합니다. 스크린샷이 필요 없으며 전체 페이지를 라스터화하더라도 품질 손실이 발생하지 않습니다. 스캔 파일, 사진이 많은 보고서, 제품 카탈로그 및 브로셔 등 다양한 형태의 문서에서 사용 가능합니다.
PDF에서 이미지를 추출하는 방법
-
1
PDF를 업로드하세요
단일 파일만 업로드할 수 있습니다. 암호화된 PDF는 먼저 해독해야 합니다.
-
2
객체 트리를 스캔하세요
추출기는 모든 페이지에 존재하는 모든 이미지 XObject를 순차적으로 열거합니다.
-
3
결과를 미리 확인하세요
각 이미지는 페이지 번호와 크기가 포함된 썸네일로 표시됩니다.
-
4
개별적으로 또는 ZIP 형식으로 다운로드하세요
단일 자산을 가져오거나 모든 파일을 `image-p1-1.png`라는 이름의 아카이브 파일로 내보낼 수 있습니다.
PDF 내에서 이미지가 어떻게 구성되는가
PDF는 이미지를 페이지 내용에서 참조되는 별도의 리소스(/XObject 스트림)로 저장합니다. 추출기는 각 스트림을 원래 인코딩 방식으로 읽어 작가가 삽입한 파일을 재구성합니다.
확인할 형식들
| PDF 필터 | 받게 되는 형식 | 일반적인 소스 |
|---|---|---|
/DCTDecode |
PNG (JPEG에서 변환) | 사진, 제품 촬영 이미지, 스캔 파일 |
/FlateDecode + RGB |
PNG | 로고, 차트, UI 스크린샷 |
/JPXDecode |
PNG (JPEG 2000에서 변환) | 고해상도 아카이브 스캔 |
/CCITTFaxDecode |
PNG (스캔에서 변환) | 흑백 스캔된 텍스트 |
/JBIG2Decode |
PNG (변환됨) | 압축된 스캔 문서 |
추출기가 제공하는 형식은 항상 PNG입니다. 브라우저에서 원본 픽셀을 다시 인코딩하므로 JPEG, JPEG 2000, CCITT 소스도 PNG로 받게 됩니다.
회복되지 않을 내용
- 벡터 일러스트레이션. PDF 경로 연산자를 사용하여 제작된 로고는 이미지가 아닙니다. 이러한 로고들은 XObject 형태가 아니라 콘텐츠 스트림에 저장됩니다. 이러한 경우 PDF를 SVG로 변환하는 도구를 사용하십시오.
- 배경 색상 및 그라디언트. 이들은 내장된 자산이 아니라 페이지 수준의 그래픽입니다.
- 외곽선으로 표시된 텍스트. “그래픽”처럼 보이지만 이미지 객체는 아닙니다.
내보내기 작업 시 참고할 팁
- 크기를 확인하십시오. 페이지에 표시된
300x300축소 이미지는 실제로 렌더링 시에 축소된 3000x3000 해상도의 원본 이미지일 수 있습니다. 사용자가 얻는 것은 화면에 표시되는 크기가 아니라 원본 픽셀 정보입니다. - 라이선스를 준수하십시오. 이미지를 추출할 수 있더라도 이를 재사용할 권한은 부여되지 않습니다. PDF에 포함된 스톡 이미지는 추출된 후에도 여전히 스톡 이미지로 간주됩니다.
- 스캔된 문서. 모든 페이지가 텍스트가 포함된 하나의 대형 이미지로 출력되는 경우, 해당 PDF는 스캔 파일입니다. 내보낸 PNG 파일에 OCR을 적용하여 텍스트를 복원하세요.
자주 묻는 질문
PDF 페이지는 이미지를 그리는 방식에 변환 행렬(뒤집기, 회전, 기울이기)을 적용할 수 있습니다. 추출기는 저장된 비트맵(원시 픽셀 데이터)을 반환합니다. 게시자가 이미지를 거꾸로 저장한 뒤 렌더링 시 뒤집어 표시했다면, 내보낸 결과도 거꾸로 표시됩니다. 이 경우 아무 이미지 편집 소프트웨어에서나 다시 회전해 바로잡을 수 있습니다.
해제한 후에만 사용할 수 있습니다. 먼저 파일을 PDF 해제 도구로 처리하여 소유자 비밀번호를 입력한 다음, 파일을 추출하세요.
네. 이미지는 페이지 순서대로 추가되며 각 파일 이름에 페이지 번호가 포함됩니다. 예를 들어 image-p1-2.png와 같은 형태이므로 각 이미지가 어느 페이지에서 왔는지 알 수 있습니다.
아니요. 원본 PDF는 브라우저에서 완전히 열리고 읽히며 서버로 전송되지 않습니다. 서버에 업로드되는 것은 추출된 이미지의 ZIP 파일뿐이며, 세션 보호 결과를 만들기 위한 것입니다. 이 파일은 최대 7일간 보관된 후 삭제됩니다.
관련 도구
PDF 양식
기존 AcroForm 필드를 로컬에서 작성하고, 미리 입력된 값을 보존하며, 대화형 사본이나 명시적으로 평면화한 사본을 다운로드하세요.
문서 사진을 PDF로 변환
JPEG, PNG, WebP 문서 사진을 브라우저에서 하나의 PDF로 만드세요. 세로 A4 또는 US Letter를 고르고 사진을 업로드하지 않은 채 다운로드할 수 있습니다.
PDF OCR
브라우저 OCR로 PDF의 인쇄된 스캔 이미지에서 일반 텍스트를 추출하세요. 12개 언어와 최대 20 MB, 40페이지 파일을 지원합니다.
PDF 비교
두 PDF에서 추출 가능한 텍스트를 페이지별로 비교하고, 파일 전송 없이 브라우저에서 변경 부분을 강조합니다.
검색 가능한 PDF 만들기
보이지 않는 OCR 텍스트 레이어를 추가해 스캔한 PDF를 검색·선택 가능한 문서로 바꿉니다. 전적으로 브라우저에서 처리; 라틴 문자 7개 언어 지원.
PDF를 Excel로 변환
텍스트 기반 PDF에서 일반 표를 찾아 로컬 XLSX, CSV 또는 TSV로 다운로드하세요. 내보내기 전에 표를 검토할 수 있습니다. 제한은 20 MiB, 150페이지입니다.
이 도구는 다른 언어로도 제공됩니다
- Lấy hình ảnh từ tệp PDF [VI]
- Ekstrak Gambar dari PDF [ID]
- ดึงภาพจากไฟล์ PDF [TH]
- Extrahera bilder från PDF [SV]
- Extraer imágenes de PDF [ES]
- Bilder aus PDF extrahieren [DE]
- Afbeeldingen extraheren uit een PDF [NL]
- Wyodrębnianie obrazów z pliku PDF [PL]
- PDF'den Görüntüler Çıkarma [TR]
- استخراج الصور من PDF [AR]
- Extraire des images d'un PDF [FR]
- PDFから画像を抽出 [JA]
- Extrair Imagens de PDF [PT]
- 从 PDF 中提取图像 [ZH]
- Extract Images from PDF [EN]
- Estrai immagini da PDF [IT]
- Извлечение изображений из PDF [RU]