PDF 요약 도구
3단계 중 1단계
이 요약 세션은 더 이상 사용할 수 없습니다
텍스트 기반 PDF 선택
20 MiB, 150페이지 이하 PDF 한 개를 사용하세요. 기존 텍스트 레이어를 읽으므로 스캔 페이지는 먼저 OCR이 필요합니다.
또는 PDF 한 개를 여기에 놓으세요
불러오는 중...
큰 문서는 시간이 걸릴 수 있습니다. 일부 결과를 남기지 않고 안전하게 중단할 수 있습니다.
페이지
요약 길이로 계속PDF에 포함된 텍스트 레이어를 읽고, 반복되는 단어를 기준으로 문장에 점수를 매긴 뒤 선택된 문장을 추출 순서대로 보여 줍니다. AI를 쓰지 않으며 문장을 바꿔 쓰거나 사실을 확인하지도 않습니다. PDF와 추출한 텍스트는 브라우저 안에 남으므로, 결과는 원문을 대신하는 자료가 아니라 빠른 1차 검토용으로 사용하세요.
PDF를 요약하는 방법
-
1
텍스트 기반 PDF 선택
20 MiB, 150페이지 이하의 올바른 PDF 한 개를 선택합니다. 스캔 이미지로만 된 PDF는 먼저 OCR 처리가 필요합니다.
-
2
브라우저에서 텍스트 추출
내장 텍스트를 기기에서 읽고, 추출량이 2,000,000자를 넘으면 중단합니다. 암호로 보호되었거나 손상되었거나 읽을 수 없는 파일은 거부합니다.
-
3
요약 길이 설정
3~20개 문장을 선택합니다. 문서가 짧다면 새 문장을 만들지 않고 이용 가능한 문장을 모두 보여 줍니다.
-
4
확인 후 복사
선택된 문장과 자주 나온 단어를 원본 PDF와 비교한 다음 요약을 복사합니다.
추출식 요약이 실제로 하는 일
추출식 요약은 새로운 글을 쓰지 않고 원문의 문장을 유지합니다. 이 도구는 의미 있는 단어를 세고, 앞부분 문장에 작은 가중치를 더한 뒤, 점수가 높은 문장을 골라 추출된 순서대로 다시 배열합니다.
간단한 예
네 문장으로 된 프로젝트 개요가 다음과 같다고 가정해 보겠습니다.
- 시범 운영으로 고객 지원의 평균 대기 시간이 줄었다.
- 팀은 교육 안내서도 새로 구성했다.
- 두 번째 도입 이후 대기 시간이 다시 줄었다.
- 보고서는 매달 대기 시간을 점검할 것을 권한다.
대기 시간이 반복되므로 1, 3, 4번 문장이 2번 문장보다 높은 점수를 받을 수 있습니다. 요약 길이를 세 문장으로 설정하면 결과는 해당 문장을 1, 3, 4번 순서대로 유지합니다. 새로운 결론을 쓰거나 보고서가 옳은지 판단하지는 않습니다.
처리 방식
| 단계 | 실제 동작 |
|---|---|
| PDF 읽기 | PDF.js로 내장 텍스트 레이어를 읽으며 OCR은 실행하지 않음 |
| 문장 구분 | 지원되는 환경에서 페이지 언어에 맞춘 Intl.Segmenter를 사용하고 Unicode 문장부호 대체 규칙도 적용 |
| 단어 구분 | 지원되는 환경에서 언어별 분리를 사용하고 소규모 상용어 목록을 제외 |
| 순위 계산 | 반복 단어와 앞부분 위치에 대한 작은 가중치로 문장 점수를 계산 |
| 결과 | 선택한 문장을 추출 순서로 유지하고 자주 나온 단어를 최대 12개 표시 |
알아둘 제한
- 다단 편집, 표, 머리글, 바닥글, 특수 글꼴 인코딩 때문에 화면의 읽기 순서와 추출 순서가 달라질 수 있습니다.
- 문장과 단어 분리는 현재 페이지 언어를 따릅니다. PDF 전체의 언어를 자동 감지하지 않습니다.
- 원문에서 그대로 가져온 문장도 주변 문단이나 표의 맥락을 잃으면 오해를 낳을 수 있습니다.
- 사실 확인, 모순 해결, 근거 평가는 하지 않습니다.
- 한도는 20 MiB, 150페이지, 추출 텍스트 2,000,000자입니다.
3단계 흐름의 개인정보 보호
원본 PDF와 추출 텍스트는 브라우저 저장소에 남습니다. URL의 추측하기 어려운 ID는 로컬 기록만 가리키며 30분 후 만료됩니다. 페이지와 PDF 라이브러리는 일반 자산을 내려받지만, 그 요청에 PDF가 실리지 않으며 당사 서버나 변환 서비스로도 보내지지 않습니다.
자주 묻는 질문
아니요. 추출한 텍스트의 단어 빈도를 결정론적으로 계산해 문장을 선택합니다. 원문을 바꿔 쓰거나 새 주장을 만들거나 사실을 확인하지 않습니다.
이미지로만 된 스캔은 바로 처리할 수 없습니다. 먼저 OCR을 실행해 검색 가능한 PDF를 만든 뒤 사용하세요.
PDF는 일반 문단이 아니라 위치가 지정된 텍스트를 저장합니다. 다단 편집, 표, 머리글, 특수 글꼴로 인해 추출 순서가 달라질 수 있습니다.
브라우저에 현재 페이지 언어로 문장과 단어를 나누도록 요청하며, 단어마다 공백을 쓰지 않는 언어도 포함합니다. Unicode 문장부호 대체 규칙이 있지만 PDF 언어를 자동 감지하지는 않습니다.
PDF 한 개, 20 MiB, 150페이지, 추출 텍스트 2,000,000자까지입니다. 암호 보호, 손상, 읽기 불가 파일은 거부됩니다.
아니요. PDF와 텍스트는 브라우저 안에 남습니다. 3단계 흐름의 비공개 로컬 기록은 최대 30분 유지되며 URL에는 불투명 ID만 들어갑니다.
관련 도구
PDF OCR
브라우저 OCR로 PDF의 인쇄된 스캔 이미지에서 일반 텍스트를 추출하세요. 12개 언어와 최대 20 MB, 40페이지 파일을 지원합니다.
HTML을 PDF로 변환
기본 HTML과 인라인 CSS를 브라우저에서 A4, Letter 또는 Legal 크기의 래스터 PDF로 변환합니다. 소스와 결과 파일은 업로드하지 않습니다.
MD에서 PDF로 변환하기
마크다운 문서를 코드 강조, 표, 이미지 및 사용자 정의 페이지 여백을 포함한 스타일화된 PDF로 변환합니다. 기본적으로는 GitHub 스타일 테마가 적용됩니다.
로컬 PDF 가림 처리
민감한 영역을 직접 가리고 기기에서 페이지 JPEG 이미지로 새 PDF를 만드세요. 파일은 업로드되지 않습니다. 결과의 모든 페이지는 검색하거나 선택할 수 없는 이미지가 됩니다.
PDF에서 이미지 추출
PDF 파일에 포함된 모든 이미지를 추출하여 원본 해상도를 그대로 유지한 상태로 개별적으로 또는 단일 ZIP 파일 형태로 다운로드할 수 있습니다.
PDF 양식
기존 AcroForm 필드를 로컬에서 작성하고, 미리 입력된 값을 보존하며, 대화형 사본이나 명시적으로 평면화한 사본을 다운로드하세요.
이 도구는 다른 언어로도 제공됩니다
- Streszczenie PDF [PL]
- Peringkas PDF [ID]
- Công cụ tóm tắt PDF [VI]
- PDF-sammanfattare [SV]
- เครื่องมือสรุป PDF [TH]
- PDF 要約ツール [JA]
- ملخّص PDF [AR]
- Resumidor de PDF [ES]
- Resumidor de PDF [PT]
- Résumeur de PDF [FR]
- PDF-Zusammenfasser [DE]
- Pdf-samenvatter [NL]
- Riassuntore di PDF [IT]
- Суммаризатор PDF [RU]
- PDF Özetleyici [TR]
- PDF 摘要工具 [ZH]
- PDF Summarizer [EN]