PDF 요약 도구
3단계 중 1단계
이 요약 세션은 더 이상 사용할 수 없습니다
텍스트 기반 PDF 선택
20 MiB, 150페이지 이하 PDF 한 개를 사용하세요. 기존 텍스트 레이어를 읽으므로 스캔 페이지는 먼저 OCR이 필요합니다.
또는 PDF 한 개를 여기에 놓으세요
불러오는 중...
큰 문서는 시간이 걸릴 수 있습니다. 일부 결과를 남기지 않고 안전하게 중단할 수 있습니다.
페이지
PDF에 포함된 텍스트 레이어를 읽고, 반복되는 단어를 기준으로 문장에 점수를 매긴 뒤 선택된 문장을 추출 순서대로 보여 줍니다. AI를 쓰지 않으며 문장을 바꿔 쓰거나 사실을 확인하지도 않습니다. PDF와 추출한 텍스트는 브라우저 안에 남으므로, 결과는 원문을 대신하는 자료가 아니라 빠른 1차 검토용으로 사용하세요.
PDF를 요약하는 방법
-
1
텍스트 기반 PDF 선택
20 MiB, 150페이지 이하의 올바른 PDF 한 개를 선택합니다. 스캔 이미지로만 된 PDF는 먼저 OCR 처리가 필요합니다.
-
2
브라우저에서 텍스트 추출
내장 텍스트를 기기에서 읽고, 추출량이 2,000,000자를 넘으면 중단합니다. 암호로 보호되었거나 손상되었거나 읽을 수 없는 파일은 거부합니다.
-
3
요약 길이 설정
3~20개 문장을 선택합니다. 문서가 짧다면 새 문장을 만들지 않고 이용 가능한 문장을 모두 보여 줍니다.
-
4
확인 후 복사
선택된 문장과 자주 나온 단어를 원본 PDF와 비교한 다음 요약을 복사합니다.
추출식 요약이 실제로 하는 일
추출식 요약은 새로운 글을 쓰지 않고 원문의 문장을 유지합니다. 이 도구는 의미 있는 단어를 세고, 앞부분 문장에 작은 가중치를 더한 뒤, 점수가 높은 문장을 골라 추출된 순서대로 다시 배열합니다.
간단한 예
네 문장으로 된 프로젝트 개요가 다음과 같다고 가정해 보겠습니다.
- 시범 운영으로 고객 지원의 평균 대기 시간이 줄었다.
- 팀은 교육 안내서도 새로 구성했다.
- 두 번째 도입 이후 대기 시간이 다시 줄었다.
- 보고서는 매달 대기 시간을 점검할 것을 권한다.
대기 시간이 반복되므로 1, 3, 4번 문장이 2번 문장보다 높은 점수를 받을 수 있습니다. 요약 길이를 세 문장으로 설정하면 결과는 해당 문장을 1, 3, 4번 순서대로 유지합니다. 새로운 결론을 쓰거나 보고서가 옳은지 판단하지는 않습니다.
처리 방식
| 단계 | 실제 동작 |
|---|---|
| PDF 읽기 | PDF.js로 내장 텍스트 레이어를 읽으며 OCR은 실행하지 않음 |
| 문장 구분 | 지원되는 환경에서 페이지 언어에 맞춘 Intl.Segmenter를 사용하고 Unicode 문장부호 대체 규칙도 적용 |
| 단어 구분 | 지원되는 환경에서 언어별 분리를 사용하고 소규모 상용어 목록을 제외 |
| 순위 계산 | 반복 단어와 앞부분 위치에 대한 작은 가중치로 문장 점수를 계산 |
| 결과 | 선택한 문장을 추출 순서로 유지하고 자주 나온 단어를 최대 12개 표시 |
알아둘 제한
- 다단 편집, 표, 머리글, 바닥글, 특수 글꼴 인코딩 때문에 화면의 읽기 순서와 추출 순서가 달라질 수 있습니다.
- 문장과 단어 분리는 현재 페이지 언어를 따릅니다. PDF 전체의 언어를 자동 감지하지 않습니다.
- 원문에서 그대로 가져온 문장도 주변 문단이나 표의 맥락을 잃으면 오해를 낳을 수 있습니다.
- 사실 확인, 모순 해결, 근거 평가는 하지 않습니다.
- 한도는 20 MiB, 150페이지, 추출 텍스트 2,000,000자입니다.
3단계 흐름의 개인정보 보호
원본 PDF와 추출 텍스트는 브라우저 저장소에 남습니다. URL의 추측하기 어려운 ID는 로컬 기록만 가리키며 30분 후 만료됩니다. 페이지와 PDF 라이브러리는 일반 자산을 내려받지만, 그 요청에 PDF가 실리지 않으며 당사 서버나 변환 서비스로도 보내지지 않습니다.
자주 묻는 질문
아니요. 추출한 텍스트의 단어 빈도를 결정론적으로 계산해 문장을 선택합니다. 원문을 바꿔 쓰거나 새 주장을 만들거나 사실을 확인하지 않습니다.
이미지로만 된 스캔은 바로 처리할 수 없습니다. 먼저 OCR을 실행해 검색 가능한 PDF를 만든 뒤 사용하세요.
PDF는 일반 문단이 아니라 위치가 지정된 텍스트를 저장합니다. 다단 편집, 표, 머리글, 특수 글꼴로 인해 추출 순서가 달라질 수 있습니다.
브라우저에 현재 페이지 언어로 문장과 단어를 나누도록 요청하며, 단어마다 공백을 쓰지 않는 언어도 포함합니다. Unicode 문장부호 대체 규칙이 있지만 PDF 언어를 자동 감지하지는 않습니다.
PDF 한 개, 20 MiB, 150페이지, 추출 텍스트 2,000,000자까지입니다. 암호 보호, 손상, 읽기 불가 파일은 거부됩니다.
아니요. PDF와 텍스트는 브라우저 안에 남습니다. 3단계 흐름의 비공개 로컬 기록은 최대 30분 유지되며 URL에는 불투명 ID만 들어갑니다.
관련 도구
PDF에서 페이지 삭제
PDF에서 선택한 페이지나 페이지 범위를 삭제하세요. 2, 5-7처럼 번호를 입력하고, 최소 1페이지를 남긴 뒤 줄어든 PDF를 다운로드할 수 있습니다.
Excel-PDF 변환기
XLSX, XLS, CSV 파일을 브라우저에서 가로 A4 PDF로 변환합니다. 각 워크시트가 깔끔한 표 페이지로 만들어져 다운로드됩니다.
PDF JPG 변환기
PDF 페이지를 원하는 해상도와 품질의 JPG 이미지로 변환합니다. 한 페이지만 받거나 전체 페이지를 ZIP 파일로 다운로드할 수 있습니다.
PDF 편집
브라우저에서 PDF에 텍스트, 강조 표시, 직사각형, 흰색 상자를 추가하세요. 소프트웨어 설치 없이 새 PDF로 내보낼 수 있습니다.
PDF 압축
브라우저에서 PDF 페이지를 JPEG 기반의 더 작은 PDF로 다시 렌더링해 공유와 업로드가 쉬운 크기로 압축합니다.
PDF를 Excel로 변환
텍스트 기반 PDF에서 일반 표를 찾아 로컬 XLSX, CSV 또는 TSV로 다운로드하세요. 내보내기 전에 표를 검토할 수 있습니다. 제한은 20 MiB, 150페이지입니다.