PDF 텍스트 변환기

다음: 검토

PDF에서 글자를 꺼내는 가장 빠른 방법입니다. 이 도구는 PDF에 이미 저장된 텍스트 레이어를 페이지 단위로 읽어, 복사하거나 .txt 파일로 저장할 수 있는 일반 텍스트를 돌려줍니다. 모든 처리가 브라우저 안에서 이루어지므로 문서가 업로드되는 일은 없습니다. 미리 알아둘 점이 하나 있습니다. 이 도구는 파일 안에 이미 있는 글자를 읽기 때문에, 스캔하거나 촬영한 문서(텍스트 레이어가 없는 이미지)는 빈 결과로 나옵니다. 그런 경우에는 대신 OCR 도구를 사용하세요.

PDF에서 텍스트를 추출하는 방법

  1. 1

    PDF 업로드

    끌어다 놓거나 클릭해서 선택하세요. 파일은 기기에 남으며 서버로 전송되지 않습니다.

  2. 2

    텍스트 추출

    도구가 각 페이지의 텍스트 레이어를 읽어 이어 붙이고, 페이지마다 앞에 표시를 넣습니다.

  3. 3

    결과 확인

    추출된 텍스트가 상자에 페이지 순서대로 표시되어 바로 확인할 수 있습니다.

  4. 4

    복사 또는 다운로드

    클립보드에 복사하거나 .txt 파일로 저장해 다른 곳에서 다시 사용하세요.

이 도구가 읽을 수 있는 것과 읽을 수 없는 것

PDF 종류 결과
Word, Google Docs, 브라우저, 디자인 도구에서 내보낸 것 전체 텍스트를 깔끔하고 빠짐없이 추출
제대로 된 텍스트 레이어가 있는 디지털 PDF 페이지 단위로 텍스트 추출
PDF로 저장한 스캔본이나 사진(이미지만) 비었거나 거의 비어 있음: 읽을 텍스트가 없음
비밀번호로 보호된 PDF 먼저 잠금을 풀기 전까지 읽을 수 없음

여기에는 OCR이 없습니다: 스캔본에는 알맞은 도구를

이 추출기는 OCR(광학 문자 인식)을 실행하지 않습니다. PDF 안에 이미 있는 글자를 복사할 뿐, 픽셀을 읽지는 않습니다. 파일이 스캔본이라 아무것도 나오지 않으면, 먼저 OCR 도구에 통과시키세요. 이미지를 진짜 텍스트 레이어로 바꿔 주며, 그다음에 추출할 수 있습니다.

텍스트가 배치되는 방식

각 페이지는 --- Page N --- 표시로 구분되어, 한 페이지가 끝나고 다음이 시작되는 지점을 볼 수 있습니다. 텍스트는 PDF에 저장된 순서대로 가져옵니다. 대부분의 문서는 자연스럽게 읽히지만, 흔치 않은 다단 레이아웃의 일부는 단이 뒤섞일 수 있습니다. 도구가 읽기 경로를 추측하지 않고 PDF에 저장된 순서를 따르기 때문입니다.

자주 쓰는 용도

  • AI 모델에 입력하기. 언어 모델은 PDF가 아니라 일반 텍스트를 받습니다. 먼저 추출해 두면 처리가 더 빠르고 예측 가능해집니다.
  • 인용과 검색. PDF 뷰어의 선택 기능과 씨름하지 않고 한 대목을 복사하세요.
  • 콘텐츠 재사용. 다시 입력하지 않고 텍스트를 문서, 이메일, 메모로 옮기세요.

자주 묻는 질문

아니요. 이 도구는 내장된 텍스트 레이어를 읽는데, 스캔본은 텍스트 레이어가 없는 이미지일 뿐이라 빈 결과로 나옵니다. 스캔하거나 촬영한 문서에는 OCR 도구를 사용한 다음 텍스트를 추출하세요.

아니요. 추출은 전적으로 여러분의 브라우저, 여러분 자신의 기기에서 이루어집니다. PDF는 서버로 전송되지 않으며 아무것도 저장되지 않습니다.

일부 PDF, 특히 다단 레이아웃은 읽는 순서와 다른 순서로 텍스트를 저장합니다. 도구는 PDF에 저장된 순서를 따르므로 단이 뒤섞일 수 있습니다. 워드프로세서에서 내보낸 문서는 거의 항상 올바르게 나옵니다.

잠겨 있는 동안에는 안 됩니다. 먼저 PDF 잠금 해제 도구로 비밀번호를 제거한 다음 텍스트를 추출하세요.

관련 도구

이 도구는 다른 언어로도 제공됩니다