본문으로 건너뛰기

PDF 텍스트 추출 — TXT로 변환, 업로드 없음

브라우저에서 PDF의 텍스트 레이어를 일반 텍스트로 추출하세요. 글자 위치로 줄과 문단을 복원하며, 복사하거나 .txt 파일로 다운로드할 수 있습니다.

브라우저에서 변환 · 가입 불필요

PDF 1개 · 최대 30 MB, 200페이지 · 기기에서 처리

사용 방법

  1. 텍스트를 선택할 수 있는 PDF를 선택하세요.
  2. 읽을 페이지를 입력하고(예: 1-3, 5), 페이지 구분을 표시할지 고르세요.
  3. '텍스트 추출'을 선택한 뒤 결과를 복사하거나 UTF-8 .txt 파일로 다운로드하세요.

예제

2페이지 보고서 → "--- 1쪽 ---

분기 보고서

첫 번째 문단…", 문단 사이에 빈 줄.

세부 정보 및 제한 사항

텍스트는 pdf.js를 통해 PDF 자체의 텍스트 레이어에서 가져옵니다. 같은 기준선의 항목은 한 줄이 되고, 단어 사이 간격은 공백이 되며, 줄 간격이 넓으면 새 문단이 시작됩니다. 다단 페이지는 단이 섞일 수 있고, 표의 넓은 간격은 공백 세 칸으로 유지됩니다.

한국어, 중국어, 일본어 텍스트를 지원합니다. 스캔한 페이지에는 텍스트 레이어가 없어 비어 있으며, 도구가 해당 페이지를 알려 주고 PDF OCR 링크를 제공합니다. PDF는 기기에서 읽습니다.

FAQ

추출한 텍스트가 비어 있는 이유는?

그 PDF는 스캔본이나 이미지 모음일 가능성이 높아 문자가 아닌 글자 그림이 들어 있습니다. 대신 PDF OCR로 텍스트를 인식하세요.

단어가 붙거나 이상하게 끊기는 이유는?

PDF는 문장이 아니라 위치가 지정된 텍스트 조각을 저장합니다. 공백과 줄바꿈은 그 위치로 추정하므로, 특이한 글꼴, 자간, 다단 때문에 결과가 완벽하지 않을 수 있습니다.

암호가 걸린 PDF에서 텍스트를 추출할 수 있나요?

바로는 안 됩니다. 암호를 알고 있다면 먼저 'PDF 암호 해제'로 암호를 제거한 다음, 해제된 사본에서 텍스트를 추출하세요.

형식 참고 자료

도구 페이지 업데이트: