PDF 텍스트 추출

PDF 안의 텍스트를 뽑아내 복사하거나 저장하세요.

    브라우저에서 실행됩니다. 파일이 기기 밖으로 나가지 않습니다.

    PDF를 텍스트로 변환하는 방법

    1. 여기에 PDF 파일을 끌어다 놓으세요.
    2. 텍스트가 추출될 때까지 기다리세요.
    3. 복사하거나, PDF마다 .txt 파일로 다운로드하세요.

    추출이 유지하는 것과 버리는 것

    • 모든 페이지의 일반 텍스트가 페이지 사이 빈 줄로 이어집니다.
    • 읽는 순서는 PDF 자체의 내부 텍스트 순서를 따르며, 항상 시각적인 레이아웃과 같지는 않습니다.
    • 글꼴, 굵게·기울임 스타일, 색상, 이미지는 유지되지 않고 단어만 남습니다.
    • 표와 여러 단으로 된 페이지는 셀이나 단이 깔끔한 읽기 순서가 아니라 뒤섞여 나올 수 있습니다.

    파일 하나일 때와 여러 개일 때

    PDF 하나만 넣으면 추출된 텍스트가 페이지의 상자 안에도 나타나며 복사 버튼으로 바로 다른 곳에 붙여넣을 수 있습니다.

    PDF를 두 개 이상 넣으면 여러 문서를 한 상자에 보여주는 것이 의미가 없으므로 각각 자신의 .txt 파일로 다운로드되거나, 전부 하나의 ZIP으로 함께 받을 수 있습니다.

    PDF에서 텍스트를 뽑아내는 좋은 이유

    • 계약서의 한 문단이나 조항을 직접 타이핑하지 않고 이메일에 붙여넣기.
    • 보고서의 문구를 워드프로세서로 가져와 자유롭게 편집하기.
    • 두 버전의 문서를 일반 텍스트로 붙여넣어 비교 도구로 비교하기.
    • PDF의 글자를 일반 텍스트만 읽는 이 사이트의 다른 도구, 예를 들어 단어 수 세기에 넣어 활용하기.

    PDF→텍스트 자주 묻는 질문

    왜 텍스트 파일이 비어 있나요?

    스캔한 PDF는 텍스트 레이어가 없는 페이지 사진이라서 추출할 것이 없습니다. 대신 이미지에서 글자를 읽어내는 이미지 텍스트 추출을 사용하세요.

    원본 서식이 유지되나요?

    아니요. 열, 표, 글꼴은 유지되지 않고 페이지에 나타나는 대략적인 순서의 일반 텍스트만 남습니다.

    PDF 여러 개를 한 번에 변환할 수 있나요?

    네. 원하는 만큼 넣고 각각의 .txt 파일을 받거나 전부 ZIP으로 다운로드하세요.

    내 문서가 업로드되나요?

    아니요. 텍스트 추출은 전부 브라우저 안에서 이루어집니다.

    문단과 줄바꿈이 유지되나요?

    각 페이지의 텍스트는 빈 줄로 구분됩니다. 페이지 안의 줄바꿈은 PDF 자체의 내부 텍스트 순서를 따르며, 보통 눈에 보이는 줄과 일치하지만 항상 그렇지는 않습니다.

    여러 단으로 된 레이아웃도 올바른 순서로 추출되나요?

    항상 그렇지는 않습니다. 추출은 시각적인 단이 아니라 PDF가 텍스트를 저장한 순서를 따르므로, 2단 페이지는 단끼리 섞여서 나올 수 있습니다.

    비밀번호로 보호된 PDF에서도 작동하나요?

    바로는 안 됩니다. PDF 암호 해제로 먼저 비밀번호를 제거한 뒤, 잠금이 풀린 파일을 이 도구에 넣으세요.

    페이지 일부에만 실제 텍스트가 있으면 어떻게 되나요?

    그 부분은 정상적으로 추출됩니다. 텍스트 문단과 스캔 이미지가 섞인 페이지는 이미지 부분에 읽을 텍스트 레이어가 없으므로 문단만 반환됩니다.

    관련 도구