본문으로 건너뛰기
忆云竹

PDF 텍스트 추출

PDF의 텍스트를 페이지별로 추출하고 복사하거나 TXT로 저장하세요. OCR이 필요한 페이지를 구분해 알려 줍니다.

PDF의 기존 텍스트를 페이지별로 추출합니다. 스캔본은 별도의 OCR이 필요합니다.

처리 설정

    예: 1-3,5 또는 3,1,1. 입력한 순서와 중복 페이지를 유지합니다.

    페이지당 100만 자, 전체 800만 자까지 지원합니다. 읽기 순서는 PDF에 따라 달라지므로 표와 다단 문서를 확인하세요.

    미리보기

    확대·축소와 회전은 미리보기에만 적용되며, 내보내는 파일은 바뀌지 않습니다.

    추출한 텍스트

    현재 브라우저에서만 처리하며 업로드하거나 입력을 저장하지 않습니다. 암호화된 PDF는 지원하지 않습니다. 취소할 수 있으며 90초가 지나면 중단됩니다. 예시에는 텍스트 한 페이지와 의도적으로 비워 둔 한 페이지가 있습니다.

    이 브라우저에서만 처리하며 업로드하거나 저장하지 않습니다.

    도구 소개

    PDF의 텍스트를 페이지별로 추출하고 복사하거나 TXT로 저장하세요. OCR이 필요한 페이지를 구분해 알려 줍니다.

    사용 방법

    PDF를 추가하면 자동으로 추출합니다. 필요하면 범위를 바꾸고 페이지를 펼쳐 내용을 확인하세요. 복사와 TXT 저장은 페이지 구분을 유지합니다. 이미지나 윤곽선으로 저장된 글자는 별도 OCR이 필요합니다. 내부 텍스트 순서를 따르며 Word 레이아웃을 재현하지 않으므로 표, 다단 내용과 특수 글꼴을 원본과 대조하세요.

    자주 묻는 질문

    글자가 보이는데 추출되지 않는 이유는 무엇인가요?

    이미지나 글자 윤곽선으로만 저장되어 텍스트가 없을 수 있습니다. 이 도구는 OCR을 실행하지 않습니다. 이미지로 변환한 뒤 이미지 OCR을 사용하세요. 빈 페이지도 텍스트 없음으로 표시됩니다.

    표와 다단 레이아웃이 유지되나요?

    보장하지 않습니다. PDF 내부의 텍스트 순서, 줄바꿈과 분명한 단어 간격을 사용하며 문서 레이아웃은 재구성하지 않습니다. 원본 페이지와 비교해 확인하세요.

    미리보기 한도 뒤의 글자는 사라지나요?

    아니요. 페이지당 20,000자까지만 표시하지만 복사와 TXT에는 전체 내용과 페이지 표시가 포함됩니다. 추출 한도는 페이지당 100만 자, 총 800만 자이며 내용은 업로드하거나 저장하지 않습니다.

    댓글

    0
    하여 토론에 참여하세요.
    아직 댓글이 없습니다.
    답글 대화

    전체 대화를 시간순으로 확인합니다. 각 답글에는 답변 대상 메시지가 표시됩니다.