본문 바로가기

또는 파일을 여기에 끌어다 놓으세요

PDF · 최대 10개 · 개당 100MB


PDF 텍스트 추출

PDF 텍스트 추출은 PDF 안에 들어 있는 텍스트 레이어를 페이지 순서대로 읽어 복사하거나 TXT 파일로 저장하는 도구입니다. 계약서에서 조항 하나만 옮겨 적어야 할 때, 논문이나 보고서에서 문장을 인용해야 할 때처럼 PDF 뷰어에서 일일이 드래그해 복사하기 번거로운 상황에 주로 씁니다.

지원자 이력서 PDF를 스무 장 넘게 받은 적이 있는데, 이름과 경력 요약만 뽑아 스프레드시트로 옮기려니 파일을 하나씩 열어 드래그하는 게 너무 오래 걸렸습니다. 그래서 여러 개를 한꺼번에 올리면 파일별로 텍스트가 알아서 떨어지게 만들었습니다.

사용 방법

지원하는 형식

올릴 수 있는 건 PDF 파일이고 한 번에 최대 10개(개당 100MB)까지 처리됩니다. 결과는 페이지 순서대로 정리된 텍스트이며, 파일별로 복사하거나 전체를 TXT(2개 이상이면 ZIP)로 저장할 수 있습니다.

  1. PDF를 드래그하거나 클릭해서 올립니다.

    PDF 텍스트 추출-guide-1

  2. 올리는 즉시 자동으로 추출이 시작됩니다. 위쪽에는 첫 페이지 미리보기, 아래쪽에는 파일별 추출 텍스트가 순서대로 쌓입니다.

    PDF 텍스트 추출-guide-2

  3. 원하는 파일만 복사하거나, 전체 텍스트를 한 번에 복사·저장합니다.

    PDF 텍스트 추출-guide-3

스캔한 PDF는 글자가 안 나옵니다

PDF가 사진이나 스캔본을 그대로 이미지로 담은 것이라면 텍스트 레이어 자체가 없어서 아무것도 추출되지 않습니다. 이런 경우엔 이미지 텍스트 추출(OCR) 도구로 페이지를 이미지째 인식시켜야 글자를 얻을 수 있습니다.

자주 묻는 질문

스캔한 PDF인데 글자가 안 나와요.

스캔본은 글자가 아니라 사진으로 저장돼 있어 이 도구로는 추출되지 않습니다. 그럴 땐 이미지 텍스트 추출(OCR) 도구를 쓰면 사진 속 글자를 읽어낼 수 있습니다.

표나 단 나눔이 있는 문서는 어떻게 나오나요?

PDF에 기록된 위치를 기준으로 줄을 다시 맞춰 뽑기 때문에 대체로 읽는 순서대로 나오지만, 표나 2단 편집처럼 복잡한 배치는 줄 순서가 섞일 수 있습니다.

여러 파일을 한 번에 뽑을 수 있나요?

네. 여러 개를 올리면 파일별로 추출되고, 각각 TXT로 저장하거나 한 번에 받을 수 있습니다.

추출한 텍스트를 바로 복사할 수 있나요?

복사 버튼을 누르면 해당 파일의 전체 텍스트가 클립보드에 담깁니다. 파일로 남기려면 TXT 저장을 쓰세요.