PDF 텍스트 추출
PDF 텍스트 추출은 PDF 안에 들어 있는 텍스트 레이어를 페이지 순서대로 읽어 복사하거나 TXT 파일로 저장하는 도구입니다. 계약서에서 조항 하나만 옮겨 적어야 할 때, 논문이나 보고서에서 문장을 인용해야 할 때처럼 PDF 뷰어에서 일일이 드래그해 복사하기 번거로운 상황에 주로 씁니다.
지원자 이력서 PDF를 스무 장 넘게 받은 적이 있는데, 이름과 경력 요약만 뽑아 스프레드시트로 옮기려니 파일을 하나씩 열어 드래그하는 게 너무 오래 걸렸습니다. 그래서 여러 개를 한꺼번에 올리면 파일별로 텍스트가 알아서 떨어지게 만들었습니다.
사용 방법
지원하는 형식
올릴 수 있는 건 PDF 파일이고 한 번에 최대 10개(개당 100MB)까지 처리됩니다. 결과는 페이지 순서대로 정리된 텍스트이며, 파일별로 복사하거나 전체를 TXT(2개 이상이면 ZIP)로 저장할 수 있습니다.
-
PDF를 드래그하거나 클릭해서 올립니다.

-
올리는 즉시 자동으로 추출이 시작됩니다. 위쪽에는 첫 페이지 미리보기, 아래쪽에는 파일별 추출 텍스트가 순서대로 쌓입니다.

-
원하는 파일만 복사하거나, 전체 텍스트를 한 번에 복사·저장합니다.

스캔한 PDF는 글자가 안 나옵니다
PDF가 사진이나 스캔본을 그대로 이미지로 담은 것이라면 텍스트 레이어 자체가 없어서 아무것도 추출되지 않습니다. 이런 경우엔 이미지 텍스트 추출(OCR) 도구로 페이지를 이미지째 인식시켜야 글자를 얻을 수 있습니다.