PDF 페이지 수 및 메타데이터를 일괄 추출하고 Excel 파일 목록을 생성하는 방법


번역EnglishFrançaisDeutschEspañol日本語한국어업데이트 시간2026-08-02 06:31:08

성명: 웹사이트의 모든 이미지, 텍스트 및 비디오 콘텐츠는 참고용이며 최신, 정확, 적절하지 않을 수 있습니다. 이의가 있는 경우 실제 경험 효과를 기준으로 하십시오!

PDF 파일 목록을 작성할 때, 일반적인 필드는 파일 이름과 크기뿐만 아니라 전체 경로, 생성 시간, 수정 시간, 페이지 수, PDF 제목, 저자, 주제, 키워드 등의 메타데이터도 포함됩니다. 본문에서는 HeSoft Doc Batch Tool 을 예시로 사용하여, 파일 정보 통계 기능을 통해 PDF를 일괄 가져오고, PDF 파일의 상세 정보를 선택하여 Excel 요약표를 생성하는 방법을 설명합니다. 이를 통해 사용자가 신속하게 자료 재고 조사, 파일 디렉토리 정리, 문서 전달 점검을 완료할 수 있도록 도와줍니다.

많은 사람들이 PDF 자료를 정리할 때 가장 먼저 Excel을 열고, 폴더를 확인하면서 파일 이름, 경로, 크기, 날짜를 수동으로 입력합니다. 파일이 몇 개뿐이라면 이렇게 해도 큰 문제가 없지만, 파일 수가 수십 개, 수백 개에 달하면 수작업 방식은 매우 비효율적이 됩니다. 더 번거로운 점은 PDF 페이지 수, 제목, 저자, 주제, 키워드, 생성 날짜, 응용 프로그램 및 제작 프로그램 등의 정보를 보통 폴더 목록에서 완전하게 바로 볼 수 없으며, 파일을 열거나 속성을 확인해야 확인할 수 있다는 것입니다.

이 글에서는 사무 환경에 더 적합한 방법을 소개합니다. 바로 HeSoft Doc Batch Tool 의 "파일 정보 통계" 기능을 사용하여 많은 PDF 파일의 기본 속성과 PDF 상세 정보를 일괄 통계하고 Excel 표로 집계하는 방법입니다. 전체 과정은 파일 선택, 처리 옵션 설정, 저장 및 처리 시작까지 마법사 방식으로 진행되어, PDF 파일 목록, PDF 페이지 수 통계표, PDF 메타데이터 대장을 빠르게 작성해야 하는 사용자에게 적합합니다.

적용 시나리오: PDF 목록 정리부터 메타데이터 검토까지 활용 가능

PDF 페이지 수와 메타데이터를 일괄 추출해야 하는 요구는 사무실에서 흔히 볼 수 있습니다. 주로 다음과 같은 작업에서 자주 나타납니다.

  • 기록물 목록 작성: 스캔본, 전자 계약, 내규 문서, 보고서 파일 등 PDF를 Excel 목록으로 정리하여 보관 및 검색을 용이하게 합니다.
  • 교육 자료 통계: 강의안, 학습 자료, 연습 문제집, 읽기 자료 등 PDF의 페이지 수를 통계하여 자료의 분량을 평가합니다.
  • 프로젝트 문서 전달: 프로젝트 자료 제출 전에 파일 목록을 생성하여 PDF가 모두 있는지, 파일 이름이 통일되었는지, 경로가 올바른지 확인합니다.
  • 파일 출처 조사: PDF 메타데이터의 저자, 응용 프로그램, 제작 프로그램 등의 필드를 통해 파일의 출처와 생성 방식을 보조적으로 판단합니다.
  • 일괄 파일 관리: 크기, 수정 시간, 소속 폴더 등의 필드에 따라 비정상 문서를 필터링하여 중복 파일이나 만료된 자료를 찾아냅니다.

이러한 시나리오에서 Excel은 정렬, 필터링, 검색 및 공유가 쉽기 때문에 가장 일반적으로 사용되는 집계 도구입니다. 그리고 사무용 소프트웨어의 일괄 처리 기능은 원래 수동으로 일일이 확인해야 했던 파일 정보를 한 번에 정리할 수 있게 해줍니다.

결과 미리보기: 일괄 통계 전후의 변화

처리 전: PDF가 폴더에 흩어져 있어 제한된 속성만 볼 수 있음

아래 처리 전 스크린샷은 여러 개의 PDF가 포함된 폴더를 보여줍니다. 파일 이름은 ClassNotesPacket.pdf, CourseSummaryReport.pdf, ExamPreparationNotes.pdf, KnowledgeReviewNotes.pdf 등입니다. 파일 탐색기에서 파일 이름, 수정된 날짜, 유형 및 크기와 같은 기본 정보를 볼 수 있지만, 이 정보는 완전하지 않습니다. 예를 들어, 각 PDF의 페이지 수를 직접 볼 수 없고, PDF 제목, 저자, 주제 또는 키워드를 일괄적으로 볼 수도 없습니다.

image-PDF 페이지 일괄 추출,PDF 메타데이터 일괄 내보내기,PDF 파일 목록 엑셀

이러한 PDF를 공식적인 장부로 정리하려면 폴더 보기만으로는 충분하지 않습니다. 사용자는 보통 원본 파일을 찾기 위한 전체 경로, 파일 버전을 판단하기 위한 생성 시간과 수정 시간, 자료 규모를 통계하기 위한 페이지 수, 문서의 규범성을 확인하기 위한 메타데이터가 필요합니다.

처리 후: Excel에서 한 행에 하나의 PDF가 구조화된 목록으로 형성됨

처리가 완료되면 PDF 파일 정보가 Excel로 출력됩니다. 스크린샷에서 볼 수 있듯이, 표는 더 이상 단순한 파일 이름 목록이 아니라 매우 완전한 필드를 포함합니다. 경로, 이름, 이름(확장명 제외), 확장명, 크기(바이트), 크기, 소속 폴더 이름, 소속 폴더 경로, 생성 시간, 수정 시간, 페이지 수, 그리고 PDF 메타데이터 제목, 저자, 주제, 키워드, 생성 날짜, 응용 프로그램, 제작 프로그램 등입니다.

image-PDF 페이지 일괄 추출,PDF 메타데이터 일괄 내보내기,PDF 파일 목록 엑셀

이러한 Excel 결과는 후속 사무 처리에 더 적합합니다. 예를 들어, 어떤 PDF의 페이지 수가 10페이지를 초과하는지 보려면 "페이지 수"로 정렬할 수 있고, 특정 PDF들이 동일한 응용 프로그램으로 생성되었는지 확인하려면 "PDF - 메타데이터 - 응용 프로그램"을 필터링할 수 있으며, 저자별로 자료 출처를 정리하려면 "PDF - 메타데이터 - 저자"로 필터링하거나 그룹화할 수 있습니다.

작업 단계: PDF 페이지 수, 경로 및 메타데이터 일괄 내보내기

1단계: 파일 정보 통계 입구 열기

HeSoft Doc Batch Tool 을(를) 시작한 후, 왼쪽 탐색에서 "파일 정리"를 선택합니다. 기능 카드 영역에서 "파일 정보 통계"를 볼 수 있으며, 설명에는 각종 파일의 이름, 경로, 크기, 시간 및 메타데이터 등의 정보를 일괄 통계한다고 나와 있습니다. PDF 파일 정보를 추출해야 하므로 이 기능을 클릭하여 진입합니다.

image-PDF 페이지 일괄 추출,PDF 메타데이터 일괄 내보내기,PDF 파일 목록 엑셀

이 단계의 역할은 올바른 일괄 처리 도구를 선택하는 것입니다. 이 글의 목표는 구체적인 PDF 파일을 통계하는 것이지 폴더 자체를 통계하는 것이 아니므로 "폴더 정보 통계"를 선택하지 마십시오. "파일 정보 통계"에 진입하면 소프트웨어가 단계별 마법사로 안내하여 사용자가 가져오기, 옵션 설정, 저장 위치 지정 및 처리를 순서대로 완료하도록 도와줍니다.

2단계: 통계할 PDF 파일 가져오기

기능 페이지에 진입하면 현재 1단계 "처리할 레코드 선택"에 있습니다. 페이지 오른쪽 상단에 "파일 추가" 및 "폴더에서 파일 가져오기" 두 가지 일반적인 입구가 제공됩니다. PDF 분포가 비교적 집중되어 있다면, 대상 폴더의 파일을 한 번에 목록에 로드할 수 있도록 "폴더에서 파일 가져오기"를 직접 사용하는 것이 좋습니다. 소수의 PDF만 통계하려면 "파일 추가"를 사용할 수 있습니다.

image-PDF 페이지 일괄 추출,PDF 메타데이터 일괄 내보내기,PDF 파일 목록 엑셀

가져오기가 완료되면 표에 파일의 일련 번호, 이름, 경로, 확장명, 생성 시간, 수정 시간 등의 정보가 나열됩니다. 스크린샷 하단의 레코드 수는 20개로 표시되어, 이번 작업에 20개의 PDF 파일이 추가되었음을 나타냅니다. 이때 먼저 파일 확장자가 pdf인지, 경로가 대상 폴더에 속하는지, 파일 수가 예상과 일치하는지 확인하는 것이 좋습니다.

잘못 선택된 파일을 발견하면 작업 열에서 해당 레코드를 삭제할 수 있고, 다시 가져와야 하는 경우 "비우기"를 사용할 수 있습니다. 파일이 많을 경우, 페이지에서 제공하는 "필터"와 "정렬"을 통해 목록을 빠르게 확인할 수도 있습니다. 확인이 끝나면 하단의 "다음"을 클릭합니다.

3단계: 추가 정보에서 PDF 파일 상세 정보 선택

2단계 "처리 옵션 설정"에 진입하면 "추가 정보" 영역을 볼 수 있습니다. 여기에는 Word 파일 상세 정보, Excel 파일 상세 정보, PPT 파일 상세 정보, PDF 파일 상세 정보, 텍스트 파일 상세 정보 및 이미지 파일 상세 정보 등 여러 파일 유형의 상세 정보 옵션이 나열됩니다.

image-PDF 페이지 일괄 추출,PDF 메타데이터 일괄 내보내기,PDF 파일 목록 엑셀

이번 작업은 PDF 페이지 수와 메타데이터를 일괄 추출하는 것이므로 "PDF 파일 상세 정보"를 선택해야 합니다. 이것이 완전한 PDF 목록을 생성하는 핵심 설정입니다. 이 옵션을 선택하면 소프트웨어가 기본 파일 속성을 통계하는 동시에 PDF 관련 상세 필드도 읽어옵니다. 최종 Excel에 나타나는 "페이지 수", "PDF - 메타데이터 - 제목", "PDF - 메타데이터 - 저자", "PDF - 메타데이터 - 주제", "PDF - 메타데이터 - 키워드" 등의 열이 바로 이 옵션으로 인해 생성됩니다.

Word, Excel, PPT, 이미지 등 다른 파일을 동시에 처리하는 경우에도 실제 필요에 따라 해당 상세 정보를 선택할 수 있습니다. 하지만 결과 표를 더 명확하게 하기 위해, 이번에는 PDF만 가져오거나 최소한 분석이 필요한 주요 대상이 PDF 파일인지 확인하는 것이 좋습니다.

4단계: 통계 결과의 저장 위치 설정

상단 프로세스에서 3단계는 "저장 위치 설정"입니다. "다음"을 클릭하여 진입한 후, 인터페이스 안내에 따라 결과 파일을 저장할 위치를 선택합니다. 예를 들어 이번 PDF가 있는 프로젝트 디렉토리, 자료 보관 디렉토리 또는 전용 통계 결과 폴더와 같이 찾기 쉬운 위치에 결과를 저장하는 것이 좋습니다.

저장 위치 설정의 목적은 처리가 완료된 후 내보낸 Excel 파일을 찾지 못하는 상황을 피하기 위함입니다. 서로 다른 배치의 PDF를 여러 번 통계해야 하는 사용자는 저장 파일 이름에 날짜, 프로젝트 이름 또는 자료 카테고리를 포함시켜 서로 다른 배치의 집계표를 쉽게 구분할 수 있습니다.

5단계: 처리 시작 및 Excel 결과 확인

저장 위치 설정을 완료한 후 4단계 "처리 시작"으로 진입합니다. 소프트웨어는 작업 목록에 따라 PDF 파일 정보를 순차적으로 읽어들여 자동으로 표 결과를 정리합니다. 수동 통계와 비교했을 때, 일괄 처리의 가장 큰 장점은 안정성, 통일성, 반복 가능성입니다. 동일한 파일 묶음에 대해 동일한 필드 체계를 사용하여 출력하므로, 수동 입력 시 발생하는 열 이름 불일치, 날짜 형식 비통일, 경로 복사 불완전 등의 문제를 피할 수 있습니다.

처리가 완료되면 Excel 결과를 엽니다. 다음 필드가 요구 사항을 충족하는지 우선 확인하는 것이 좋습니다. 전체 경로가 원본 파일을 찾을 수 있는지, 페이지 수가 생성되었는지, PDF 제목, 저자, 주제, 키워드 등 메타데이터 열이 존재하는지, 생성 시간, 수정 시간이 버전 판단에 사용될 수 있는지, 파일 크기가 비정상 파일을 확인하는 데 사용될 수 있는지 등입니다.

자주 묻는 질문 및 주의 사항

1. PDF 페이지 수만 통계하고 싶은데, 모든 메타데이터를 내보내야 합니까?

스크린샷 결과를 보면, PDF 파일 상세 정보를 선택하면 페이지 수와 여러 유형의 PDF 메타데이터 필드가 출력됩니다. 페이지 수에만 관심이 있다면, Excel 생성 후 "페이지 수"와 필요한 경로, 파일 이름 필드를 유지하고 필요 없는 메타데이터 열을 삭제하거나 숨길 수 있습니다. 이렇게 하면 소프트웨어의 완전한 추출 기능을 활용하면서도 최종 표를 간결하게 유지할 수 있습니다.

2. PDF 파일 이름과 Excel의 이름은 어떤 차이가 있습니까?

결과 표에는 보통 "이름"과 "이름(확장명 제외)"이 동시에 포함됩니다. 전자에는 .pdf 확장자가 포함되어 있어 원본 파일과 대조하기 적합하고, 후자는 확장자가 제거되어 있어 후속적으로 제목, 번호 또는 자료 이름에 따라 매칭 정리하기에 적합합니다.

3. 전체 경로 필드가 필요한 이유는 무엇입니까?

여러 폴더에 동일한 이름의 PDF가 존재하는 경우, 파일 이름만으로는 구체적으로 어떤 파일인지 판단하기 어려울 수 있습니다. 전체 경로는 파일이 위치한 곳을 명확히 하여, 추적하거나 원본 파일을 열거나 후속 이전을 수행하는 데 용이합니다.

4. 메타데이터가 완전하지 않은 것은 소프트웨어가 읽기에 실패한 것입니까?

반드시 그렇지는 않습니다. PDF 메타데이터의 완전성은 파일 자체에 달려 있습니다. 많은 PDF가 생성될 때 저자, 주제 또는 키워드를 기입하지 않으므로 해당 필드가 비어 있는 것은 정상입니다. 소프트웨어는 기존 정보를 일괄 추출할 수 있지만, 파일에 존재하지 않는 메타데이터를 무에서 생성할 수는 없습니다.

5. 파일 수가 매우 많을 때 오류 확률을 낮추는 방법은 무엇입니까?

폴더나 프로젝트별로 나누어 가져오고, 먼저 레코드 수와 경로를 확인한 다음 PDF 파일 상세 정보를 선택하는 것이 좋습니다. 처리가 완료된 후 Excel에서 빈 값, 비정상 페이지 수 또는 비정상 시간을 필터링하여 2차 검사를 수행합니다. 이렇게 하면 처리 효율을 유지하면서 문제 파일을 쉽게 찾을 수 있습니다.

요약: 일괄 처리 방식으로 PDF 페이지 수 및 메타데이터 통계 완료

PDF 파일 목록 작성의 핵심은 단순히 파일 이름을 나열하는 것이 아니라, 파일 시스템과 PDF 내부에 흩어져 있는 다양한 정보를 통일적으로 집계하는 것입니다. HeSoft Doc Batch Tool 은(는) "파일 정보 통계" 기능을 통해 파일 가져오기, PDF 상세 정보 선택, 저장 위치 설정, 처리 시작이라는 과정을 연결하여 사용자가 Excel 형식의 PDF 정보 표를 빠르게 얻을 수 있도록 합니다.

만약 PDF 자료 보관, 문서 전달, 페이지 수 통계 또는 메타데이터 검토 작업을 하고 계시다면, 이 글의 절차에 따라 진행할 수 있습니다. 먼저 파일 정리에서 파일 정보 통계로 들어가 PDF 파일을 가져온 후, "PDF 파일 상세 정보"를 선택하고 마지막으로 Excel을 출력하면 됩니다. PDF를 하나씩 열어보는 것과 비교했을 때, 이 방법은 사무 환경에서의 대량 파일 처리에 훨씬 더 적합하며 반복적인 작업을 크게 줄여 통계의 정확성과 전달 효율을 높일 수 있습니다.


키워드PDF 페이지 일괄 추출 , PDF 메타데이터 일괄 내보내기 , PDF 파일 목록 엑셀
생성 시간2026-08-02 06:30:52

성명: 웹사이트의 모든 이미지, 텍스트 및 비디오 콘텐츠는 참고용이며 최신, 정확, 적절하지 않을 수 있습니다. 이의가 있는 경우 실제 경험 효과를 기준으로 하십시오!

관련 기사

더 많은 기사