하나의 폴더에 많은 PDF 보고서, 강의 자료 또는 아카이브 파일이 쌓이면 완전한 파일 목록을 정리하는 것이 쉽지 않습니다. 본 문서는 PDF 문서 정보 취합 시나리오를 중심으로 HeSoft Doc Batch Tool 을(를) 사용하여 PDF의 전체 경로, 파일명, 확장자, 크기, 생성/수정 시간, 페이지 수, 제목, 저자, 주제, 키워드 등 메타데이터를 Excel로 일괄 추출하는 방법을 설명합니다. 본 문서는 처리 전후 효과와 소프트웨어 조작 단계를 결합하여 사용자가 신속하게 필터링, 정렬, 전달이 가능한 PDF 자료 리스트를 구축할 수 있도록 도와줍니다.
많은 사무 환경에서 PDF 문서에 대한 체계적인 현황 파악이 필요합니다. 파일의 총 개수, 각 파일의 저장 경로, 각 PDF의 페이지 수, 파일 크기, 생성 및 수정 시간, PDF 속성에 제목, 작성자, 주제, 키워드 등의 메타데이터가 있는지 여부 등이 그 대상입니다. 단순히 정보를 정리하는 작업처럼 보이지만, 파일 수가 많으면 수작업 통계는 반복적이고 지루하며 오류가 발생하기 쉬운 작업이 됩니다.
예를 들어, 프로젝트 종료 후 고객에게 제출할 PDF 자료 목록, 학교나 교육 기관에서 정리해야 할 강의 자료 및 연습문제집, 회사 내부의 과거 보고서, 규정 문서, 스캔档案에 대한 전산 현황 파악, 기록물 관리자가 폴더에 흩어져 있는 PDF를 Excel 대장으로 정리하는 경우 등이 있습니다. 이러한 상황의 공통점은 PDF 내용을 페이지별로 읽을 필요는 없지만, 파일 수준의 정보와 PDF 속성 정보를 빠르게 확보해야 한다는 점입니다.
HeSoft Doc Batch Tool 은(는) 사무 파일 일괄 처리를 위한 소프트웨어로, 그중 파일 정보 통계 기능을 통해 여러 PDF의 기본 파일 정보와 PDF 상세 정보를 종합하여 출력할 수 있습니다. 본 문서는 실제 작업 흐름에 따라 PDF 파일 경로, 페이지 수 및 메타데이터를 Excel로 일괄 내보내는 방법을 소개하여, 보다 표준화된 방식으로 PDF 문서 정보 현황 파악을 완료할 수 있도록 도와드립니다.
적용 시나리오: 폴더 보기에서 Excel 문서 대장으로 업그레이드
Windows 폴더에서 PDF 목록을 보는 것만으로는 보통 파일 이름, 수정 날짜, 유형, 크기 등 제한된 정보만 얻을 수 있습니다. 진정한 문서 관리 측면에서는 이러한 정보만으로는 부족합니다. 파일 위치를 찾기 위한 전체 경로, 번호 부여 및 매칭을 위한 확장자를 제외한 이름, 작업량 계산을 위한 페이지 수, 파일 출처와 주제 파악을 위한 PDF 메타데이터가 추가로 필요한 경우가 많습니다.
PDF 정보를 Excel로 일괄 내보내는 기능은 다음과 같은 사용자에게 적합합니다. 첫째, 정기적으로 전자 파일 목록을 생성해야 하는 자료 관리자, 둘째, 프로젝트 산출물 목록을 작성해야 하는 프로젝트 어시스턴트, 셋째, 교육 자료의 PDF 수량과 페이지 수를 집계해야 하는 교사, 연구원 또는 교육 운영 담당자, 넷째, 증거 자료, 보고서, 계약서 스캔본을 통합 등록해야 하는 법무, 재무, 감사 등 직종의 담당자, 다섯째, PDF 폴더 내용을 구조화된 표로 변환해야 하는 모든 사람입니다.
"PDF 파일을 Excel에 하나씩 나열하고" 페이지 수, 경로, 작성자, 제목 등의 정보까지 자동으로 가져오고 싶다면, 일괄 파일 정보 통계가 수동 복사보다 더 적합합니다. 이를 통해 Excel 목록을 단순한 파일 이름 목록에서 필터링, 정렬, 추적 가능한 문서 대장으로 업그레이드할 수 있습니다.
결과 미리보기: 처리 전에는 일반 PDF 파일 목록만 존재
처리 전 폴더에는 여러 PDF 자료가 포함되어 있습니다. 스크린샷에서 학습 자료, 강의 요약, 훈련 가이드, 프로젝트 보고서 등으로 명명된 여러 PDF 파일을 볼 수 있습니다. 탐색기 보기에는 파일 이름, 날짜, 파일 형식 및 크기가 표시되지만, 이러한 정보로는 완전한 Excel 표를 직접 만들 수 없으며 PDF 페이지 수나 PDF 메타데이터의 제목, 작성자, 주제, 키워드 등의 필드도 볼 수 없습니다.

이 시점에서 수작업 방식을 사용한다면, 일반적으로 먼저 파일 이름을 복사하고 경로를 복사한 다음, 일일이 PDF를 열거나 속성을 확인하여 페이지 수와 메타데이터를 기록해야 합니다. 파일 수가 조금만 많아져도 통계 속도와 정확성을 보장하기 어렵습니다. 특히 경로 정보가 길 경우 수동 복사 시 폴더 계층을 빠뜨리기 쉽고, 메타데이터 필드가 많으면 제목, 주제, 키워드를 혼동하기 쉽습니다.
결과 미리보기: 처리 후 PDF 상세 정보가 포함된 Excel 획득
파일 정보 통계 기능으로 처리하면 결과가 Excel로 정리됩니다. 처리된 표에는 경로, 이름, 확장자, 파일 크기, 포함된 폴더, 생성 시간, 수정 시간 등의 기본 필드뿐만 아니라 페이지 수, PDF 메타데이터 제목, 작성자, 주제, 키워드, 생성 날짜, 응용 프로그램, 제작 프로그램 등의 정보도 포함됩니다.

이러한 Excel 표의 장점은 후속 활용도가 높다는 점입니다. 폴더 경로별로 특정 PDF 배치를 필터링하고, 페이지 수별로 총 페이지를 집계하고, 작성자나 주제별로 자료 출처를 분석하고, 수정 시간별로 파일이 최신 버전인지 확인할 수 있으며, 이 표를 보관 목록, 납품 목록 또는 내부 자산 대장으로 사용할 수도 있습니다. 스크린샷이나 폴더 목록에 비해 Excel 결과는 팀 협업 및 장기 유지 관리에 더 적합합니다.
작업 단계: PDF 경로, 페이지 수 및 메타데이터 일괄 추출
1단계: 파일 정보 통계 입구 열기
HeSoft Doc Batch Tool 을(를) 시작한 후 왼쪽 분류에서 파일 정리로 들어갑니다. 오른쪽 기능 영역에서 파일 정보 통계를 찾습니다. 스크린샷에서 해당 기능 카드의 설명은 '각종 파일의 이름, 경로, 크기, 시간 및 메타데이터 등의 정보 일괄 통계'로, 일반적인 파일 이름 정리에 국한되지 않고 보다 완전한 파일 정보 집계를 지향한다는 것을 보여줍니다.

이 단계의 작업 목적은 올바른 일괄 처리 모듈을 선택하는 것입니다. 우리가 수행하려는 작업은 PDF 정보 현황 파악이지 PDF 병합, 분할 또는 변환이 아니므로 파일 정보 통계로 들어가야 합니다. 진입하면 소프트웨어는 절차화된 단계를 통해 파일 선택, 처리 옵션 설정, 저장 위치 설정 및 처리 시작을 안내합니다.
2단계: 현황 파악이 필요한 PDF 파일 가져오기
파일 정보 통계 인터페이스에 진입하면 첫 단계는 처리할 레코드를 선택하는 것입니다. 인터페이스 상단에서 파일 추가, 폴더에서 파일 가져오기, 비우기 등의 작업 입구를 볼 수 있습니다. 개별적으로 선택한 PDF는 파일 추가를 사용할 수 있고, 이미 같은 디렉터리에 있는 대량의 PDF는 폴더에서 파일 가져오기를 사용하여 한 번에 전체 자료를 추가하는 것이 더 좋습니다.

가져오기가 완료되면 목록에 현재 파일 레코드가 표시됩니다. 스크린샷의 필드에는 번호, 이름, 경로, 확장자, 생성 시간, 수정 시간 및 작업이 포함되며, 하단에는 레코드 수가 20개로 표시됩니다. 여기서 먼저 파일 수가 폴더 내 PDF 수와 일치하는지, 경로가 올바른지, 통계가 필요 없는 파일이 섞여 있지 않은지 확인할 수 있습니다. 필요 없는 레코드는 작업 열에서 제거할 수 있으며, 데이터 양이 많은 목록은 필터링 및 정렬을 통해 보조적으로 확인할 수 있습니다.
이 단계는 처리 대기열을 구축하는 것과 같습니다. 대기열이 정확해야 최종 Excel 통계 결과가 신뢰할 수 있습니다. 따라서 다음 단계로 넘어가기 전에 파일 목록을 확인하는 시간을 갖는 것이 좋습니다. 특히 프로젝트 납품, 기록물 보관과 같이 목록 정확성 요구가 높은 상황에서 더욱 중요합니다.
3단계: PDF 파일 상세 정보를 추가 정보로 선택
파일 목록을 확인한 후 다음을 클릭하여 처리 옵션 설정으로 들어갑니다. 추가 정보 영역에서 Word 파일 상세 정보, Excel 파일 상세 정보, PPT 파일 상세 정보, PDF 파일 상세 정보, 텍스트 파일 상세 정보, 이미지 파일 상세 정보 등 여러 파일 형식의 상세 정보 옵션을 볼 수 있습니다. 여기서 PDF 파일 상세 정보를 선택해야 합니다.

이 단계는 Excel에 PDF 관련 필드가 나타날지 여부를 결정합니다. 기본 통계를 통해 파일 이름, 경로, 크기, 시간 등의 일반 정보를 얻을 수 있지만, 페이지 수, PDF 메타데이터 제목, 작성자, 주제, 키워드, 생성 날짜, 응용 프로그램, 제작 프로그램 등의 필드는 PDF 상세 정보 범위에 속합니다. 따라서 PDF 문서 정보 현황 파악 시 PDF 파일 상세 정보가 선택되었는지 반드시 확인해야 합니다.
폴더에 PDF만 있다면 PDF 파일 상세 정보만 선택하면 됩니다. 하나의 프로젝트 디렉터리에 doc, docx, xls, xlsx, ppt, pptx, txt 또는 이미지 파일이 혼재되어 있는 경우, 필요에 따라 해당 상세 정보 옵션을 선택할 수도 있습니다. 하지만 결과 표를 더 집중적으로 만들기 위해, 이번 통계 목표에 따라 필요한 항목만 선택하여 관련 없는 열을 너무 많이 내보내지 않도록 하는 것이 좋습니다.
4단계: 저장 위치 설정 및 Excel 통계 결과 생성
처리 옵션을 완료한 후 계속 다음을 눌러 저장 위치를 설정합니다. 저장 위치는 내보낸 Excel 결과 파일을 저장하는 데 사용됩니다. 프로젝트 자료 관련 디렉터리(예: 프로젝트 납품 폴더, 기록물 통계 폴더 또는 임시 정리 디렉터리)에 결과를 저장하는 것이 좋습니다. 이렇게 하면 추후 찾아보고 재검토하기가 더 편리합니다.
이어서 처리 시작으로 들어갑니다. 소프트웨어는 파일 목록에 따라 PDF 정보를 하나씩 읽고 통계 결과를 Excel에 기록합니다. 수동 통계와 비교할 때, 일괄 처리의 장점은 절차가 일관되고, 필드가 통일되며, 레코드가 완전하다는 점입니다. 특히 여러 파일 배치를 반복적으로 처리해야 하는 사무 환경에 적합합니다. 사용자는 페이지 수를 확인하기 위해 PDF를 일일이 열 필요가 없고, 각 파일의 전체 경로를 수동으로 복사할 필요도 없습니다.
5단계: Excel에서 재검토 및 추가 작업
처리가 완료되면 내보낸 Excel 표를 엽니다. 먼저 레코드 행 수가 가져온 파일 수와 일치하는지 확인한 다음, 주요 필드가 예상과 맞는지 검사할 수 있습니다. 일반적인 검사 포인트는 다음과 같습니다: 경로가 올바른 디렉터리를 가리키는지, 이름과 확장자가 올바른지, 페이지 수가 생성되었는지, PDF 메타데이터 필드에 내용이 있는지, 생성 시간 및 수정 시간이 추후 파일 버전 판단에 용이한지 등입니다.
이후 정식 자료 목록을 만들어야 한다면 Excel에서 번호, 분류, 비고, 담당 부서, 검토 상태 등의 열을 계속 추가할 수 있습니다. 또는 필터 기능을 사용하여 주제, 작성자, 폴더 또는 페이지 수 범위별로 문서를 볼 수도 있습니다. 대량의 PDF 자료에 있어 Excel 내보내기는 작업의 끝이 아니라, 표준화된 파일 관리를 구축하는 시작점입니다.
자주 묻는 질문 및 주의사항
PDF 메타데이터와 파일 시스템 시간은 다른 종류의 정보입니다
내보낸 Excel에는 생성 시간, 수정 시간과 PDF 메타데이터의 생성 날짜가 동시에 나타날 수 있습니다. 전자는 일반적으로 파일 시스템 속성에서 비롯되어 디스크 상의 파일 시간 정보를 나타내고, 후자는 PDF 내부 메타데이터에서 비롯되어 PDF 생성 시 기록된 속성을 반영합니다. 둘은 일치할 수도 있고 다를 수도 있습니다. 보관 또는 감사 시 업무 규칙에 따라 어떤 필드를 사용할지 선택해야 합니다.
일부 PDF에 작성자, 제목 또는 키워드가 없는 이유
모든 PDF가 메타데이터를 완전하게 기입하는 것은 아닙니다. 많은 PDF가 생성 시 제목, 작성자, 주제 및 키워드를 설정하지 않거나, 다른 소프트웨어, 스캔 장치, 일괄 생성 프로그램에 의해 생성되어 메타데이터 필드가 비어 있거나 비표준적일 수 있습니다. 따라서 Excel에서 일부 PDF 메타데이터가 비어 있는 것은 드문 일이 아닙니다. 통계 도구는 기존 정보를 추출할 책임이 있지만, 모든 PDF 내부에 완전한 메타데이터가 존재한다고 보장할 수는 없습니다.
페이지 수는 어떤 통계에 사용될 수 있나요
페이지 수는 PDF 관리에서 매우 실용적인 필드입니다. 인쇄 비용 추정, 자료 완전성 확인, 읽기 작업량 계산, 비정상 파일 판단 등에 사용될 수 있습니다. 예를 들어, 동일한 시리즈 보고서 대부분이 약 10페이지인데 특정 파일만 1페이지라면, 페이지 누락이나 내보내기 불완전 여부를 추가로 확인할 가치가 있습니다. 페이지 수를 Excel로 내보낸 후 합계, 정렬, 필터링 등의 방법으로 빠르게 분석할 수 있습니다.
경로 필드가 중요한 이유
파일 이름이 같거나 유사한 PDF가 다른 폴더에 존재하는 경우는 흔합니다. 이름만 통계하면 이후에 파일 위치를 정확히 찾지 못할 수 있습니다. 전체 경로는 파일의 위치를 명확히 하여 여러 계층의 디렉터리에서 반복적으로 찾을 필요를 없애줍니다. 부서 간 협업, 프로젝트 납품 및 기록물 관리에 있어 경로 필드는 종종 자료 추적의 핵심입니다.
대량 파일 처리 전 소량으로 먼저 테스트하는 것이 좋습니다
해당 기능을 처음 사용하는 경우, 먼저 소량의 PDF를 선택하여 테스트한 후, 내보낸 필드와 형식이 요구사항에 맞는지 확인하고 나서 전체 폴더에 대한 일괄 통계를 수행하는 것이 좋습니다. 이를 통해 파일 범위, 저장 위치 또는 추가 정보 옵션을 조정해야 할 필요성을 미리 발견하여 재작업을 줄일 수 있습니다.
요약: PDF 정보 현황 파악을 수동 등록에서 일괄 내보내기로 전환
대량의 PDF 문서 정보 현황 파악의 어려움은 특정 필드의 복잡성보다는 파일 수가 많고, 필드가 분산되어 있으며, 수작업 반복이 많다는 데 있습니다. HeSoft Doc Batch Tool 의 파일 정보 통계 기능을 통해 PDF 경로, 이름, 확장자, 크기, 생성/수정 시간, 페이지 수 및 메타데이터를 한 번에 Excel로 집계하여, 흩어져 있던 폴더 내용을 구조화된 목록으로 만들 수 있습니다.
현재 PDF 자료 보관, 프로젝트 납품, 교육 자료 정리 또는 전자 파일 대장 작성으로 고민하고 계시다면, 본 문서의 단계에 따라 진행해 보십시오. 파일 정리에서 파일 정보 통계로 들어가 PDF 파일을 가져오고, PDF 파일 상세 정보를 선택한 다음, 저장 위치를 설정하고 처리를 시작하십시오. 최종적으로 얻은 Excel은 수동 입력 시간을 줄일 뿐만 아니라 파일 관리의 정확성과 추적 가능성도 향상시킬 것입니다.