많은 Word 문서의 파일명은 바로 보관용으로 사용하기 어려운 경우가 많으며, 실제 유용한 번호는 본문 안에 있는 경우가 대부분입니다. 본문에서는 Document ID를 예로 들어, HeSoft Doc Batch Tool 에 여러 docx 파일을 가져와 정규 표현식을 사용하여 본문 내 번호를 일치시키고, 일치된 결과를 새로운 파일명으로 덮어쓰는 방법을 설명합니다. 이 방법은 보고서, 계약서, 학습 자료, 기록 보관 파일 등 대량 정리 작업 시나리오에 적합하며, Word를 일일이 열어 번호를 복사하고 수동으로 이름을 변경하는 반복 작업을 줄일 수 있습니다.
Word 파일을 일괄 정리할 때 자주 마주치는 전형적인 문제가 있습니다. 폴더 내 파일 이름은 제목, 주제 또는 임시 명칭이지만, 부서별 보관, 시스템 가져오기 또는 향후 검색 시 문서 내부의 고유 번호를 파일 이름으로 사용해야 하는 경우입니다. 예를 들어 Cosmic_Distances.docx, Planets_and_Orbits.docx 같은 docx 파일들은 파일 이름만으로는 주제만 알 수 있고 문서 ID를 바로 알 수 없습니다. Word를 열어 보면 본문 상단에 Document ID: 2JMM01GJ 같은 번호가 적혀 있다는 것을 발견하게 됩니다.
파일 수가 적다면 수동으로 Word를 열고, 번호를 복사하고, 문서를 닫고, 붙여 넣어 이름을 변경하는 것도 그럭저럭 괜찮을 수 있습니다. 하지만 파일 수가 수십, 수백 개 이상으로 늘어나면 이러한 반복 작업은 많은 시간을 소모할 뿐만 아니라 복사 오류, 이름 변경 누락, 확장자 실수 삭제, 파일명 중복 등의 문제가 발생하기 쉽습니다. 본문에서는 사무 환경에 더 적합한 방법을 소개합니다. HeSoft Doc Batch Tool 를 사용하여 정규 표현식으로 Word 본문에서 목표 텍스트를 추출하고, 해당 텍스트를 새로운 Word 파일 이름으로 일괄 설정하는 방법입니다.
적용 시나리오: Word 본문에서 번호를 추출하여 파일 이름으로 사용
본문의 방법은 파일 이름을 Word 내용에 따라 결정해야 하는 모든 경우에 적용됩니다. 일반적인 시나리오로는 계약서 본문의 계약 번호를 docx 파일 이름으로 사용, 검사 보고서의 시료 번호를 파일 이름으로 사용, 학생 과제의 학번을 파일 이름으로 사용, 프로젝트 문서 표지의 프로젝트 코드를 파일 이름으로 사용, 기록 자료의 Document ID를 파일 이름으로 사용하는 것 등이 있습니다.
이러한 시나리오의 공통점은 각 문서에 목표 정보가 존재하지만 원본 파일 이름이 반드시 규칙적이지는 않다는 점이며, 목표 정보는 일반적으로 유사한 접두사, 위치 또는 형식을 가지므로 규칙으로 식별할 수 있다는 것입니다. 정규 표현식의 장점은 모든 번호가 완전히 동일할 필요 없이, 형식 규칙을 통해 서로 다른 문서의 변동 내용을 식별할 수 있다는 데 있습니다.
스크린샷의 처리 전 폴더에는 5개의 Word 파일이 있으며, 확장자는 모두 docx이고 파일 이름은 영문 제목으로 명명되었습니다. 이 명칭들은 읽기에는 적합하지만 문서 ID에 따라 정렬, 업로드 또는 보관해야 하는 경우에는 번호식 명칭으로 변환해야 합니다.

그중 하나의 Word 문서를 열어 보면 페이지 상단 빨간 상자에 Document ID: 2JMM01GJ이라고 표시된 것을 볼 수 있습니다. 여기서 2JMM01GJ이 바로 추출할 텍스트입니다. 다른 Word 파일에도 유사한 Document ID가 있으므로 한 번의 매칭 규칙 설정으로 소프트웨어가 모든 파일을 일괄 처리하도록 할 수 있습니다.

효과 미리보기: docx 파일 이름이 제목에서 본문 번호로 변경
처리가 완료되면 폴더 내 Word 파일 이름은 더 이상 원래의 영문 제목이 아니라 본문에서 추출된 번호로 변경됩니다. 스크린샷은 5개의 파일이 각각 2JMM01GJ.docx, 4HE73OR5.docx, CK83CAEJ.docx, KR8IHZD6.docx, R6J2S6E6.docx로 변경된 것을 보여줍니다.

이러한 변화는 소프트웨어가 세 가지 작업을 완료했음을 설명합니다. 첫째, 각 Word 문서 내용을 일괄 읽어 들였습니다. 둘째, 정규 표현식에 따라 Document ID 뒤의 번호를 찾았습니다. 셋째, 매칭된 번호를 파일 이름으로 작성하고 원래의 Word 확장자를 보존했습니다. docx, doc 등 사무용 문서를 일괄 처리해야 하는 사용자에게 이러한 흐름은 수동으로 하나씩 이름을 변경하는 것보다 더 안정적이며 반복 작업에 더 적합합니다.
조작 단계 1: HeSoft Doc Batch Tool 에서 해당 기능 찾기
HeSoft Doc Batch Tool 를 시작한 후, 먼저 왼쪽 내비게이션 바를 확인합니다. 스크린샷에서 소프트웨어가 파일 이름, 폴더 이름, 파일 정리, Word 도구, Excel 도구, PowerPoint 도구, PDF 도구, 텍스트 도구, 이미지 도구 등 분류를 제공하는 것을 볼 수 있으며, 사무 파일 일괄 처리를 지향하는 소프트웨어임을 알 수 있습니다. 이번 작업은 Word 파일 이름을 수정하는 것이므로 파일 이름 분류로 들어갑니다.
파일 이름 기능 페이지에서, 6번째 항목인 파일 내용을 사용하여 Word 파일 이름 바꾸기를 선택합니다. 이 기능 카드의 설명은 Word 파일 내용 중 일부 텍스트를 해당 파일의 파일 이름으로 일괄 지정하는 것이며, 본문에서 하려는 Document ID에 따른 docx 파일 이름 변경과 완전히 일치합니다.

이 단계에서 중요한 것은 기능을 잘못 선택하지 않는 것입니다. 단순히 파일 이름의 키워드를 대체하는 것이면 파일 이름에서 키워드 찾기 및 바꾸기를 사용할 수 있고, 파일 이름에 고정 텍스트를 삽입하려면 파일 이름에 텍스트 삽입을 선택할 수 있습니다. 그러나 본문의 명칭 출처는 Word 본문 내용이므로 파일 내용을 사용하여 Word 파일 이름 바꾸기로 진입해야 합니다.
조작 단계 2: 이름을 변경할 Word 문서 가져오기
기능 인터페이스에 진입하면 페이지 상단에 현재 작업 이름 ‘파일 내용을 사용하여 Word 파일 이름 바꾸기’가 표시됩니다. 상단 버튼 영역은 파일 추가, 폴더에서 파일 가져오기, 비우기, 더 보기 등의 작업을 제공합니다. 파일 보관 상황에 따라 가져오기 방식을 선택하면 됩니다. 파일이 분산되어 있을 때는 파일 추가를 사용하고, 파일이 동일한 폴더에 집중되어 있을 때는 폴더에서 파일 가져오기를 사용하는 것이 더 편리합니다.
스크린샷에는 이미 5개의 레코드가 가져와져 있습니다. 테이블에는 파일 이름, 경로, 확장자, 생성 시간, 수정 시간 등의 정보가 나열되어 있으며, 이 파일들이 모두 D:\test 디렉터리에 있고 확장자가 docx임을 볼 수 있습니다. 하단에는 레코드 수가 5개로 집계 표시됩니다.

가져온 후에는 먼저 확인 작업을 권장합니다. 목록의 파일이 모두 이번에 이름을 변경해야 하는 Word 문서인지, 경로가 정확한지, 무관한 파일이 작업에 추가되지 않았는지 확인합니다. 처리하지 말아야 할 파일이 발견되면 작업 열의 삭제 아이콘을 사용하여 제거하고, 전체 가져오기가 잘못되었다면 비운 후 다시 선택할 수 있습니다. 일괄 처리의 효율은 매우 높지만, 전제 조건은 처리 대기 목록이 정확해야 한다는 것입니다.
확인이 끝나면 인터페이스 하단의 다음 단계를 클릭하여 처리 옵션 설정으로 진입합니다. 이 마법사식 흐름은 규칙 누락 설정 상황을 줄여 주어, 사용자가 파일 선택, 처리 옵션 설정, 저장 위치 설정, 처리 시작 순서로 작업을 완료하게 합니다.
조작 단계 3: 사용자 정의 수식과 일치하는 텍스트 선택
2단계 처리 옵션 설정에 들어가면, 먼저 검색 영역을 설정해야 합니다. 인터페이스에서 첫 번째 줄 텍스트, 첫 번째 바코드 이미지, 사용자 정의 수식과 일치하는 텍스트 세 가지 옵션을 볼 수 있습니다. 본 사례는 본문에서 Document ID 뒤의 번호를 추출해야 하며 첫 번째 줄의 전체 텍스트를 직접 사용하는 것이 아니므로 사용자 정의 수식과 일치하는 텍스트를 선택합니다.

이 옵션을 선택하는 목적은 소프트웨어가 단순히 고정된 행을 파일 이름으로 사용하도록 하는 것이 아니라, 사용자가 입력한 규칙에 따라 문서 내용에서 목표 텍스트를 찾도록 지시하는 것입니다. 이렇게 하면 번호가 한 문단의 텍스트 안에 나타나더라도 앞뒤 형식이 안정적이기만 하면 정확하게 추출될 수 있습니다.
조작 단계 4: Document ID 번호와 일치하는 정규 표현식 입력
정규 표현식 입력 상자에 스크린샷과 같은 규칙을 입력합니다:
(?<=Document ID:)[0-9A-Z]+
이 규칙은 두 부분으로 구성됩니다. 첫 번째 부분 (?<=Document ID:) 는 매칭 위치를 제한하는 것으로, Document ID: 뒤에 위치한 내용만 일치시킴을 의미합니다. 두 번째 부분 [0-9A-Z]+ 는 번호 형식을 제한하는 것으로, 하나 이상의 연속된 숫자 또는 대문자 영문자를 일치시킴을 의미합니다. 이렇게 얻은 결과는 2JMM01GJ, 4HE73OR5 같은 번호이며, Document ID: 자체를 파일 이름에 포함시키지 않습니다.
정규 표현식의 장점은 유연성입니다. 만약 당신의 Word 문서에 Document ID: 뒤에 공백이 있거나, 필드 이름이 Report ID, 계약 번호, 시료 번호 등으로 되어 있다면 실제 텍스트에 맞춰 표현식을 조정해야 합니다. 대표적인 Word 파일 하나를 골라 목표 텍스트 앞뒤의 고정 내용을 관찰한 후 매칭 규칙을 작성하는 것이 좋습니다.
정규 표현식에 익숙하지 않은 사용자에게는 이를 하나의 필터 조건으로 이해할 수 있습니다. 앞에 Document ID:라고 고정적으로 쓰여 있고, 그 뒤에 연속적으로 나타나는 숫자와 대문자가 우리가 파일 이름으로 가져올 내용입니다. 각 Word 파일이 이러한 구조에 부합하기만 하면 일괄 명명이 일관성을 유지할 수 있습니다.
조작 단계 5: 파일 이름에서의 번호 위치 설정
위치 영역에서는 전체 파일 이름 덮어쓰기, 파일 이름 왼쪽에 추가하기, 파일 이름 오른쪽에 추가하기를 선택할 수 있습니다. 스크린샷에서는 전체 파일 이름 덮어쓰기를 선택했는데, 이는 추출된 번호가 원래 파일 주 명칭을 직접 대체한다는 의미입니다.
Cosmic_Distances.docx를 예로 들면, 소프트웨어가 본문에서 2JMM01GJ를 매칭한 후 파일 이름은 2JMM01GJ.docx로 변경됩니다. 원래의 Cosmic_Distances는 대체되고, 확장자 docx는 여전히 Word 문서 형식을 나타내는 데 사용됩니다.
원본 제목을 유지하려면 실제 필요에 따라 다른 위치를 선택할 수도 있습니다. 예를 들어 파일 이름 왼쪽에 추가하면 2JMM01GJ_Cosmic_Distances.docx 같은 명명 방식을, 파일 이름 오른쪽에 추가하면 Cosmic_Distances_2JMM01GJ.docx 같은 명명 방식을 만들 수 있습니다. 하지만 스크린샷 사례의 목표는 완전히 Document ID에 따라 보관하는 것이므로 전체 파일 이름 덮어쓰기가 요구 사항에 더 부합합니다.
조작 단계 6: 저장 위치 설정 및 일괄 처리 실행
처리 옵션 설정을 완료한 후, 계속해서 다음 단계를 클릭합니다. 인터페이스 진행 표시줄은 이후 저장 위치 설정과 처리 시작임을 보여줍니다. 저장 위치는 처리된 파일이 어디로 출력될지를 결정합니다. 실제 작업에서는 해당 Word 파일들이 중요할 경우, 먼저 백업을 준비하거나 새로운 출력 위치를 선택하여 처리하는 것을 권장합니다. 이렇게 하면 정규식 규칙을 조정해야 해도 원본 파일에 영향을 주지 않습니다.
처리 시작 단계에 진입하면, 세 가지 핵심 정보를 다시 확인합니다: 처리할 파일 수가 올바른지, 정규 표현식이 Word 본문의 필드와 일치하는지, 위치 옵션이 예상했던 전체 파일 이름 덮어쓰기인지. 확인 후 처리를 시작하면, 소프트웨어는 목록에 따라 각 docx 파일 내용을 읽어 들이고 매칭 결과를 파일 이름에 적용합니다.
완료 후 대상 폴더를 열면 파일 이름이 일괄적으로 Document ID 번호로 변경된 것을 볼 수 있습니다. 처리 전후의 스크린샷을 비교해 보면, 원래는 일일이 열어서 복사해야 했던 작업을 이제 한 번의 규칙 설정으로 일괄 완료할 수 있습니다.
자주 발생하는 문제: 정규식으로 Word 텍스트를 추출하여 이름 변경 시 주의할 점
1. 정규 표현식이 왜 번호를 매칭하지 못하나요? 가장 흔한 원인은 필드 표기법이 일치하지 않기 때문입니다. 예를 들어 Word 내에 실제로 Document · ID, Document ID 뒤에 공백이 있거나, 콜론이 전각 콜론이거나, 번호에 소문자, 대시(-), 밑줄(_)이 포함된 경우입니다. 이런 상황이 발생하면 본문 원문을 확인한 후 규칙을 수정해야 합니다.
2. 파일 이름에 임의의 매칭 텍스트를 사용할 수 있나요? 특수 기호가 포함된 텍스트를 파일 이름으로 직접 사용하는 것은 권장하지 않습니다. Windows 파일 이름은 특정 문자에 제한이 있어, 매칭 내용에 슬래시, 콜론, 별표, 물음표 등의 문자가 포함되면 이름 변경이 실패할 수 있습니다. 번호류 텍스트가 일반적으로 파일 이름에 더 적합합니다.
3. 여러 Word 파일에서 동일한 번호가 추출되면 어떻게 하나요? 두 파일이 완전히 동일한 파일 이름을 생성하면 이름 중복 충돌이 발생할 수 있습니다. 처리 전에 Document ID가 고유성을 가지는지 확인하는 것이 좋습니다. 고유성을 보장할 수 없다면, 번호를 원본 파일 이름 왼쪽이나 오른쪽에 배치하고 전체 파일 이름을 덮어쓰지 않는 것을 고려할 수 있습니다.
4. 모든 Word 파일을 먼저 열어야 하나요? 하나씩 열 필요는 없습니다. 파일이 소프트웨어 목록에 추가되기만 하면 소프트웨어가 일괄 처리 시 내용을 읽어 들입니다. 오히려 편집 중인 Word 문서는 파일 점유로 인한 처리 영향을 피하기 위해 닫는 것이 좋습니다.
5. 이 방법은 영문 번호에만 적합한가요? 아닙니다. 스크린샷 예시는 대문자와 숫자로 구성된 Document ID이므로 [0-9A-Z]+를 사용했습니다. 만약 번호가 중국어, 숫자, 날짜 또는 기타 형식이라면 실제 상황에 따라 다른 매칭 규칙을 작성할 수 있습니다.
성공률을 높이기 위한 작은 제안
많은 양의 Word 파일을 정식으로 처리하기 전에, 먼저 3~5개의 샘플 문서로 테스트하는 것이 좋습니다. 샘플 문서는 다양한 번호, 다른 제목 및 존재할 수 있는 형식 차이를 포함하는 것이 가장 좋습니다. 테스트 결과가 정확하면 전체 폴더를 일괄 가져옵니다. 이렇게 하면 정규 표현식이 너무 좁거나 너무 넓은지 조기에 발견할 수 있습니다.
또한, 일괄 이름 변경 전에 확장자가 파일 이름 내용으로 수정되지 않았는지 확인해야 합니다. 본문 예시에서 처리 후에도 여전히 docx 파일인 것은 소프트웨어가 파일 주 명칭만 대체했을 뿐 Word 형식을 파괴하지 않았음을 설명합니다. 장기간 보관해야 하는 사무 문서의 경우 올바른 확장자를 유지하는 것이 매우 중요합니다.
문서 내부에 유사한 필드가 여러 개 존재하는 경우에도 정규 표현식을 최대한 정확하게 만들어야 합니다. 예를 들어 본문에 Document ID 외에도 Image ID, Section ID가 있다면, 잘못된 번호와 일치하는 것을 피하기 위해 더욱 명확한 접두사로 위치를 지정해야 합니다. 규칙이 명확할수록 일괄 처리가 더 신뢰할 수 있게 됩니다.
요약: 일괄 처리 도구로 Word 명명 규칙 표준화하기
Word 본문 내용에 따라 파일 이름을 변경하는 것은 본질적으로 문서 내부의 구조화된 정보를 외부 파일 이름으로 변환하는 것입니다. 계약서, 보고서, 기록물, 교육 자료 등의 사무 파일에 있어 이는 검색, 보관 및 인계 효율을 크게 향상시킬 수 있습니다.
HeSoft Doc Batch Tool 를 통해 사용자는 파일 이름 분류에서 파일 내용을 사용하여 Word 파일 이름 바꾸기를 선택하고, 여러 docx 문서를 가져오고, 사용자 정의 수식과 일치하는 텍스트를 선택하고, 정규 표현식 (?<=Document ID:)[0-9A-Z]+를 입력한 후, 전체 파일 이름 덮어쓰기를 선택하여 최종적으로 Word 본문의 Document ID를 파일 이름으로 일괄 변경할 수 있습니다.
번호에 따라 명명해야 하는 Word, docx 또는 doc 자료를 처리 중이라면, 먼저 소량의 샘플로 규칙을 테스트 시작하여 매칭 결과가 오류 없는지 확인한 후 일괄 실행하는 것이 좋습니다. 이렇게 하면 반복적으로 열고 수동으로 이름을 변경하는 시간을 줄일 수 있을 뿐만 아니라 수동 입력 오류도 낮추어 파일 정리 작업을 더욱 규범화되고 효율적으로 만들 수 있습니다.