Cet article explique comment utiliser HeSoft Doc Batch Tool pour extraire en masse du texte spécifié du contenu de plusieurs documents Word et l'utiliser comme nouveau nom de fichier. Dans l'exemple, les fichiers docx initialement nommés avec des titres en anglais contiennent un ID de document en haut du contenu principal. Après avoir extrait ce numéro par correspondance d'expression régulière, les noms de fichiers peuvent être modifiés en une seule fois en numéros tels que 2JMM01GJ, 4HE73OR5, etc. Cela convient aux scénarios où les contrats, rapports, archives et copies d'examen doivent être archivés selon des numéros internes.
Lors de l'organisation d'un grand nombre de documents Word, les informations d'identification réelles de nombreux fichiers ne se trouvent pas dans le nom du fichier, mais sont inscrites dans le corps du texte, l'en-tête, la couverture ou le début du document. Par exemple, un lot de fichiers docx nommés à l'origine Cosmic_Distances.docx, Galaxies_and_the_Milky_Way.docx ressemblent à des titres ordinaires, mais chaque document Word a un ID de document plus adapté à l'archivage en haut du corps du texte. Si vous ouvrez manuellement chaque fichier Word, copiez le numéro, fermez le document et retournez dans le dossier pour le renommer, quelques dizaines de fichiers peuvent encore être traités, mais des centaines de fichiers doc et docx deviennent un travail très répétitif et sujet aux erreurs.
Le problème que cet article vise à résoudre est le suivant : utiliser des caractères génériques ou des expressions régulières pour extraire en masse un texte spécifique du contenu d'un document Word, puis renommer le fichier Word avec le résultat. Voici un exemple avec HeSoft Doc Batch Tool pour montrer comment extraire l'ID de document du corps d'un document Word et l'utiliser pour renommer le fichier en masse, réalisant ainsi un nommage automatique basé sur le contenu du document.
Scénarios d'application : Quels fichiers Word se prêtent au renommage en masse par le contenu ?
Cette méthode est particulièrement adaptée aux documents dont les noms ne sont pas normalisés mais qui contiennent un numéro fixe, un champ fixe ou un texte au format fixe. Par exemple, un numéro de projet en haut du rapport, un numéro de contrat sur la première page, un numéro d'étudiant dans un devoir, un numéro d'échantillon dans un rapport de test, ou un ID de document dans un dossier d'archives. Tant que ces informations sont écrites de manière relativement cohérente dans plusieurs fichiers Word, une extraction en masse par expression régulière est possible.
Comme le montre l'exemple de capture d'écran, avant le traitement, il y a 5 documents Word dans le dossier, avec des noms de sujets en anglais et l'extension docx. Bien qu'ils expriment le thème du contenu, ils ne facilitent pas la recherche, l'archivage et l'importation système par numéro interne. Si les besoins métier exigent que le nom du fichier soit identique au numéro de document, le renommage manuel est très fastidieux.

En ouvrant l'un des documents Word, on peut voir une ligne de texte en haut : Document ID: 2JMM01GJ. Ici, 2JMM01GJ est le contenu que nous voulons extraire et utiliser comme nom de fichier. Comme le numéro est composé de lettres majuscules et de chiffres, et qu'il suit « Document ID: », il est très bien adapté à une correspondance par expression régulière.

Aperçu du résultat : Qu'est-ce qui change dans les noms de fichiers après traitement ?
Avant traitement, les noms sont Cosmic_Distances.docx, Galaxies_and_the_Milky_Way.docx, Planets_and_Orbits.docx, Stars_and_Life_Cycles.docx, The_Expanding_Universe.docx. Ces noms sont lisibles, mais si le processus suivant nécessite un téléversement par ID de document, un archivage par numéro ou une comparaison, une nouvelle recherche manuelle est nécessaire.
Après traitement, HeSoft Doc Batch Tool générera en masse de nouveaux noms de fichiers basés sur le numéro correspondant dans le corps de chaque document Word. Les 5 fichiers docx de l'exemple sont renommés 2JMM01GJ.docx, 4HE73OR5.docx, CK83CAEJ.docx, KR8IHZD6.docx, R6J2S6E6.docx. L'extension est conservée en .docx, seul le nom principal du fichier change.

La valeur clé de ce résultat est qu'il n'est plus nécessaire d'ouvrir les documents Word un par un pour copier le contenu, ni de modifier les noms un par un dans l'explorateur de fichiers. Tant que les règles sont correctement définies, le logiciel peut lire en masse le contenu des fichiers Word, faire correspondre le texte et renommer les fichiers en masse, réduisant ainsi le travail répétitif et les erreurs de saisie humaine.
Étape 1 : Accéder à l'outil Nom de fichier et choisir la fonction de renommage par contenu Word
Après avoir ouvert HeSoft Doc Batch Tool , dans la classification des outils à gauche, vous pouvez voir les modules Nom de fichier, Nom de dossier, Organisation de fichiers, Outils Word, Outils Excel, Outils PowerPoint, Outils PDF, etc. Comme l'objectif est de modifier les noms de fichiers, commencez par entrer dans la catégorie Nom de fichier à gauche.
Dans la liste des fonctions liées au nom de fichier, choisissez « Renommer les fichiers Word en utilisant le contenu du fichier ». La description de la fonction dans la capture d'écran indique « Renommer en masse les fichiers Word en utilisant un certain texte de leur contenu comme nom de fichier », ce qui correspond exactement au besoin de cet article : extraire l'ID de document du corps du texte Word et l'utiliser pour remplacer le nom de fichier original.

Le but de cette étape est d'accéder au bon point d'entrée de la fonction de traitement par lot. De nombreux utilisateurs pensent à tort qu'il faut d'abord chercher et remplacer dans Word, ou renommer en masse avec l'explorateur de fichiers. Mais si le nommage est basé sur le contenu du document, les outils de remplacement de nom de fichier ordinaires ne peuvent généralement pas lire le corps du texte. Choisir ici la fonction dédiée « Renommer par contenu Word » permet au logiciel d'identifier le texte dans les documents docx.
Étape 2 : Ajouter les fichiers Word à traiter en masse
Une fois dans l'interface « Renommer les fichiers Word en utilisant le contenu du fichier », vous pouvez voir en haut les boutons d'opération comme Ajouter des fichiers, Importer des fichiers d'un dossier, Vider, Plus, etc. La zone centrale est la liste des fichiers à traiter, avec un tableau listant des informations comme le N°, le Nom, le Chemin, l'Extension, la Date de création, la Date de modification et l'Action.
S'il n'y a qu'un petit nombre de fichiers spécifiques à traiter, vous pouvez cliquer sur Ajouter des fichiers ; si un dossier entier contient des documents Word à traiter uniformément, vous pouvez utiliser Importer des fichiers d'un dossier. La capture d'écran montre 5 fichiers docx importés, situés dans le répertoire D:\test, avec un nombre d'enregistrements de 5.

Le résultat attendu de cette étape est que tous les fichiers Word à renommer apparaissent dans la liste. Il est conseillé de vérifier le nombre, l'extension et le chemin des fichiers avant de passer à l'étape suivante. Pour les fichiers Word, les extensions courantes sont .docx et .doc. Dans l'exemple de capture d'écran, ils sont tous .docx, donc l'extraction par expression régulière et le renommage seront exécutés sur ces enregistrements importés.
Si des fichiers non désirés se sont glissés dans la liste, vous pouvez les supprimer un par un via l'icône de suppression dans la colonne Action ; en cas d'erreur d'importation, vous pouvez utiliser Vider puis réimporter. Cela évite de renommer accidentellement des fichiers non concernés.
Étape 3 : Définir la zone de recherche sur « Texte correspondant à une formule personnalisée »
Après avoir cliqué sur « Étape suivante » en bas, vous entrez dans les options de traitement. L'interface indique que vous êtes à l'étape 2, pour configurer principalement la zone de recherche, l'expression régulière et la position du nom de fichier. Comme nous ne prenons pas simplement la première ligne de texte ou la première image de code-barres, mais que nous voulons extraire le numéro après « Document ID: », nous devons choisir « Texte correspondant à une formule personnalisée ».

Après avoir sélectionné « Texte correspondant à une formule personnalisée », remplissez la règle de correspondance dans la zone de saisie de l'expression régulière. L'expression dans la capture d'écran est :
(?<=Document ID:)[0-9A-Z]+
Cette expression peut être comprise comme : trouver un texte continu composé de chiffres de 0 à 9 et de lettres majuscules de A à Z, situé immédiatement après « Document ID: ». Le début (?<=Document ID:) est une assertion arrière positive, utilisée pour limiter la position de la correspondance ; la suite [0-9A-Z]+ signifie correspondre à un ou plusieurs chiffres ou lettres majuscules. Le contenu final qui servira de nom de fichier est le numéro lui-même, par exemple 2JMM01GJ, et non pas le texte entier « Document ID: ».
Si la formulation des champs dans vos documents Word est différente, vous devez ajuster l'expression en fonction du contenu réel. Par exemple, si le champ est « Numéro:ABC123 », la règle ne peut pas copier « Document ID: » ; si le numéro contient des lettres minuscules ou des tirets, il faut également étendre la plage de caractères. Le point clé de cet exemple n'est pas d'utiliser un numéro fixe, mais de faire correspondre précisément le texte cible dans le corps du document Word via une expression régulière.
Étape 4 : Choisir « Remplacer le nom de fichier entier »
En bas de la même interface « Options de traitement », vous pouvez voir les options de position : Remplacer le nom de fichier entier, À gauche du nom de fichier, À droite du nom de fichier. Dans la capture d'écran, « Remplacer le nom de fichier entier » est sélectionné.
« Remplacer le nom de fichier entier » signifie que l'ID de document trouvé remplacera directement le nom principal du fichier original. Par exemple, après que Cosmic_Distances.docx ait été mis en correspondance avec 2JMM01GJ, le nouveau nom de fichier deviendra 2JMM01GJ.docx. L'extension .docx ne fera pas partie du numéro à cause de ce paramètre ; elle est généralement conservée.
Si votre besoin métier est simplement d'ajouter le numéro devant le nom original, vous pouvez choisir « À gauche du nom de fichier » ; si vous souhaitez conserver le titre original et ajouter le numéro à la fin, vous pouvez choisir « À droite du nom de fichier ». Mais l'objectif de cet exemple est d'archiver entièrement par numéro de document, donc choisir « Remplacer le nom de fichier entier » est le plus direct.
Étape 5 : Continuer à définir l'emplacement de sauvegarde et commencer le traitement
Après avoir renseigné l'expression régulière et la position, cliquez sur Suivant. La barre de progression en haut de l'interface indique qu'il reste deux étapes : « Définir l'emplacement de sauvegarde » et « Démarrer le traitement ». Le paramètre d'emplacement de sauvegarde sert à décider où les résultats seront exportés ; vous pouvez choisir selon vos habitudes de travail. Par mesure de sécurité, avant un renommage en masse, il est conseillé d'utiliser un répertoire de sortie séparé ou de sauvegarder les fichiers originaux à l'avance pour éviter d'affecter les données sources si la règle ne correspond pas aux attentes.
Une fois dans la phase « Démarrer le traitement », vérifiez que le nombre de fichiers à traiter, la règle de nommage et l'emplacement de sauvegarde sont corrects, puis exécutez le traitement. Le logiciel lira un par un le contenu des fichiers Word de la liste, cherchera le texte correspondant selon l'expression régulière, et générera un nouveau nom de fichier selon l'option de position choisie. Une fois le traitement terminé, retournez dans le dossier pour voir que les noms de fichiers sont passés en masse des titres anglais aux IDs de document.
Explication de l'écriture de l'expression régulière : Pourquoi peut-elle correspondre au numéro après Document ID ?
Dans ce cas, le champ fixe en haut de la page Word est « Document ID: », et la partie variable est le numéro qui suit. L'expression régulière utilise le champ fixe pour se positionner, puis extrait la partie variable, ce qui est une approche très courante dans le renommage en masse.
(?<=Document ID:) signifie qu'il ne correspond qu'au contenu situé après « Document ID: », mais sans inclure « Document ID: » lui-même dans le résultat. [0-9A-Z]+ signifie que le numéro est composé uniquement de majuscules et de chiffres, et peut comporter un ou plusieurs caractères. En combinant les deux, le logiciel peut obtenir des numéros différents pour chaque document Word.
Si le résultat de la correspondance est vide, il faut généralement vérifier trois aspects : premièrement, si le champ réel dans Word est cohérent avec l'expression, par exemple si les deux-points sont anglais ou chinois ; deuxièmement, s'il y a un espace après le champ, auquel cas il peut être nécessaire d'ajouter une correspondance pour les caractères blancs dans l'expression ; troisièmement, si le numéro contient des lettres minuscules, des tirets bas ou d'autres symboles. Plus l'expression régulière correspond étroitement au texte réel, plus le résultat du renommage en masse sera stable.
Questions fréquentes et remarques
1. Faut-il fermer les documents Word avant le traitement ? Il est conseillé de fermer les fichiers Word en cours de traitement. Lorsqu'un fichier est utilisé par Word, le logiciel de traitement par lots peut ne pas pouvoir le lire ou écrire normalement ; fermer le document réduit le risque d'échec.
2. Les fichiers .doc et .docx peuvent-ils tous être traités selon cette logique ? L'exemple de capture d'écran de cet article concerne des fichiers .docx. Pour d'autres formats Word comme les fichiers .doc, la possibilité de traitement dépend de l'importation et de la reconnaissance réelles par le logiciel. Après avoir ajouté les fichiers, vérifiez l'extension dans la liste pour confirmer qu'ils ont bien été ajoutés.
3. Que faire si plusieurs documents correspondent au même numéro ? Évitez de générer des noms de fichiers en double lors d'un renommage en masse. Il est préférable de vérifier par échantillonnage si les numéros de document sont uniques avant le traitement. Si des numéros en double existent professionnellement, envisagez de ne pas remplacer le nom entier mais d'ajouter le numéro à gauche ou à droite du nom pour réduire le risque de doublon.
4. Que faire si l'expression régulière ne trouve rien ? Ouvrez d'abord un exemple de document Word, confirmez l'écriture exacte du champ cible, puis modifiez l'expression en conséquence. Par exemple, la présence d'espaces entre « Document » et « ID », après les deux-points, ou des caractères spéciaux dans le numéro, affecteront le résultat.
5. Pourquoi ne pas utiliser directement la fonction Rechercher de Word ? La fonction Rechercher de Word ne peut que vous aider à localiser le contenu dans un seul document, mais ne peut pas appliquer directement le contenu trouvé aux noms de fichiers en masse. La valeur de HeSoft Doc Batch Tool est de combiner la lecture du contenu, la correspondance de texte, la génération de noms de fichiers et le traitement par lots en un seul flux.
Résumé : Utiliser le contenu pour piloter le nommage des fichiers et réduire le travail répétitif de renommage
Lorsque le nom du fichier et le numéro interne du document ne correspondent pas, le renommage manuel est souvent inefficace et source d'erreurs. Avec la fonction « Renommer les fichiers Word en utilisant le contenu du fichier » de HeSoft Doc Batch Tool , vous pouvez extraire des informations comme l'ID de document, le numéro de contrat, le numéro de rapport ou le numéro d'étudiant du corps des documents Word pour générer en masse des noms de fichiers normalisés.
L'exemple de cet article utilise l'expression régulière (?<=Document ID:)[0-9A-Z]+ pour faire correspondre le numéro dans les documents Word et choisit « Remplacer le nom de fichier entier », renommant finalement 5 fichiers docx uniformément avec ces numéros. Pour les utilisateurs qui doivent organiser un grand nombre de documents Word, .docx, .doc, cette méthode de traitement par lots peut réduire considérablement les opérations répétitives d'ouverture, copie, collage et renommage. Il vous est conseillé de tester d'abord la règle sur un petit nombre de documents échantillons, de confirmer que le résultat est correct, puis d'exécuter le traitement par lots sur le dossier complet.