De nombreux noms de fichiers de documents Word ne peuvent pas être utilisés directement pour l'archivage, car le numéro vraiment utile se trouve souvent dans le corps du texte. Cet article prend l'identifiant de document comme exemple pour expliquer comment importer plusieurs fichiers docx dans HeSoft Doc Batch Tool , utiliser des expressions régulières pour rechercher le numéro dans le corps du texte, puis remplacer le résultat correspondant par le nouveau nom de fichier. Cette méthode convient aux scénarios de tri par lots de rapports, contrats, supports pédagogiques, dossiers d'archives, etc., et permet de réduire les opérations répétitives consistant à ouvrir chaque document Word, copier le numéro puis renommer manuellement.
Lors du traitement par lots de fichiers Word, un problème typique se rencontre fréquemment : les noms de fichiers dans le dossier sont des titres, des sujets ou des noms temporaires, mais l'archivage de l'unité, l'importation système ou la recherche ultérieure nécessitent d'utiliser le numéro unique interne du document comme nom de fichier. Par exemple, un lot de fichiers docx nommés Cosmic_Distances.docx, Planets_and_Orbits.docx, ne permet de voir que le sujet d'après le nom, sans pouvoir identifier directement l'ID du document. C'est seulement après avoir ouvert le Word que l'on découvre qu'un numéro comme Document ID: 2JMM01GJ est déjà inscrit en haut du corps du texte.
Si le nombre de fichiers est très faible, ouvrir manuellement Word, copier le numéro, fermer le document, coller et renommer peut sembler acceptable. Mais lorsque le nombre de fichiers augmente à plusieurs dizaines, centaines, voire plus, ce type de travail répétitif prend beaucoup de temps et engendre facilement des erreurs de copie, des oublis de renommage, des suppressions accidentelles d'extensions ou des doublons de noms de fichiers. Cet article présente une approche plus adaptée au contexte bureautique : utiliser HeSoft Doc Batch Tool , extraire le texte cible du corps du document Word via une expression régulière, et utiliser ce texte par lots comme nouveau nom de fichier Word.
Scénarios applicables : Extraire un numéro du corps d'un document Word comme nom de fichier
La méthode décrite ici convient à toutes les situations où le nom de fichier doit être déterminé par le contenu du document Word. Les scénarios courants incluent : utiliser le numéro de contrat dans le corps du texte comme nom de fichier docx, le numéro d'échantillon d'un rapport d'inspection comme nom de fichier, le numéro d'étudiant dans un devoir comme nom de fichier, le code projet sur la page de garde d'un document de projet comme nom de fichier, ou le Document ID dans du matériel d'archive comme nom de fichier.
Ces scénarios ont un point commun : l'information cible existe dans chaque document, mais le nom de fichier original n'est pas toujours standardisé ; l'information cible a généralement un préfixe, une position ou un format similaire, identifiable par des règles. L'avantage des expressions régulières est qu'elles n'exigent pas que chaque numéro soit identique, mais reconnaissent le contenu variable dans différents documents grâce à des règles de format.
Dans la capture d'écran, le dossier avant traitement contient 5 fichiers Word, tous avec l'extension docx, nommés avec des titres en anglais. Ces noms sont adaptés à la lecture, mais s'il faut trier, téléverser ou archiver selon le Document ID, une nomenclature basée sur les numéros est nécessaire.

En ouvrant l'un des documents Word, on voit que le Document ID: 2JMM01GJ est indiqué dans le cadre rouge en haut de la page. Ce « 2JMM01GJ » est le texte à extraire. Comme les autres fichiers Word ont un Document ID similaire, il suffit de définir une fois la règle de correspondance pour que le logiciel traite tous les fichiers par lots.

Aperçu du résultat : Les noms de fichiers docx passent des titres aux numéros du corps du texte
Une fois le traitement terminé, les noms de fichiers Word dans le dossier ne sont plus les titres anglais originaux, mais les numéros extraits du corps du texte. La capture d'écran montre que les 5 fichiers sont devenus respectivement 2JMM01GJ.docx, 4HE73OR5.docx, CK83CAEJ.docx, KR8IHZD6.docx et R6J2S6E6.docx.

Ce changement montre que le logiciel a accompli trois choses : premièrement, lire en lot le contenu de chaque document Word ; deuxièmement, trouver le numéro après le Document ID selon l'expression régulière ; troisièmement, utiliser le numéro trouvé comme nom de fichier tout en conservant l'extension Word originale. Pour les utilisateurs ayant besoin de traiter par lots des documents bureautiques comme docx ou doc, ce flux de travail est plus stable et mieux adapté aux tâches répétitives qu'un renommage manuel fichier par fichier.
Étape 1 : Trouver la fonction correspondante dans HeSoft Doc Batch Tool
Après avoir lancé HeSoft Doc Batch Tool , consultez d'abord la barre de navigation de gauche. La capture d'écran montre que le logiciel propose des catégories comme Nom de fichier, Nom de dossier, Organisation des fichiers, Outils Word, Outils Excel, Outils PowerPoint, Outils PDF, Outils texte, Outils image, se positionnant comme un logiciel de traitement par lots de fichiers bureautiques. Cette tâche consistant à modifier le nom de fichier Word, allez dans la catégorie Nom de fichier.
Dans la page des fonctions Nom de fichier, choisissez la 6ème option « Utiliser le contenu du fichier pour renommer un fichier Word ». La description de cette carte de fonction indique « Utiliser par lots un texte du contenu d'un fichier Word comme nom de ce fichier », ce qui correspond exactement à notre objectif de renommer les fichiers docx selon le Document ID.

Le point crucial ici est de ne pas sélectionner la mauvaise fonction. S'il s'agit juste de remplacer un mot-clé dans le nom de fichier, on peut utiliser « Rechercher et remplacer un mot-clé dans le nom de fichier » ; pour insérer un texte fixe, on peut choisir « Insérer du texte dans le nom de fichier ». Mais ici, la source du nommage est le contenu du corps du document Word, il est donc nécessaire d'utiliser « Utiliser le contenu du fichier pour renommer un fichier Word ».
Étape 2 : Importer les documents Word à renommer
Après être entré dans l'interface de la fonction, le nom de la tâche actuelle « Utiliser le contenu du fichier pour renommer un fichier Word » s'affiche en haut. La zone de boutons supérieure propose des opérations comme Ajouter des fichiers, Importer des fichiers d'un dossier, Vider, Plus, etc. Choisissez le mode d'importation selon la situation des fichiers : si les fichiers sont dispersés, utilisez « Ajouter des fichiers » ; s'ils sont concentrés dans un même dossier, « Importer des fichiers d'un dossier » est plus pratique.
La capture d'écran montre que 5 enregistrements ont été importés. Le tableau liste les informations comme le nom du fichier, le chemin, l'extension, la date de création, la date de modification ; on voit que ces fichiers se trouvent dans le répertoire D:\test avec l'extension docx. Le résumé en bas indique un total de 5 enregistrements.

Après l'importation, il est conseillé de faire une vérification : confirmez que les fichiers listés sont bien ceux à renommer, que le chemin est correct et qu'aucun fichier non pertinent n'a été ajouté à la tâche. Si un fichier ne doit pas être traité, utilisez l'icône de suppression dans la colonne Actions pour le retirer ; en cas d'erreur globale d'importation, videz la liste et resélectionnez. L'efficacité du traitement par lots est élevée, à condition que la liste à traiter soit précise.
Une fois la vérification terminée, cliquez sur le bouton « Étape suivante » en bas pour accéder aux paramètres des options de traitement. Ce processus guidé par assistant réduit les risques d'oubli de règles, permettant à l'utilisateur de terminer la tâche en suivant l'ordre : sélectionner des fichiers, définir les options, paramétrer l'emplacement de sauvegarde et lancer le traitement.
Étape 3 : Choisir « Texte correspondant à une formule personnalisée »
À la deuxième étape « Définir les options de traitement », il faut d'abord configurer la zone de recherche. L'interface montre trois options : Première ligne de texte, Première image de code-barres et Texte correspondant à une formule personnalisée. Dans ce cas, nous voulons extraire le numéro situé après le Document ID du corps du texte, et non utiliser directement la première ligne complète. Nous sélectionnons donc « Texte correspondant à une formule personnalisée ».

Le but de cette option est d'indiquer au logiciel de ne pas prendre une ligne fixe comme nom de fichier, mais de rechercher le texte cible dans le contenu du document selon la règle saisie par l'utilisateur. Ainsi, même si le numéro apparaît au milieu d'un texte, tant que le format environnant est stable, il peut être extrait avec précision.
Étape 4 : Saisir l'expression régulière pour le numéro de Document ID
Dans la zone de saisie de l'expression régulière, entrez la règle illustrée dans la capture d'écran :
(?<=Document ID:)[0-9A-Z]+
Cette règle est composée de deux parties. La première, (?<=Document ID:), définit la position de la correspondance ; elle signifie « faire correspondre uniquement le contenu situé après Document ID: ». La seconde partie, [0-9A-Z]+, définit le format du numéro ; elle signifie « faire correspondre un ou plusieurs chiffres ou lettres majuscules consécutifs ». Le résultat obtenu est ainsi le numéro comme 2JMM01GJ, 4HE73OR5, sans inclure le préfixe « Document ID: » lui-même dans le nom de fichier.
L'avantage des expressions régulières est leur flexibilité. Si votre document Word comporte un espace après « Document ID: », ou si le nom du champ est Report ID, Numéro de contrat, Numéro d'échantillon, il suffit d'ajuster l'expression en fonction du texte réel. Il est conseillé de sélectionner d'abord un fichier Word représentatif, d'observer le contenu fixe avant et après le texte cible, puis d'écrire la règle de correspondance.
Pour les utilisateurs peu familiers avec les expressions régulières, on peut la comprendre comme une condition de filtrage : « le contenu qui suit le texte fixe Document ID: et qui est une suite continue de chiffres et de lettres majuscules est ce que nous voulons utiliser comme nom de fichier ». Tant que chaque fichier Word respecte cette structure, le renommage par lots restera cohérent.
Étape 5 : Définir la position du numéro dans le nom de fichier
Dans la zone Position, on peut choisir : Remplacer tout le nom de fichier, À gauche du nom de fichier, À droite du nom de fichier. La capture d'écran montre le choix « Remplacer tout le nom de fichier », ce qui signifie que le numéro extrait remplacera directement le nom principal du fichier original.
En prenant l'exemple de Cosmic_Distances.docx, lorsque le logiciel trouve 2JMM01GJ dans le corps du texte, le nom de fichier devient 2JMM01GJ.docx. Le nom original « Cosmic_Distances » est remplacé, tandis que l'extension docx est conservée pour indiquer le format de document Word.
Si vous souhaitez conserver le titre original, vous pouvez choisir d'autres positions selon vos besoins. Par exemple, « À gauche du nom de fichier » peut créer une convention comme 2JMM01GJ_Cosmic_Distances.docx, et « À droite » peut générer Cosmic_Distances_2JMM01GJ.docx. Cependant, l'objectif de cet exemple est d'archiver entièrement selon le Document ID, donc « Remplacer tout le nom de fichier » est plus approprié.
Étape 6 : Définir l'emplacement de sauvegarde et exécuter le traitement par lots
Une fois les options de traitement configurées, continuez en cliquant sur « Étape suivante ». La barre de progression de l'interface montre que les étapes suivantes consistent à paramétrer l'emplacement de sauvegarde et à lancer le traitement. L'emplacement de sauvegarde détermine où les fichiers traités seront exportés. En pratique, si ces fichiers Word sont importants, il est conseillé de préparer une sauvegarde au préalable ou de choisir un nouvel emplacement de sortie. Ainsi, même si la règle d'expression régulière doit être ajustée, les fichiers originaux ne seront pas affectés.
Arrivé à la phase de lancement du traitement, vérifiez à nouveau trois informations clés : le nombre de fichiers à traiter est-il correct ? L'expression régulière correspond-elle bien au champ dans le corps du document Word ? L'option de position choisie est-elle bien « Remplacer tout le nom de fichier » ? Après confirmation, lancez le traitement. Le logiciel va lire un par un le contenu des fichiers docx de la liste et appliquer le résultat de la correspondance au nom de fichier.
Une fois terminé, ouvrez le dossier cible pour constater que les noms de fichiers ont été changés par lots en numéros de Document ID. En comparant les captures d'écran avant et après, le travail qui nécessitait auparavant d'ouvrir et de copier un par un peut maintenant être accompli par lots en une seule configuration de règle.
Questions fréquentes : À quoi faut-il faire attention lors de l'extraction de texte Word par expression régulière pour renommer ?
1. Pourquoi l'expression régulière ne trouve-t-elle pas le numéro ? La cause la plus fréquente est une incohérence dans l'écriture du champ. Par exemple, dans le document Word, on peut trouver Document · ID, un espace après Document ID, un deux-points chinois, ou bien le numéro contient des minuscules, des tirets, des underscores. Dans ce cas, vérifiez le texte source original avant de modifier la règle.
2. Peut-on utiliser n'importe quel texte correspondant comme nom de fichier ? Il n'est pas recommandé d'utiliser directement un texte contenant des caractères spéciaux comme nom de fichier. Les noms de fichiers Windows ont des restrictions sur certains caractères. Si le contenu trouvé contient des caractères comme /, :, *, ?, cela peut entraîner l'échec du renommage. Les textes de type numéro sont généralement plus adaptés comme noms de fichiers.
3. Que faire si plusieurs fichiers Word produisent le même numéro ? Si deux fichiers génèrent un nom de fichier strictement identique, un conflit de nom peut survenir. Avant le traitement, il est préférable de confirmer que le Document ID est unique. Si l'unicité ne peut être garantie, envisagez de placer le numéro à gauche ou à droite du nom de fichier original plutôt que de remplacer tout le nom.
4. Doit-on d'abord ouvrir tous les fichiers Word ? Il n'est pas nécessaire de les ouvrir un par un. Tant que les fichiers sont ajoutés à la liste du logiciel, celui-ci lira leur contenu lors du traitement par lots. Il est même conseillé de fermer les documents Word en cours d'édition pour éviter que le verrouillage du fichier ne perturbe le traitement.
5. Cette méthode ne convient-elle qu'aux numéros en anglais ? Non. L'exemple de capture d'écran montre des Document ID composés de lettres majuscules et de chiffres, d'où l'utilisation de [0-9A-Z]+. Si votre numéro est en chinois, en chiffres, en date ou tout autre format, vous pouvez écrire une règle de correspondance différente selon la situation réelle.
Petits conseils pour augmenter le taux de réussite
Avant de traiter un grand nombre de fichiers Word, il est conseillé de tester d'abord avec 3 à 5 documents échantillons. Les échantillons devraient idéalement couvrir différents numéros, titres et les éventuelles différences de format. Une fois le résultat du test correct, importez le dossier complet par lots. Cela permet de détecter rapidement si l'expression régulière est trop restrictive ou trop large.
De plus, avant le renommage par lots, assurez-vous que l'extension n'a pas été modifiée comme faisant partie du contenu du nom de fichier. Dans l'exemple de cet article, les fichiers sont toujours des fichiers docx après traitement, ce qui montre que le logiciel ne fait que remplacer le nom principal du fichier sans endommager le format Word. Pour les documents bureautiques destinés à l'archivage à long terme, il est très important de conserver la bonne extension.
Si le document contient plusieurs champs similaires, l'expression régulière doit être rendue aussi précise que possible. Par exemple, si le corps du texte contient à la fois un Document ID, un Image ID et un Section ID, un préfixe de localisation plus explicite doit être utilisé pour éviter de correspondre à un mauvais numéro. Plus la règle est claire, plus le traitement par lots est fiable.
Résumé : Standardiser les règles de nommage Word avec un outil de traitement par lots
Renommer des fichiers selon le contenu du corps d'un document Word revient essentiellement à transformer l'information structurée interne au document en un nom de fichier externe. Pour les documents bureautiques tels que les contrats, rapports, archives et matériels pédagogiques, cela améliore significativement l'efficacité de la recherche, de l'archivage et de la transmission.
Grâce à HeSoft Doc Batch Tool , l'utilisateur peut, dans la catégorie Nom de fichier, sélectionner « Utiliser le contenu du fichier pour renommer un fichier Word », importer plusieurs documents docx, choisir « Texte correspondant à une formule personnalisée », saisir l'expression régulière (?<=Document ID:)[0-9A-Z]+, puis choisir « Remplacer tout le nom de fichier », pour finalement transformer par lots le Document ID du corps des documents Word en nom de fichier.
Si vous traitez actuellement un lot de documents Word, docx ou doc nécessitant un nommage par numéro, il est conseillé de commencer par tester la règle avec un petit nombre d'échantillons, de confirmer que les résultats de la correspondance sont corrects, puis de l'exécuter par lots. Cela permet non seulement de réduire le temps passé à ouvrir et renommer manuellement, mais aussi de diminuer les erreurs de saisie humaine, rendant le travail d'organisation des fichiers plus standardisé et plus efficace.