Cet article explique comment utiliser HeSoft Doc Batch Tool pour extraire en masse le texte spécifié du contenu d'un document Word et l'utiliser comme nouveau nom de fichier. Dans l'exemple, le nom de fichier original est un nom de sujet en anglais, et l'en-tête de chaque document docx contient un numéro Document ID. En faisant correspondre le numéro via une expression régulière personnalisée, plusieurs fichiers Word peuvent être renommés en une seule fois avec leur ID correspondant, ce qui convient aux scénarios tels que l'archivage de documents, la numérotation de copies d'examen, la numérotation de contrats et l'organisation de documents de projet.
Dans le travail quotidien, les informations d'identification réelles de nombreux documents Word ne se trouvent pas dans le nom du fichier, mais dans le corps du document, l'en-tête, la couverture ou un emplacement fixe. Par exemple, dans un dossier, on peut voir une série de noms de fichiers en anglais : Cosmic_Distances.docx, Galaxies_and_the_Milky_Way.docx, Planets_and_Orbits.docx. Mais après avoir ouvert les documents, on découvre dans l'en-tête un code plus adapté à l'archivage, comme 2JMM01G après l'identifiant « Document ID ». Si l'on a affaire à seulement quelques fichiers, ouvrir, copier le code, revenir au dossier et renommer manuellement peut encore se faire. Cependant, lorsque le nombre de fichiers atteint plusieurs dizaines, centaines, voire plus, ce travail répétitif devient très inefficace, avec un risque accru d'erreurs de copie, d'omissions ou de suppression de l'extension.
Le problème que cet article vise à résoudre est le suivant : comment utiliser les capacités de traitement par lot d'un logiciel bureautique, via des caractères génériques ou des expressions régulières, pour extraire un texte spécifique du contenu d'un document Word et l'utiliser par lot comme nom de fichier Word. Ci-dessous, en prenant HeSoft Doc Batch Tool comme exemple, nous montrerons le processus complet pour extraire le code situé après « Document ID » dans un document docx et renommer le fichier Word par lot.
Scénarios applicables : Quels fichiers Word se prêtent au renommage par lot basé sur le contenu ?
Cette méthode convient à tous les scénarios de classement de documents Word où « le nom de fichier n'est pas normalisé, mais le document contient un identifiant stable ». Par exemple, les dossiers d'archives contiennent une référence dans l'en-tête, les contrats contiennent un numéro de contrat au début du corps, les documents d'examen ou de devoir contiennent un numéro d'étudiant, les documents de projet contiennent un code de projet sur la couverture, les supports de formation contiennent un code de cours. Tant que ces textes ont un format relativement fixe dans chaque document Word, une expression régulière peut être utilisée pour les identifier et écrire le contenu trouvé dans le nom du fichier.
Contrairement aux outils ordinaires de remplacement de noms de fichiers, ce processus ne traite pas simplement les noms de fichiers existants, mais lit le contenu du document Word, puis utilise une partie de ce texte pour nommer le fichier. Il est donc particulièrement adapté au renommage par lot de fichiers Word tels que docx et doc. Pour les employés de bureau qui doivent maintenir une base documentaire sur le long terme, rechercher des documents par code et unifier les règles de nommage, ce type de traitement par lot peut réduire considérablement les tâches répétitives.
Aperçu des résultats : Évolution des noms de fichiers avant et après traitement
Avant traitement, les noms de fichiers Word dans le dossier sont principalement des titres de documents ou des noms de sujets. Bien que lisibles, ces noms ne sont pas nécessairement adaptés à la gestion des archives, surtout lorsque l'entreprise s'appuie davantage sur des codes, des identifiants ou des références pour retrouver les fichiers. Le nom de fichier d'origine n'est alors plus assez pertinent.

En ouvrant l'un des documents Word, on peut voir en haut de la page un contenu au format fixe : « Document ID » suivi d'une chaîne de caractères composée de chiffres et de lettres majuscules. La zone encadrée en rouge dans la capture d'écran est la source du texte cible à extraire dans cet article. Autrement dit, il ne s'agit pas de renommer arbitrairement, mais d'extraire le code unique déjà présent dans le contenu Word pour l'utiliser comme nom de fichier.

Une fois le traitement par lots terminé, les noms de fichiers thématiques d'origine sont remplacés par les codes internes au document, par exemple 2JMM01G.docx, 4HE73OR5.docx, CK83CAEJ.docx, etc. L'extension reste en .docx, ce qui permet de continuer à ouvrir et modifier les fichiers avec Word.

Procédure : Utiliser des expressions régulières pour extraire le contenu Word et renommer
Étape 1 : Accéder à l'outil de nom de fichier et choisir de renommer un fichier Word en utilisant le contenu
Après avoir ouvert HeSoft Doc Batch Tool , sélectionnez « Nom de fichier » dans la classification des fonctions à gauche. L'interface principale affiche plusieurs cartes de fonctions liées au traitement par lot des noms de fichiers, incluant la recherche et le remplacement de mots-clés, l'insertion de texte, l'ajout de préfixes/suffixes, etc. Cet article nécessitant de lire le contenu Word et de l'utiliser pour nommer, il faut donc sélectionner « Renommer le fichier Word en utilisant son contenu ».

L'objectif de cette étape est d'entrer dans le flux de traitement dédié au renommage par le contenu des fichiers Word. Après avoir sélectionné la bonne fonction, l'interface suivante vous guidera, sous forme d'assistant, pour ajouter les fichiers, définir les règles de correspondance, spécifier l'emplacement de sauvegarde et lancer le traitement. Pour les utilisateurs peu familiers avec les expressions régulières, ce flux par étapes réduit le risque d'erreur de manipulation.
Étape 2 : Ajouter les fichiers docx ou doc à traiter
Une fois dans l'interface « Renommer le fichier Word en utilisant son contenu », vous arrivez d'abord à « Sélectionner les enregistrements à traiter ». En haut de la page, on voit des boutons d'action tels que « Ajouter un fichier », « Importer des fichiers depuis un dossier », « Vider », « Plus ». Dans l'exemple, 5 fichiers docx ont déjà été importés, et le tableau affiche le numéro d'ordre, le nom, le chemin, l'extension, la date de création et la date de modification.

Si vous n'avez qu'un petit nombre de documents Word à traiter, vous pouvez cliquer sur « Ajouter un fichier » pour les sélectionner un par un ; si les fichiers sont tous concentrés dans un même dossier, vous pouvez utiliser « Importer des fichiers depuis un dossier » pour les ajouter en une fois. Après l'ajout, vérifiez deux points essentiels : d'une part, que le nombre d'enregistrements correspond au nombre de fichiers à traiter ; d'autre part, que l'extension est bien le format Word cible, comme docx. Une fois la liste confirmée, cliquez sur le bouton « Suivant » en bas de la page.
Le résultat attendu de cette étape est que tous les fichiers Word à renommer apparaissent dans la liste du logiciel, avec le bon chemin d'accès. Si vous trouvez des fichiers qui n'ont pas besoin d'être traités, vous pouvez les supprimer via l'icône de suppression à droite de la liste, pour éviter de modifier par erreur le nom d'autres documents.
Étape 3 : Définir la zone de recherche sur le texte correspondant à une formule personnalisée
Après être passé à « Définir les options de traitement », l'interface propose un choix pour la zone de recherche. La capture d'écran montre des options telles que « Première ligne de texte », « Première image de code-barres », « Texte correspondant à une formule personnalisée ». Comme le code cible de l'exemple se situe après « Document ID » et que son format est assez clair, on sélectionne « Texte correspondant à une formule personnalisée ».
L'intérêt de cette option est que le logiciel ne va pas simplement prendre la première ligne ni se baser sur un emplacement fixe, mais va chercher dans le contenu du document Word le texte conforme à la règle fournie par votre expression régulière. Tant que le format de « Document ID » est cohérent d'un document à l'autre, le traitement par lot pourra extraire le code propre à chaque document.
Étape 4 : Saisir l'expression régulière pour correspondre au code après « Document ID »
Dans le champ de saisie « Expression régulière », la règle remplie dans l'exemple est :
(?<=Document ID:)[0-9A-Z]+

Cette expression peut se comprendre en la décomposant : (?<=Document ID:) signifie qu'il faut trouver une correspondance uniquement pour ce qui suit « Document ID: », sans inclure ce dernier dans le résultat ; [0-9A-Z]+ signifie un ou plusieurs chiffres et lettres majuscules. Ainsi, si le contenu Word contient « Document ID:2JMM01G », le texte final utilisé pour renommer sera « 2JMM01G ».
Il faut noter que les espaces, sauts de ligne ou symboles invisibles affichés dans Word peuvent affecter la correspondance. Si votre document contient « Document - ID », « DocumentID », « Document ID: » ou un espace après les deux points, vous devrez ajuster l'expression en fonction du texte réel. Par exemple, s'il y a un espace après le deux-points, la règle peut être ajustée pour correspondre au code après cet espace. Le principe de base est : le texte fixe en amont sert de repère, et la plage de caractères en aval sert à extraire la partie que l'on souhaite réellement utiliser comme nom de fichier.
Étape 5 : Choisir l'emplacement d'écriture du nom de fichier
En bas de la même page, on trouve l'option « Emplacement », qui comprend « Remplacer tout le nom du fichier », « À gauche du nom du fichier », « À droite du nom du fichier ». Dans l'exemple, « Remplacer tout le nom du fichier » est sélectionné, ce qui signifie que l'ID extrait remplacera directement le nom de fichier principal d'origine, l'extension .docx étant conservée.
Si votre objectif est que le code devienne le nom de fichier principal, par exemple 2JMM01G.docx, choisissez « Remplacer tout le nom du fichier ». Si vous souhaitez conserver le titre original et simplement ajouter le code à gauche ou à droite, vous pouvez choisir en fonction de vos besoins. Cependant, du point de vue de la normalisation de l'archivage, si le code est unique et plus pratique pour la recherche, remplacer tout le nom du fichier est généralement plus simple.
Étape 6 : Continuer à définir l'emplacement de sauvegarde et lancer le traitement
Après avoir terminé la règle de correspondance et le paramètre d'emplacement, cliquez sur « Suivant ». Comme on peut le voir dans le flux de l'interface, les étapes suivantes incluent « Définir l'emplacement de sauvegarde » et « Démarrer le traitement ». Il est conseillé, avant le traitement officiel, de sauvegarder en priorité dans un nouveau dossier, ou de s'assurer d'avoir une copie des fichiers originaux. Ainsi, même si le réglage de l'expression régulière ne donne pas le résultat escompté, vous pourrez revenir rapidement en arrière.
Une fois le traitement lancé, le logiciel va lire un par un les fichiers Word de la liste, rechercher le code suivant « Document ID » selon l'expression régulière, puis écrire le texte trouvé dans le nom du fichier. Une fois le traitement terminé, retournez dans le dossier pour constater que les noms de fichiers ont été changés par lot en les codes correspondants.
Questions fréquentes et points d'attention
1. Que faire si l'expression régulière ne trouve aucune correspondance ?
Vérifiez d'abord si le texte fixe dans le contenu Word est parfaitement identique à l'expression. Par exemple, la cible dans la capture d'écran est le code situé après « Document ID ». Si le document réel contient des deux-points chinois, des espaces supplémentaires, des sauts de ligne ou des différences de casse, la correspondance peut échouer. Il est conseillé d'ouvrir d'abord un échantillon de document Word, de copier le texte près de la cible, puis d'ajuster l'expression en fonction du format réel.
2. Que se passe-t-il si « Document ID » apparaît à plusieurs endroits ?
Si un document contient « Document ID » avec le même format à plusieurs endroits, le logiciel risque de prendre l'un ou l'autre résultat selon la règle de correspondance. Pour éviter toute incertitude, il faut essayer de rendre l'expression régulière plus précise, par exemple en combinant le texte fixe de l'en-tête, la longueur du code ou des mots-clés proches, afin que le résultat de la correspondance soit unique.
3. Peut-on traiter ainsi les fichiers .doc comme les .docx ?
L'exemple de la capture d'écran traite des fichiers docx. Pour les formats Word comme .doc, la capacité à lire le contenu dépend des fonctionnalités actuelles du logiciel et de l'état du fichier lui-même. En pratique, il est possible de faire d'abord un test sur un petit nombre, puis d'importer un grand volume de fichiers par lot. Qu'il s'agisse de .doc ou de .docx, il est conseillé de fermer d'abord les documents ouverts pour éviter qu'ils ne soient verrouillés et que cela empêche le renommage.
4. Attention aux caractères illégaux dans les noms de fichiers
Les noms de fichiers Windows ne peuvent pas contenir certains caractères spéciaux. Dans l'exemple, le code ne contient que des chiffres et des lettres majuscules, ce qui le rend parfaitement adapté comme nom de fichier. Si vous extrayez un nom de contrat, un titre ou un texte descriptif, faites attention à ce qu'il ne contienne pas de barres obliques, de deux-points, de points d'interrogation ou d'autres caractères inadaptés à un nom de fichier.
Résumé : Réduire le travail répétitif de renommage Word avec le traitement par lots
Grâce à la fonction « Renommer le fichier Word en utilisant son contenu » de HeSoft Doc Batch Tool , il est possible d'extraire par lot des textes tels que des codes, identifiants ou références internes aux documents Word, et de les écrire automatiquement dans le nom du fichier. Comparée à l'ouverture manuelle de chaque fichier docx pour copier-coller, cette méthode est plus adaptée au classement de grands volumes de fichiers et réduit les erreurs humaines.
Si vos noms de fichiers Word sont en désordre mais que le contenu du document contient un code ou un champ clé stable, il est conseillé de sélectionner d'abord quelques échantillons pour confirmer la régularité du texte, puis d'établir une règle de correspondance avec une expression régulière, et enfin de lancer l'exécution par lots. Cela permet de transformer une tâche de renommage de fichiers, habituellement chronophage, en un processus standardisé, rendant l'archivage, la recherche et la transmission des documents plus efficaces.