Al crear una lista de varios documentos PDF, si solo se depende del explorador de recursos y la introducción manual, es difícil obtener simultáneamente la ruta completa, el número de páginas, el tamaño, la fecha de creación, la fecha de modificación, así como el título del PDF, autor, palabras clave y otra información. Este artículo describe el uso de la función de estadísticas de información de archivos de HeSoft Doc Batch Tool , importando PDF por lotes y seleccionando la información detallada del archivo PDF para generar automáticamente una lista en Excel, adecuada para la organización de archivos, inventario de materiales, entrega de proyectos y verificación de propiedades de PDF.
"¿Cómo hacer una lista de varios documentos PDF?" Esta es una pregunta muy común en la gestión documental. Muchos usuarios tienen un lote de materiales PDF y desean organizarlos en una tabla de Excel que incluya no solo el nombre del archivo, sino también la ruta, el tamaño, la fecha de creación, la fecha de modificación, el número de páginas e incluso campos de metadatos del PDF como título, autor, tema y palabras clave. Si se hace manualmente, se requiere cambiar constantemente entre carpetas, el lector de PDF y Excel, lo cual es muy ineficiente.
Lo más importante es que la organización manual difícilmente garantiza la consistencia. Por ejemplo, algunos copian la ruta relativa, otros la ruta completa; algunos archivos registran el número de páginas, otros se olvidan de rellenarlo; algunos campos de metadatos no se verifican, lo que provoca que se descubra información faltante durante el archivado posterior. Para resolver este problema, la forma más adecuada es usar software de oficina para el procesamiento por lotes. Este artículo toma como ejemplo HeSoft Doc Batch Tool para demostrar cómo extraer la ruta, el número de páginas y la información de propiedades de varios PDF en Excel de una sola vez.
Escenarios aplicables: Útil siempre que se necesite una lista de documentos PDF
Las listas de documentos PDF se usan comúnmente en la gestión de materiales y entregas. Siempre que sea necesario extraer información de archivos de las carpetas y organizarla en una tabla, se puede usar este método de extracción por lotes.
- Archivo de contratos y documentos escaneados: Extraer la ruta, tamaño, fecha y número de páginas de cada contrato PDF para formar un directorio de archivo.
- Organización de materiales de estudio: Generar listas de PDFs como materiales de curso, apuntes, cuadernos de ejercicios y lecturas para clasificarlos por tema o número de páginas.
- Entrega de informes: Al finalizar un proyecto, generar un desglose en Excel de todos los informes PDF como anexo de entrega o lista de verificación interna.
- Verificación de propiedades de archivos: Revisar la fecha de creación, fecha de modificación, aplicación y productor del PDF para ayudar a determinar la versión y el origen del archivo.
- Inventario de archivos a gran escala: Realizar un inventario por lotes de PDFs en servidores, unidades compartidas o directorios locales para evitar omitir materiales importantes.
La característica común de estos trabajos es: gran cantidad de archivos, campos fijos y muchas operaciones repetitivas. HeSoft Doc Batch Tool está diseñado precisamente para ayudar a los usuarios a procesar documentos y archivos por lotes, reducir el trabajo repetitivo y mejorar la eficiencia en la oficina.
Vista previa del resultado: De la lista de carpetas a un libro de registro de documentos en Excel
Antes del procesamiento: Archivos PDF dispersos, información difícil de consolidar
En la captura de pantalla previa al procesamiento, la carpeta muestra varios archivos PDF, como ClassNotesPacket.pdf, CourseSummaryReport.pdf, ExamPreparationNotes.pdf, GrammarReviewHandout.pdf, ReadingChecklistPacket.pdf, etc. El explorador de archivos puede mostrar el nombre, la fecha, el tipo y el tamaño, pero estos campos no son suficientes para formar una lista de documentos completa.

Por ejemplo, en la vista del explorador de archivos no se ve el número de páginas de cada PDF, ni los metadatos internos como el título, autor, tema, palabras clave, fecha de creación, aplicación o productor. Para un inventario formal de materiales o la entrega de un proyecto, estos campos suelen ser muy valiosos.
Después del procesamiento: Ruta, número de páginas y metadatos del PDF en Excel
La captura de pantalla posterior al procesamiento muestra que toda la información de los archivos PDF se ha consolidado en una tabla de Excel. Cada fila corresponde a un archivo PDF y cada columna a un tipo de campo. Se pueden ver campos como ruta, nombre, nombre (sin extensión), extensión, tamaño (bytes), tamaño, nombre de la carpeta contenedora, ruta de la carpeta contenedora, fecha de creación, fecha de modificación, número de páginas, título de metadatos PDF, autor de metadatos PDF, tema de metadatos PDF, palabras clave de metadatos PDF, fecha de creación de metadatos PDF, aplicación de metadatos PDF y productor de metadatos PDF.

Esta lista de Excel se puede usar directamente como un libro de registro de documentos o como base para el procesamiento posterior de datos. Por ejemplo, agrupar por la ruta de la carpeta contenedora para verificar si los materiales en un directorio están completos; ordenar por número de páginas para encontrar archivos con un número anómalo de páginas; filtrar por autor del PDF para organizar materiales de diferentes fuentes; verificar la versión del archivo por fecha de creación o modificación.
Pasos a seguir: Generar una lista de documentos PDF por lotes
Paso 1: Seleccionar "Estadísticas de información de archivos" en "Organización de archivos"
Abra HeSoft Doc Batch Tool , verá una barra de navegación a la izquierda con funciones divididas por tipo de herramienta: Organización de archivos, Herramientas de Word, Herramientas de Excel, etc. El objetivo de este artículo es extraer la información de los archivos en sí, por lo tanto, vaya a "Organización de archivos" y seleccione "Estadísticas de información de archivos".

La descripción de la función en la captura de pantalla indica que se usa para extraer por lotes información como el nombre, la ruta, el tamaño, la fecha y los metadatos de varios archivos. La frase "varios archivos" indica que no solo procesa PDFs, sino también otros archivos de oficina; pero para crear una lista de documentos PDF, nos centraremos en los detalles del archivo PDF.
Paso 2: Añadir los PDFs a procesar a la lista
Tras entrar en "Estadísticas de información de archivos", la página está en el paso 1 "Seleccionar registros a procesar". En la esquina superior derecha se ven los botones "Añadir archivos" e "Importar archivos de carpeta". Para PDFs dispersos, puede hacer clic en "Añadir archivos"; si los PDFs ya están en un directorio, usar "Importar archivos de carpeta" es más eficiente.

Tras la importación, la lista mostrará información como el nombre del PDF, la ruta, la extensión, la fecha de creación y la fecha de modificación. La captura de pantalla muestra 20 registros importados, todos con extensión pdf. Esta lista es la lista de entrada para esta tarea de extracción, y el software extraerá la información uno por uno según estos registros.
Antes de continuar, revise cuidadosamente tres puntos: primero, que el número de registros coincida con el número de archivos objetivo; segundo, que las rutas apunten a las carpetas correctas; tercero, que no se hayan incluido archivos no deseados. Si hay errores, puede eliminar registros desde la columna de operaciones o usar "Limpiar" y volver a importar. Una vez confirmado, haga clic en "Siguiente".
Paso 3: Seleccionar "Detalles de archivo PDF" como información adicional
El paso 2 es "Configurar opciones de procesamiento". La página tiene un área de "Información adicional" que lista opciones para diferentes tipos de archivo: Detalles de archivo Word, Detalles de archivo Excel, Detalles de archivo PPT, Detalles de archivo PDF, Detalles de archivo de texto, Detalles de archivo de imagen. Para generar una lista de documentos PDF que incluya número de páginas y metadatos, debe marcar "Detalles de archivo PDF".

Este paso determina la riqueza de campos en la tabla final de Excel. Si no se marca, es posible que solo obtenga atributos básicos como nombre, ruta, tamaño y fecha; al marcarlo, podrá obtener el número de páginas y los metadatos del PDF como título, autor, tema, palabras clave, fecha de creación, aplicación y productor.
Para los usuarios que necesitan contar páginas de PDF, verificar propiedades de PDF o exportar metadatos de PDF a Excel, se recomienda mantener esta opción marcada. Después de configurarlo, haga clic en "Siguiente".
Paso 4: Establecer la ubicación de guardado y preparar la salida a Excel
Según el flujo en la parte superior de la página, los pasos siguientes son "Establecer ubicación de guardado" y "Comenzar a procesar". Al llegar al paso de ubicación de guardado, siga las indicaciones del software para elegir el directorio de destino. Para facilitar la gestión, se recomienda guardar el resultado en la carpeta del proyecto actual o en el directorio de archivo, usando un nombre de archivo fácil de reconocer, que incluya, por ejemplo, el nombre del proyecto, la fecha o el lote del material.
Una vez configurada la ubicación, pase al paso de inicio del procesamiento. El software leerá por lotes las propiedades de los archivos según la lista de PDFs importada y la opción de detalles de PDF marcada, y generará el resultado en Excel.
Paso 5: Ver y usar la lista de PDFs generada
Una vez finalizado el proceso, abra el archivo de Excel para ver los resultados. Se recomienda verificar primero si los campos de encabezado están completos, especialmente "Número de páginas" y los campos que comienzan por "PDF - Metadatos". Si estas columnas se han generado, los detalles del PDF se han incluido exitosamente.
A continuación, puede continuar procesando según las necesidades del negocio. Por ejemplo, el personal de archivo puede conservar los campos de ruta, nombre, páginas, fecha de creación y modificación como un directorio de archivo; el personal de proyecto puede añadir columnas personalizadas como estado de entrega, responsable y notas; el personal académico o de formación puede calcular el volumen de lectura por tipo de material según el número de páginas; el personal de TI o administración de documentos puede analizar el origen de los archivos según los campos de aplicación y productor.
Preguntas frecuentes y consideraciones
1. ¿El número de páginas del PDF es lo mismo que el concepto de página?
En la lista extraída, normalmente se representa como "Número de páginas", que es el número total de páginas que contiene el archivo PDF. Lo que los usuarios llaman comúnmente recuento de páginas de PDF, en la mayoría de los casos, es el recuento del total de páginas de cada PDF.
2. ¿Para qué sirve el campo de ruta de archivo?
La ruta es un campo muy importante en una lista de documentos. Los nombres de archivo pueden repetirse, pero la ruta completa ubica de forma única el archivo. Especialmente al organizar PDFs en múltiples subcarpetas, unidades compartidas o directorios de proyecto, el campo de ruta evita confusiones.
3. ¿Por qué mantener tanto el tamaño (bytes) como el tamaño en Excel?
El tamaño en bytes es más adecuado para cálculos precisos y procesamiento programático, mientras que el tamaño normal es más fácil de leer para las personas. Conservar ambos permite tanto el análisis de datos como la consulta visual diaria.
4. ¿Qué hacer si el autor o las palabras clave en los metadatos del PDF están vacíos?
Si estos metadatos no se escribieron al generar el PDF, los campos correspondientes en el Excel exportado pueden estar vacíos. Esto se debe a la falta de información en el propio archivo y no afecta a la extracción de otros campos. Posteriormente, puede filtrar los valores vacíos en Excel y usarlos como base para complementar o estandarizar los metadatos.
5. ¿Se puede usar el mismo método para archivos doc, docx, xls, xlsx, ppt, pptx?
Como se ve en las opciones de información adicional de la captura de pantalla, el software ofrece opciones de detalles para archivos Word, Excel, PPT, etc. Para documentos de oficina como doc, docx, xls, xlsx, ppt, pptx, puede seleccionar la opción correspondiente según sus necesidades. Sin embargo, el enfoque de este artículo son los PDFs, por lo que marcamos principalmente la opción de detalles de archivo PDF.
6. Hay muchos PDFs en la carpeta, ¿cómo mejorar la eficiencia de verificación previa?
Se recomienda organizar primero las carpetas por proyecto o categoría, y luego usar "Importar archivos de carpeta". Una vez importados, revise el número de registros, las extensiones y las rutas. Si la lista es muy larga, puede usar las funciones de filtro y ordenación de la página para revisarla y confirmar que es correcta antes de continuar.
Resumen: Gestionar grandes volúmenes de PDFs con listas de Excel es más eficiente
La clave para crear una lista de múltiples documentos PDF reside en extraer de una sola vez las propiedades básicas del sistema de archivos y los detalles internos del PDF. La función "Estadísticas de información de archivos" que ofrece HeSoft Doc Batch Tool puede ayudar a los usuarios a extraer por lotes la ruta, el nombre, el tamaño, la fecha de creación, la fecha de modificación, el número de páginas y los metadatos de los PDFs, y exportarlos a una tabla de Excel.
En comparación con abrir cada PDF manualmente e introducir los datos uno por uno, este método es mucho más adecuado para tareas por lotes en un entorno de oficina real. No solo ahorra tiempo, sino que también unifica la estructura de los campos y facilita la verificación de los resultados. Se recomienda a los usuarios con necesidades de archivado de PDFs, inventario de materiales, recuento de páginas o entrega de proyectos que sigan los pasos de este artículo para probar la generación por lotes de listas de documentos PDF y delegar el trabajo repetitivo al software de oficina.