Gescannte PDFs enthalten häufig aufgrund von doppelseitigem Scannen, falschen Seiteneinstellungen oder Dokumentenlayout ungültige Inhalte auf ungeraden oder geraden Seiten. Dieser Artikel konzentriert sich auf die Büroanforderung "Stapelweises Löschen aller ungeraden oder geraden Seiten in vielen PDF-Dateien" und erklärt, wie Sie mit HeSoft Doc Batch Tool das PDF-Tool aufrufen, "Seiten aus PDF löschen" auswählen, mehrere PDFs hinzufügen und im Bearbeitungsbereich ungerade oder gerade Seiten auswählen. Das Beispiel zeigt, dass nach dem Löschen gerader Seiten aus einer PDF-Datei mit Seiten 1 bis 4 nur noch Seite 1 und Seite 3 übrig bleiben, was sich ideal zur Bereinigung von Scans und zur Vorbereitung auf die Archivierung eignet.
Gescannte PDFs sind die gängigste Dateiart in vielen Unternehmen und Privathaushalten. Papierverträge, Rechnungsanhänge, Schulungsunterlagen und Archivmaterialien werden nach dem Scannen üblicherweise als PDF gespeichert. Aber gescannte PDFs sind nicht immer sauber und nutzbar: Manche Dateien enthalten viele leere Rückseiten, andere weisen auf jeder zweiten Seite Erläuterungsseiten auf, und wieder andere haben ungerade oder gerade Seiten, die nicht archiviert werden müssen. Wenn diese Probleme nur in einer einzelnen Datei auftreten, kann man sie manuell beheben; befinden sich jedoch viele PDFs in einem Ordner, wird das manuelle Löschen von Seiten zu repetitiver Arbeit.
Dieser Artikel behandelt eine sehr praktische Anforderung bei der Bereinigung von Scans und Stapel-PDFs: das batchweise Löschen aller ungeraden oder geraden Seiten in mehreren PDF-Dateien. Das Beispiel verwendet HeSoft Doc Batch Tool , eine Bürosoftware, deren Kernkompetenz die batchweise Verarbeitung von Dateien, die Reduzierung repetitiver Vorgänge und die Steigerung der Effizienz bei der Dokumentenorganisation ist. Mit der Funktion „Seiten aus PDF löschen“ kann dieselbe Seitenlöschregel auf mehrere PDF-Dateien angewendet werden, was sich sehr gut zum Bereinigen von Scans, zur Archivierung von Dokumenten und für die Aufbereitung vor dem Druck eignet.
Anwendungsszenarien: Warum müssen bei Scans oft ungerade oder gerade Seiten gelöscht werden?
Ungültige Inhalte auf geraden/ungeraden Seiten in Scans hängen meist mit dem Scanverfahren, der Papiereinlage und der Struktur des Quellmaterials zusammen. Solange die ungültigen Seiten in mehreren PDFs einem gleichmäßigen Muster folgen, ist die Batch-Verarbeitung geeignet.
1. Leere Rückseiten durch Duplex-Scanning
Viele Scanner aktivieren standardmäßig oder bei Batch-Aufträgen das Duplex-Scanning. Wenn das Originalpapier nur auf der Vorderseite Inhalt hat, entstehen beim Scannen leere Seiten auf der Rückseite im PDF. Diese Leerseiten fallen je nach Scan-Reihenfolge gleichmäßig auf gerade oder ungerade Seiten.
2. Zwischengefügte Trenn- oder Indossamentseiten in Archivdokumenten
Für den Druck oder die Bindung werden manchen Archivdokumenten Trennseiten, Notizseiten oder Indossamentseiten beigefügt. Bei der Archivierung müssen diese Seiten möglicherweise nicht erhalten bleiben. Wenn sie einem ungerade/gerade-Muster folgen, können sie einheitlich gelöscht werden.
3. Abwechselnde Fragen und Antworten nach dem Scannen
Unterrichtsmaterial besteht häufig aus einer Seite mit Aufgaben und einer mit Antworten. Soll eine Schülerversion erstellt werden, können die Antwortseiten (ungerade oder gerade) gelöscht werden; sollen die Antworten separat gesammelt werden, können die Aufgabenseiten gelöscht werden.
4. Verkleinerung der Dateiseitenanzahl vor dem Batch-Upload in ein System
Manche Geschäftssysteme stellen Anforderungen an Seitenzahl, Dateigröße oder Inhaltsstruktur von PDFs. Das Entfernen überflüssiger ungerader/gerader Seiten macht die Datei schlanker und erleichtert den Upload, die Prüfung und die Archivierung.
Ergebnisvorschau: PDF hat nach dem Löschen gerader Seiten nur noch 2 statt 4 Seiten
Vor der Verarbeitung befinden sich im Beispielordner 4 PDF-Dateien mit den Namen 1.pdf, 2.pdf, 3.pdf und 4.pdf. Diese Benennung wird üblicherweise bei Batch-Scans, Batch-Exporten oder Testmustern verwendet und zeigt, dass es sich beim Verarbeitungsobjekt nicht um eine einzelne Datei, sondern um eine Gruppe einheitlich zu bereinigender PDFs handelt.

Öffnet man das PDF vor der Verarbeitung, hat das Dokument 4 Seiten mit den Inhalten Page 1, Page 2, Page 3, Page 4. Der rote Pfeil im Bildschirmfoto zeigt auf Page 2, was bedeutet, dass die geraden Seiten im Fokus stehen. Wenn diese geraden Seiten alle leere Rückseiten oder ungültigen Inhalt haben, kann man das Löschen der geraden Seiten wählen.

Nach der Verarbeitung zeigt der PDF-Reader eine Gesamtseitenzahl von 2 Seiten, es sind nur noch Page 1 und Page 3 vorhanden. Das heißt, Page 2 und Page 4 wurden gelöscht. Dies ist genau das Ergebnis von „Gerade Seiten löschen, ungerade Seiten behalten“.

Befinden sich die Leerseiten im tatsächlichen Scan auf den ungeraden Seiten, wählt man bei der Bearbeitung einfach „Ungerade Seiten“. Das Beispiel zeigt das Löschen gerader Seiten, die Vorgehenslogik gilt jedoch genauso für das Löschen ungerader Seiten.
Vorgehensweise: Batchweises Löschen ungerader oder gerader Seiten aus gescannten PDFs
Nachfolgend wird der Ablauf anhand von Software-Screenshots in der tatsächlichen Bearbeitungsreihenfolge erläutert. Der gesamte Prozess lässt sich zusammenfassen als: Funktion wählen, Dateien importieren, Seitenlöschbereich einstellen, Speicherort einstellen, Verarbeitung starten.
Schritt 1: Die Seitenlöschfunktion in den PDF-Tools öffnen
Wählen Sie nach dem Aufrufen von HeSoft Doc Batch Tool zunächst in der linken Navigationsleiste „PDF-Tools“. Auf der rechten Seite werden mehrere PDF-Funktionskarten angezeigt, darunter PDF-Wasserzeichen hinzufügen, PDF zu Word, PDF zu JPG usw. Da das Ziel das Löschen von PDF-Seiten ist, müssen Sie auf „Seiten aus PDF löschen“ klicken.
Aus dem Screenshot geht hervor, dass die Funktionsbeschreibung „Batchweises Löschen einiger Seiten aus PDF“ lautet. Das zeigt, dass die Funktion nicht nur eine einzelne Datei verarbeiten kann, sondern sich für das einheitliche Löschen von Seiten in mehreren PDFs eignet. Für die Batch-Bereinigung von Scans ist dies wichtig, da beim Scanvorgang oft viele Dateien auf einmal entstehen.

Nach dem Aufrufen der Funktion wird oben der Bearbeitungsfortschritt angezeigt: Zu verarbeitende Datensätze auswählen, Verarbeitungsoptionen einstellen, Speicherort einstellen, Verarbeitung starten. Wenn Sie in dieser Reihenfolge vorgehen, vermeiden Sie, zuerst den Bereich einzustellen und dann zu vergessen, Dateien hinzuzufügen, oder ohne festgelegten Speicherort direkt zu verarbeiten.
Schritt 2: Gescannte PDF-Dateien hinzufügen
Auf der Seite „Zu verarbeitende Datensätze auswählen“ können Sie über „Datei hinzufügen“ einzelne oder mehrere PDFs auswählen; befinden sich die Scans alle im selben Verzeichnis, können Sie auch auf „Dateien aus Ordner importieren“ klicken. Im Beispiel wurden 4 PDF-Dateien importiert, die Tabelle zeigt Dateiname, Pfad, Erweiterung sowie Erstelldatum und Änderungsdatum an.

Ziel dieses Schritts ist es, alle PDFs, aus denen batchweise ungerade/gerade Seiten gelöscht werden sollen, zur Aufgabenliste hinzuzufügen. Das erwartete Ergebnis ist, dass die Tabelle alle Zieldateien anzeigt und die Anzahl der Einträge unten korrekt ist. Der Screenshot zeigt 4 Einträge, was bedeutet, dass 1.pdf, 2.pdf, 3.pdf und 4.pdf alle in diese Verarbeitung einbezogen werden.
Wenn in der Praxis die Anzahl der Scans größer ist, empfiehlt es sich, die Dateien zuerst im Explorer in einem Ordner zu sammeln und sicherzustellen, dass nicht zu verarbeitende PDFs entfernt wurden. So lassen sich Fehlauswahl und -auslassungen beim Importieren aus dem Ordner reduzieren.
Schritt 3: Im Verarbeitungsbereich „Ungerade Seiten“ oder „Gerade Seiten“ wählen
Nachdem Sie die Dateiliste bestätigt haben, klicken Sie unten auf „Weiter“ und gelangen zu „Verarbeitungsoptionen einstellen“. Die Oberfläche enthält einen Bereich „Verarbeitungsbereich“ mit den Optionen „Die ersten Seiten“, „Die letzten Seiten“, „Ungerade Seiten“, „Gerade Seiten“, „Benutzerdefiniert“.
Wenn die Leerseiten oder ungültigen Seiten im Scan auf geraden Seiten erscheinen, wählen Sie „Gerade Seiten“. Im Screenshot ist genau „Gerade Seiten“ aktiviert, daher wurden letztlich die Seiten 2, 4, 6 usw. jeder PDF gelöscht.

Erscheinen die Leerseiten im Scan auf ungeraden Seiten, wählen Sie „Ungerade Seiten“. Wichtig ist hierbei, dass die Option den „zu löschenden Seitenbereich“ angibt, nicht den „zu erhaltenden Seitenbereich“. Beispielsweise führt die Wahl von „Gerade Seiten“ zum Löschen gerader und Erhalten ungerader Seiten; die Wahl von „Ungerade Seiten“ löscht ungerade Seiten und erhält gerade.
Schritt 4: Speicherort einstellen und Verarbeitung ausführen
Nachdem Sie den Verarbeitungsbereich eingestellt haben, klicken Sie weiter auf „Weiter“. Gemäß dem Fortschrittsbalken oben müssen Sie nun den Speicherort einstellen und dann die Verarbeitung starten. Für das batchweise Löschen von PDF-Seiten wird empfohlen, als Speicherort ein neues Verzeichnis zu wählen, z. B. „Scans ohne Leerseiten“ oder „Ergebnis Löschung gerader PDF-Seiten“, um Original- und neue Dateien besser unterscheiden zu können.
Nach Abschluss der Speicherorteinstellung beginnt der Verarbeitungsschritt. Es wird empfohlen, nach Abschluss einige Ausgabe-PDFs stichprobenartig zu öffnen, um zu prüfen, ob die Seiten den Erwartungen entsprechen. Im Beispiel hatte das ursprüngliche PDF Page 1 bis Page 4, nach der Wahl zum Löschen gerader Seiten blieben nur Page 1 und Page 3 übrig, was die korrekte Einstellung zeigt.
Häufige Fragen und wichtige Hinweise
1. Befinden sich Leerseiten in Scans immer auf geraden Seiten?
Nicht unbedingt. Ob die Leerseiten auf geraden oder ungeraden Seiten liegen, hängt von der Platzierung der Vorlage, der Scan-Reihenfolge und davon ab, ob die Datei einen Einband enthält. Daher sollten Sie vor der eigentlichen Batch-Verarbeitung 1 bis 2 Muster-PDFs öffnen, um die Position der ungültigen Seiten zu prüfen und dann zu entscheiden, ob Sie ungerade oder gerade Seiten wählen.
2. Beeinträchtigt das Löschen ungerader/gerader Seiten die Text- oder Bildqualität in der PDF?
Der Schwerpunkt dieser Operation liegt auf dem Entfernen von Seiten, nicht auf der Neubearbeitung des Seiteninhalts. Der Inhalt der beibehaltenen Seiten stammt nach der Verarbeitung weiterhin aus der ursprünglichen PDF. Um sicherzustellen, dass die Ergebnisse den Anforderungen entsprechen, wird eine stichprobenartige Prüfung wichtiger Dateien nach Abschluss empfohlen.
3. Was tun, wenn die aufgedruckte Seitenzahl nicht mit der vom Programm ermittelten geraden/ungeraden Seite übereinstimmt?
Bei manchen PDFs beginnt die Seitennummerierung im Haupttext erst nach Deckblatt oder Inhaltsverzeichnis, die aufgedruckte „Seite 1“ ist also nicht unbedingt die tatsächliche Seite 1 der PDF. Das batchweise Löschen ungerader/gerader Seiten orientiert sich üblicherweise an der tatsächlichen Seitenfolge der PDF, daher muss diese bei Dateien mit Deckblatt, Inhaltsverzeichnis oder Einlegeblättern vorher bestätigt werden.
4. Kann man nur Seiten in einem bestimmten Bereich löschen?
Wie der Screenshot zeigt, bietet der Verarbeitungsbereich neben ungeraden und geraden Seiten auch Optionen wie „Benutzerdefiniert“. Wenn die ungültigen Seiten keinem reinen Muster aus ungerade/gerade folgen, sondern einen spezifischeren Seitenbereich betreffen, kann eine passende Methode über die Optionen in der Benutzeroberfläche gewählt werden.
5. Warum sollte man vor der Batch-Verarbeitung die Originaldatei behalten?
Der Vorteil der Batch-Verarbeitung ist die Geschwindigkeit, aber wenn die Regel falsch eingestellt ist, wirkt sich der Fehler schnell auf viele Dateien aus. Das Aufbewahren der Originaldatei oder das Ausgeben in einen neuen Ordner ist eine sehr wichtige Gewohnheit. So kann man, auch wenn man die falsche ungerade/gerade-Seite ausgewählt hat, die Einstellung neu vornehmen und die Verarbeitung erneut starten.
Fazit: Die Bereinigung gescannter PDFs erledigt man besser per batchweisem Seitenlöschen
Bei gescannten PDFs kommt es sehr häufig vor, dass ungerade oder gerade Seiten leer, Rückseiten, Notizen oder Antwortseiten sind. Löscht man diese manuell Datei für Datei, ist das nicht nur zeitaufwendig, sondern man übersieht auch leicht Seiten. HeSoft Doc Batch Tool kann als Software zur batchweisen Verarbeitung von Bürodateien über die Funktion „Seiten aus PDF löschen“ die Seitenlöschung für mehrere PDFs in einer einmaligen Regeleinstellung zusammenfassen.
Das Beispiel in diesem Artikel zeigt den vollständigen Ansatz zum Löschen gerader Seiten: Zuerst die PDF-Tools aufrufen, „Seiten aus PDF löschen“ wählen, dann mehrere PDFs importieren, im Verarbeitungsbereich „Gerade Seiten“ ankreuzen, zuletzt den Speicherort einstellen und die Verarbeitung starten. Danach enthält das ursprünglich 4-seitige PDF nur noch Page 1 und Page 3. Bei ungeraden Leerseiten kann auf dieselbe Weise „Ungerade Seiten“ gewählt werden. Wenn Sie häufig Scans bereinigen, PDFs archivieren oder batchweise Druckdateien vorbereiten, empfiehlt es sich, diese Batch-Methode vorrangig zu nutzen, um das wiederholte Löschen von Seiten schneller und stabiler zu machen.