Wie es funktioniert

Warum die Seitenzahlen in einem PDF nicht zu den Seiten passen

Warum stimmen die Seitenzahlen in meinem PDF nicht mit den aufgedruckten überein?

Kurze Antwort

Weil es für dasselbe Blatt bis zu drei Nummern gibt und nichts sie verbindet. Seine Position in der Datei ist, was jedes Werkzeug zählt und was ein Seitenbereich bedeutet. Die Bezeichnung, die ein Betrachter in seinem Seitenfeld zeigt, ist optional, und viele Anwendungen schreiben nie eine. Die auf die Seite gedruckte Zahl ist Tinte — Teil des Bildes wie jede andere Markierung — und nichts liest sie. Ein Dokument mit Deckblatt und römisch nummeriertem Vorspann hat alle drei konstruktionsbedingt uneins.

Drei Nummern für dasselbe Blatt

Die Verwirrung ist kein Fehler von irgendetwas. Es ist, dass das Wort „Seite“ gleichzeitig drei Aufgaben erfüllt.

351ii23

Three numbers for the same sheet

  1. Where the sheet sits in the file: the fifth of however many. This is what every tool counts, what a page range means, and it always exists.
  2. The label the document may carry for that sheet — roman numerals for front matter, a prefix for an appendix. Optional, and many applications never write one.
  3. The number printed on the page. It is ink: part of the picture, the same as any other mark, and nothing reads it.

Die Position in der Datei. Die Seiten eines PDFs stehen in einem Baum, in Reihenfolge, und die fünfte ist die fünfte. Diese Nummer wird nicht neben der Seite gespeichert — sie ist schlicht die Reihenfolge — und sie existiert immer, von 1 bis zur Seitenzahl. Alles Maschinelle benutzt sie: Seitenbereiche, Extrahieren, Löschen, die Zahl, an der dein Betrachter beim Scrollen vorbeikommt.

Die Bezeichnung. Ein Dokument kann zusätzlich für jedes Blatt eine Bezeichnung tragen: i, ii, iii für den Vorspann, dann 1 aufwärts für den Hauptteil, dann A-1 für einen Anhang. Das ist optional, es ist eine von den Seiten getrennte Struktur, und ein Betrachter, der sie unterstützt, zeigt die Bezeichnung im Seitenfeld anstelle der Position.

Die Tinte. Die Zahl, die der Autor in die Fußzeile gedruckt hat, ist eine Markierung auf der Seite, gezeichnet von derselben Maschinerie, die die Wörter darüber gezeichnet hat. Sie ist kein Wert, den die Datei irgendwo festhält; sie ist ein Bild einer Zahl. Nichts zieht sie heran, nichts kann sich über sie irren, und nichts wird sie für dich ändern.

Ein Bericht mit Deckblatt, Inhaltsverzeichnis und zwei Seiten Vorspann hat also einen Hauptteil, der auf Blatt 5 beginnt, vielleicht als 1 bezeichnet ist und 1 aufgedruckt trägt — drei verschiedene, allesamt richtige Antworten auf „welche Seite ist das?“. Ärger entsteht erst, wenn zwei Menschen, oder ein Mensch und ein Programm, verschiedene meinen.

Die Bezeichnung, und warum dein Betrachter sie vielleicht nicht zeigt

Seitenbezeichnungen sind in ISO 32000-1 definiert und werden sparsamer gespeichert, als man vermuten würde. Ein Dokument trägt nicht eine Bezeichnung pro Seite. Es trägt einen kleinen Satz von Bereichen, von denen jeder sagt: ab diesem Blatt nummeriere die Seiten in diesem Stil, mit diesem Präfix, beginnend bei diesem Wert.

1i2ii3iii4152637A-18A-2123

How page labels are actually stored

  1. Where each sheet sits in the file. This is the order of the pages, not a value written beside them, and it runs 1 to N whatever else the document says.
  2. The labels. A reader that supports them shows these in its page box instead of the position, which is how a document can open at a page called ii.
  3. They are stored as a few ranges, not one label per page: a style, a prefix and a starting number, applied from one sheet until the next range begins.

Verfügbar sind Dezimalziffern, große und kleine römische Zahlen sowie große und kleine Buchstaben, jeweils wahlweise mit einem Präfix — daher kommen A-1 und Appendix 2.

Bereiche statt Werte zu speichern ist effizient und hat eine Folge, die jeden erwischt: Die Bereiche hängen an Positionen, nicht an Seiten. Verschiebe eine Seite, und ihre Bezeichnung wandert nicht mit; die Bezeichnung gehört dorthin, wo die Seite jetzt sitzt. Lösche die ersten beiden Blätter eines Dokuments, dessen Bezeichnungen beim dritten neu beginnen, und du hast ein Dokument, das bei iii anfängt, oder eines mit zwei Seiten, die beide 1 heißen.

Dann gibt es die Unterstützung durch Betrachter, die lückenhafter ist, als die Funktion verdient. Manche zeigen Bezeichnungen im Seitenfeld und lassen dich sie eintippen; andere zeigen unabhängig von der Datei die Position; und die Erhebung der PDF Association ergab, dass viele Anzeigeprogramme im Navigationsfeld nur arabische Ziffern annehmen — ein Dokument mit den Bezeichnungen ii und A-1 hat also Seiten, die du selbst in Software, die die Namen anzeigt, nicht per Name ansteuern kannst. Dieselbe Erhebung macht den für die meisten nützlicheren Punkt: Die verbreiteten Textverarbeitungen nummerieren Seiten auf der Seite tadellos und exportieren die Bezeichnungsinformation meist überhaupt nicht.

Das heißt, der Normalfall ist ein Dokument ganz ohne Bezeichnungen — sein Betrachter zählt Blätter, seine Fußzeilen sagen etwas anderes, und nichts ist kaputt.

Was ein Seitenbereich wirklich bedeutet

Jedes Werkzeug auf dieser Seite zählt Blätter vom Anfang der Datei an. Nicht Bezeichnungen und schon gar nicht aufgedruckte Zahlen.

1-3147484950515223

A range box counts sheets, not printed numbers

  1. A page range, as every tool here reads it: positions in the file, counted from the front.
  2. So it takes the first three sheets, whatever happens to be printed on them.
  3. These are the printed numbers — ink, from whatever document these pages were cut out of. Asking for 47 to 49 asks for pages this file does not have.

Wenn du also die Seiten 47 bis 52 eines Vertrags als eigenes PDF bekommen hast, hat dieses Dokument sechs Seiten und das sind die Seiten 1 bis 6. 47-52 einzutippen verlangt etwas, das es nicht hat. Das ist die mit Abstand häufigste Art, wie eine Extraktion schiefgeht, und die Datei trifft keine Schuld.

Die beiden Bereichsfelder hier verhalten sich unterschiedlich, und das zu wissen lohnt sich, bevor du einem von beiden traust:

  • Seiten extrahieren verwendet den gemeinsamen Parser. Er nimmt 1, 4-6, 12, akzeptiert -, einen Halbgeviertstrich oder das Wort to zwischen zwei Zahlen und dreht einen verkehrten Bereich richtig herum. Danach sortiert und entdoppelt er, also gibt 3,1 dir die Seiten 1 und 3 in dieser Reihenfolge und nicht in der getippten. Nennst du eine Seite, die es nicht gibt, lehnt er ab und sagt welche und wie viele es sind, statt zu raten.
  • PDF teilen hat ein nachsichtigeres und damit leiseres Seitenlistenfeld. Es kappt einen Bereich, der über das Ende hinausläuft — bei einem zwölfseitigen Dokument liefert 1-500 die Seiten 1 bis 12 — und ignoriert stillschweigend eine einzelne Seitenzahl, die es nicht gibt. Es behält die getippte Reihenfolge. Sein Bereichsmodus arbeitet stattdessen mit Von/Bis-Zahlenfeldern, und das ist die Variante für den Fall, dass es darauf ankommt.

Die Gewohnheit, die den Nachmittag rettet: Bevor du einen Bereich tippst, schick die Datei durch Seitenzahl und Dateiinfo und lies die Seitenzahl dort ab. Es meldet außerdem die Seitenmaße und ob eine Textebene vorhanden ist — die beiden anderen Dinge, die Leute annehmen, statt sie zu prüfen. Wie man ein PDF teilt behandelt die Wahl zwischen den Modi.

Was du ändern kannst und was nicht

Seitenzahlen zu einem PDF hinzufügen druckt Zahlen auf die Seiten. Genau was es tut, denn das Detail ist sein ganzer Wert:

  • Es zeichnet 10-Punkt-Helvetica, 28 Einheiten vom Rand, in einer von fünf Positionen, in Dunkelgrau. Es nutzt eine der vierzehn Standardschriften, also werden der Datei keine Schriftdaten hinzugefügt — ein paar hundert Bytes Zeichenanweisungen pro Seite und sonst nichts.
  • Es hat zwei getrennte Starteinstellungen, und dafür kommen die Leute: auf welchem Blatt begonnen wird und bei welcher Zahl zu zählen begonnen wird. So können Deckblatt und Inhaltsverzeichnis unnummeriert bleiben, während Blatt 3 eine 1 druckt. Blätter vor dem Start bekommen gar nichts.
  • Das Format n / total zählt die Blätter, die nummeriert werden, verschoben um die Startzahl. Beginne auf Blatt 2 eines zehnblättrigen Dokuments, und Blatt 2 druckt 1 / 9, nicht 1 / 10. Das ist wohl die richtige Antwort und sicher eine überraschende, also lohnt es sich, das vor dem Download in der Vorschau zu sehen.
  • Zahlen werden an der eigenen Größe jeder Seite ausgerichtet, sodass ein Bündel aus A4 und Letter — was zusammengeführte Dokumente regelmäßig sind — seine Zahlen trotzdem auf jedem Blatt an derselben sichtbaren Stelle bekommt.
  • Auf einer Seite mit Drehung wird die Zahl in den gespeicherten, ungedrehten Raum der Seite gezeichnet, und der Betrachter dreht anschließend die ganze Seite — bei einem quer liegenden Scan landet die Zahl also entlang dessen, was du als Kante siehst, und liest sich seitlich. Die Vorschau zeigt das, statt es zu beschönigen. Warum ein gedrehtes PDF wieder zurückspringt erklärt das Attribut dahinter.

Zwei Dinge, die es nicht tut, und die sonst auch nichts hier tut.

Es schreibt keine Seitenbezeichnungen. Kein Werkzeug auf dieser Seite setzt sie, also zeigt das Seitenfeld deines Betrachters nach dem Hinzufügen von Zahlen weiterhin Positionen. Verlangt eine Einreichung, dass das Navigationsfeld den aufgedruckten Zahlen entspricht, ist das eine Aufgabe für Seitenbezeichnungen und gehört in eine Anwendung, die sie schreiben kann — am besten die, aus der das Dokument stammt.

Und es entfernt keine Zahlen, die schon da sind. Aufgedruckte Zahlen sind Teil des Seiteninhalts; ein zweiter Satz gibt dir zwei. Die einzigen Wege, gedruckte Tinte zu entfernen, sind sie zu überdecken oder abzuschneiden: Schwärzen übermalt sie und rastert diese Seite, und Zuschneiden verbirgt nur, was außerhalb der neuen Grenze liegt, statt es zu löschen. Beides ist schlechter, als zur Quelle zurückzugehen und neu zu exportieren, wenn du kannst.

Wo das wehtut

  • „Siehe Seite 12“ ist mehrdeutig. In einem Dokument mit separat nummeriertem Vorspann kommen drei Blätter dafür infrage. Sag, welches du meinst — „das zwölfte Blatt“ oder „die Seite mit der aufgedruckten 12“ — und der Austausch ist damit erledigt.
  • Nach einer gedruckten Zahl zu suchen funktioniert selten. In einem Scan sind es Pixel, es gibt also nichts zu finden. Selbst in einem Textdokument wird eine Seitenzahl in der Fußzeile häufig getrennt vom Fließtext gezeichnet und extrahiert womöglich nicht in nützlicher Reihenfolge. Warum kopierter Text durcheinander ankommt erklärt, warum die Extraktionsreihenfolge eine Vermutung ist.
  • Umsortieren oder Löschen von Seiten nummeriert nichts neu. Gedruckte Zahlen bleiben gedruckt; Bezeichnungen bleiben bei ihren Bereichen. Und die Werkzeuge hier bauen das Dokument aus kopierten Seiten neu auf, was von einem frischen Dokumentkatalog ausgeht — ein Bezeichnungsschema aus dem Original wird also nicht in die Ausgabe übernommen, und zurück bekommst du schlichte Positionen. PDF-Seiten umsortieren und löschen behandelt, was sich sonst noch bewegt und was nicht.
  • Lesezeichen und interne Links zeigen auf Seiten, nicht auf Zahlen. Sie überstehen das Umsortieren, weil sie das Seitenobjekt referenzieren, was meist gewünscht ist — und es bedeutet auch, dass ein Inhaltsverzeichnis, dessen gedruckte Zahlen du gerade entwertet hast, dich weiterhin an die richtige Stelle bringt und dabei die falsche Zahl anzeigt.
  • Ein zusammengeführtes Bündel geht fast nie auf. Jedes Ausgangsdokument brachte seine eigenen gedruckten Fußzeilen mit, und das neue Dokument hat eine durchgehende Positionszählung. Muss das Bündel zitierfähig sein, nummeriere es nach dem Zusammenführen und schreib in die Begleitnotiz, dass die im Text gedruckten Zahlen die der Originale sind.

Tools, um die es in diesem Artikel geht

Quellen

Primärdokumentation zu den Aussagen oben.

Zuletzt geprüft: 30. September 2026

Veröffentlicht von iBuildPDF.

Mehr aus der Wissensdatenbank

Wissensdatenbank durchsuchen