Cómo funciona

Por qué los números de página de un PDF no coinciden con las páginas

¿Por qué los números de página de mi PDF no coinciden con los impresos en las páginas?

Respuesta breve

Porque hay hasta tres números para la misma hoja y nada los conecta. Su posición en el archivo es lo que cuentan todas las herramientas y lo que significa un rango de páginas. La etiqueta que un lector muestra en su casilla de página es opcional, y muchas aplicaciones nunca escriben ninguna. El número impreso en la página es tinta — parte de la imagen, como cualquier otra marca — y nada lo lee. Un documento con portada y preliminares en números romanos tiene los tres en desacuerdo por diseño.

Tres números para la misma hoja

La confusión no es un fallo de nada. Es que la palabra «página» hace tres trabajos a la vez.

351ii23

Three numbers for the same sheet

  1. Where the sheet sits in the file: the fifth of however many. This is what every tool counts, what a page range means, and it always exists.
  2. The label the document may carry for that sheet — roman numerals for front matter, a prefix for an appendix. Optional, and many applications never write one.
  3. The number printed on the page. It is ink: part of the picture, the same as any other mark, and nothing reads it.

La posición en el archivo. Las páginas de un PDF se guardan en un árbol, en orden, y la quinta es la quinta. Este número no se almacena junto a la página — es simplemente el orden — y siempre existe, de 1 hasta cuantas páginas haya. Todo lo mecánico lo usa: rangos de páginas, extracción, borrado, el número por el que pasa tu lector al desplazarse.

La etiqueta. Un documento también puede llevar una etiqueta para cada hoja: i, ii, iii para los preliminares, luego 1 en adelante para el cuerpo, luego A-1 para un anexo. Es opcional, es una estructura separada de las páginas en sí, y un lector que la admite muestra la etiqueta en su casilla de página en lugar de la posición.

La tinta. El número que el autor imprimió en el pie es una marca en la página, dibujada por la misma maquinaria que dibujó las palabras de arriba. No es un valor que el archivo registre en ninguna parte; es una imagen de un número. Nada lo consulta, nada puede equivocarse sobre él y nada lo cambiará por ti.

Así que un informe con portada, índice y dos páginas de preliminares tiene un cuerpo que empieza en la hoja 5, puede estar etiquetado 1 y lleva 1 impreso encima: tres respuestas distintas, todas correctas, a «¿qué página es esta?». Los problemas solo empiezan cuando dos personas, o una persona y un programa, se refieren a distintas.

La etiqueta y por qué tu lector puede no mostrarla

Las etiquetas de página están definidas en ISO 32000-1 y se almacenan de forma más barata de lo que supondrías. Un documento no lleva una etiqueta por página. Lleva un pequeño conjunto de rangos, cada uno diciendo: desde esta hoja en adelante, numera las páginas con este estilo, con este prefijo, empezando en este valor.

1i2ii3iii4152637A-18A-2123

How page labels are actually stored

  1. Where each sheet sits in the file. This is the order of the pages, not a value written beside them, and it runs 1 to N whatever else the document says.
  2. The labels. A reader that supports them shows these in its page box instead of the position, which is how a document can open at a page called ii.
  3. They are stored as a few ranges, not one label per page: a style, a prefix and a starting number, applied from one sheet until the next range begins.

Los estilos disponibles son dígitos decimales, números romanos en mayúsculas y minúsculas, y letras mayúsculas y minúsculas, cada uno opcionalmente con un prefijo, que es de donde salen A-1 y Appendix 2.

Almacenar rangos en vez de valores es eficiente y tiene una consecuencia que pilla a todo el mundo: los rangos están unidos a posiciones, no a páginas. Mueve una página y su etiqueta no viaja con ella; la etiqueta pertenece al lugar donde ahora está. Borra las dos primeras hojas de un documento cuyas etiquetas se reinician en la tercera y tendrás un documento que empieza en iii, o uno con dos páginas etiquetadas ambas 1.

Luego está el soporte de los lectores, más irregular de lo que la función merece. Algunos muestran las etiquetas en la casilla de página y te dejan escribirlas; otros muestran la posición dijera lo que dijera el archivo; y el estudio de la PDF Association encontró que muchos visores solo aceptan dígitos arábigos en la casilla de navegación, así que un documento etiquetado ii y A-1 tiene páginas a las que no puedes ir por nombre ni siquiera en software que muestra los nombres. El mismo estudio apunta lo más útil para la mayoría: los procesadores de texto habituales numeran las páginas perfectamente bien en la página y en su mayoría no exportan en absoluto la información de etiquetas.

Lo que significa que el caso corriente es un documento sin etiqueta alguna: su lector cuenta hojas, sus pies dicen otra cosa, y nada está roto.

Qué significa realmente un rango de páginas

Todas las herramientas de este sitio cuentan hojas desde el principio del archivo. No etiquetas, y desde luego no números impresos.

1-3147484950515223

A range box counts sheets, not printed numbers

  1. A page range, as every tool here reads it: positions in the file, counted from the front.
  2. So it takes the first three sheets, whatever happens to be printed on them.
  3. These are the printed numbers — ink, from whatever document these pages were cut out of. Asking for 47 to 49 asks for pages this file does not have.

Así que si te dieron las páginas 47 a 52 de un contrato como su propio PDF, ese documento tiene seis páginas y son las páginas 1 a 6. Escribir 47-52 pide algo que no tiene. Esta es la forma más común en que una extracción sale mal, y el archivo no tiene la culpa.

Las dos casillas de rango de aquí se comportan de forma distinta entre sí, cosa que conviene saber antes de fiarse de ninguna:

  • Extraer páginas usa el analizador compartido. Acepta 1, 4-6, 12, admite -, una raya o la palabra to entre dos números, y endereza un rango invertido. Después ordena y elimina duplicados, así que 3,1 te da las páginas 1 y 3 en ese orden y no en el que escribiste. Si nombras una página que no existe, se niega y dice qué página y cuántas hay, en lugar de adivinar.
  • Dividir PDF tiene una casilla de lista de páginas más permisiva y por tanto más silenciosa. Recorta un rango que se pasa del final — en un documento de doce páginas, 1-500 te da de la 1 a la 12 — e ignora en silencio un número de página suelto que no existe. Mantiene el orden que escribiste. Su modo de rango son en cambio campos numéricos de desde/hasta, que es la versión a usar cuando importa.

La costumbre que salva la tarde: antes de escribir un rango, pasa el archivo por contar páginas e información del archivo y lee ahí el número de páginas. También informa de las dimensiones de las páginas y de si hay capa de texto, que son las otras dos cosas que la gente supone en vez de comprobar. Cómo dividir un PDF trata la elección entre los modos.

Qué puedes cambiar y qué no

Añadir números de página a un PDF imprime números sobre las páginas. Exactamente qué hace, porque el detalle es todo su valor:

  • Dibuja Helvetica de 10 puntos, a 28 unidades del borde, en una de cinco posiciones, en gris oscuro. Usa una de las catorce tipografías estándar, así que no se añaden datos de fuente al archivo: unos cientos de bytes de instrucciones de dibujo por página y nada más.
  • Tiene dos ajustes de inicio separados, y esto es a lo que viene la gente: en qué hoja empezar y desde qué número empezar a contar. Así una portada y un índice pueden quedar sin numerar mientras la hoja 3 imprime 1. Las hojas anteriores al inicio no reciben nada.
  • El formato n / total cuenta las hojas que se están numerando, desplazadas por el número de inicio. Empieza en la hoja 2 de un documento de diez y la hoja 2 imprime 1 / 9, no 1 / 10. Es discutiblemente la respuesta correcta y desde luego es sorprendente, así que conviene verlo en la vista previa antes de descargar.
  • Los números se colocan según el tamaño propio de cada página, así que un paquete que mezcla A4 y Letter — cosa que los documentos fusionados hacen con frecuencia — sigue recibiendo sus números en el mismo lugar visual en todas las hojas.
  • En una página con rotación, el número se dibuja en el espacio almacenado y sin rotar de la página, y el lector gira después la página entera, así que en un escaneo apaisado el número cae a lo largo de lo que tú ves como un borde, leyéndose de lado. La vista previa lo muestra en vez de disimularlo. Por qué un PDF rotado vuelve a como estaba explica el atributo que hay detrás.

Dos cosas que no hace, y que tampoco hace nada más de aquí.

No escribe etiquetas de página. No hay ninguna herramienta en este sitio que las establezca, así que después de añadir números la casilla de página de tu lector sigue mostrando posiciones. Si una presentación exige que la casilla de navegación coincida con los números impresos, eso es trabajo de etiquetas de página y corresponde a una aplicación capaz de escribirlas, idealmente aquella de la que salió el documento.

No quita números que ya están ahí. Los números impresos forman parte del contenido de la página; añadir un segundo juego te da dos. Las únicas formas de quitar tinta impresa son taparla o recortarla: redactar la pinta encima y rasteriza esa página, y recortar solo oculta lo que queda fuera del nuevo límite en vez de borrarlo. Ambas son peores que volver al origen y exportar de nuevo, si puedes.

Dónde duele esto

  • «Ver página 12» es ambiguo. En un documento cuyos preliminares van numerados aparte, tres hojas responden a eso. Di cuál quieres decir — «la hoja doce» o «la página con el 12 impreso» — y el intercambio termina ahí.
  • Buscar un número impreso rara vez funciona. En un escaneo son píxeles, así que no hay nada que encontrar. Incluso en un documento de texto, un número de página en un pie se dibuja con frecuencia aparte del texto del cuerpo y puede no extraerse en un orden útil. Por qué el texto copiado sale desordenado explica por qué el orden de extracción es una conjetura.
  • Reordenar o borrar páginas no renumera nada. Los números impresos siguen impresos; las etiquetas siguen con sus rangos. Y las herramientas de aquí reconstruyen el documento a partir de páginas copiadas, lo que parte de un catálogo de documento nuevo: así que un esquema de etiquetas que estuviera en el original no llega a la salida, y lo que recuperas son posiciones sin más. Reordenar y borrar páginas de un PDF cubre qué más se mueve y qué no.
  • Los marcadores y los enlaces internos apuntan a páginas, no a números. Sobreviven al reordenado porque referencian el objeto de página, que suele ser lo que quieres — y también significa que un índice cuyos números impresos acabas de invalidar seguirá llevándote al sitio correcto mientras muestra el número equivocado.
  • Un paquete fusionado casi nunca cuadra. Cada documento de origen trajo sus propios pies impresos, y el documento nuevo tiene un único recuento continuo de posiciones. Si el paquete tiene que poder citarse, numéralo después de fusionar y di en la nota de acompañamiento que los números impresos en el cuerpo son los de los originales.

Herramientas que cubre este artículo

Fuentes

Documentación primaria de las afirmaciones anteriores.

Última revisión: 30 de septiembre de 2026

Publicado por iBuildPDF.

Más de la base de conocimientos

Explorar la base de conocimientos