Convertir y extraer

Guardar una página web como PDF

¿Por qué una página web guardada como PDF sale mal?

Respuesta breve

Porque una página web no tiene páginas. Es una columna continua que se adapta a la ventana, y hacer un PDF significa cortarla en hojas fijas en posiciones que nadie eligió. Los encabezados caen al final de una página, las tablas se parten por la mitad, y cualquier cosa colocada en relación con la ventana acaba en un sitio no previsto.

Dos formatos con supuestos opuestos

Una página HTML está escrita para no tener un tamaño fijo. Se reajusta para un teléfono o un monitor ancho, puede cargar más contenido mientras te desplazas, y su diseño se calcula en el momento en que la miras.

Un PDF es lo contrario en todos los sentidos: tamaño de página fijo, posiciones fijas, decidido una sola vez. Consulta qué es realmente un PDF.

Así que la conversión tiene que inventar la información que la página web nunca tuvo: cuánto mide de ancho la página, y dónde termina cada hoja. Las víctimas habituales:

  • Las cabeceras fijas y los botones flotantes se repiten en cada página, o quedan encima del texto.
  • Los avisos de cookies y las ventanas emergentes de boletín se capturan junto con todo lo demás.
  • Cualquier cosa que se cargue al hacer scroll puede faltar, porque nunca llegó a cargarse.
  • Las tablas anchas se cortan por el borde derecho en lugar de ajustarse.
  • Los temas oscuros se imprimen oscuros, usando mucha tinta.

Dónde caen los cortes

El conversor llena una hoja, corta, y empieza la siguiente. No tiene ni idea de que la línea que acaba de cortar era un encabezado.

123

Cortar una página continua en hojas

  1. Una página web: una columna sin páginas y sin un lugar natural donde parar.
  2. Dónde caen los cortes — decidido por lo que cabe, no por lo que significa el contenido.
  3. El resultado. Una hoja de estilos de impresión es lo que evita un corte en medio de un encabezado o tabla.

Los sitios bien construidos incluyen una hoja de estilos de impresión: instrucciones para exactamente esta situación, que le dicen al navegador que oculte la navegación, evite cortar dentro de una fila de tabla y mantenga un encabezado junto al texto que le sigue. Cuando una página se convierte de forma impecable, esa es la razón. Cuando se convierte mal, el sitio simplemente nunca pensó en la impresión, y no hay nada en la página que guíe el corte.

HTML a PDF hace la conversión y respeta una hoja de estilos de impresión donde exista.

Conseguir un resultado limpio

  • Busca primero una vista de impresión o de lectura. Muchos artículos tienen una, y es una página construida exactamente para esto: sin navegación, sin barra lateral, sin aviso.
  • Desplázate hasta el final antes de convertir, para que se haya cargado todo lo que carga de forma diferida.
  • Descarta los avisos antes de capturar, o se vuelven permanentes.
  • Usa horizontal para tablas anchas. Es el único ajuste que las rescata de forma fiable.
  • Recorta después en lugar de pelearte con el diseño. Recortar PDF elimina un margen de encabezado repetido en todas las páginas de una vez, y Eliminar páginas quita la sección de comentarios.
  • Combina páginas relacionadas en un solo documento con Unir PDF, útil para un conjunto de documentación guardado página a página.

Si la página capturada es enorme por fotografías a todo lo ancho, Comprimir PDF normalmente recupera la mayor parte.

Lo que no se puede capturar

Cualquier cosa detrás de un inicio de sesión a la que un conversor no pueda llegar. Una herramienta que solicita una URL ve la página como un visitante anónimo, así que un panel personal o un artículo de pago vuelve como una pantalla de inicio de sesión. Imprimir desde tu propio navegador, donde ya has iniciado sesión, es la forma de sortearlo.

Cualquier cosa interactiva. Mapas, gráficos que responden al pasar el cursor, vídeo, formularios y cualquier cosa impulsada por un script se convierten en una imagen fija de su estado actual, o de su estado vacío, si no habían terminado de dibujarse.

Páginas que bloquean las solicitudes automatizadas. Algunos sitios rechazan peticiones que no vienen de un navegador, y devolverán una página de error en lugar de su contenido.

Y un punto que merece decirse con claridad: capturar una página produce una copia del trabajo de otra persona. Guardar un artículo para leerlo sin conexión suele ser correcto; redistribuirlo es otra cuestión, y esa es una pregunta sobre permiso, no sobre formatos de archivo.

Herramientas que cubre este artículo

Fuentes

Documentación primaria de las afirmaciones anteriores.

Última revisión: 24 de septiembre de 2026

Publicado por iBuildPDF.

Más de la base de conocimientos

Explorar la base de conocimientos