Pourquoi les signets et les liens disparaissent quand vous fusionnez ou divisez un PDF
Pourquoi mes signets ont-ils disparu après la fusion de deux PDF ?
Enregistrez vos outils favoris
Créez un compte iBuildPDF gratuit pour conserver vos outils favoris et les retrouver rapidement à tout moment.
Compte gratuit. Les outils PDF eux-mêmes n’en demandent jamais.
Réponse courte
Parce que les signets ne font pas partie d’une page. Ils vivent dans une structure distincte qui dépend du document dans son ensemble, et les outils d’ici construisent un document entièrement neuf dans lequel ils copient les pages. Les pages arrivent ; la structure attachée à l’ancien document, non. Les liens web sont dessinés sur les pages elles-mêmes, et ceux-là survivent. Les liens qui pointent vers une autre page du même document sont le cas intermédiaire délicat : la zone cliquable survit, mais sa destination ne pointe pas de façon fiable vers un endroit que vous pouvez atteindre.
Les signets ne sont pas sur les pages
Un PDF a un catalogue : un objet au sommet du fichier qui dit où se trouve tout le reste. Les pages en dépendent, sous forme d’arbre. Plusieurs autres choses aussi, et deux d’entre elles font le sujet de cet article.
Où vivent réellement les signets
- Le catalogue : un objet au sommet du fichier dont tout le reste dépend.
- Le plan que votre lecteur affiche comme signets, et la table des destinations nommées. Les deux appartiennent au document, à aucune page.
- Ce qu’une fusion ou une division copie : les pages, et seulement les pages. Un document neuf est créé, avec un catalogue neuf et vide.
Le plan — ce que votre lecteur affiche comme signets dans son panneau latéral — est un arbre d’entrées qui dépend du catalogue. Chaque entrée a un titre et une destination, et la destination pointe vers un objet de page. La page n’en sait rien. Il n’y a aucune marque sur la page 14 disant « le chapitre 3 commence ici » ; il y a, ailleurs dans le fichier, une entrée de plan qui se trouve pointer vers la page 14.
Les destinations nommées sont une table de correspondance, portée elle aussi par le catalogue, qui associe des noms comme chapter3 à des endroits du document. Elles existent pour qu’un lien puisse dire « aller à chapter3 » plutôt que « aller à la page 14 », ce qui lui permet de survivre au déplacement du chapitre. C’est aussi par elles que des liens venus de l’extérieur du fichier atteignent un endroit précis à l’intérieur.
Les deux sont des propriétés du document. Aucune n’est une propriété d’une page. Cette seule phrase explique entièrement ce qui suit.
Ces outils construisent un document neuf
Fusionner, diviser, extraire des pages, supprimer des pages et réorganiser les pages fonctionnent tous de la même façon, dans votre navigateur : créer un PDF vide, y copier les pages voulues, l’enregistrer.
Ils ne modifient pas votre fichier. Rien n’est supprimé de quoi que ce soit — votre original reste intact sur votre disque, et ce que vous téléchargez est un document neuf qui contient les mêmes pages. C’est ce choix de conception qui rend ces outils rapides, qui leur permet de fonctionner hors ligne, et qui les empêche d’abîmer ce dont vous êtes parti.
C’est aussi exactement pourquoi les signets ne passent pas. L’opération de copie prend des pages. Le plan et la table des noms n’ont jamais été attachés à une page, il n’y a donc rien à emporter : le document neuf reçoit un catalogue tout neuf avec un plan vide, et votre lecteur, ne trouvant aucun plan, n’affiche aucun panneau de signets.
Le même raisonnement explique plusieurs autres choses que les gens remarquent :
- Les étiquettes de page ne passent pas non plus — les chiffres romains des pages liminaires, les préfixes d’annexe, et tout ce que votre lecteur affichait dans sa case de numéro de page. Même structure, même raison. Pourquoi les numéros de page d’un PDF ne correspondent pas aux pages traite les étiquettes en détail.
- Les champs de formulaire et les signatures ne survivent pas intacts non plus, et une signature ne pourrait pas être autorisée à le faire : elle certifie un document précis, et celui-ci est un autre document. Comment fonctionnent les formulaires PDF traite ce côté-là.
- Les numéros de page imprimés survivent, eux, parce qu’ils sont de l’encre sur la page, et ils seront désormais faux. Ce n’est pas un dysfonctionnement, c’est le même fait vu par l’autre bout.
Ce qui survit
Tout ce qui fait véritablement partie d’une page passe, parce que c’est la page qui est copiée :
- Tout le contenu visible — texte, polices, graphiques vectoriels, images, à pleine qualité. Les pages sont copiées, pas rendues à nouveau : rien n’est recompressé et rien ne perd de netteté.
- Les liens web. Un lien vers un site est une annotation posée sur la page, avec l’adresse écrite dedans. Il n’a besoin de rien en dehors de la page, il continue donc de fonctionner. Cela vaut pour les liens e-mail et tout ce qui est une adresse simple.
- Le format, la rotation et les boîtes de page. Chaque page porte les siens, un assemblage mêlant A4 et Letter reste mêlé, et une page couchée reste couchée. Pourquoi un PDF pivoté revient comme avant traite la rotation.
- Les commentaires et les surlignages, qui sont aussi des annotations de page — même si un fil de réponses qui renvoie au document peut finir incomplet.
Et ce qui ne survit pas : le plan, les destinations nommées, les étiquettes de page, les métadonnées du document comme le titre et l’auteur, les pièces jointes, les fils d’articles, et l’action d’ouverture du document — l’instruction qui dit à un lecteur d’ouvrir à la page 5 ou à un zoom précis.
Les métadonnées méritent une note à part, parce qu’elles coupent dans le bon sens : un document neuf ne naît pas en portant le nom d’auteur, le logiciel et l’historique de révision de l’ancien. Ce que contiennent les métadonnées d’un PDF couvre ce que cela comprend d’ordinaire, et l’éditeur de métadonnées vous permet de vérifier ce qui est ressorti.
Le cas délicat : les liens vers une autre page du même fichier
Une table des matières dont les entrées sautent aux chapitres, ou un renvoi « voir page 12 », est une annotation sur la page comme un lien web — mais au lieu d’une adresse, elle contient une destination : une référence à un autre objet de page du même document.
Ce qui arrive à un lien qui pointe à l’intérieur du document
- Les pages du nouveau document, dans l’ordre. C’est tout ce qu’un lecteur peut atteindre.
- La zone du lien, copiée avec sa page. Elle se met toujours en surbrillance au survol.
- Sa destination a été copiée aussi — comme un septième objet de page qui n’est pas dans l’arbre. Le fichier est valide, le lien est actif, et il ne mène nulle part.
Quand les pages sont copiées dans un document neuf, l’annotation suit sa page. Sa destination doit être copiée aussi, et cette destination est une page. La machinerie de copie suit donc la référence et fait passer cette page elle aussi — comme un objet distinct qui n’est pas dans l’arbre des pages du nouveau document.
Nous l’avons mesuré sur la sortie de ces outils plutôt que de le supposer. Fusionner un document de six pages contenant un lien interne produit un fichier avec sept objets de page et six pages. Le fichier est structurellement valide — un vérificateur n’y trouve rien d’anormal — et le lien se met toujours en surbrillance au survol. Il pointe simplement vers une page qui n’est pas dans le document, un lecteur n’a donc nulle part où vous emmener.
Donc : considérez que les liens internes ne survivent pas. La zone cliquable peut encore être là, ce qui est pire qu’une rupture franche parce que cela a l’air de fonctionner. C’est vrai même quand la page cible est une page que vous avez gardée, et même pour une simple fusion où toutes les pages ont été copiées.
Les liens qui utilisent une destination nommée échouent plus honnêtement : la table des noms est portée par le catalogue, elle a donc disparu, et le lien n’a rien à résoudre.
Que faire
Aucun outil de ce site n’écrit un plan, et cette page le dira plutôt que de laisser croire le contraire. Ce qu’il y a :
- Faites d’abord le travail sur les pages, la navigation en dernier. Fusionnez, divisez et réorganisez tant que le document est encore brut, et ajoutez les signets dans l’application qui produira le fichier final. Dans l’autre sens, le travail est jeté.
- Si l’assemblage a besoin de navigation, construisez-la depuis les documents source. Un traitement de texte ou un éditeur PDF de bureau capable d’écrire un plan est l’outil qu’il faut ; ces outils de navigateur ne le peuvent pas, et un outil qui prétend conserver les signets à travers une fusion fait considérablement plus que copier des pages.
- Ajoutez les numéros de page imprimés après la fusion, pas avant. Ajouter des numéros de page donne à l’assemblage une seule séquence honnête, et un réglage distinct permet de choisir sur quelle feuille commencer, pour qu’une page de couverture reste non numérotée.
- Donnez au lecteur une table des matières sous forme de texte. Ce n’est pas un substitut aux signets, mais dans un assemblage fusionné, une première page listant ce qui se trouve où survit à tout et ne demande aucune prise en charge particulière.
- Vérifiez avant d’envoyer. Ouvrez le résultat et regardez le panneau des signets et un ou deux renvois. Cela prend dix secondes, et l’alternative est de l’apprendre du destinataire.
Comment combiner des fichiers PDF et réordonner et supprimer des pages couvrent le reste de ce qui suit et de ce qui ne suit pas.
Les outils traités dans cet article
Sources
Documentation primaire des affirmations ci-dessus.