Pages orphelines : le lien manquant que le CMS a créé

Ordinateur portable noir ouvert de trois quarts sur fond blanc

Un lien oublié, et la page disparaît des radars. Pas supprimée, pas cassée : juste posée là, sans personne pour la pointer. WordPress en fabrique tous les jours, des archives de date, des pages d’auteur, des résultats de recherche, sans que l’auteur s’en aperçoive. Le pire, c’est que la plupart du temps, on croit avoir maillé son contenu. On a ajouté des liens entre ses articles, on a soigné ses ancres, et pourtant une partie du site reste dans l’ombre.

Une page existe, mais personne ne la trouve

Une page orpheline, dans le vocabulaire du référencement, c’est une page qui ne reçoit aucun lien interne, pas même depuis la navigation principale ou un vieil article qui traîne. Vous pouvez la consulter en tapant son URL dans la barre d’adresse, elle s’affiche correctement, elle a du contenu, parfois même de jolies images.

Mais pour un visiteur qui navigue normalement, elle n’existe pas. Et pour un robot qui explore en suivant les liens, elle n’existe pas non plus, ce qui rend le problème sournois : rien ne plante, aucun message d’erreur ne s’affiche, le site tourne.

La démonstration la plus simple consiste à ouvrir une page au hasard et à se demander par quel chemin un internaute pourrait bien y arriver. Si la réponse est « en tapant l’adresse à la main », la page est orpheline. Ça paraît évident dit comme ça, et pourtant dans la pratique, on ne le fait jamais, parce qu’on connaît l’adresse par cœur après l’avoir créée.

Le robot d’exploration de Google, lui, part de la page d’accueil, suit les liens qu’il rencontre, et découvre de proche en proche. Une page vers laquelle aucun lien ne mène reste en dehors de ce parcours, et peut très bien ne jamais être indexée, ou l’être des mois plus tard, par hasard, grâce à un lien externe ou à un plan de site. C’est un peu la loterie, et ça ne se voit pas dans la Search Console tant qu’on ne pense pas à chercher.

Le CMS fabrique des URL dans votre dos

Voilà le point que la plupart des guides survolent. Le maillage interne ne concerne pas seulement les articles qu’on publie. WordPress, et beaucoup d’autres systèmes de gestion de contenu, créent automatiquement des pages : archives par mois, archives par catégorie, pages d’auteur, résultats de recherche, pagination. Elles ont une URL, elles sont accessibles, et elles ne figurent dans aucun menu si personne ne les y met.

Prenez une page de résultats de recherche interne : elle se génère à la volée quand un visiteur tape un mot dans la barre de recherche du site, elle n’a souvent aucun lien entrant, et elle peut être indexée par Google si rien ne l’en empêche. Une page d’archive d’auteur, c’est pareil, puisqu’elle liste les articles d’une personne sans que rien sur le site ne pointe vers elle. Vous ne l’avez jamais créée au sens propre, donc vous ne pensez pas à la mailler, et c’est exactement là que l’orphelinage se glisse.

femme stressée devant ordinateur, mains sur visage, expression de désespoir

Les outils qui détectent les pages orphelines, comme creaweb3000.com, listent justement ces URL que l’auteur n’a jamais pensées comme des pages. Le diagnostic tombe souvent comme une surprise, parce qu’on croyait avoir tout relié et qu’on découvre une dizaine d’adresses isolées. La vérification explicite, page par page, reste le seul moyen d’en avoir le cœur net.

Ce qui trahit une page isolée

Plusieurs signaux reviennent, et aucun ne suffit à lui seul à confirmer l’orphelinage ; en revanche, quand deux ou trois se cumulent sur une même adresse, il y a de fortes chances qu’elle soit seule au monde, sans aucun chemin d’accès depuis le reste du site. Sur ce point, voir aussi notre article sur date journal systeme.

  • Elle apparaît dans le plan de site XML mais dans aucun menu, aucune sidebar, aucun fil d’Ariane.
  • Combien de clics la séparent de la page d’accueil ? Si vous devez en compter plus de quatre, méfiance.
  • La Search Console la signale comme « détectée, actuellement non indexée » et ça dure.
  • Une page de catégorie que vous n’avez jamais ouverte depuis sa création.
  • Son trafic organique est nul depuis des mois, alors qu’elle contient un vrai contenu.

Le lien interne joue un rôle qu’on sous-estime. Il ne sert pas qu’à guider le lecteur, puisqu’il transmet aussi du « jus SEO », le fameux PageRank que Google répartit de page en page. Une page sans lien entrant n’en reçoit aucun, et elle reste à zéro, même avec un texte parfait. Aucune astuce de rédaction ne compense ça, c’est mécanique.

Le budget de crawl, ce robinet qu’on oublie d’ouvrir

Un moteur de recherche n’explore pas un site à l’infini : il consacre un temps limité à chaque domaine, ce qu’on appelle le budget de crawl. Chaque page orpheline qui traîne consomme une part de ce temps sans rien rapporter, puisqu’elle ne sera probablement jamais découverte par les liens, et pendant ce temps, les pages récentes qui comptent attendent leur tour.

La logique s’inverse quand on y pense deux minutes : en laissant des URL isolées se multiplier, on réduit la vitesse à laquelle Google explore ce qui compte vraiment. Le problème n’est pas tant la page oubliée elle-même que la place qu’elle occupe dans une file d’attente déjà chargée. Nettoyer le maillage, c’est aussi rendre le crawl plus efficace.

Franchement, la solution n’a rien de spectaculaire. On ouvre la liste des pages du site, on prend chaque URL, et on cherche qui pointe vers elle. Quand la réponse est personne, on ajoute un lien depuis un contenu proche, un article de la même catégorie par exemple, avec une ancre qui décrit la page d’arrivée, puis on vérifie que ce lien apparaît bien dans le corps du texte et pas seulement dans un bloc de navigation secondaire. Ce travail prend une heure, parfois deux, et il règle un problème que six mois de publication n’auraient pas résolu.

Trois individus en conversation dans un salon, documents et téléphone en main

Pourquoi ça nous échappe

L’angle mort, c’est la mémoire. On se souvient d’avoir créé la page, donc on suppose qu’on l’a reliée. Le CMS, lui, ne suppose rien : il génère, il affiche, il attend. Les archives, les résultats de recherche, les pages d’auteur naissent sans lien entrant par défaut, et il faut une action volontaire pour les intégrer au reste. Personne ne la fait, parce que personne ne sait qu’elles existent.

Une page devient donc orpheline au moment précis où le CMS crée son URL sans qu’aucun lien interne ne pointe vers elle, même quand l’auteur est persuadé d’avoir maillé son site. Le maillage réel ne se limite pas aux articles publiés. Combien de pages de votre propre site n’avez-vous jamais ouvertes depuis leur création ? C’est souvent la question qui fait tomber le masque.

Le maillage se vérifie, il ne se suppose pas

Retenez l’essentiel : une page que rien ne relie reste invisible pour les visiteurs comme pour les robots, et le CMS en fabrique sans prévenir. L’inventaire prend une heure, pas une semaine, et il évite de publier dans le vide pendant des mois. Ouvrir la liste des URL, une par une, et chercher le lien entrant manquant reste la seule méthode fiable pour sortir ces pages de l’ombre.

Laisser un commentaire