Ce que la métaphore recouvre
Le mécanisme derrière la métaphore est le PageRank, publié en 1998. Une page distribue sa valeur entre ses liens sortants, avec un amortissement à chaque saut. Trois conséquences pratiques : moins de liens sur une page, plus chacun compte ; le sculptage par nofollow ne fonctionne plus depuis 2009 ; et les scores d'autorité des outils du marché ne sont pas le PageRank de Google, seulement des estimations.
D'où vient l'idée
Le concept vient de l'article fondateur de Larry Page et Sergey Brin, publié à Stanford en 1998, qui décrit l'algorithme PageRank. Son principe est emprunté à la bibliométrie : une page importante est une page vers laquelle pointent des pages importantes, et cette définition circulaire se résout par itérations successives sur l'ensemble du graphe du web.
Deux éléments de l'algorithme d'origine expliquent la métaphore et ses limites.
- La division entre les liens sortants. Une page distribue sa valeur entre les liens qu'elle porte. Une page qui fait dix liens transmet, toutes choses égales par ailleurs, dix fois moins par lien qu'une page qui n'en fait qu'un. C'est le fondement de tout le raisonnement de maillage interne.
- Le facteur d'amortissement. L'article retient une valeur d'environ 0,85 : à chaque saut, une part de la valeur se perd, ce qui modélise la probabilité qu'un internaute cesse de suivre des liens. Concrètement, la valeur se dégrade vite avec la profondeur, et une page à cinq clics de l'accueil ne reçoit presque plus rien.
Ce que la métaphore fait mal comprendre. Le mot « jus » suggère un réservoir qui se vide, et donc qu'un lien sortant vers un autre site vous appauvrit. C'est faux dans le modèle : la valeur d'une page se recalcule à chaque itération à partir de ce qu'elle reçoit, elle ne se consomme pas. Faire un lien vers une source de qualité ne vous coûte rien de mesurable, et l'idée inverse a produit des années de pages qui refusaient de citer leurs sources. C'est aussi vrai que le classement de Google en 2026 ne se réduit évidemment pas au PageRank : celui-ci n'est plus qu'un signal parmi beaucoup d'autres.
Les attributs de lien, et ce qui a changé en 2019
C'est le point le plus mal actualisé du sujet, parce que la règle qu'on a apprise en 2005 n'est plus celle qui s'applique.
| Attribut | À quoi il sert | Depuis quand |
|---|---|---|
rel="nofollow" | Signaler qu'on ne veut pas être associé à la page liée, ni qu'elle soit explorée depuis chez soi | 2005, redéfini en 2019 |
rel="sponsored" | Marquer un lien payé ou une publicité. Obligatoire sur tout lien commercial | 10 septembre 2019 |
rel="ugc" | Marquer un lien issu d'un contenu déposé par un utilisateur : commentaire, forum | 10 septembre 2019 |
Le changement de fond est ailleurs. Le 10 septembre 2019, Google a annoncé que ces trois attributs deviennent des indications et non plus des directives strictes, pour le classement dès cette date et pour l'exploration et l'indexation à partir du 1er mars 2020. La documentation actuelle indique que les liens ainsi marqués ne sont généralement pas suivis, et rappelle que la page liée peut de toute façon être découverte autrement, par un plan de site ou par un lien depuis un autre domaine.
Ce que cela change en pratique : on ne peut plus raisonner comme si un nofollow bloquait quelque chose de façon certaine. C'est un signal envoyé à Google, pas un interrupteur. Voir le backlink nofollow et les attributs sponsored et ugc.
Le sculptage de PageRank, mort en 2009
L'idée avait sa logique : si une page distribue sa valeur entre ses liens, il suffirait de mettre en nofollow les liens sans intérêt, mentions légales, contact, panier, pour que la part récupérée aille aux pages qui comptent.
Matt Cutts a mis fin à cette lecture en 2009 en expliquant comment le calcul fonctionne réellement : la part attribuée à un lien en nofollow n'est pas redistribuée aux autres liens de la page, elle est simplement perdue. Mettre dix liens en nofollow sur une page qui en compte vingt ne double pas la valeur des dix autres ; cela retire la moitié de ce que la page distribuait.
La conséquence est simple et souvent mal admise : la seule façon de concentrer l'autorité interne est de faire moins de liens, pas d'en neutraliser. Cela se décide au moment de construire le gabarit de page, pas après coup.
Ce qui marche encore, en maillage interne
Une fois retirées les fausses idées, il reste des principes solides, qui découlent directement du modèle.
- 1. Réduire la profondeur des pages importantes
Chaque saut supplémentaire amortit la valeur reçue. Une page stratégique à quatre clics de l'accueil est mal alimentée par construction. Trois clics est un bon plafond, deux pour les pages qui doivent se positionner sur des requêtes disputées.
- 2. Alléger les gabarits
Un pied de page à quatre-vingts liens répétés sur toutes les pages du site dilue chaque lien du site entier. C'est l'un des postes d'amélioration les plus rentables, et il se corrige une fois pour tout le site.
- 3. Faire les liens dans le texte, pas dans un bloc
Un lien posé dans une phrase apporte un contexte que le moteur exploite, ce qu'un module « articles similaires » ne fait pas. C'est la logique développée dans la création d'un cocon sémantique.
- 4. Soigner les ancres, sans les suroptimiser
L'ancre décrit la page d'arrivée. Répéter la même ancre exacte cent fois sur un site est un signal artificiel ; varier naturellement est à la fois plus lisible et plus sûr. Voir l'ancre de lien.
- 5. Supprimer les pages orphelines
Une page vers laquelle aucun lien interne ne pointe ne reçoit rien du tout. Un crawl du site les remonte en quelques minutes, et c'est souvent la correction la plus rentable d'un audit. Voir la page orpheline.
Ce qu'on peut mesurer, et ce qu'on ne peut pas
Le PageRank interne de Google n'est pas observable. Ce qui l'est :
| Ce qu'on mesure | Avec quoi | Ce que ça vaut |
|---|---|---|
| Profondeur de chaque page | Un crawler de site | Directement actionnable. La donnée la plus utile du lot |
| Nombre de liens internes entrants par page | Le même crawl | Révèle immédiatement les pages stratégiques sous-alimentées |
| Nombre de liens sortants par gabarit | Le même crawl | Sert à décider quoi retirer d'un pied de page |
| Scores d'autorité de domaine des outils | Les outils du marché | Des estimations propriétaires, utiles pour comparer deux sites, jamais pour connaître ce que Google calcule |
| PageRank affiché de la barre d'outils | Plus rien | Gelé en 2013, retiré en 2016. Toute mention actuelle est un signal d'obsolescence de la source |
Deux tableaux suffisent
Je ne cherche pas à modéliser une distribution de valeur, ce serait une illusion de précision. Je fais deux tableaux à partir d'un crawl. Le premier croise les pages stratégiques, celles qui font l'activité du client, avec leur profondeur et leur nombre de liens internes entrants ; il révèle presque toujours une page importante à quatre clics avec trois liens entrants. Le second liste les liens répétés sur toutes les pages, et sert à décider ce qui sort des gabarits. Ces deux tableaux couvrent l'essentiel du sujet, et ils tiennent en une demi-journée.
Questions fréquentes
Sources
- Page, Brin, Motwani et Winograd, « The PageRank Citation Ranking: Bringing Order to the Web », rapport technique de l'université Stanford, 1998 : division de la valeur entre liens sortants et facteur d'amortissement d'environ 0,85.
- Google Search Central, « Evolving nofollow », 10 septembre 2019 : création de
sponsoredetugc, passage des trois attributs au statut d'indication, effectif le 1er mars 2020 pour l'exploration et l'indexation. - Google Search Central, qualifier ses liens sortants : usage actuel des trois attributs et rappel que la page liée peut être découverte par d'autres voies.
- Fin du sculptage de PageRank : explications publiques de Matt Cutts en 2009 sur la non-redistribution de la part attribuée à un lien en nofollow.