La définition qui marche
Une page est mince quand elle n'apporte rien que le lecteur ne trouve ailleurs. Pas quand elle est courte. Le test tient en une question : qu'est-ce que cette page contient que les cinq premiers résultats n'ont pas ? Si la réponse est « rien », vous y êtes, quelle que soit sa longueur.
Court ou mince, deux choses différentes
La confusion coûte cher, parce qu'elle envoie tout le monde dans la mauvaise direction. On rallonge des pages qui n'en avaient pas besoin, et on laisse tranquilles des pages longues qui posent un vrai problème.
| Page | Longueur | Verdict |
|---|---|---|
| Réponse précise à une question fermée | 300 mots | Excellente, rallonger la dégraderait |
| Fiche produit avec le texte du fabricant | 400 mots | Mince : le même texte existe sur cinquante sites |
| Article qui reformule les trois premiers résultats | 2 000 mots | Mince, et long |
| Page de ville identique aux trente autres, nom changé | 600 mots | Mince, et détectable en un coup d'œil |
| Page qui porte une donnée que vous seul publiez | 500 mots | Forte, et difficile à copier |
| Page de contact | 80 mots | Courte par nature, et parfaitement légitime |
La quatrième ligne concerne beaucoup de monde. Une série de pages construites sur le même gabarit n'est pas un problème en soi, elle le devient quand la seule chose qui change d'une page à l'autre est le nom. Les mêmes pages, portant chacune des données réelles et vérifiables qui lui sont propres, sont utiles et personne d'autre ne les propose. C'est le même travail de production, et deux résultats opposés. Voir les types de contenus.
Le signal que Google vous envoie
C'est le point que je veux mettre en avant, parce qu'il est explicite, gratuit, et presque jamais consulté.
Dans la Search Console, rapport Indexation des pages, le motif « Découverte, actuellement non indexée » signifie que Google connaît l'adresse de la page et a choisi de ne pas l'indexer. Le motif ne signale ni blocage technique ni file d'attente : Google a jugé la page. Quand ce motif concerne des dizaines de pages, vous tenez votre diagnostic.
| Signal | Où le lire | Ce qu'il veut dire |
|---|---|---|
| Découverte, actuellement non indexée | Rapport d'indexation | Google a vu et a dit non |
| Explorée, actuellement non indexée | Rapport d'indexation | Il l'a lue et n'en a rien fait : même diagnostic |
| Indexée, zéro impression sur 6 mois | Rapport Performances | Elle existe pour personne |
| Beaucoup de pages, très peu indexées | Comparaison crawl et index | Problème de qualité perçue à l'échelle du site |
| Autre page canonique sélectionnée | Rapport d'indexation | Doublon : voir contenu dupliqué |
L'effet d'entraînement, celui qu'on sous-estime. Le contenu mince ne se contente pas de ne rien rapporter. En quantité, il abaisse la perception globale du site : le budget d'exploration part sur des pages sans valeur, les pages fortes sont moins souvent revisitées, et les signaux se diluent. C'est pourquoi supprimer cinquante pages faibles fait parfois monter les pages restantes, alors qu'on n'a rien ajouté. Voir budget de crawl.
Les familles de pages concernées
Sur les sites que j'audite, le contenu mince se concentre presque toujours dans les mêmes endroits.
- Les fiches produits reprenant le texte du fabricant. Le même paragraphe existe sur tous les revendeurs. Le remède n'est pas de le paraphraser, c'est d'ajouter ce que vous savez : usages réels, compatibilités, délais, ce que les clients demandent au téléphone.
- Les pages de ville dupliquées. Trente pages identiques au nom près. Voir SEO local pour la façon de les rendre légitimes.
- Les étiquettes et catégories vides. Une étiquette créée pour un seul article, souvent en trois variantes orthographiques.
- Les archives par date et par auteur. Générées automatiquement, sans usage réel, indexées par défaut.
- Les vieux articles jamais mis à jour. Trois cents mots écrits en 2018 sur un sujet qui a changé depuis.
- Les pages créées pour une variante de mot-clé. « Plombier Lyon », « Plombier à Lyon » et « Plombier sur Lyon » font trois pages qui se concurrencent pour une seule intention.
- Les résultats de recherche interne indexés. Un générateur de pages infini, dont Google ne veut pas.
Enrichir, fusionner ou supprimer
Trois issues, et l'ordre des questions détermine laquelle choisir.
| Situation de la page | Décision | Comment |
|---|---|---|
| Elle reçoit des impressions | Enrichir | Quelqu'un la cherche : complétez-la à partir de ce que traitent les pages classées devant |
| Une autre page traite le même sujet | Fusionner | Gardez la meilleure, intégrez ce que l'autre apportait, redirigez en 301 |
| Ni impressions, ni équivalent, rien à en tirer | Supprimer | Erreur assumée, et retrait des liens internes qui y menaient |
| Utile aux visiteurs mais sans intérêt en recherche | Désindexer | Balise noindex : la page reste accessible, elle sort de l'index |
| Page générée automatiquement, sans usage | Désindexer ou bloquer | Étiquettes, archives, résultats de recherche interne |
Deux précautions avant de supprimer quoi que ce soit. Vérifiez les liens externes : une page sans trafic peut porter un lien qui, lui, a de la valeur, et il faut alors rediriger plutôt que supprimer. Et ne supprimez pas cent pages le même jour : par lots, en notant les dates, sans quoi vous ne saurez jamais ce qui a produit quoi.
Reprendre vaut mieux que produire
Sur la plupart des sites, les vingt pages qui reçoivent des impressions sans clics rapportent plus, et plus vite, que vingt pages neuves. Encore faut-il savoir lesquelles, et ce qui leur manque.
Reprise des pages existantes avant production de nouvelles.
Le cas du contenu produit par IA
La question revient à chaque discussion, et elle est mal posée. L'outil de production n'est pas le critère. Ce que visent les règles de Google, c'est le contenu produit en masse dans le but principal de manipuler le classement, quelle que soit la façon dont il a été fabriqué.
Concrètement, deux pages produites avec exactement le même outil peuvent recevoir deux traitements opposés. Celle qui porte une donnée vérifiée, à jour, que personne d'autre ne publie, apporte quelque chose : elle est utile, et elle se comporte comme telle. Celle qui reformule ce qui existe déjà partout n'apporte rien : elle est mince, et elle finit non indexée.
Le critère opérationnel, avant de lancer une série : la donnée qui différencie chaque page existe-t-elle vraiment, et peut-on la maintenir ? Si la réponse est non pour dix pages sur cent, ces dix pages ne doivent pas exister. C'est aussi simple, et aussi exigeant que cela.
Éviter d'en produire
- Une page par intention, pas par variante de mot-clé. Trois formulations d'une même recherche font une seule page.
- Décider de la valeur ajoutée avant d'écrire. Si vous ne savez pas dire ce que la page apportera de plus, ne l'écrivez pas.
- Ne pas viser un nombre de mots. Un objectif de longueur produit mécaniquement du délayage. Voir le bon nombre de mots.
- Désindexer par défaut ce qui est généré. Étiquettes, archives, filtres, recherche interne.
- Mettre à jour plutôt que republier. Reprendre une page existante concentre les signaux, en créer une nouvelle les disperse.
- Compter les pages sans impressions une fois par an. C'est le meilleur indicateur de la santé éditoriale d'un site.
Questions fréquentes
Sources
- Aide Search Console, rapport sur l'indexation des pages : le détail des motifs de non-indexation.
- Google Search Central, créer du contenu utile et fiable.
- Google Search Central, règles anti-spam : contenu produit en masse et pages satellites.