La question qui tranche

Un visiteur peut-il atteindre ce texte ? S'il lui suffit de cliquer sur un onglet, de déplier un bloc ou d'utiliser un lecteur d'écran, tout va bien. Si aucune action ne le lui rend accessible alors que le moteur le lit, c'est du texte caché, et c'est visé par les règles anti-spam. La technique employée ne change rien à l'affaire, l'intention si.

Ce qui est parfaitement légitime

Ombre portée, image d'un texte dissimulé dans une page

Commençons par là, parce que la peur du texte caché conduit à se priver de solutions d'ergonomie tout à fait valables.

CasPourquoi c'est admisLa condition
Accordéon, bloc dépliableChoix d'ergonomie courant, surtout sur mobileLe texte est dans le code, et un clic l'affiche
OngletsMême logique, pour organiser un contenu denseIdem
« Lire la suite »Évite un mur de texte à l'ouvertureLe contenu complet est présent dès le chargement
Menu replié sur mobileSans lui, la navigation serait inutilisableLes liens existent dans le code
Libellé pour lecteur d'écranBonne pratique d'accessibilité, recommandée par les standardsQuelques mots utiles, pas des paragraphes de mots-clés
Lien d'évitement en tête de pagePermet d'atteindre le contenu au clavierIl devient visible à la prise de focus

Sur le contenu replié, la position de Google est stable depuis le passage à l'indexation prioritaire sur mobile : ce qui est présent dans le code d'une page mobile est traité normalement, y compris dans un accordéon. La crainte ancienne selon laquelle un texte plié compterait moins n'a plus de fondement.

Le cas de l'accessibilité mérite d'être défendu. Masquer visuellement un libellé tout en le laissant lisible par une synthèse vocale est exactement ce que recommandent les référentiels d'accessibilité. Un intitulé de champ de recherche, la fonction d'un bouton représenté par une icône, le contexte d'un lien « en savoir plus » servent des utilisateurs réels, et les supprimer par peur du référencement dégrade le site pour les personnes qui en ont le plus besoin. Ce qui distingue ces libellés d'un texte caché, c'est qu'ils sont courts, utiles, et qu'ils décrivent ce que le visiteur voit.

Ce qui est visé

Les règles anti-spam de Google désignent le texte rendu invisible dans le but de manipuler le classement. Voici les procédés que je retrouve encore sur des sites anciens.

TechniqueComment elle se présenteDétection
Texte blanc sur fond blancLa plus ancienne, et toujours vivanteSélectionner toute la page : le texte apparaît en surbrillance
Taille de police nulleUn paragraphe réduit à rienRecherche dans le code des tailles à zéro
Positionnement hors écranLe bloc est déplacé à des milliers de pixels du cadreRecherche des valeurs de position négatives extrêmes
Texte derrière une imageEmpilement de couches, texte au fondDésactiver les images ou le CSS
Lien sur un caractère isoléUn point ou un espace transformé en lienCrawl : liens dont le texte fait un caractère
Bloc masqué par du styleUn pavé de mots-clés jamais affichéComparer le texte du code au texte rendu
Texte de la même couleur que le fond du blocVariante plus discrète du premier procédéSélection de la page, ou désactivation du CSS

Tous ces procédés ont un point commun, ils ne rapportent plus rien depuis très longtemps. Le risque subsiste, le bénéfice a disparu. Quand j'en trouve, c'est presque toujours un héritage, un vieux gabarit, une prestation ancienne ou un bloc ajouté par quelqu'un qui est parti depuis. Voir black hat SEO et cloaking, sa version plus grave.

Trouver du texte caché, en trois contrôles

  1. 1. Tout sélectionner, tout copier

    Sélectionnez l'intégralité de la page et collez-la dans un éditeur de texte brut. Tout ce qui apparaît et que vous n'aviez pas vu à l'écran mérite un examen. Trente secondes, et cela suffit dans la majorité des cas.

  2. 2. Désactiver le CSS

    Dans les outils de développement du navigateur, désactivez les feuilles de style. La page devient laide et parfaitement honnête, tout ce qui était masqué par du style s'affichant d'un coup.

  3. 3. Comparer le code au rendu, à l'échelle du site

    Un crawl qui extrait le texte du code et le compare au texte réellement affiché signale les écarts. C'est le seul moyen praticable au-delà de quelques dizaines de pages.

Un quatrième contrôle vaut la peine sur un site repris : regardez l'outil d'inspection d'URL de la Search Console, qui montre le HTML tel que Google l'a reçu. Un écart marqué entre ce qu'il voit et ce que vous voyez pose une question plus large que le texte caché.

Audit

Ce qu'on hérite en reprenant un site

Textes cachés, liens sortants oubliés et blocs de mots-clés d'une prestation ancienne ne se voient pas à l'écran, mais se trouvent en une heure de crawl. Autant le savoir avant d'investir sur le site.

Voir l'audit SEO

Contrôle du code servi, pas seulement de la page affichée.

Ce qu'il faut faire quand on en trouve

Le réflexe est de supprimer, et c'est souvent une occasion manquée.

Regardez d'abord ce que le texte contenait. Dans les cas que je rencontre, il s'agit fréquemment d'informations que la page gagnerait à afficher normalement : la liste des prestations, les zones desservies, des précisions techniques, des questions fréquentes. Quelqu'un a jugé, il y a des années, que c'était bon pour le référencement et mauvais pour le design, et a choisi de le cacher.

La bonne correction consiste donc à réécrire ce contenu à sa place, visible, dans le corps de la page. Vous supprimez le risque, et vous ajoutez du contenu réel là où il en manquait. C'est l'un des rares chantiers où corriger un défaut fait progresser la page.

Reste le cas du bourrage pur : trois cents mots-clés empilés sans phrase. Là, il n'y a rien à sauver, et c'est du keyword stuffing à supprimer sans état d'âme.

Ce que l'on risque vraiment

Questions fréquentes

Un texte dans un accordéon ou un onglet est-il pénalisé ?
Non, à condition qu'il soit accessible d'un clic et présent dans le code de la page. Les accordéons, les onglets et les blocs « lire la suite » sont des choix d'ergonomie parfaitement admis, et depuis l'indexation prioritaire sur mobile, Google indique traiter ce contenu comme le reste. Ce qui compte est l'intention : replier pour ne pas noyer le lecteur est légitime, replier pour dissimuler un texte destiné au seul moteur ne l'est pas.
Qu'est-ce qui est réellement interdit ?
Le texte rendu invisible dans le but de manipuler le classement, c'est-à-dire tout ce qu'un visiteur ne peut pas atteindre alors que le moteur le lit. Texte blanc sur fond blanc, taille de police nulle, texte positionné hors de l'écran, texte glissé derrière une image, ou lien posé sur un caractère isolé. La règle tient en une question : si vous montriez cette page à un client, verrait-il tout ce que Google voit ?
Les textes destinés aux lecteurs d'écran posent-ils problème ?
Non, et c'est même l'inverse : une classe qui masque visuellement un libellé tout en le laissant lisible par une synthèse vocale est une bonne pratique d'accessibilité, recommandée par les standards du web. Un intitulé de champ, un texte alternatif de bouton ou un lien d'évitement en début de page entrent dans cette catégorie. La différence avec le texte caché tient à l'intention et au volume : quelques mots utiles à un utilisateur, pas trois paragraphes de mots-clés.
Comment savoir si un site contient du texte caché ?
Le contrôle le plus rapide consiste à sélectionner toute la page avec le raccourci de sélection puis à la copier dans un éditeur de texte, où tout ce qui apparaît et que vous n'aviez pas vu à l'écran mérite un examen. En complément, désactivez le CSS de la page dans les outils de développement du navigateur, ce qui fait apparaître d'un coup tout ce qui était masqué par du style. Sur un site entier, un crawl comparant le texte du code au texte rendu fait le même travail à grande échelle.
Que risque-t-on concrètement ?
Cela dépend de l'ampleur. Une occurrence isolée héritée d'un vieux gabarit passe le plus souvent inaperçue et le texte est simplement ignoré. Une pratique systématique sur tout un site relève des règles anti-spam et peut valoir une action manuelle, notifiée dans la Search Console, avec une chute de visibilité à la clé. Dans tous les cas, le calcul est mauvais : le gain espéré est nul depuis longtemps, et le risque, lui, existe toujours.
J'ai trouvé du texte caché sur un site que je reprends, que faire ?
Le retirer, sans hésiter, et vérifier ensuite s'il portait quelque chose d'utile. Beaucoup de textes cachés hérités contiennent en réalité des informations que la page gagnerait à afficher normalement : une liste de prestations, des zones desservies, des précisions. Réécrivez-les à leur place, visibles, dans le corps du contenu. Vous supprimez le risque et vous ajoutez du contenu réel, ce qui est doublement gagnant.

Sources