Ce qu'il faut retenir

Le Black Hat désigne le non-respect des règles anti-spam publiées par Google, qui comptent dix-huit entrées. Trois d'entre elles ont pris beaucoup d'importance ces dernières années : le contenu produit à grande échelle, l'abus de réputation de site et le rachat de domaines expirés. Les sanctions prennent deux formes très différentes, et seule l'une des deux est notifiée. Ce qui devrait faire réfléchir avant d'y aller relève du calcul de rentabilité plus que de la morale.

Représentation d'une tentative de manipulation du classement dans un moteur de recherche

La distinction entre chapeau blanc et chapeau noir est héritée des débuts du référencement, et elle a le défaut de suggérer une question de morale là où il s'agit d'un contrat. Google publie ses règles, tout le monde peut les lire, et ce qu'on appelle Black Hat désigne simplement ce qui les enfreint. Le seul débat qui vaille porte sur le rapport entre le gain espéré et le risque encouru.

Ce que Google range dans ses règles anti-spam

Le document de référence compte dix-huit entrées. Les huit suivantes sont celles que je rencontre réellement sur le terrain.

PratiqueEn quoi elle consisteFréquence en audit
Liens créés pour manipulerLiens obtenus dans le but principal d'influencer le classementTrès fréquente
Contenu à grande échelleProduction de nombreuses pages sans valeur propre, quel que soit le mode de rédactionEn forte hausse
Abus de réputation de sitePublier du contenu tiers sur un domaine établi pour profiter de son autoritéEn hausse, et surveillée de près
Domaines expirés détournésRacheter un domaine pour en exploiter l'historique sur un sujet sans rapportFréquente sur les marchés concurrentiels
DissimulationServir un contenu différent au robot et à l'internauteRare, souvent involontaire
Texte et liens cachésContenu invisible à l'écran mais présent pour le moteurRare, héritage de vieux sites
Accumulation de mots-clésRépétition anormale d'expressions dans une pageEn voie de disparition
Pages satellitesPages quasi identiques créées pour capter des variantes de requêtesEncore courante en SEO local

Le contenu à grande échelle, l'abus de réputation et les domaines expirés sont les trois entrées les plus récentes, et elles visent des pratiques qui n'étaient pas explicitement couvertes il y a cinq ans. Google est passé de la manipulation technique d'une page à la production industrielle de contenu et à l'exploitation de l'autorité d'un domaine.

Les deux types de sanction

La confusion entre les deux mécanismes est la source de la plupart des mauvaises décisions prises après une chute de trafic.

L'action manuelle est décidée par un évaluateur humain. Elle est notifiée dans la Search Console, elle précise le motif, et elle ouvre une procédure : on corrige, on demande un réexamen, on obtient une réponse. C'est désagréable, mais c'est un processus avec un interlocuteur et une fin.

Le déclassement algorithmique n'est jamais notifié. Le site perd des positions, personne ne dit pourquoi, et il n'existe aucune procédure de recours. La remontée suppose de corriger ce qu'on suppose être la cause, puis d'attendre une réévaluation qui peut prendre des mois.

Cherchez la notification en premier. Une action manuelle arrive avec son motif et sa procédure de sortie, quand un déclassement algorithmique laisse le site chercher tout seul pendant des mois. Devant une chute inexpliquée, l'ouverture de la Search Console décide donc de toute la suite du travail, avant même qu'on ait regardé une seule page.

Le calcul économique

Je ne fais pas la leçon sur ce sujet, et je n'ai jamais vu la morale convaincre qui que ce soit en rendez-vous. Ce qui fait réfléchir un dirigeant tient en trois lignes de comptabilité.

La durée. Une technique de manipulation fonctionne jusqu'à ce qu'elle cesse de fonctionner, et personne ne choisit la date. Sur un site que vous comptez garder dix ans, vous construisez sur un terrain dont vous ignorez la date d'expiration.

Le coût de la remise en état. Il est presque toujours supérieur au gain obtenu, parce qu'il faut à la fois défaire ce qui a été fait et reconstruire ce qui aurait dû l'être. Sur les dossiers de sortie de pénalité que j'ai traités, le temps passé dépassait largement celui qu'aurait demandé un travail propre au départ.

L'effet sur la revente. Un site à l'historique douteux se vend mal, et l'acquéreur sérieux regarde le profil de liens avant de signer.

Ce calcul s'inverse dans un cas. Sur un site jetable, construit pour une campagne courte, sans valeur de marque et sans intention de durer, le risque ne pèse rien puisqu'il n'y a rien à perdre. C'est une stratégie qui existe, qui a ses praticiens, et qui n'a simplement rien à voir avec l'accompagnement d'une entreprise dans la durée.

La zone grise

Entre le respect intégral des règles et la manipulation caractérisée, il existe une bande large où se situe l'essentiel du métier réel. Deux exemples suffisent à la décrire.

Le lien obtenu contre rémunération. Au sens strict des règles, un lien payé qui transmet du signal est visé. Dans la réalité, l'écart est immense entre un article sponsorisé publié sur un média lu par de vrais lecteurs, avec un contenu qui tient debout, et un réseau de sites créés pour vendre des liens à la chaîne. Le premier ressemble à du partenariat éditorial et se distingue mal d'un placement de marque. Le second est un schéma que sa régularité rend détectable par construction. Ce n'est pas la même pratique, et je refuse de les traiter avec le même mot.

Le contenu produit avec des outils. Google vise la production de nombreuses pages dont l'objectif principal est le classement plutôt que le lecteur, et le mode de rédaction n'entre nulle part dans son texte. Une page utile reste une page utile, quel que soit l'outil qui a aidé à l'écrire, et mille pages creuses restent mille pages creuses, qu'un humain ou une machine les ait produites.

Dans les deux cas, le critère qui tranche est le même : est-ce que cette chose existerait s'il n'y avait pas de moteur de recherche ? Si la réponse est non, vous êtes du mauvais côté, quelle que soit la propreté de l'exécution.

Reprendre un site à l'historique douteux

  1. Vérifier les notifications. Une action manuelle change complètement la méthode et le calendrier.
  2. Inventorier le profil de liens. Sur un outil disposant d'un index de liens, en cherchant les schémas : mêmes ancres répétées, mêmes réseaux de domaines, pics d'acquisition sans événement correspondant.
  3. Repérer les pages produites en masse. Des centaines de pages au même gabarit, avec une variable qui change et rien d'autre, sont le motif le plus courant aujourd'hui.
  4. Contrôler ce qui est servi au robot. Comparer le contenu vu par un visiteur et celui renvoyé au robot. Le sujet est traité en détail sur ma page consacrée au cloaking.
  5. Décider quoi garder. Supprimer une page sans valeur coûte moins cher que d'essayer de la sauver, et le nettoyage produit souvent un gain à lui seul.

Questions fréquentes

Qu'est-ce que le Black Hat SEO ?
L'ensemble des pratiques qui contreviennent aux règles anti-spam de Google. Google en publie la liste complète, qui n'a rien d'une catégorie morale : dissimulation, pages satellites, texte caché, accumulation de mots-clés, liens créés uniquement pour manipuler le classement, contenu produit en masse sans valeur, et une dizaine d'autres entrées.
Quelle est la sanction en cas de Black Hat ?
Deux mécanismes coexistent. L'action manuelle est décidée par un évaluateur, notifiée dans la Search Console, et peut être levée après correction et demande de réexamen. Le déclassement algorithmique, lui, n'est jamais notifié, et le site perd des positions sans explication ni procédure de recours.
Acheter un lien est-il du Black Hat ?
Au sens des règles de Google, tout lien obtenu contre rémunération et transmettant du signal est concerné. Dans la pratique, l'écart est immense entre un article payé sur un vrai média lu par de vrais lecteurs et un réseau de sites créés pour vendre des liens. Le premier ressemble à du sponsoring éditorial, le second est un schéma détectable par construction.
Le contenu généré par IA est-il pénalisé ?
Non, les règles portent sur l'intention et jamais sur le mode de production. Google sanctionne la génération de nombreuses pages dans le but principal de manipuler le classement, quelle que soit la méthode employée. Une page utile écrite avec l'aide d'un outil ne pose aucun problème ; mille pages sans valeur en posent un, qu'elles soient écrites par une machine ou par un humain.
Combien de temps faut-il pour se relever d'une sanction ?
Pour une action manuelle, comptez de deux semaines à trois mois après une correction complète et une demande de réexamen argumentée. Pour un déclassement algorithmique, il faut attendre une réévaluation du site, qui peut prendre plusieurs mois et n'a rien d'automatique.

Sources