Ce qu'est vraiment un audit SEO
Un audit SEO n'est pas une liste d'erreurs techniques exportée d'un outil. C'est une analyse structurée de tout ce qui influence la visibilité d'un site dans les résultats de recherche : la technique, le contenu, l'architecture interne, le profil de liens et le positionnement face à la concurrence. L'objectif est un état des lieux précis et priorisé, pas un PDF de 80 pages que personne ne lit jusqu'au bout.
Quand j'audite un site, je cherche à répondre à trois questions concrètes, dans cet ordre : qu'est-ce qui pénalise ce site aujourd'hui, qu'est-ce qui fonctionne et peut être amplifié, et quelles opportunités la concurrence n'a pas encore saisies. Tout le reste est du détail.
Ce qu'un audit n'est pas
Ce n'est pas un export Screaming Frog brut, ni un score sur 100 généré automatiquement, ni un document qui dit "ajoutez des mots-clés". Un audit qui ne hiérarchise pas les problèmes par impact ne sert à rien : on ne sait pas par où commencer.
Pourquoi auditer avant d'agir
La plupart des budgets SEO sont gaspillés faute de diagnostic. On lance de la rédaction sur un site dont le crawl est saturé, on achète des liens vers des pages qui se cannibalisent, on refait un design qui casse l'indexation. Chaque action menée à l'aveugle coûte du temps et de l'argent, et masque la vraie cause d'une stagnation.
Un audit inverse la logique : on identifie d'abord le facteur qui plafonne le site, puis on concentre l'effort dessus. Sur la majorité des sites que j'analyse, l'essentiel du potentiel bloqué tient à deux ou trois problèmes précis. Les trouver vaut mieux que corriger cinquante détails sans effet.
Les six problèmes que je trouve le plus souvent
À force d'auditer des sites de tailles et de secteurs différents, on finit par voir revenir les mêmes causes. Elles ne sont ni exotiques ni sophistiquées, et c'est précisément pour ça qu'elles passent inaperçues : personne ne les cherche.
- Des pages qui reçoivent des impressions mais aucune position exploitable. Le site est visible sur des requêtes, très loin dans les résultats. C'est le gisement le plus rentable d'un audit : la page existe déjà, Google la comprend déjà, il manque souvent une réécriture et deux liens internes.
- De la cannibalisation entre deux ou trois pages. Plusieurs URLs visent la même requête et se neutralisent. Aucun crawl ne le signale, aucune alerte ne se déclenche. J'y consacre une section entière plus bas.
- Un maillage interne qui ne reflète pas les priorités. Les pages qui font le chiffre d'affaires reçoivent trois liens internes, une mention légale en reçoit deux cents parce qu'elle est dans le pied de page. Le site indique à Google exactement l'inverse de ce que veut l'entreprise.
- Des redirections empilées après une migration. Chaînes de deux ou trois sauts, boucles, redirections vers la page d'accueil au lieu de l'équivalent réel. Chaque saut dilue, chaque redirection vers l'accueil jette la page.
- Un contenu correct mais impossible à extraire. La réponse existe, noyée au sixième paragraphe, sans titre qui l'annonce. Google la trouve mal, un moteur génératif ne la cite pas du tout.
- Des paramètres d'URL qui dupliquent tout le catalogue. Filtres, tris, pagination mal gérée : le site fait croire à Google qu'il a dix fois plus de pages qu'il n'en a, et le budget de crawl se dilue dans des variantes sans valeur.
Aucun de ces six points n'exige un outil rare. Ils exigent qu'on les cherche, et qu'on sache reconnaître ce qui est anormal. C'est toute la différence entre lancer un crawl et faire un audit.
Un diagnostic priorisé, et une heure pour l'expliquer
Les vérifications gratuites de cette page éliminent les problèmes grossiers. Pour le reste, il faut croiser le crawl, vos données réelles et la concurrence, puis trancher par impact.
Chiffré après avoir regardé votre site, jamais sur un nombre de pages annoncé.
Les 5 axes d'un audit complet
| Axe | Ce qui est analysé | Outils |
|---|---|---|
| Technique | Vitesse et Core Web Vitals, indexation, balises canoniques, erreurs 404, redirections, structure des URLs, mobile, robots.txt et sitemap | Screaming Frog, Search Console, PageSpeed |
| Contenu | Qualité et unicité des textes, couverture des intentions de recherche, structure des titres, contenu dupliqué, thin content | Screaming Frog, analyse manuelle, Search Console |
| Maillage interne | Architecture des liens, profondeur de crawl, pages orphelines, ancres, transmission du jus de lien | Screaming Frog, analyse manuelle |
| Profil de liens | Volume et qualité des backlinks, domaines référents, liens toxiques, ancres entrantes, comparaison concurrence | Ahrefs, Semrush, Majestic |
| Positionnement | Mots-clés positionnés, évolution des positions, cannibalisation, pages sous-performantes, requêtes non couvertes | Search Console, Semrush, Monitorank |
Ces cinq axes ne pèsent pas le même poids selon les sites. Sur un e-commerce ancien, la technique et la cannibalisation dominent. Sur un site récent, c'est presque toujours le contenu et le maillage. La valeur d'un audit tient justement à savoir où creuser, pas à tout analyser au même niveau.
Ma méthode, étape par étape
Je n'applique pas un protocole identique à tous les sites. Chaque audit commence par le contexte : votre secteur, vos objectifs, l'histoire du site, les migrations passées, les chutes de trafic, les actions déjà tentées. C'est ce contexte qui décide de la profondeur sur chaque axe.
- Prise de contexte et accès
Entretien pour comprendre votre situation et vos objectifs. Accès à Search Console et Analytics. Sur les cas complexes, je peux demander les logs serveurs pour analyser le crawl réel de Googlebot, mais ce n'est pas systématique.
- Crawl complet
Le crawl cartographie toutes les pages et remonte les erreurs, les redirections en chaîne, les balises manquantes, la profondeur. L'outil produit la donnée brute ; l'interprétation, elle, est faite à la main.
- Analyse manuelle des pages stratégiques
Les outils ne voient pas la qualité réelle d'un contenu ni la pertinence d'une structure. J'analyse à la main les pages qui comptent : pages money, piliers, et celles qui captent déjà des impressions sans convertir.
- Analyse de la concurrence
Identification de vos vrais concurrents sur Google, de leur profil de liens et de leur stratégie de contenu. C'est souvent là que se trouvent les meilleures pistes d'action, pas dans vos propres erreurs.
- Rapport priorisé et restitution
Un rapport où chaque problème est classé par impact et par effort, expliqué et illustré. Suivi d'une session où on passe les priorités en revue ensemble. Un rapport qu'on ne vous explique pas n'a aucune valeur.
L'audit de cannibalisation, l'angle que les outils ne voient pas
La cannibalisation de mots-clés est l'une des causes les moins visibles de stagnation. Elle se produit quand plusieurs pages d'un même site visent la même requête et se concurrencent dans les résultats : aucune ne se positionne correctement, alors qu'une seule page bien travaillée l'aurait fait.
Ce problème n'apparaît dans aucun crawl technique. Il se détecte en croisant les données de Search Console (plusieurs URLs qui ressortent sur les mêmes requêtes) avec une lecture manuelle des contenus. C'est la partie de l'audit qui demande le plus d'interprétation, et c'est souvent celle qui débloque le plus de trafic. Les cas les plus fréquents :
- Un article de blog et une page de service qui visent le même mot-clé transactionnel.
- Plusieurs articles proches (variantes ou synonymes) qui se font concurrence entre eux.
- Une vieille page jamais supprimée qui concurrence une page plus récente et plus complète.
- Une page catégorie e-commerce et une page de marque sur la même requête.
La solution dépend du cas : redirection 301 de la page faible vers la forte, fusion des contenus, ou simple dé-optimisation pour déplacer une page vers une autre intention. Sur les sites qui stagnent malgré un bon contenu, c'est le premier endroit où je regarde.
La détecter vous-même, en dix minutes
Dans la Search Console, ouvrez le rapport Performances, passez la période à 16 mois, puis cliquez sur une requête importante dans l'onglet Requêtes. Basculez ensuite sur l'onglet Pages : vous voyez alors les URLs qui ressortent sur cette seule requête. Si deux ou trois de vos pages apparaissent avec des impressions comparables, vous tenez un cas de cannibalisation. Répétez sur vos vingt requêtes les plus stratégiques, c'est là que le problème coûte le plus cher.
L'accessibilité aux moteurs génératifs, le volet neuf de l'audit
Depuis que ChatGPT, Perplexity et les aperçus IA de Google renvoient des réponses citant des sources, un site peut être parfaitement référencé dans Google et totalement absent de ces réponses. La cause est souvent triviale : ses robots sont bloqués, par le fichier robots.txt, par un pare-feu applicatif ou par une protection anti-bot activée par défaut chez l'hébergeur.
Le point important, et il est mal compris, c'est que ces robots n'ont pas tous la même fonction. Certains collectent des données pour entraîner les modèles, d'autres vont chercher des pages au moment où un utilisateur pose une question. Bloquer les premiers est un choix légitime. Bloquer les seconds revient à se retirer des réponses.
| Robot | Éditeur | À quoi il sert | Le bloquer, ça veut dire |
|---|---|---|---|
GPTBot |
OpenAI | Collecte pour l'entraînement des modèles | Refuser que vos contenus servent à entraîner. Sans effet sur les citations. |
OAI-SearchBot |
OpenAI | Indexation pour la recherche de ChatGPT | Sortir des sources citées par ChatGPT. |
ChatGPT-User |
OpenAI | Récupération d'une page à la demande d'un utilisateur | Empêcher ChatGPT d'ouvrir votre page quand quelqu'un lui donne le lien. |
ClaudeBot |
Anthropic | Collecte pour l'entraînement | Même logique que GPTBot. |
Claude-SearchBot |
Anthropic | Indexation pour la recherche de Claude | Sortir des sources citées par Claude. |
PerplexityBot |
Perplexity | Indexation du web pour Perplexity | Sortir des sources citées par Perplexity. |
Google-Extended |
Jeton d'exclusion pour l'entraînement de Gemini | Refuser l'entraînement, sans toucher au référencement Google classique. |
La configuration que je recommande dans la majorité des cas est asymétrique : laisser passer les robots de recherche et de récupération, et décider séparément, selon votre position sur le sujet, du sort des robots d'entraînement. C'est une position que la documentation d'OpenAI prévoit explicitement, en distinguant GPTBot d'OAI-SearchBot.
Deux vérifications complètent ce volet. D'abord, votre contenu doit être lisible sans exécution de JavaScript : la plupart de ces robots ne rendent pas les pages comme un navigateur, et un texte injecté côté client leur est invisible. Ensuite, votre hébergeur ou votre CDN ne doit pas renvoyer un code 403 à ces robots au motif qu'ils ne sont pas Googlebot. Ce cas est fréquent, silencieux, et se teste en une requête. Le sujet est détaillé sur la page GEO.
Ce que vous pouvez vérifier vous-même, gratuitement
Autant le dire clairement : une partie du diagnostic ne nécessite ni budget ni prestataire. Si vous voulez commencer par vous faire une idée, voici l'ordre dans lequel je procéderais. Ces vérifications ne remplacent pas un audit, mais elles éliminent les problèmes les plus grossiers et vous permettront de poser de meilleures questions à n'importe quel consultant.
- Le site est-il seulement indexé
Dans la Search Console, rapport Indexation des pages. Comparez le nombre de pages indexées au nombre de pages que vous croyez avoir. Un écart important est le premier signal, et il rend tout le reste secondaire. La page mon site n'apparaît pas sur Google déroule ce diagnostic en détail.
- Les pages qui frôlent la première page
Toujours dans Performances sur 16 mois, triez par impressions et regardez les positions moyennes entre 8 et 20. Ce sont vos meilleurs candidats : le travail y est déjà fait à 80 %.
- Les titles dupliqués ou absents
Un crawl gratuit avec Screaming Frog (500 URLs en version libre) répond en quelques minutes. Des titles identiques sur des dizaines de pages sont un symptôme classique de gabarit mal configuré.
- Les redirections en chaîne
Dans le même crawl, onglet des codes 3xx. Toute chaîne de plus d'un saut est à corriger, surtout après une migration.
- Le rendu sans JavaScript
Affichez le code source d'une page importante et cherchez-y une phrase visible à l'écran. Si vous ne la trouvez pas, votre contenu dépend du JavaScript, avec toutes les conséquences décrites plus haut.
- Le robots.txt
Ouvrez votre-site.fr/robots.txt et lisez-le en entier. C'est un fichier de quelques lignes qui provoque des dégâts disproportionnés, et il contient parfois des blocages hérités d'une préproduction jamais nettoyée.
Pour un premier passage rapide sur une page précise, mon outil d'audit de page est en accès libre et ne demande aucune inscription.
Ce que vous recevez concrètement
L'audit est livré sous forme d'un document structuré, lisible par un non-technicien. Pour chaque problème : une explication claire, l'impact estimé sur le référencement, et une recommandation actionnable. Je sépare trois niveaux : les actions urgentes qui bloquent l'indexation, les actions à fort impact qui peuvent faire bouger les positions, et les améliorations à planifier dans le temps.
Le document s'accompagne toujours d'une heure de restitution. Ce point n'est pas une option de confort : envoyer un rapport sans le présenter, sans l'expliquer et sans en discuter n'a aucun intérêt. Un audit qu'on ne vous commente pas finit dans un dossier, et vous aurez payé un document au lieu d'une décision. Pendant cette heure, on passe les points clés en revue, on arbitre les priorités selon vos moyens réels, et vous repartez en sachant quoi faire, dans quel ordre et pourquoi.
| Taille du site | Charge d'audit | Ce qui pèse le plus |
|---|---|---|
| Site vitrine, moins de 50 pages | 1 à 2 jours | Contenu et maillage : la technique est rarement le frein |
| Site de contenu, 50 à 200 pages | 2 à 5 jours | Cannibalisation et pages à impressions sans position |
| E-commerce, 1 000 pages et plus | 5 jours et au-delà | Duplication de gabarits, facettes, budget de crawl |
| Site après migration | Variable, cadré sur l'urgence | Redirections, indexation, comparaison avant/après |
Je chiffre toujours après avoir regardé le site, jamais sur la base d'un nombre de pages annoncé. Deux e-commerces de même taille peuvent demander un travail du simple au triple selon la propreté de leur gabarit.
Audit ponctuel ou accompagnement
L'audit peut être une prestation ponctuelle pour un état des lieux complet, ou la première étape d'un accompagnement mensuel où les recommandations sont mises en oeuvre progressivement, avec un audit de suivi à intervalles réguliers pour mesurer les progrès.
Quand un audit est vraiment nécessaire
Un audit complet ne se justifie pas en permanence. Il prend tout son sens dans trois situations : après une refonte ou une migration, lors d'une chute de trafic inexpliquée, ou avant d'engager un budget d'acquisition sur un site dont on ne connaît pas l'état réel. En dehors de ces cas, un site stable n'a pas besoin d'être audité de fond en comble chaque année : un suivi régulier détecte les problèmes au fil de l'eau, ce qui coûte moins cher et évite les mauvaises surprises.
Questions fréquentes
Sources : documentation OpenAI sur ses robots d'exploration (distinction GPTBot / OAI-SearchBot / ChatGPT-User) ; documentation Anthropic sur ClaudeBot, Claude-SearchBot et Claude-User ; documentation Google sur le jeton Google-Extended ; aide Google Search Console sur le rapport Performances et l'indexation.