Deux pages de votre site se disputent la même requête. Google en choisit une, puis change d'avis deux semaines plus tard. Vous perdez des positions sur les deux, sans qu'aucune n'ait jamais rien fait de mal. Ce scénario, je le vois passer au moins une fois par mois chez des clients qui me jurent n'avoir "jamais touché au SEO".
La cannibalisation ne se voit pas dans une alerte. Elle se débusque. Et pour la débusquer, il faut un audit de contenu structuré, pas un coup d'œil rapide à Search Console en buvant son café.
Points clés à retenir
- La cannibalisation, c'est deux URLs ou plus de votre site qui se positionnent sur la même intention de recherche — et se pénalisent mutuellement.
- Le symptôme le plus fiable : une même requête qui fait osciller l'URL positionnée d'une semaine à l'autre.
- Un audit sérieux croise les requêtes de la Search Console avec les URLs qui répondent réellement, page par page.
- Cinq décisions possibles face à un doublon : fusionner, rediriger en 301, poser un canonical, différencier l'intention, ou supprimer. Aucune n'est un choix par défaut.
- Le crawl et l'indexation sont deux choses distinctes. Une page peut être crawlée sans être indexée.
Pourquoi un audit de contenu est la seule façon sérieuse de repérer les pages cannibalisées
Un crawl de site ne vous le dira pas. Un outil de suivi de positions non plus, la plupart du temps. La cannibalisation est un phénomène relationnel : elle n'existe que dans l'écart entre ce que vous croyez avoir publié et ce que Google interprète.
J'ai longtemps cru qu'une page = une requête cible suffisait. Erreur de débutant. Sur un site éditorial de 600 articles que j'ai repris l'an dernier, 23 % des URLs se disputaient une intention avec au moins une autre page. Personne ne s'en était aperçu, parce que chaque article, pris isolément, avait l'air propre.
Ce que la cannibalisation fait vraiment à votre site
Elle dilue. Vos liens internes, censés consolider une page, se répartissent entre plusieurs concurrentes. Vos signaux d'autorité — backlinks, ancres, mentions — pointent dans des directions différentes. Résultat : Google ne sait plus quelle URL mérite la position, alors il alterne. Et pendant qu'il alterne, vous reculez sur les deux fronts à la fois.
Sur ce site de 600 articles, la correction a pris cinq semaines. La visibilité organique sur les requêtes concernées a progressé de 31 % dans les trois mois suivants, sans publier un seul nouvel article. Tout le gain venait de la consolidation.
Préparer l'audit : ce qu'il faut réunir avant de chercher quoi que ce soit
Vous ne trouverez rien si vous partez à l'aveugle. Avant de plonger, il faut deux jeux de données minimum.
Les données indispensables
- Un export Search Console sur 6 à 12 mois (performances + couverture).
- Un crawl complet du site, pour lister chaque URL avec son title, son H1 et son contenu principal.
- Une table de correspondance, même grossière, entre vos intentions de recherche cibles et vos URLs.
Ce dernier point, personne ne le fait spontanément. Et c'est exactement là que se cache le problème. Si plusieurs URLs partagent la même intention dans votre table, vous avez déjà votre première liste de suspects.
La méthode pas à pas pour identifier les pages cannibalisées
Voici comment je procède, dans l'ordre. Ce n'est pas la seule méthode, mais c'est celle qui m'a donné les résultats les plus fiables.
Étape 1 : croiser requêtes et URLs
Exportez les requêtes depuis la Search Console, puis pour chacune, regardez combien d'URLs différentes du site apparaissent. Une requête qui fait remonter trois URLs à des positions 4, 9 et 12 ? C'est un signal fort. Deux URLs qui alternent en position 1 et 2 sur la même requête ? Signal encore plus fort.
Ce croisement se fait très bien dans un tableur. Pas besoin d'un outil payant pour démarrer.
Étape 2 : vérifier l'overlap sémantique réel
Deux pages peuvent cibler des mots-clés différents et se cannibaliser quand même, si leur contenu répond à la même question. Comparez le title, le H1 et les deux premiers paragraphes. S'ils se ressemblent à plus de 60 %, considérez qu'il y a doublon jusqu'à preuve du contraire.
Étape 3 : contrôler l'indexation de chaque page suspecte
Une page non indexée ne se positionne pas, donc elle ne cannibalise pas — mais elle révèle souvent une intention mal servie ailleurs. Si une de vos pages importantes n'apparaît pas dans les résultats, plusieurs causes sont classiques : une balise noindex oubliée dans le code, un robots.txt mal configuré, un problème de crawl, du contenu dupliqué, une erreur technique, ou un manque de liens internes pointant vers elle.
Le réflexe à avoir : vérifier en priorité la balise noindex, car c'est la cause la plus fréquente et la plus facile à corriger.
Étape 4 : cartographier les décisions
Chaque doublon confirmé appelle une décision. Il n'y a pas de règle unique, mais un arbre logique simple :
| Situation | Décision recommandée |
|---|---|
| Deux pages quasi identiques, même intention | Fusionner le contenu sur la plus forte, rediriger l'autre en 301 |
| Deux pages proches, intentions légèrement distinctes | Différencier les deux : réécrire l'une pour clarifier son angle |
| Page ancienne et faible, contenu recyclable | Fusionner, puis redirection |
| Page orpheline, sans trafic ni backlinks | Supprimer ou rediriger selon sa valeur |
| Page concurrente d'une page pilier | Canonical vers la page pilier si le contenu est redondant |
Le choix de la page à conserver ne tient pas au hasard : c'est celle qui a le plus de backlinks, le plus de trafic historique, ou le contenu le plus complet. Dans 90 % des cas, ces trois critères désignent la même URL.
Quelles sont les raisons pour lesquelles une page web peut ne pas être indexée par un moteur de recherche généraliste ?
Une URL peut être accessible à vos visiteurs, correctement publiée, et pourtant totalement absente des résultats de recherche. Plusieurs causes expliquent cette situation : une balise noindex présente dans le code HTML ou configurée depuis un CMS, un problème de crawl empêchant le moteur d'explorer la page, une mauvaise configuration du fichier robots.txt, du contenu dupliqué, une erreur technique, ou encore un manque de liens internes pointant vers la page.
Pour un site qui compte sur le référencement naturel, une page importante non indexée représente une perte de visibilité directe : elle ne peut pas se positionner dans les résultats organiques. La balise noindex est la première chose à vérifier, car c'est la cause la plus fréquente et la plus rapide à corriger.
Les erreurs que je vois le plus souvent dans un audit de cannibalisation
Fusionner sans vérifier l'intention réelle
J'ai fusionné deux articles qui traitaient, croyais-je, du même sujet. En réalité, l'un visait une intention transactionnelle, l'autre une intention informationnelle. La fusion a plu à personne — ni à Google, ni aux lecteurs. Trois semaines de travail pour un résultat plat. Depuis, je vérifie toujours l'intention avant de fusionner.
Rediriger systématiquement vers la page la plus ancienne
Non. La page la plus ancienne n'est presque jamais la plus forte. Je regarde le profil de backlinks et le trafic organique sur 6 mois avant de décider. Parfois, la page la plus récente est celle qui mérite de rester.
Ignorer l'angle des moteurs de réponse IA
En 2026, ce n'est plus un détail. Les moteurs de réponse génératifs citent des pages qui répondent clairement à une question unique. Une page qui se bat avec une autre pour la même requête a beaucoup moins de chances d'être citée qu'une page seule et nette sur son sujet. La consolidation sert doublement : elle règle la cannibalisation classique et améliore votre citabilité par les IA.
Après l'audit : mesurer et ajuster
Un audit sans suivi ne sert à rien. Après chaque correction, notez la date, l'URL modifiée, la décision prise. Puis observez la Search Console sur 4 à 6 semaines. Sur le site dont je parlais plus haut, certaines redirections ont mis huit semaines avant de produire leur plein effet. Ne concluez pas trop vite qu'une action n'a rien donné.
Et si une redirection 301 vous fait perdre du trafic sur la cible, c'est souvent le signe que vous avez gardé la mauvaise page.
Reste une question que je me pose encore, et à laquelle personne ne semble avoir de réponse tranchée : quand une IA synthétise une réponse à partir de trois pages d'un même site, laquelle cite-t-elle ? La plus complète ? La plus récente ? Ou celle qui se trouve la mieux placée à l'instant T ? Tant que ce n'est pas clair, consolider reste la seule stratégie défendable — moins de pages, mieux ciblées, chacune seule sur son terrain.