Ce que ce workflow vous apporte
Vous avez une page qui était dans le top 10 d'un mot clé important, et elle est passée à la position 34. Vous cherchez la même phrase et voyez deux liens de votre site dans les résultats. Ou votre équipe de contenu a publié 40 nouveaux posts le mois dernier, et vous soupçonnez que certains se font concurrence en silence.
Ce workflow transforme le soupçon en liste confirmée et en plan de correction. Au final, vous aurez : chaque requête où deux liens ou plus de votre site sont en compétition, un verdict pour chaque cluster (fusionner, canonique, différencier ou supprimer) et un plan de vérification de quatre semaines qui vous dit si la correction a tenu.
- Pour qui : les experts SEO et les équipes de contenu sur des sites de plusieurs centaines de pages et plus, et toute personne qui publie vite.
- Temps : environ 90 minutes pour la première audit d'un site moyen typique ; la moitié une fois la routine en place.
- Prérequis : accès en lecture à Google Search Console, une exportation d'exploration (Screaming Frog, Sitebulb ou équivalent) et un suivi de positions si vous êtes abonné à l'un.
- Critère de fin : chaque cluster concurrent de votre liste a exactement un des quatre verdicts ci-dessus, les corrections sont appliquées, et une date est au calendrier pour revoir positions et impressions.
Une vérification de réalité avant de commencer, car elle vous évite de réparer ce qui n'est pas cassé : voir plusieurs liens pour une requête est normal. Une page de catégorie, un article de blog et une page produit peuvent tous se positionner sur la même phrase — s'ils servent des intentions différentes (quelqu'un qui recherche contre quelqu'un qui est prêt à acheter), c'est une SERP saine, pas de la cannibalisation. Ce workflow ne marque que les pages qui se disputent le même travail à la même étape.
Pourquoi c'est plus important en 2026 qu'il y a cinq ans, pour une raison : les briefs et brouillons générés par IA produisent des pages similaires à une vitesse que la relecture manuelle ne suit pas, donc la cannibalisation arrive maintenant à l'échelle. Elle frappe à la fois le classement Google et les citations en recherche IA.
Le check des symptômes en 3 minutes
Parcourez ceci avant de plonger dans les données. Si deux points ou plus vous parlent, lancez l'audit complète.
Symptôme | À quoi ça ressemble | Cause la plus probable |
|---|---|---|
Classement bloqué | La page tenait le top 10 pendant des mois puis est passée aux positions 25–50 après le lancement d'une nouvelle page | La nouvelle page concurrence la même requête |
Impressions partagées | Deux liens se partagent les impressions d'une requête presque à 50/50 | Aucune page n'obtient une pertinence claire |
Titre jumeau | Deux pages avec H1 et title identiques ou presque identiques | L'auteur a fait une variante, pas un complément |
Classement alterné | Le lien classé pour le terme alterne entre vos pages semaine après semaine | Le moteur ne peut pas choisir la page d'autorité |
Réponses IA alternées | L'assistant IA cite différents liens de votre site pour la même question selon les exécutions | La même dilution, sur une autre surface |
Avant de commencer : les données nécessaires
Rassemblez ces trois choses :
- Search Console avec au moins 6 mois d'historique. Quatre-vingt-dix jours suffisent pour un check rapide, mais la fenêtre plus longue montre quand un classement a chuté par rapport au lancement d'une page.
- Une exploration récente avec title et H1 extraits. Screaming Frog le fait nativement ; Sitebulb et Botify conviennent aussi. Si vous n'en avez aucun, une recherche
site:plus la liste des pages du CMS couvre les cas les plus évidents. - Une exportation du suivi de positions (Semrush, Ahrefs, Authority Labs). Cette étape est facultative — les croisements Search Console seuls trouvent la plupart des cas.
Exportez deux choses de Search Console avant de commencer : le rapport de requêtes (requête, impressions, clics, position) et le même rapport avec la dimension pages (URLs). Les deux se trouvent dans Performance, dans le rapport complet.
Étape 1 : trouvez les URLs concurrentes dans Search Console
C'est le croisement gratuit au signal le plus fort.
- Ouvrez Search Console → Performance → rapport complet.
- Utilisez le filtre de requêtes et tapez votre premier mot clé prioritaire.
- Regardez la liste de liens sous le graphique. Notez chaque requête où deux pages de votre site ou plus reçoivent des impressions.
Vous cherchez deux schémas : des pages qui se partagent les impressions à peu près également sur la même période, et des pages bloquées entre les positions 20 et 50 qui étaient autrefois dans le top 10 — surtout si la chute a commencé autour du lancement d'une page similaire.
Commencez par vos 10–15 mots clés les plus importants. Si vous trouvez des clusters dans la moitié d'entre eux, le problème est au niveau du site et il vaut la peine de balayer toutes les requêtes avec, disons, plus de 50 impressions sur le semestre. Si cela n'apparaît que sur quelques-unes, le problème est isolé — corrigez-les et continuez.
Sortie attendue : une liste de requêtes, chacune avec deux liens ou plus de votre site et leur répartition des impressions. Contrôle qualité : les pages doivent vraiment partager le classement de la même requête. Si elles sonnent seulement similaires, ce sont des voisines, pas des concurrentes — sortez-les. Chemin de récupération : rien trouvé ? Élargissez la fenêtre à 3 mois et incluez des variantes de longue traîne de vos mots clés. Vérifiez aussi la répartition des termes de marque contre hors-marque — c'est là que se cachent les doublons sur les sites multiversion (paires de langues, grossiste contre détaillant).
Étape 2 : trouvez les title et H1 en double dans votre exploration
La cannibalisation est souvent un accident de production de contenu : on demande à un auteur « écris sur X », il ne vérifie pas ce qui existe déjà, et il fabrique une page avec le même titre que celle qui se positionne déjà.
Ouvrez l'exportation d'exploration, triez d'abord par title, puis par H1, et marquez les doublons et quasi-doublons. « Quasi » compte — deux pages n'ont pas besoin de titres identiques pour se concurrencer. « Best CRM software » et « Best CRM tools » visant le même public sont des candidats ; « Best CRM for real estate » est une autre page, elle n'entre pas dans la liste.
Pendant que vous êtes dans les données d'exploration, vérifiez les suspects techniques : les canoniques pointant ailleurs que vers la page elle-même, les règles meta robots noindex modifiées lors de l'ajout de variantes, et les blocages robots.txt qui ont commencé ou cessé. Comme le dit le guide de Search Engine Journal sur le sujet : quand vous changez la façon dont vous instruisez les moteurs de crawler, d'indexer et d'ignorer, vous créez des problèmes de cannibalisation. L'exemple classique est la page de variante produit qui a hérité du canonique de l'ancien produit.
Sortie attendue : des paires de pages avec title et H1 en double ou concurrents, plus tout drapeau technique. Contrôle qualité : pour chaque paire, répondez à une question — une page existait-elle et se classait-elle avant le lancement de l'autre ? Si oui, notez-le ; c'est le signal le plus fort d'un vrai problème. Chemin de récupération : si votre CMS rend les exportations pénibles, générez la liste depuis le CSV d'exploration avec la skill Codex à la fin de cet article. Traitez sa sortie comme une liste de candidats, pas comme un verdict.
Étape 3 : confirmez avec le suivi de positions
Search Console dit ce que Google rapporte ; le suivi de positions montre où sont vos liens dans le temps — et c'est ce qui expose les pages vraiment bloquées.
Ouvrez chaque requête candidate dans votre suivi. Le schéma qui confirme la cannibalisation : le mot clé bloqué entre le milieu des 20 et le milieu des 50, ou le lien tenant la position X qui continue d'alterner entre vos pages. Semrush montre lesquelles de vos pages sont apparues pour le terme sur l'année écoulée ; Authority Labs liste chaque lien pour chaque mot clé. Si deux liens ou plus apparaissent dans l'historique de l'année et qu'aucun n'a touché le top 10, vous avez la confirmation.
Lisez aussi la direction. Si votre page d'origine se classait bien jusqu'à la publication de la nouvelle et que les deux flottent maintenant sous la ligne de flottaison, la nouvelle n'a pas « volé » les classements. Les deux pages se sont mutuellement diluées. Cela change la correction : fusionnez la nouvelle dans l'originale, pas l'inverse.
Sortie attendue : un statut de confirmation pour chaque cluster candidat — « confirmé » ou « non confirmé, révision manuelle ». Contrôle qualité : la confirmation nécessite au moins deux signaux indépendants. Search Console + exploration comptent pour deux ; le suivi de positions seul est un signal unique faible. Chemin de récupération : si votre suivi n'affiche qu'un lien par mot clé, sautez cette étape. Les croisements Search Console et exploration suffisent pour dérouler tout le workflow.

Le pipeline d'audit : trois passes de détection, une matrice de décision, une boucle de vérification.
Étape 4 : décidez de la correction
Pour chaque cluster confirmé, choisissez exactement un des quatre verdicts. Ce tableau est toute la décision :
Verdict | Utilisez-le quand | L'action |
|---|---|---|
Fusionner | Les pages servent la même intention et l'une est clairement plus complète | Pliez les points uniques de la page faible dans la forte, puis supprimez ou 301 l'URL faible |
Canonique | Des variantes quasi identiques qui doivent exister (variantes produit, paramètres, pages de campagne) | Choisissez l'URL officiel, mettez un canonique autoréférent dessus et canonisez les variantes vers lui |
Différencier | Même sujet, intention réellement différente que vous voulez garder (ex. : how-to contre page produit) | Réécrivez une page pour servir clairement une autre requête ou étape d'entonnoir ; assurez-vous que title et H1 ne se chevauchent plus |
Supprimer | La page est fine, dupliquée, ou n'existe que pour un terme déjà couvert | Supprimez-la après avoir plié toute valeur unique dans la page survivante |
Deux cas ne sont pas de la cannibalisation, laissez-les tranquilles : un article how-to et une page de conversion visant le même mot clé à des étapes d'entonnoir différentes — Google comprend quelle page fait quoi — et les versions linguistiques séparées d'une même page avec hreflang.
Une question pour vérifier votre verdict : après ce changement, l'utilisateur qui cherche le terme atterrit-il sur une page et reçoit-il tout ce que l'autre offrait ? Si oui, fusionnez ou supprimez. Sinon, canonisez ou différenciez.
Étape 5 : appliquez les corrections sans perdre de visibilité
Correction A : consolidation de contenu (verdict fusionner). Travaillez depuis la page survivante. Copiez-y chaque section unique de la page perdante — les réponses FAQ, les exemples, le bloc cité, les liens internes qui pointaient vers elle. Réorganisez si nécessaire pour que le contenu le plus fort soit en haut. Quand la page perdante a des backlinks externes ou de vrais classements à elle, faites un 301 vers la survivante plutôt qu'un 404 ; quand elle n'a ni l'un ni l'autre, la suppression est acceptable. Le guide de Search Engine Journal évite le 301 à dessein — il préfère plier le contenu et supprimer la page la plus récente — et le 301 ne devient nécessaire que lorsque l'URL supprimé porte son propre poids de liens. Mettez à jour les liens internes qui utilisaient l'ancre de la page perdante pour qu'ils pointent vers la survivante.

Fusionner deux pages concurrentes en une URL transforme un partage d'impressions 50/50 en un gagnant unique.
Correction B : canonicalisation (verdict canonique). Mettez un canonique autoréférent sur la page officielle et canonisez les variantes vers elle. C'est l'outil pour les pages quasi dupliquées qui doivent exister : variantes produit, URLs à paramètres, pages de campagne. Ce n'est pas un substitut à la consolidation. Si deux pages ont un contenu significatif, le canonique seul laisse les deux dans l'exploration et divise votre focus éditorial — faites d'abord le travail de contenu, puis pointez le canonique.
Correction C : blocage programmatique de l'indexation (verdict adjacent à supprimer). Quand les doublons sont structurels — pages de paramètres, combinaisons de filtres, variantes régionales qui n'ont pas besoin d'indexation — appliquez noindex au niveau du dossier ou du template, pas page par page. C'est le cas où une ligne de code bat 200 éditions manuelles.
Correction D : corrigez les liens internes selon l'intention (verdict différencier). Quand deux pages servent légitimement des intentions différentes, faites en sorte que vos liens internes le disent. La règle du guide d'origine : si le texte autour du mot « pommes » parle d'acheter des pommes, liez vers la page de conversion ; s'il parle d'où viennent les pommes, liez vers la page d'information. Chaque lien interne est un vote. Quand vos liens pointent constamment vers la page qui devrait gagner, vous supprimez l'ambiguïté que les moteurs résoudraient seuls — souvent dans la mauvaise direction.
Étape 6 : vérifiez que la correction a tenu
Attendez deux à quatre semaines après les corrections et relancez les contrôles.
- Search Console : la requête devrait maintenant montrer une URL dominante au lieu d'un partage, et les impressions de la page survivante devraient monter. Les impressions agrégées du cluster peuvent chuter une à deux semaines pendant le reclassement — c'est normal, pas un échec.
- Suivi de positions : le mot clé devrait cesser d'osciller entre les liens.
- Surfaces IA : posez votre terme principal à un assistant IA ou un moteur de recherche IA et confirmez que le lien cité est le survivant — pas le supprimé. Les pages divisées divisent aussi les citations IA. Consolider est l'une des rares corrections qui aident à la fois le classement Google et la visibilité en recherche IA.
Si le cluster est encore divisé après quatre semaines, soit vous avez raté une page (re-vérifiez les variantes que vous ne connaissiez pas), soit les pages servent réellement des intentions différentes et devaient être différenciées, pas fusionnées. Vérifiez à nouveau et décidez à nouveau.
Empêcher que ça revienne
L'audit est la partie facile. Rester propre est une discipline de publication. Trois pratiques, par ordre d'importance :
- Tenez une liste de sujets que l'équipe de contenu consulte avant d'écrire. Le chemin le plus rapide pour créer de la cannibalisation est un auteur qui ne sait pas que la page existe déjà.
- Faites du chevauchement une conversation, pas une barrière. Au lieu d'interdire un sujet, aidez l'auteur à trouver l'angle complémentaire — le how-to, la comparaison, la version verticale.
- Surveillez particulièrement les pipelines de création IA. La sortie générée par IA est la fabrique de cannibalisation la plus rapide qui existe : elle produit des pages fines et répétées qui se concurrencent indépendamment de la qualité du prompt. Toute page générée par IA ou briefée par IA doit passer le check de la liste de sujets avant d'être programmée, et l'audit trimestriel doit leur donner la priorité.
Lancez l'audit complète chaque trimestre et de nouveau après chaque lancement qui a ajouté plus de quelques pages à la même zone du site.
Automatisez l'audit : une skill Codex
Les étapes ci-dessus sont manuelles pour que vous compreniez ce que signifient les données. Une fois compris, confiez les parties répétables à un agent de programmation IA. Voici un fichier de skill complet pour Codex : il lit vos exportations Search Console, marque les clusters concurrents et produit une feuille de verdicts sans toucher à votre site.
---
name: keyword-cannibalization-audit
description: Find and classify keyword cannibalization clusters from Google Search Console, crawl, and rank-tracker exports. Use when a query shows multiple URLs, rankings dropped after a new page launch, or you need a cannibalization verdict sheet. Read-only: produces a report, never edits pages.
---
# Keyword Cannibalization Audit
## Inputs (required)
- `gsc-queries.csv` — Search Console query export (query, impressions, clicks, position)
- `gsc-pages.csv` — Search Console page export (page, impressions, clicks, position)
- `crawl-titles.csv` — crawl export with URL, title, H1, canonical
- `rank-history.csv` — optional rank tracker export with per-keyword URL history
## Procedure
1. Load the CSVs. Normalize URLs (lowercase host, strip trailing slash and tracking parameters).
2. Join `gsc-queries.csv` and `gsc-pages.csv` on query to build query-to-URL mappings.
3. Flag queries where 2+ URLs each received at least 10% of the query's impressions in the last 90 days.
4. Flag queries where a URL sits between positions 20-50 and a second URL for the same query was created later (compare crawl or tracker history).
5. From `crawl-titles.csv`, flag pairs whose titles or H1s are identical or share 80%+ of their significant tokens.
6. From `rank-history.csv`, flag queries whose ranking URL changed more than twice in 6 months.
7. Cross-check every flag. Keep only clusters confirmed by at least two signals (Search Console + crawl counts as two).
8. Classify each surviving cluster as MERGE, CANONICALIZE, DIFFERENTIATE, or REMOVE:
- Same intent + one page clearly more complete → MERGE (fold unique sections into the survivor; note a 301 only if the removed URL has external backlinks)
- Near-identical variants that must exist (parameters, variants) → CANONICALIZE
- Same topic, genuinely different intent you want to keep → DIFFERENTIATE (rewrite one page, no title overlap)
- Thin or fully duplicated page with no unique value → REMOVE
- Complementary intent (how-to vs. product for the same keyword) → NOT CANNIBALIZATION, skip
9. Output `cannibalization-verdicts.md`: a table of query | competing URLs | signals found | verdict | action, ordered by query impressions. Include for each cluster the exact URLs, the evidence rows (dates, positions, impressions), and fix text ready to paste into a CMS task.
## Rules
- Read-only. Never edit pages, robots.txt, or canonicals. Output the report and a proposed action plan only.
- Never merge a URL into a survivor whose content is not equal to or better than the merged output.
- Do not classify locale variants (hreflang) or genuinely different intents as cannibalization.
- Clusters with fewer than two confirming signals get marked "unconfirmed — review manually," never dropped.
- When the rank tracker export is missing, run with Search Console + crawl only and say so in the report header.Enregistrez-la comme keyword-cannibalization-audit/SKILL.md dans le dossier de skills de Codex, déposez les quatre CSV dans un dossier de workspace et lancez. Une exécution typique sur quelques milliers de pages prend quelques minutes et renvoie la feuille de verdicts.
Deux prompts plus courts, pour ceux qui ne veulent pas une skill complète :
- Tri de l'exportation : « Voici mon exportation de requêtes Search Console. Trouve toutes les requêtes où deux liens ou plus de mon site reçoivent chacun au moins 10 % des impressions. Sortie en tableau : requête, URLs, répartition des impressions, position de chaque URL. Aucune recommandation. »
- Verdict du cluster : « Deux de mes pages se positionnent pour [requête] : [URL A] en position [X] et [URL B] en position [Y]. [URL B] a été lancée le [date]. Compare leur contenu et dis-moi lequel des quatre verdicts s'applique — fusionner, canonique, différencier, supprimer — et pourquoi, en deux phrases. »
Questions fréquentes
Plusieurs pages se positionnent pour mon mot clé — est-ce automatiquement de la cannibalisation ?
Non. Si les pages servent des intentions différentes (recherche contre achat) ou des langues différentes, les moteurs les gèrent très bien. Seules les pages qui se disputent le même travail à la même étape d'entonnoir ont besoin d'un verdict.
Canonique ou noindex — lequel utiliser ?
Le canonique quand les pages doivent rester accessibles (variantes produit, paramètres) et que leurs signaux doivent affluer vers la page officielle. Le noindex, appliqué programmatiquement, quand les pages sont de purs doublons qui ne servent aucun besoin utilisateur. Aucun des deux ne remplace la consolidation de contenu quand la page dupliquée contient du contenu réellement utile.
Dois-je faire un 301 de la page perdante ?
Seulement si elle a des backlinks externes ou de vrais classements à elle. Sinon, pliez son contenu unique dans la page survivante et supprimez-la. Un 301 vers une page qui n'est pas un vrai remplaçant gaspille le poids du redirect et déroute les utilisateurs.
Le trafic a baissé après la fusion de pages — ai-je cassé quelque chose ?
Une chute brève pendant que Google réévalue le cluster est courante. Mesurez à quatre semaines : si la survivante se classe pour la requête et que les impressions du cluster se sont rétablies, la correction a tenu. Si c'est une autre page qui gagne, vous avez fusionné dans la mauvaise direction. Revenez en arrière avant que le problème ne s'aggrave.
La cannibalisation affecte-t-elle les citations en recherche IA ?
Oui. Quand deux liens de votre site sont en compétition, les réponses IA choisissent entre eux et peuvent citer l'un ou l'autre — ou aucun. Consolider vous donne un lien fort et citable au lieu de deux dilués.
À quelle fréquence dois-je lancer l'audit ?
Trimestriellement comme base, plus après toute vague de nouvelles pages. Les sites qui produisent du contenu avec l'IA devraient traiter l'audit comme une partie du pipeline de publication, pas comme une tâche périodique.
Auteure : Clara Bennett, stratège de contenu avec dix ans d'expérience chez Auspia. Clara écrit sur les systèmes éditoriaux, les cartes de sujets et les opérations de contenu reproductibles qui empêchent les plans de publication de se heurter.












