यह वर्कफ़्लो आपको क्या देता है
आपका एक पेज किसी महत्वपूर्ण कीवर्ड के लिए टॉप 10 में था, और अब वह 34वीं पोज़ीशन पर फिसल गया है। आप वही फ़्रेज़ खोजते हैं और नतीजों में अपने दो लिंक देखते हैं। या आपकी कंटेंट टीम ने पिछले महीने 40 नए पोस्ट प्रकाशित किए और आपको संदेह है कि उनमें से कुछ चुपचाप एक-दूसरे से प्रतिस्पर्धा कर रहे हैं।
यह वर्कफ़्लो संदेह को पुष्टि की गई सूची और सुधार योजना में बदल देता है। अंत में आपके पास होगा: हर वह क्वेरी जिसमें आपके दो या अधिक लिंक प्रतिस्पर्धा कर रहे हैं, हर क्लस्टर के लिए एक फ़ैसला (विलय करें, कैननिकल, अलग करें या हटाएँ), और चार सप्ताह की सत्यापन योजना जो बताएगी कि सुधार टिका या नहीं।
- किसके लिए: कुछ सौ पेजों और उससे बड़ी साइटों पर काम करने वाले SEO विशेषज्ञ और कंटेंट टीमें, साथ ही हर कोई जो तेज़ी से प्रकाशित करता है।
- समय: एक सामान्य मध्यम आकार की साइट के पहले ऑडिट में लगभग 90 मिनट; हाथ आ जाने पर आधा।
- पूर्वापेक्षाएँ: Google Search Console तक पढ़ने की पहुँच, क्रॉल का एक्सपोर्ट (Screaming Frog, Sitebulb या समतुल्य) और रैंक ट्रैकर, अगर आपकी सदस्यता है।
- पूर्णता मानदंड: आपकी सूची का हर प्रतिस्पर्धी क्लस्टर ऊपर दिए चार फ़ैसलों में से ठीक एक रखता है, सुधार लागू हैं, और कैलेंडर में रैंकिंग और इम्प्रेशन की समीक्षा की तारीख़ है।
शुरू करने से पहले एक वास्तविकता-जाँच, क्योंकि यह आपको गैर-खराब चीज़ ठीक करने से बचाएगी: एक क्वेरी के लिए कई लिंक देखना सामान्य है। एक कैटेगरी पेज, एक ब्लॉग पोस्ट और एक प्रोडक्ट पेज एक ही फ़्रेज़ के लिए रैंक कर सकते हैं — अगर वे अलग-अलग इंटेंट पूरे करते हैं (खोज करने वाला बनाम खरीदने को तैयार), तो यह स्वस्थ SERP है, कैनिबलाइज़ेशन नहीं। यह वर्कफ़्लो केवल उन पेजों को चिह्नित करता है जो एक ही चरण में एक ही काम के लिए प्रतिस्पर्धा कर रहे हैं।
2026 में पाँच साल पहले की तुलना में यह ज़्यादा महत्वपूर्ण क्यों है, एक कारण से: AI-जनरेटेड ब्रीफ़ और ड्राफ़्ट समान पेज ऐसी गति से बना रहे हैं जिसे मैन्युअल समीक्षा पकड़ नहीं पाती, इसलिए कैनिबलाइज़ेशन अब बड़े पैमाने पर होता है। यह Google रैंकिंग और AI-सर्च साइटेशन दोनों को एक साथ नुकसान पहुँचाता है।
3 मिनट का लक्षण-जाँच
डेटा में उतरने से पहले इस सूची को देख लें। अगर दो या अधिक बिंदु परिचित लगते हैं, तो पूर्ण ऑडिट चलाएँ।
लक्षण | कैसा दिखता है | सबसे संभावित कारण |
|---|---|---|
रैंकिंग अटकी | पेज महीनों टॉप 10 में रहा और नए पेज के आने के बाद 25–50 पर गिर गया | नया पेज उसी क्वेरी के लिए प्रतिस्पर्धा कर रहा है |
इम्प्रेशन बँटे | दो लिंक किसी क्वेरी के इम्प्रेशन लगभग 50/50 बाँट रहे हैं | कोई भी पेज स्पष्ट अधिकार नहीं जीत पा रहा |
जुड़वाँ टाइटल | दो पेजों के H1 और title समान या लगभग समान | लेखक ने पूरक नहीं, वैरिएंट बनाया |
डगमगाती रैंकिंग | टर्म के लिए रैंक करने वाला लिंक सप्ताह-दर-सप्ताह आपके पेजों के बीच बदलता है | सर्च इंजन अधिकार-पेज चुन नहीं पा रहा |
बदलते AI उत्तर | AI असिस्टेंट एक ही सवाल पर अलग-अलग रन में आपके अलग-अलग लिंक उद्धृत करता है | वही कमज़ोरी, दूसरी सतह पर |
शुरू करने से पहले: चाहिए डेटा
ये तीन चीज़ें इकट्ठा करें:
- कम से कम 6 महीने के इतिहास वाला Search Console। त्वरित जाँच के लिए 90 दिन काफ़ी हैं, लेकिन लंबी विंडो दिखाती है कि रैंकिंग किसी पेज के लॉन्च के सापेक्ष कब गिरी।
- title और H1 निकाला हुआ ताज़ा क्रॉल। Screaming Frog इसे नेटिव रूप से करता है; Sitebulb और Botify भी चलेंगे। कुछ भी न हो तो
site:खोज और CMS पेज सूची सबसे स्पष्ट मामले कवर कर लेती है। - रैंक ट्रैकर का एक्सपोर्ट (Semrush, Ahrefs, Authority Labs)। यह चरण वैकल्पिक है — अकेले Search Console तुलनाएँ ज़्यादातर मामले खोज लेती हैं।
शुरू से पहले Search Console से दो चीज़ें एक्सपोर्ट करें: क्वेरी रिपोर्ट (क्वेरी, इम्प्रेशन, क्लिक, पोज़ीशन) और वही रिपोर्ट पेज डाइमेंशन (URL) के साथ। दोनों प्रदर्शन सेक्शन के पूर्ण रिपोर्ट में हैं।
चरण 1: Search Console में प्रतिस्पर्धी URL खोजें
यह सबसे मज़बूत सिग्नल वाली मुफ़्त तुलना है।
- Search Console खोलें → प्रदर्शन → पूर्ण रिपोर्ट।
- क्वेरी फ़िल्टर का उपयोग करें और अपना पहला प्राथमिकता कीवर्ड टाइप करें।
- ग्राफ़ के नीचे लिंक सूची देखें। हर उस क्वेरी को नोट करें जिसमें दो या अधिक आपके पेज इम्प्रेशन पा रहे हैं।
दो पैटर्न खोजें: पेज जो इम्प्रेशन उसी अवधि में लगभग बराबर बाँट रहे हैं, और पेज जो 20–50 के बीच अटके हैं जबकि पहले टॉप 10 में थे — खासकर अगर गिरावट किसी समान पेज के लॉन्च के आसपास शुरू हुई।
अपने 10–15 सबसे महत्वपूर्ण कीवर्ड से शुरू करें। अगर आधे में क्लस्टर मिलते हैं, तो समस्या साइट-व्यापी है और छह महीने में, मान लीजिए 50 से अधिक इम्प्रेशन वाली सभी क्वेरीज़ को छानना उचित है। अगर केवल कुछ पर दिखते हैं, तो समस्या अलग-थलग है — ठीक करें और आगे बढ़ें।
अपेक्षित आउटपुट: क्वेरीज़ की सूची, हर एक में आपके दो या अधिक लिंक और उनका इम्प्रेशन बँटवारा। गुणवत्ता-जाँच: पेजों को वास्तव में एक ही क्वेरी के लिए रैंकिंग साझा करनी चाहिए। अगर वे सिर्फ़ समान लगते हैं, तो वे पड़ोसी हैं, प्रतिस्पर्धी नहीं — हटा दें। पुनर्प्राप्ति मार्ग: कुछ नहीं मिला? विंडो 3 महीने तक बढ़ाएँ और अपने कीवर्ड के लॉन्ग-टेल वैरिएंट जोड़ें। ब्रांडेड और नॉन-ब्रांडेड टर्म्स के बीच बँटवारा भी देखें — बहु-संस्करण साइटों (भाषा जोड़े, थोक/खुदरा) पर डुप्लिकेट वहीं छिपते हैं।
चरण 2: अपने क्रॉल में डुप्लिकेट title और H1 खोजें
कैनिबलाइज़ेशन अक्सर कंटेंट-निर्माण दुर्घटना होती है: लेखक से कहा जाता है "X पर लिखो", वह मौजूदा चीज़ जाँचता नहीं, और वह पेज बना देता है जिसका शीर्षक पहले से रैंक कर रहे पेज जैसा ही है।
क्रॉल एक्सपोर्ट खोलें, पहले title से फिर H1 से सॉर्ट करें, और डुप्लिकेट व लगभग-डुप्लिकेट चिह्नित करें। "लगभग" मायने रखता है — दो पेजों को प्रतिस्पर्धा के लिए समान शीर्षकों की ज़रूरत नहीं है। "सर्वश्रेष्ठ CRM सॉफ़्टवेयर" और उसी दर्शक को लक्षित "सर्वश्रेष्ठ CRM टूल्स" उम्मीदवार हैं; "रियल एस्टेट के लिए सर्वश्रेष्ठ CRM" अलग पेज है, सूची में नहीं।
क्रॉल डेटा में रहते हुए तकनीकी संदिग्धों की भी जाँच करें: canonical जो पेज से भिन्न जगह इशारा करता है, meta robots noindex नियम जो वैरिएंट जोड़ने पर बदले गए, और robots.txt ब्लॉक जो शुरू या बंद हुए। जैसा कि Search Engine Journal का इस विषय पर गाइड कहता है: जब आप सर्च इंजनों को क्रॉल, इंडेक्स और अनदेखा करने के निर्देश देने का तरीका बदलते हैं, तो आप कैनिबलाइज़ेशन समस्याएँ बनाते हैं। क्लासिक उदाहरण वह प्रोडक्ट-वैरिएंट पेज है जिसे पुराने प्रोडक्ट का canonical विरासत में मिला।
अपेक्षित आउटपुट: डुप्लिकेट या प्रतिस्पर्धी title और H1 वाले पेजों के जोड़े, साथ तकनीकी झंडे। गुणवत्ता-जाँच: हर जोड़े के लिए एक सवाल का जवाब दें — क्या एक पेज दूसरे के लॉन्च से पहले अस्तित्व में था और रैंक कर रहा था? अगर हाँ, नोट करें: यह वास्तविक समस्या का सबसे मज़बूत संकेत है। पुनर्प्राप्ति मार्ग: अगर आपका CMS एक्सपोर्ट को यातना बना देता है, तो इस लेख के अंत के Codex स्किल से क्रॉल CSV से सूची बनवाएँ। उसके आउटपुट को फ़ैसला नहीं, उम्मीदवार सूची मानें।
चरण 3: रैंक ट्रैकर से पुष्टि करें
Search Console बताता है कि Google क्या रिपोर्ट करता है; रैंक ट्रैकर दिखाता है कि आपके लिंक समय में कहाँ हैं — और वही असली अटके पेजों को बेनकाब करता है।
हर उम्मीदवार क्वेरी अपने ट्रैकर में खोलें। कैनिबलाइज़ेशन की पुष्टि करने वाला पैटर्न: कीवर्ड 20 के मध्य से 50 के मध्य के बीच अटका है, या पोज़ीशन X पकड़ने वाला लिंक आपके पेजों के बीच बदलता रहता है। Semrush दिखाता है कि पिछले साल में टर्म के लिए आपके कौन से पेज दिखे; Authority Labs हर कीवर्ड के लिए हर लिंक सूचीबद्ध करता है। अगर सालाना इतिहास में आपके दो या अधिक लिंक दिखते हैं और कोई टॉप 10 नहीं छू पाया — पुष्टि मिल गई।
दिशा भी पढ़ें। अगर आपका मूल पेज नए के प्रकाशन तक अच्छा रैंक करता था और अब दोनों फ़ोल्ड-रेखा के नीचे डोल रहे हैं, तो नए पेज ने रैंकिंग "चुराई" नहीं। दोनों पेजों ने एक-दूसरे को कमज़ोर किया। इससे सुधार बदलता है: आप नए पेज को मूल में विलय करते हैं, उल्टा नहीं।
अपेक्षित आउटपुट: हर उम्मीदवार क्लस्टर के लिए पुष्टि स्थिति — "पुष्ट" या "अपुष्ट, मैन्युअल समीक्षा"। गुणवत्ता-जाँच: पुष्टि के लिए कम से कम दो स्वतंत्र सिग्नल चाहिए। Search Console + क्रॉल दो गिने जाते हैं; अकेला रैंक ट्रैकर कमज़ोर एकल सिग्नल है। पुनर्प्राप्ति मार्ग: अगर आपका ट्रैकर प्रति कीवर्ड केवल एक लिंक दिखाता है, यह चरण छोड़ दें। Search Console और क्रॉल तुलनाएँ पूरा वर्कफ़्लो चलाने के लिए काफ़ी हैं।

ऑडिट पाइपलाइन: तीन पहचान-पास, एक निर्णय मैट्रिक्स, एक सत्यापन लूप।
चरण 4: सुधार का फ़ैसला करें
हर पुष्ट क्लस्टर के लिए चार फ़ैसलों में से ठीक एक चुनें। यह तालिका पूरा फ़ैसला है:
फ़ैसला | कब उपयोग करें | कार्य |
|---|---|---|
विलय करें | पेज एक ही इंटेंट पूरे करते हैं और एक स्पष्ट रूप से पूर्ण है | कमज़ोर पेज के अनूठे बिंदुओं को मज़बूत पेज में मोड़ें, फिर कमज़ोर URL हटाएँ या 301 करें |
कैननिकल | लगभग समान वैरिएंट जो मौजूद रहने चाहिए (प्रोडक्ट वैरिएंट, पैरामीटर, कैम्पेन पेज) | आधिकारिक URL चुनें, उस पर सेल्फ-कैननिकल लगाएँ और वैरिएंट उस पर कैननिकल करें |
अलग करें | एक ही विषय, सचमुच अलग इंटेंट जो आप रखना चाहते हैं (जैसे, how-to बनाम प्रोडक्ट पेज) | एक पेज फिर से लिखें ताकि वह स्पष्ट रूप से दूसरी क्वेरी या फ़नल चरण पूरा करे; title और H1 अब ओवरलैप न हों |
हटाएँ | पेज पतला, डुप्लिकेट या सिर्फ़ पहले से कवर टर्म के लिए मौजूद है | कोई अनूठा मूल्य बचे पेज में मोड़ने के बाद हटा दें |
दो मामले कैनिबलाइज़ेशन नहीं हैं, उन्हें छोड़ दें: एक how-to लेख और एक कन्वर्ज़न पेज जो फ़नल के अलग-अलग चरणों में एक ही कीवर्ड लक्षित करते हैं — Google समझता है कि कौन सा पेज क्या करता है — और hreflang वाले एक ही पेज के अलग भाषा संस्करण।
अपने फ़ैसले की जाँच के लिए एक सवाल: इस बदलाव के बाद टर्म खोजने वाला उपयोगकर्ता एक पेज पर उतरता है और उसे वह सब मिलता है जो दूसरा देता था? अगर हाँ — विलय करें या हटाएँ। अगर नहीं — कैननिकल करें या अलग करें।
चरण 5: दृश्यता खोए बिना सुधार लागू करें
सुधार A: कंटेंट कंसोलिडेशन (विलय करें फ़ैसला)। बचे हुए पेज से काम करें। हारने वाले पेज का हर अनूठा सेक्शन उसमें कॉपी करें — FAQ उत्तर, उदाहरण, उद्धृत ब्लॉक, उसकी ओर इशारा करने वाले आंतरिक लिंक। ज़रूरत पड़े तो क्रम फिर से लगाएँ ताकि सबसे मज़बूत कंटेंट ऊपर रहे। जब हारने वाले पेज के बाहरी बैकलिंक या अपनी वास्तविक रैंकिंग हों, तो 404 के बजाय बचे पेज पर 301 करें; जब दोनों में से कुछ न हो, तो हटाना ठीक है। Search Engine Journal का गाइड जानबूझकर 301 से बचता है — वह कंटेंट मोड़कर नया पेज हटाना पसंद करता है — और 301 तभी ज़रूरी होता है जब हटाया गया URL अपना लिंक-वज़न रखता हो। हारने वाले पेज की एंकर इस्तेमाल करने वाले आंतरिक लिंक बचे पेज की ओर इशारा करने के लिए अपडेट करें।

दो प्रतिस्पर्धी पेजों को एक URL में मोड़ना 50/50 इम्प्रेशन बँटवारे को एक विजेता में बदल देता है।
सुधार B: कैननिकलाइज़ेशन (कैननिकल फ़ैसला)। आधिकारिक पेज पर सेल्फ-कैननिकल लगाएँ और वैरिएंट उस पर कैननिकल करें। यह उन लगभग-डुप्लिकेट पेजों के लिए उपकरण है जिन्हें मौजूद रहना चाहिए: प्रोडक्ट वैरिएंट, पैरामीटर वाले URL, कैम्पेन पेज। यह कंसोलिडेशन की जगह नहीं लेता। अगर दो पेजों में महत्वपूर्ण कंटेंट है, तो अकेला canonical दोनों को क्रॉल में छोड़ता है और आपका संपादकीय फ़ोकस बाँटता है — पहले कंटेंट का काम करें, फिर canonical निशाना लगाएँ।
सुधार C: प्रोग्रामैटिक इंडेक्सेशन-ब्लॉकिंग (हटाएँ के निकट फ़ैसला)। जब डुप्लिकेट संरचनात्मक हों — पैरामीटर पेज, फ़िल्टर संयोजन, क्षेत्रीय वैरिएंट जिन्हें इंडेक्सिंग की ज़रूरत नहीं — तो पेज-दर-पेज नहीं, फ़ोल्डर या टेम्पलेट स्तर पर noindex लागू करें। यह वह मामला है जहाँ कोड की एक पंक्ति 200 मैन्युअल संपादनों को हरा देती है।
सुधार D: इंटेंट के अनुसार आंतरिक लिंक ठीक करें (अलग करें फ़ैसला)। जब दो पेज वैध रूप से अलग-अलग इंटेंट पूरे करते हैं, तो अपने आंतरिक लिंक से यह कहलवाएँ। मूल गाइड का नियम: अगर "सेब" शब्द के आसपास का टेक्स्ट सेब खरीदने की बात करता है, तो कन्वर्ज़न पेज से लिंक करें; अगर सेब कहाँ से आते हैं, तो सूचना पेज से। हर आंतरिक लिंक एक वोट है। जब आपके लिंक लगातार उस पेज की ओर जाते हैं जिसे जीतना चाहिए, तो आप वह अस्पष्टता हटा देते हैं जिसे सर्च इंजन खुद हल करते — अक्सर गलत दिशा में।
चरण 6: सत्यापित करें कि सुधार टिका
सुधारों के बाद दो-चार सप्ताह प्रतीक्षा करें और जाँचें फिर चलाएँ।
- Search Console: क्वेरी में अब बँटवारे के बजाय एक प्रभावी URL दिखना चाहिए, और बचे पेज के इम्प्रेशन बढ़ने चाहिए। पुनः-रैंकिंग के दौरान क्लस्टर के कुल इम्प्रेशन एक-दो सप्ताह गिर सकते हैं — यह सामान्य है, विफलता नहीं।
- रैंक ट्रैकर: कीवर्ड को लिंकों के बीच डोलना बंद कर देना चाहिए।
- AI सतहें: अपना मुख्य टर्म किसी AI असिस्टेंट या AI सर्च इंजन से पूछें और पुष्टि करें कि उद्धृत लिंक बचा हुआ है — हटाया हुआ नहीं। बँटे हुए पेज AI साइटेशन भी बाँटते हैं। कंसोलिडेशन उन कुछ सुधारों में से है जो Google रैंकिंग और AI सर्च विज़िबिलिटी दोनों को एक साथ मदद करते हैं।
अगर क्लस्टर चार सप्ताह बाद भी बँटा है, तो या तो आपने कोई पेज चूका (अज्ञात वैरिएंट फिर जाँचें), या पेज सचमुच अलग-अलग इंटेंट पूरे कर रहे हैं और विलय के बजाय अलग किए जाने चाहिए थे। फिर सत्यापित करें और फिर फ़ैसला करें।
इसे दोबारा होने से रोकें
ऑडिट आसान हिस्सा है। साफ़ रहना संपादकीय अनुशासन है। तीन अभ्यास, महत्व क्रम में:
- विषय सूची रखें जिसे कंटेंट टीम लिखने से पहले जाँचती है। कैनिबलाइज़ेशन बनाने का सबसे तेज़ तरीका वह लेखक है जिसे पता नहीं कि पेज पहले से मौजूद है।
- ओवरलैप को बाड़ नहीं, बातचीत बनाएँ। विषय पर प्रतिबंध लगाने के बजाय लेखक को पूरक कोण खोजने में मदद करें — how-to, तुलना, वर्टिकल संस्करण।
- AI निर्माण पाइपलाइनों पर सबसे पहले नज़र रखें। AI आउटपुट कैनिबलाइज़ेशन की सबसे तेज़ फ़ैक्ट्री है: यह पतले, दोहराए गए पेज बनाता है जो प्रॉम्प्ट गुणवत्ता से परे एक-दूसरे से प्रतिस्पर्धा करते हैं। AI-जनरेटेड या AI-ब्रीफ़ वाला हर पेज शेड्यूलिंग से पहले विषय-सूची जाँच से गुज़रे, और तिमाही ऑडिट उन्हें प्राथमिकता दे।
पूर्ण ऑडिट हर तिमाही और हर उस रिलीज़ के बाद चलाएँ जिसने साइट के एक क्षेत्र में कुछ पेजों से अधिक जोड़े।
ऑडिट स्वचालित करें: एक Codex स्किल
उपरोक्त चरण मैन्युअल हैं ताकि आप समझें कि डेटा का क्या मतलब है। समझने के बाद दोहराए जाने वाले हिस्से किसी AI प्रोग्रामिंग एजेंट को सौंप दें। यह Codex के लिए पूर्ण स्किल फ़ाइल है: यह आपके Search Console एक्सपोर्ट पढ़ता है, प्रतिस्पर्धी क्लस्टर चिह्नित करता है और आपकी साइट को छुए बिना फ़ैसला-शीट बनाता है।
---
name: keyword-cannibalization-audit
description: Find and classify keyword cannibalization clusters from Google Search Console, crawl, and rank-tracker exports. Use when a query shows multiple URLs, rankings dropped after a new page launch, or you need a cannibalization verdict sheet. Read-only: produces a report, never edits pages.
---
# Keyword Cannibalization Audit
## Inputs (required)
- `gsc-queries.csv` — Search Console query export (query, impressions, clicks, position)
- `gsc-pages.csv` — Search Console page export (page, impressions, clicks, position)
- `crawl-titles.csv` — crawl export with URL, title, H1, canonical
- `rank-history.csv` — optional rank tracker export with per-keyword URL history
## Procedure
1. Load the CSVs. Normalize URLs (lowercase host, strip trailing slash and tracking parameters).
2. Join `gsc-queries.csv` and `gsc-pages.csv` on query to build query-to-URL mappings.
3. Flag queries where 2+ URLs each received at least 10% of the query's impressions in the last 90 days.
4. Flag queries where a URL sits between positions 20-50 and a second URL for the same query was created later (compare crawl or tracker history).
5. From `crawl-titles.csv`, flag pairs whose titles or H1s are identical or share 80%+ of their significant tokens.
6. From `rank-history.csv`, flag queries whose ranking URL changed more than twice in 6 months.
7. Cross-check every flag. Keep only clusters confirmed by at least two signals (Search Console + crawl counts as two).
8. Classify each surviving cluster as MERGE, CANONICALIZE, DIFFERENTIATE, or REMOVE:
- Same intent + one page clearly more complete → MERGE (fold unique sections into the survivor; note a 301 only if the removed URL has external backlinks)
- Near-identical variants that must exist (parameters, variants) → CANONICALIZE
- Same topic, genuinely different intent you want to keep → DIFFERENTIATE (rewrite one page, no title overlap)
- Thin or fully duplicated page with no unique value → REMOVE
- Complementary intent (how-to vs. product for the same keyword) → NOT CANNIBALIZATION, skip
9. Output `cannibalization-verdicts.md`: a table of query | competing URLs | signals found | verdict | action, ordered by query impressions. Include for each cluster the exact URLs, the evidence rows (dates, positions, impressions), and fix text ready to paste into a CMS task.
## Rules
- Read-only. Never edit pages, robots.txt, or canonicals. Output the report and a proposed action plan only.
- Never merge a URL into a survivor whose content is not equal to or better than the merged output.
- Do not classify locale variants (hreflang) or genuinely different intents as cannibalization.
- Clusters with fewer than two confirming signals get marked "unconfirmed — review manually," never dropped.
- When the rank tracker export is missing, run with Search Console + crawl only and say so in the report header.इसे Codex स्किल फ़ोल्डर में keyword-cannibalization-audit/SKILL.md के रूप में सहेजें, चारों CSV एक वर्कस्पेस फ़ोल्डर में रखें और चलाएँ। कुछ हज़ार पेजों पर एक सामान्य रन कुछ मिनट लेता है और फ़ैसला-शीट लौटाता है।
दो छोटे प्रॉम्प्ट उनके लिए जो पूर्ण स्किल नहीं चाहते:
- एक्सपोर्ट ट्राइएज: "यह रहा मेरा Search Console क्वेरी एक्सपोर्ट। वे सभी क्वेरी खोजें जिनमें मेरे दो या अधिक लिंक हर एक को कम से कम 10% इम्प्रेशन मिलते हैं। आउटपुट तालिका में: क्वेरी, URL, इम्प्रेशन बँटवारा, हर URL की पोज़ीशन। कोई सिफ़ारिश नहीं।"
- क्लस्टर फ़ैसला: "मेरे दो पेज [क्वेरी] के लिए रैंक कर रहे हैं: [URL A] पोज़ीशन [X] पर और [URL B] पोज़ीशन [Y] पर। [URL B] [तारीख़] को प्रकाशित हुआ। उनकी सामग्री की तुलना करें और बताएँ कि चार फ़ैसलों में से कौन लागू होता है — विलय करें, कैननिकल, अलग करें, हटाएँ — और क्यों, दो वाक्यों में।"
अक्सर पूछे जाने वाले प्रश्न
मेरे कीवर्ड के लिए कई पेज रैंक कर रहे हैं — क्या यह अपने आप कैनिबलाइज़ेशन है?
नहीं। अगर पेज अलग-अलग इंटेंट (खोज बनाम खरीद) या अलग-अलग भाषाएँ पूरे करते हैं, तो सर्च इंजन उन्हें अच्छी तरह संभालते हैं। केवल वे पेज जो फ़नल के एक ही चरण में एक ही काम के लिए प्रतिस्पर्धा कर रहे हैं, फ़ैसले की ज़रूरत रखते हैं।
कैननिकल या noindex — किसका उपयोग करूँ?
कैननिकल जब पेज सुलभ रहने चाहिए (प्रोडक्ट वैरिएंट, पैरामीटर) और उनके सिग्नल आधिकारिक पेज में बहने चाहिए। noindex, प्रोग्रामैटिक रूप से लागू, जब पेज शुद्ध डुप्लिकेट हैं जो किसी उपयोगकर्ता ज़रूरत की सेवा नहीं करते। जब डुप्लिकेट पेज में वास्तव में उपयोगी कुछ हो, तो कोई भी कंटेंट कंसोलिडेशन की जगह नहीं लेता।
क्या मुझे हारने वाले पेज से 301 करना चाहिए?
केवल अगर उसके बाहरी बैकलिंक या अपनी महत्वपूर्ण रैंकिंग हों। नहीं तो उसकी अनूठी सामग्री बचे पेज में मोड़ें और हटा दें। असली विकल्प न बनने वाले पेज पर 301 रिडायरेक्ट वज़न बर्बाद करता है और उपयोगकर्ताओं को भ्रमित करता है।
पेज विलय के बाद ट्रैफ़िक गिर गया — क्या मैंने कुछ तोड़ा?
Google क्लस्टर का पुनर्मूल्यांकन करते समय छोटी गिरावट आम है। चौथे सप्ताह में मापें: अगर बचा पेज क्वेरी के लिए रैंक कर रहा है और क्लस्टर के इम्प्रेशन वापस आए, तो सुधार टिका। अगर दूसरा पेज जीत रहा है, तो आपने गलत दिशा में विलय किया। बदतर होने से पहले वापस लें।
क्या कैनिबलाइज़ेशन AI सर्च साइटेशन को प्रभावित करता है?
हाँ। जब आपके दो लिंक प्रतिस्पर्धा करते हैं, तो AI उत्तर उनके बीच चुनते हैं और एक, दूसरा या कोई भी उद्धृत कर सकते हैं। कंसोलिडेशन आपको दो कमज़ोर लिंक के बजाय एक मज़बूत, उद्धरण-योग्य लिंक देता है।
मुझे ऑडिट कितनी बार चलाना चाहिए?
आधार के रूप में तिमाही, साथ ही हर नए पेज की लहर के बाद। AI से कंटेंट बनाने वाली साइटों को ऑडिट को समय-समय का काम नहीं, संपादकीय पाइपलाइन का हिस्सा मानना चाहिए।
लेखिका: क्लारा बेनेट, Auspia में दस वर्षों के अनुभव वाली कंटेंट रणनीतिकार। क्लारा संपादकीय प्रणालियों, विषय मानचित्रों और दोहराए जाने योग्य कंटेंट संचालन के बारे में लिखती हैं जो प्रकाशन योजनाओं को आपस में टकराने से रोकते हैं।












