Apa yang aliran kerja ini berikan kepada anda
Anda ada halaman yang berada dalam top 10 untuk kata kunci penting, dan kini ia jatuh ke kedudukan 34. Anda mencari frasa yang sama dan nampak dua pautan anda dalam hasil carian. Atau pasukan kandungan anda menerbitkan 40 siaran baharu bulan lepas dan anda mengesyaki sebahagian daripadanya bersaing secara senyap antara satu sama lain.
Aliran kerja ini menukar syak wasangka kepada senarai yang disahkan dan pelan pembaikan. Pada akhirnya anda akan ada: setiap pertanyaan yang mana dua atau lebih pautan anda bersaing, satu keputusan untuk setiap kelompok (gabung, kanonikal, bezakan atau buang) dan pelan pengesahan empat minggu yang memberitahu anda sama ada pembaikan itu bertahan.
- Untuk siapa: pakar SEO dan pasukan kandungan di tapak dari beberapa ratus halaman ke atas, serta sesiapa yang menerbitkan dengan pantas.
- Masa: kira-kira 90 minit untuk audit pertama tapak bersaiz sederhana biasa; separuh daripadanya setelah mahir.
- Prasyarat: akses baca ke Google Search Console, eksport imbasan (Screaming Frog, Sitebulb atau yang setara) dan penjejak kedudukan jika anda melanggan.
- Kriteria siap: setiap kelompok bersaing dalam senarai anda mempunyai tepat satu daripada empat keputusan di atas, pembaikan telah dilaksanakan dan ada tarikh dalam kalendar untuk menyemak semula kedudukan serta impresi.
Dahulukan satu semakan realiti, kerana ia menyelamatkan anda daripada membaiki perkara yang tidak rosak: melihat berbilang pautan untuk satu pertanyaan adalah normal. Halaman kategori, siaran blog dan halaman produk semuanya boleh meletakkan kedudukan untuk frasa yang sama — jika ia melayani niat yang berbeza (yang menyelidik lawan yang bersedia membeli), itu SERP yang sihat, bukan kanibalisasi. Aliran kerja ini hanya menandakan halaman yang bersaing untuk kerja yang sama pada peringkat yang sama.
Kenapa ini lebih penting pada 2026 daripada lima tahun lalu, kerana satu sebab: brief dan draf yang dijana AI menghasilkan halaman serupa pada kelajuan yang semakan manual tidak dapat mengejar, jadi kanibalisasi kini berlaku secara berskala. Ia menjejaskan kedudukan Google dan petikan carian AI pada masa yang sama.
Semakan gejala 3 minit
Lalui senarai ini sebelum menyelami data. Jika dua atau lebih perkara kedengaran biasa — jalankan audit penuh.
Gejala | Macam mana ia kelihatan | Punca paling mungkin |
|---|---|---|
Kedudukan tersekat | Halaman kekal dalam top 10 berbulan-bulan dan jatuh ke 25–50 selepas halaman baharu keluar | Halaman baharu bersaing untuk pertanyaan yang sama |
Impresi terbahagi | Dua pautan membahagi impresi pertanyaan hampir 50/50 | Tiada halaman memenangi autoriti yang jelas |
Tajuk kembar | Dua halaman dengan H1 dan title yang sama atau hampir sama | Penulis membuat varian, bukan pelengkap |
Kedudukan berubah-ubah | Pautan yang meletakkan kedudukan untuk istilah itu bertukar antara halaman anda minggu ke minggu | Enjin carian tidak dapat memilih halaman autoriti |
Jawapan AI berubah-ubah | Pembantu AI memetik pautan berbeza anda untuk soalan yang sama dalam larian berbeza | Pencairan yang sama, pada permukaan lain |
Sebelum bermula: data yang diperlukan
Kumpulkan tiga perkara:
- Search Console dengan sekurang-kurangnya 6 bulan sejarah. 90 hari cukup untuk semakan pantas, tetapi tetingkap lebih panjang menunjukkan bila kedudukan jatuh berbanding pelancaran halaman.
- Imbasan terkini dengan title dan H1 diekstrak. Screaming Frog melakukannya secara natif; Sitebulb dan Botify juga berfungsi. Jika tiada langsung, carian
site:ditambah senarai halaman CMS meliputi kes paling ketara. - Eksport penjejak kedudukan (Semrush, Ahrefs, Authority Labs). Langkah ini pilihan — perbandingan Search Console sahaja menemui kebanyakan kes.
Eksport dua perkara daripada Search Console sebelum bermula: laporan pertanyaan (pertanyaan, impresi, klik, kedudukan) dan laporan yang sama dengan dimensi halaman (URL). Kedua-duanya ada dalam bahagian Prestasi, dalam laporan penuh.
Langkah 1: cari URL yang bersaing dalam Search Console
Ini perbandingan percuma dengan isyarat paling kuat.
- Buka Search Console → Prestasi → laporan penuh.
- Gunakan penapis pertanyaan dan taip kata kunci keutamaan pertama anda.
- Lihat senarai pautan di bawah graf. Catat setiap pertanyaan yang mana dua atau lebih halaman anda menerima impresi.
Anda mencari dua corak: halaman yang membahagi impresi lebih kurang sama dalam tempoh yang sama, dan halaman yang tersekat antara kedudukan 20 dan 50 yang dahulu dalam top 10 — terutamanya jika kejatuhan bermula sekitar pelancaran halaman serupa.
Mulakan dengan 10–15 kata kunci paling penting anda. Jika anda menjumpai kelompok dalam separuh daripadanya, masalahnya berskala tapak dan berbaloi untuk menyaring semua pertanyaan dengan, katakan, lebih 50 impresi dalam setengah tahun. Jika ia hanya muncul pada beberapa — masalah terpencil: baiki dan teruskan.
Hasil jangkaan: senarai pertanyaan, setiap satu dengan dua atau lebih pautan anda dan pecahan impresi mereka. Semakan kualiti: halaman mesti benar-benar berkongsi kedudukan untuk pertanyaan yang sama. Jika ia hanya kedengaran serupa — ia jiran, bukan pesaing: keluarkan. Laluan pemulihan: tiada apa dijumpai? Luaskan tetingkap kepada 3 bulan dan tambah varian long-tail kata kunci anda. Semak juga pecahan antara istilah berjenama dan tidak berjenama — di situlah duplikat pada tapak berbilang versi bersembunyi (pasangan bahasa, borong/runcit).
Langkah 2: cari title dan H1 duplikat dalam imbasan anda
Kanibalisasi selalunya kemalangan pengeluaran kandungan: penulis disuruh "tulis tentang X", tidak menyemak apa yang sudah wujud, dan mencipta halaman dengan tajuk yang sama dengan halaman yang sudah meletakkan kedudukan.
Buka eksport imbasan, susun mengikut title dahulu kemudian H1, dan tandai duplikat serta hampir-duplikat. "Hampir" dikira — dua halaman tidak perlu tajuk serupa untuk bersaing. "Perisian CRM terbaik" dan "Alat CRM terbaik" yang menyasarkan khalayak sama ialah calon; "CRM terbaik untuk hartanah" ialah halaman lain, tidak masuk senarai.
Semasa dalam data imbasan, semak juga suspek teknikal: kanonik yang menghala ke tempat lain selain halaman itu sendiri, peraturan meta robots noindex yang diubah apabila varian ditambah, dan blok robots.txt yang bermula atau berhenti. Seperti kata panduan Search Engine Journal mengenai topik ini: apabila anda mengubah cara anda mengarahkan enjin carian untuk mengimbas, mengindeks dan mengabaikan, anda mencipta masalah kanibalisasi. Contoh klasik ialah halaman varian produk yang mewarisi kanonik produk lama.
Hasil jangkaan: pasangan halaman dengan title dan H1 duplikat atau bersaing, serta bendera teknikal. Semakan kualiti: untuk setiap pasangan jawab satu soalan — adakah satu halaman wujud dan meletakkan kedudukan sebelum halaman lain dilancarkan? Jika ya, catatkan: itu isyarat paling kuat masalah sebenar. Laluan pemulihan: jika CMS anda menjadikan eksport satu seksaan, hasilkan senarai daripada CSV imbasan dengan skill Codex di hujung artikel ini. Anggap outputnya sebagai senarai calon, bukan keputusan.
Langkah 3: sahkan dengan penjejak kedudukan
Search Console memberitahu apa yang Google laporkan; penjejak kedudukan menunjukkan di mana pautan anda berada dalam masa — dan dialah yang mendedahkan halaman yang benar-benar tersekat.
Buka setiap pertanyaan calon dalam penjejak anda. Corak yang mengesahkan kanibalisasi: kata kunci tersekat antara pertengahan 20-an dan pertengahan 50-an, atau pautan yang memegang kedudukan X bertukar-tukar antara halaman anda. Semrush menunjukkan halaman mana anda muncul untuk istilah itu dalam tahun lalu; Authority Labs menyenaraikan setiap pautan untuk setiap kata kunci. Jika dua atau lebih pautan anda muncul dalam sejarah tahunan dan tiada satu pun mencecah top 10 — anda ada pengesahan.
Baca juga arahnya. Jika halaman asal anda meletakkan kedudukan dengan baik sehingga halaman baharu diterbitkan dan kini kedua-duanya turun naik di bawah lipatan, halaman baharu tidak "mencuri" kedudukan. Kedua-dua halaman mencairkan antara satu sama lain. Ini mengubah pembaikan: anda menggabungkan halaman baharu ke dalam halaman asal, bukan sebaliknya.
Hasil jangkaan: status pengesahan untuk setiap kelompok calon — "disahkan" atau "tidak disahkan, semakan manual". Semakan kualiti: pengesahan memerlukan sekurang-kurangnya dua isyarat bebas. Search Console + imbasan dikira sebagai dua; penjejak kedudukan sahaja ialah isyarat tunggal yang lemah. Laluan pemulihan: jika penjejak anda hanya menunjukkan satu pautan setiap kata kunci, langkau langkah ini. Perbandingan Search Console dan imbasan mencukupi untuk menjalankan keseluruhan aliran kerja.

Saluran audit: tiga laluan pengesanan, satu matriks keputusan, satu gelung pengesahan.
Langkah 4: buat keputusan pembaikan
Untuk setiap kelompok yang disahkan, pilih tepat satu daripada empat keputusan. Jadual ini ialah keseluruhan keputusan:
Keputusan | Bila guna | Tindakan |
|---|---|---|
Gabung | Halaman melayani niat yang sama dan satu jelas lebih lengkap | Lipat titik unik halaman lemah ke dalam halaman kuat, kemudian buang URL lemah atau buat 301 |
Kanonikal | Varian hampir serupa yang mesti wujud (varian produk, parameter, halaman kempen) | Pilih URL rasmi, letak kanonik kendiri padanya dan kanonikkan varian kepadanya |
Bezakan | Topik sama, niat benar-benar berbeza yang anda mahu kekalkan (cth.: cara-buat lawan halaman produk) | Tulis semula satu halaman supaya jelas melayani pertanyaan atau peringkat corong lain; title dan H1 tidak lagi bertindih |
Buang | Halaman nipis, duplikat atau hanya wujud untuk istilah yang sudah diliputi | Buang selepas melipat sebarang nilai unik ke dalam halaman yang bertahan |
Dua kes bukan kanibalisasi, biarkan sahaja: artikel cara-buat dan halaman penukaran yang menyasarkan kata kunci sama pada peringkat corong berbeza — Google faham halaman mana buat apa — serta versi bahasa berasingan halaman yang sama dengan hreflang.
Satu soalan untuk menguji keputusan anda: selepas perubahan ini, pengguna yang mencari istilah itu mendarat pada satu halaman dan menerima semua yang halaman lain tawarkan? Jika ya — gabung atau buang. Jika tidak — kanonikkan atau bezakan.
Langkah 5: laksanakan pembaikan tanpa kehilangan keterlihatan
Pembaikan A: penyatuan kandungan (keputusan gabung). Bekerja dari halaman yang bertahan. Salin ke dalamnya setiap bahagian unik halaman yang kalah: jawapan FAQ, contoh, blok yang dipetik, pautan dalaman yang menghala kepadanya. Susun semula jika perlu supaya kandungan paling kuat di atas. Apabila halaman yang kalah mempunyai pautan balik luaran atau kedudukan sebenar sendiri, buat 301 ke halaman yang bertahan dan bukannya 404; apabila tiada kedua-duanya — pembuangan adalah baik. Panduan Search Engine Journal sengaja mengelak 301 — ia lebih suka melipat kandungan dan membuang halaman yang lebih baharu — dan 301 hanya menjadi perlu apabila URL yang dibuang membawa berat pautan sendiri. Kemas kini pautan dalaman yang menggunakan sauh halaman yang kalah supaya menghala ke halaman yang bertahan.

Melipat dua halaman bersaing menjadi satu URL mengubah pecahan impresi 50/50 kepada satu pemenang.
Pembaikan B: kanonikalisasi (keputusan kanonikal). Letak kanonik kendiri pada halaman rasmi dan kanonikkan varian kepadanya. Ini alat untuk halaman hampir duplikat yang mesti wujud: varian produk, URL dengan parameter, halaman kempen. Ia tidak menggantikan penyatuan. Jika dua halaman mempunyai kandungan ketara, kanonik sahaja meninggalkan kedua-duanya dalam imbasan dan membahagi fokus editorial anda — buat kerja kandungan dahulu, kemudian sasarkan kanonik.
Pembaikan C: sekatan pengindeksan berprogram (keputusan bersebelahan buang). Apabila duplikat bersifat struktur — halaman parameter, gabungan penapis, varian wilayah yang tidak perlu diindeks — gunakan noindex pada peringkat folder atau templat, bukan halaman demi halaman. Ini kes di mana satu baris kod menewaskan 200 suntingan manual.
Pembaikan D: baiki pautan dalaman mengikut niat (keputusan bezakan). Apabila dua halaman sah melayani niat berbeza, jadikan pautan dalaman anda mengatakannya. Peraturan daripada panduan asal: jika teks di sekeliling perkataan "epal" bercakap tentang membeli epal — pautkan ke halaman penukaran; jika bercakap tentang dari mana epal berasal — pautkan ke halaman maklumat. Setiap pautan dalaman ialah satu undi. Apabila pautan anda konsisten menghala ke halaman yang sepatutnya menang, anda menghapuskan kekaburan yang enjin carian akan selesaikan sendiri — selalunya ke arah yang salah.
Langkah 6: sahkan pembaikan bertahan
Tunggu dua–empat minggu selepas pembaikan dan jalankan semula semakan.
- Search Console: pertanyaan kini patut menunjukkan satu URL dominan dan bukannya pecahan, dan impresi halaman yang bertahan patut meningkat. Impresi agregat kelompok mungkin jatuh untuk satu-dua minggu semasa kedudukan semula — itu normal, bukan kegagalan.
- Penjejak kedudukan: kata kunci patut berhenti berayun antara pautan.
- Permukaan AI: tanya istilah utama anda kepada pembantu AI atau enjin carian AI dan sahkan pautan yang dipetik ialah yang bertahan — bukan yang dibuang. Halaman yang berpecah membahagikan juga petikan AI. Penyatuan ialah salah satu daripada sedikit pembaikan yang membantu kedudukan Google dan keterlihatan carian AI serentak.
Jika kelompok masih berpecah selepas empat minggu, anda sama ada terlepas satu halaman (semak semula varian yang anda tidak tahu), atau halaman benar-benar melayani niat berbeza dan patut dibezakan, bukan digabung. Sahkan semula dan buat keputusan semula.
Halang ia berulang
Audit ialah bahagian mudah. Kekal bersih ialah disiplin editorial. Tiga amalan, mengikut urutan kepentingan:
- Simpan senarai topik yang pasukan kandungan semak sebelum menulis. Cara terpantas untuk mencipta kanibalisasi ialah penulis yang tidak tahu halaman itu sudah wujud.
- Jadikan pertindihan sebagai perbualan, bukan pagar. Daripada mengharamkan topik, bantu penulis mencari sudut pelengkap — cara-buat, perbandingan, versi menegak.
- Awasi saluran pengeluaran AI dahulu. Output AI ialah kilang kanibalisasi terpantas: ia menghasilkan halaman nipis yang berulang dan bersaing antara satu sama lain tanpa mengira kualiti prompt. Setiap halaman yang dijana AI atau dengan brief AI mesti melalui semakan senarai topik sebelum dijadualkan, dan audit suku tahunan mesti mengutamakan mereka.
Jalankan audit penuh setiap suku tahun dan selepas setiap pelancaran yang menambah lebih daripada beberapa halaman ke kawasan yang sama pada tapak.
Automasikan audit: satu skill Codex
Langkah-langkah di atas adalah manual supaya anda faham maksud data. Apabila sudah faham, serahkan bahagian berulang kepada ejen AI pengaturcaraan. Ini fail skill lengkap untuk Codex: ia membaca eksport Search Console anda, menandai kelompok bersaing dan menghasilkan helaian keputusan tanpa menyentuh tapak anda.
---
name: keyword-cannibalization-audit
description: Find and classify keyword cannibalization clusters from Google Search Console, crawl, and rank-tracker exports. Use when a query shows multiple URLs, rankings dropped after a new page launch, or you need a cannibalization verdict sheet. Read-only: produces a report, never edits pages.
---
# Keyword Cannibalization Audit
## Inputs (required)
- `gsc-queries.csv` — Search Console query export (query, impressions, clicks, position)
- `gsc-pages.csv` — Search Console page export (page, impressions, clicks, position)
- `crawl-titles.csv` — crawl export with URL, title, H1, canonical
- `rank-history.csv` — optional rank tracker export with per-keyword URL history
## Procedure
1. Load the CSVs. Normalize URLs (lowercase host, strip trailing slash and tracking parameters).
2. Join `gsc-queries.csv` and `gsc-pages.csv` on query to build query-to-URL mappings.
3. Flag queries where 2+ URLs each received at least 10% of the query's impressions in the last 90 days.
4. Flag queries where a URL sits between positions 20-50 and a second URL for the same query was created later (compare crawl or tracker history).
5. From `crawl-titles.csv`, flag pairs whose titles or H1s are identical or share 80%+ of their significant tokens.
6. From `rank-history.csv`, flag queries whose ranking URL changed more than twice in 6 months.
7. Cross-check every flag. Keep only clusters confirmed by at least two signals (Search Console + crawl counts as two).
8. Classify each surviving cluster as MERGE, CANONICALIZE, DIFFERENTIATE, or REMOVE:
- Same intent + one page clearly more complete → MERGE (fold unique sections into the survivor; note a 301 only if the removed URL has external backlinks)
- Near-identical variants that must exist (parameters, variants) → CANONICALIZE
- Same topic, genuinely different intent you want to keep → DIFFERENTIATE (rewrite one page, no title overlap)
- Thin or fully duplicated page with no unique value → REMOVE
- Complementary intent (how-to vs. product for the same keyword) → NOT CANNIBALIZATION, skip
9. Output `cannibalization-verdicts.md`: a table of query | competing URLs | signals found | verdict | action, ordered by query impressions. Include for each cluster the exact URLs, the evidence rows (dates, positions, impressions), and fix text ready to paste into a CMS task.
## Rules
- Read-only. Never edit pages, robots.txt, or canonicals. Output the report and a proposed action plan only.
- Never merge a URL into a survivor whose content is not equal to or better than the merged output.
- Do not classify locale variants (hreflang) or genuinely different intents as cannibalization.
- Clusters with fewer than two confirming signals get marked "unconfirmed — review manually," never dropped.
- When the rank tracker export is missing, run with Search Console + crawl only and say so in the report header.Simpan sebagai keyword-cannibalization-audit/SKILL.md dalam folder skill Codex, letak empat CSV dalam folder workspace dan jalankan. Larian biasa pada beberapa ribu halaman mengambil masa beberapa minit dan mengembalikan helaian keputusan.
Dua prompt lebih kecil untuk mereka yang tidak mahu skill penuh:
- Triage eksport: "Ini eksport pertanyaan Search Console saya. Cari semua pertanyaan yang mana dua atau lebih pautan saya masing-masing menerima sekurang-kurangnya 10% impresi. Output dalam jadual: pertanyaan, URL, pecahan impresi, kedudukan setiap URL. Tiada cadangan."
- Keputusan kelompok: "Dua halaman saya meletakkan kedudukan untuk [pertanyaan]: [URL A] pada kedudukan [X] dan [URL B] pada kedudukan [Y]. [URL B] diterbitkan pada [tarikh]. Bandingkan kandungan mereka dan beritahu keputusan mana antara empat yang terpakai — gabung, kanonikal, bezakan, buang — dan mengapa, dalam dua ayat."
Soalan lazim
Berbilang halaman meletakkan kedudukan untuk kata kunci saya — adakah itu automatik kanibalisasi?
Tidak. Jika halaman melayani niat berbeza (penyelidikan lawan pembelian) atau bahasa berbeza, enjin carian mengendalikannya dengan baik. Hanya halaman yang bersaing untuk kerja sama pada peringkat corong sama memerlukan keputusan.
Kanonikal atau noindex — guna yang mana?
Kanonikal apabila halaman mesti kekal boleh diakses (varian produk, parameter) dan isyaratnya perlu mengalir ke halaman rasmi. Noindex, digunakan secara berprogram, apabila halaman ialah duplikat tulen yang tidak melayani sebarang keperluan pengguna. Kedua-duanya tidak menggantikan penyatuan kandungan apabila halaman duplikat mengandungi sesuatu yang benar-benar berguna.
Patutkah saya buat 301 daripada halaman yang kalah?
Hanya jika ia mempunyai pautan balik luaran atau kedudukan ketara sendiri. Jika tidak, lipat kandungan uniknya ke dalam halaman yang bertahan dan buangnya. 301 ke halaman yang bukan pengganti sebenar membazir berat redirect dan mengelirukan pengguna.
Trafik jatuh selepas saya menggabung halaman — adakah saya merosakkan sesuatu?
Kejatuhan ringkas semasa Google menilai semula kelompok adalah biasa. Ukur pada minggu keempat: jika halaman yang bertahan meletakkan kedudukan untuk pertanyaan dan impresi kelompok pulih — pembaikan bertahan. Jika halaman lain menang, anda menggabung ke arah yang salah. Tarik balik sebelum ia menjadi lebih teruk.
Adakah kanibalisasi menjejaskan petikan carian AI?
Ya. Apabila dua pautan anda bersaing, jawapan AI memilih antara mereka dan boleh memetik satu, satu lagi — atau tiada langsung. Penyatuan memberi anda satu pautan kuat yang layak dipetik dan bukannya dua yang cair.
Berapa kerap saya perlu menjalankan audit?
Setiap suku tahun sebagai garis asas, ditambah selepas setiap gelombang halaman baharu. Tapak yang menghasilkan kandungan dengan AI patut menganggap audit sebagai sebahagian saluran editorial, bukan tugas berkala.
Penulis: Clara Bennett, ahli strategi kandungan dengan pengalaman sepuluh tahun di Auspia. Clara menulis tentang sistem editorial, peta topik dan operasi kandungan berulang yang menghalang pelan penerbitan daripada berlanggar antara satu sama lain.












