Cara Disitasi oleh AI Search: Baiki 4 Faktor yang Benar-Benar Penting

Perkara utama

Satu pos viral mendakwa kajian SIGIR membuktikan schema tidak berkesan. Kajian itu tidak pernah menguji schema. Ini 4 faktor yang benar-benar diuji.

Apa yang anda akan peroleh selepas selesai

Audit peringkat halaman terhadap empat faktor yang dikenal pasti oleh satu kajian terkawal dengan 252,000 percubaan sebagai penentu sitasi AI, bersama urutan pembaikan tujuh faktor sekunder yang hanya mula berkesan selepas keempat-empat itu selesai. Anda juga akan faham, berserta sumber, mengapa dakwaan viral bahawa "markup schema langsung tiada kesan pada sitasi AI" bukan kesimpulan sebenar kajian tersebut, supaya anda tidak menghabiskan satu sprint membaiki perkara yang salah.

Untuk siapa: sesiapa yang bertanggungjawab atas SEO atau GEO di peringkat halaman bagi laman yang mahu disitasi dalam ChatGPT, Gemini, Perplexity, Claude atau jawapan AI Google.

Masa diperlukan: 30 hingga 45 minit setiap halaman, termasuk audit dan pusingan pembaikan pertama.

Selesai apabila: halaman yang anda audit lulus keempat-empat penapis penentu dan anda mempunyai senarai bertulis faktor sekunder yang masih perlu dibaiki.

Sebelum bermula: apa asas senarai semak ini dan apa yang dibetulkannya

Ada satu pos yang tersebar dalam kalangan SEO/GEO mendakwa satu kajian SIGIR menjalankan 252,000 percubaan ke atas enam LLM dan mendapati markup schema serta JSON-LD mempunyai "kesan terukur sifar" terhadap sitasi AI, manakala harga, kesegaran, spesifikasi dan kedalaman banyak menggerakkan hasilnya.

Kajian itu memang wujud. Bilangan percubaannya betul. Nisbah odds yang disebut dalam pos itu juga hampir dengan angka sebenar. Satu sahaja yang tidak bertahan: kajian itu tidak pernah menguji markup schema. Bukan kerana schema "diukur sifar", tetapi kerana schema memang tiada dalam senarai perkara yang diukur sejak awal.

Kertas itu bertajuk "What Gets Cited: Competitive GEO in AI Answer Engines" (Vishwakarma, Kumar, Jamidar, Sprinklr; SIGIR '26, Melbourne). Reka bentuknya menyuntik tepat dua sumber calon ke dalam enam LLM (Gemini-2.5-Flash, Claude-3.5-Sonnet, Kimi-K2-Thinking dan tiga varian GPT-5), dengan setiap pasangan berbeza pada tepat satu daripada 18 faktor kandungan, lalu merekodkan sumber mana yang disitasi dahulu. Ke-18 faktor itu merangkumi padanan kandungan, kesempurnaan, kredibiliti, kebolehbacaan, kedudukan bersaing dan kesegaran. Format data berstruktur tidak muncul dalam ke-18 itu — disahkan melalui padanan terus dengan jadual taksonomi kertas itu sendiri.

Kalau anda mahu jawapan sebenar tentang schema, jawapannya datang dari tempat lain: kajian terkawal Ahrefs Mei 2026 yang membandingkan 1,885 halaman yang ditambah JSON-LD dengan 4,000 halaman kawalan yang dipadankan. Hasilnya ialah tiada peningkatan sitasi yang bermakna di Google AI Overviews (−4.6%, penurunan kecil tetapi signifikan secara statistik), Google AI Mode (+2.4%, tidak signifikan) dan ChatGPT (+2.2%, tidak signifikan). Satu ujian berasingan oleh searchVIU mendapati ChatGPT, Claude, Perplexity, Gemini dan Google AI Mode langsung tidak membaca JSON-LD, Microdata tersembunyi atau RDFa tersembunyi semasa pengambilan masa nyata.

Asingkan kedua-dua perkara ini sebelum mula mengaudit: kajian SIGIR memberitahu anda apa yang perlu diutamakan pada halaman. Kajian Ahrefs memberitahu anda schema bukan salah satu keutamaan itu dari segi jumlah sitasi, walaupun ia masih relevan untuk hasil diperkaya dan kejelasan entiti di tempat lain.

Langkah 1: jalankan audit penapis penentu

Periksa halaman anda terhadap keempat-empat faktor ini. Kajian SIGIR mendapati keempat-empatnya sebulat suara pada enam model, dengan kesan yang sangat besar (nisbah odds melebihi 100 pada kebanyakan model). Gagal pada satu sahaja boleh menghapuskan peluang disitasi, tidak kira betapa kukuhnya bahagian lain halaman itu.

Penapis

Apa yang diperiksa

Julat nisbah odds (daripada enam model yang diuji)

Padanan topik

Adakah halaman menjawab terus pertanyaan yang ingin direbutkannya, bukan topik yang berhampiran?

Menentukan pada 5 daripada 6 model

Harga dinyatakan

Adakah harga konkrit kelihatan pada halaman, bukan tersembunyi di sebalik "hubungi kami"?

6.26 hingga melebihi 10,000

Cap masa terkini

Adakah tarikh penerbitan atau tarikh semakan terakhir kelihatan terkini dan tepat?

14.4 hingga melebihi 10,000

Kedudukan dalam senarai

Adakah halaman cenderung menduduki tempat pertama antara calon pertanyaan itu, bukan tempat kedua?

1,795 hingga melebihi 10,000

Tindakan: buka halaman bersebelahan dengan pertanyaan sasaran. Baca 150 patah perkataan pertama dan tanya sama ada ia menjawab pertanyaan itu secara terus. Cari harga pada halaman; kalau perlu isi borang atau telefon, itu kegagalan. Bandingkan tarikh yang dipaparkan dengan bila kandungan itu sebenarnya kali terakhir dikemas kini. Periksa kedudukan semasa atau bahagian sitasi anda untuk pertanyaan itu.

Hasil dijangka: lulus atau gagal bagi setiap empat baris.

Semakan kualiti: kalau padanan topik gagal, berhenti di sini — tiada langkah seterusnya yang boleh menyelamatkan halaman yang menjawab soalan yang salah.

Laluan pemulihan: kegagalan harga dan tarikh boleh dibaiki pada hari yang sama (langkah 2). Kegagalan kedudukan dalam senarai bukan masalah kandungan; ia bermakna asas SEO perlu dibaiki dahulu sebelum halaman ini boleh bersaing untuk sitasi, dan penggilapan di dalam halaman tidak boleh menggantikannya.

Gambar rajah aliran yang menunjukkan empat penapis penentu mengikut urutan, dengan cabang "berhenti dan baiki" apabila mana-mana penapis gagal
Gagal pada satu penapis sahaja boleh menghapuskan peluang disitasi — baiki dahulu sebelum meneruskan.

Langkah 2: baiki dahulu penapis yang gagal

Lakukan ini sebelum menyentuh apa-apa yang lain. Semuanya item dengan tuas terbesar dan usaha paling kecil dalam keseluruhan senarai.

Kalau tiada harga: letakkan angka sebenar. Kalau harga berbeza-beza, terbitkan harga permulaan sebenar atau julat yang jelas dan bukan borang hubungan. Ini salah satu daripada empat penapis dalam kajian itu.

Kalau cap masa sudah lapuk atau tiada: kemas kini tarikh penerbitan atau tarikh semakan terakhir, tetapi hanya selepas anda benar-benar menyemak semula kandungannya. Menukar tarikh tanpa kemas kini sebenar ialah isyarat kesegaran yang anda tidak boleh pertahankan kalau ada orang menyemaknya.

Kalau padanan topik lemah: tulis semula 150 patah perkataan pertama supaya ia menjawab terus tugasan pertanyaan itu, bukan topik yang berkaitan. Jangan sambung pembukaan baharu pada struktur lama — gantikan sahaja.

Semakan kualiti: baca semula halaman seolah-olah anda ialah pertanyaan itu. Adakah orang luar mendapat jawapan konkrit di perenggan pertama?

Laluan pemulihan: kalau harga sebenar tidak boleh diterbitkan (sebut harga tersuai, kontrak korporat), terbitkan harga permulaan yang mewakili atau julat biasa daripada membiarkannya kosong — kajian itu mengukur keadaan gagal sebagai "harga tidak disebut", bukan "harga berbeza-beza".

Langkah 3: selesaikan faktor pembeza sekunder

Setelah keempat-empat penapis lulus, tujuh faktor berikut memberi pembezaan sekunder, dengan nisbah odds sekitar 2 hingga 243 bergantung pada model. Baiki mengikut urutan ini:

  1. Spesifikasi hilang. Tambah spesifikasi teknikal yang benar-benar akan dibandingkan oleh pembeli (saiz, bahan, kapasiti, keserasian). Nisbah odds 8.63 hingga 243 mengikut model, salah satu kesan sekunder terbesar.
  2. Tiada perbandingan. Tambah perbandingan terus dengan sekurang-kurangnya satu alternatif yang dinamakan. Nisbah odds 1.61 hingga 7.45.
  3. Bahasa berlapik. Gantikan "mungkin", "boleh jadi", "berkemungkinan" dengan kenyataan terus yang benar-benar boleh dipertahankan oleh halaman itu.
  4. Dakwaan tanpa bukti. Lampirkan bukti pada dakwaan: keputusan ujian, pensijilan, metodologi yang dinamakan.
  5. Percanggahan dalaman. Periksa sama ada angka dan dakwaan konsisten antara bahagian dalam halaman yang sama; ini mudah masuk semasa menyunting dan mudah terlepas semasa menyemak.
  6. Jurang kata kunci. Pastikan halaman benar-benar mengandungi istilah khusus yang digunakan oleh pertanyaan sasaran, bukan sekadar sinonim.
  7. Cadangan nilai lebih lemah. Pertajam kenyataan manfaat konkrit anda berbanding apa yang ditawarkan halaman pesaing.

Tindakan: ikut senarai dari atas ke bawah dan baiki yang berkenaan. Bukan setiap halaman mempunyai kesemua tujuh masalah itu.

Hasil dijangka: halaman yang setiap dakwaannya konkrit, boleh dibandingkan atau berasaskan bukti.

Semakan kualiti: adakah pembaca yang ragu masih menjumpai satu ayat kabur atau tanpa asas yang tertinggal pada halaman itu?

Laluan pemulihan: kalau masa suntuk, berhenti pada item 1 dan 2 (spesifikasi dan perbandingan) — kedua-duanya mempunyai nisbah odds tertinggi antara ketujuh-tujuhnya.

Carta palang mendatar yang menyusun tujuh faktor sekunder sitasi AI mengikut julat nisbah odds, paling atas "spesifikasi hilang", paling bawah "cadangan nilai lebih lemah"
Setelah keempat-empat penapis lulus, ikut senarai ini dari atas ke bawah.

Langkah 4: langkau perubahan format semata-mata

Kajian itu menunjukkan secara jelas tiada kesan konsisten daripada menukar perenggan menjadi poin, menambah sari kata demi kebolehbacaan atau menyusun semula maklumat yang bertaburan, kerana model yang diuji mentafsir kandungan tanpa dipengaruhi struktur visual. Kalau halaman anda sudah lulus semakan di atas, jangan bakar satu sprint untuk menggilap format dengan harapan sitasi meningkat. Formatkan untuk pembaca manusia anda, bukan untuk kenaikan sitasi yang tidak disokong data.

Langkah 5: biarkan schema di tempat yang sepatutnya

Kekalkan markup schema betul dari segi teknikal, kerana ia melakukan kerja sebenar: membantu Google dan Bing mentafsir hasil diperkaya dan memberi sistem carian pemahaman yang jelas tentang apa itu halaman dan entiti. Apa yang ia tidak lakukan, menurut bukti terkawal terbaik yang ada, ialah menggerakkan peluang disitasi oleh AI. Jangan letak kerja schema di hadapan langkah 1 hingga 3 atas alasan ia tuas sitasi: tiada kajian terkawal menyokongnya, dan satu-satunya kajian yang dipetik untuk menyokongnya tidak pernah menguji schema. Kalau anda mahu huraian penuh tentang apa yang sebenarnya diukur oleh kajian schema Ahrefs, lihat panduan SEO semantik 2026 kami.

Sahkan hasil akhir

Jalankan semula audit dari langkah 1 pada halaman selepas pembaikan. Keempat-empat penapis sepatutnya kini lulus. Periksa secara pensampelan dua hingga tiga faktor sekunder dari langkah 3 yang anda baiki. Kalau anda mempunyai akses kepada alat keterlihatan AI atau penjejakan sitasi, seperti AI Search Visibility Checker, catatkan bahagian sitasi semasa halaman itu untuk pertanyaan sasaran sebagai garis dasar sebelum beralih ke halaman seterusnya, supaya kemudian anda boleh tentukan sama ada perubahan itu menggerakkan apa-apa.

Kekalkan hasilnya

Periksa semula penapis tarikh setiap kali halaman menerima kemas kini yang bermakna, bukan mengikut kalendar tetap. Bagi halaman yang kehilangan bahagian sitasi, audit semula bermula dengan keempat-empat penapis sebelum menganggap ada faktor sekunder yang tergelincir.

Soalan lazim

Adakah kajian SIGIR menguji markup schema atau JSON-LD? Tidak. Taksonomi 18 faktornya merangkumi padanan kandungan, kesempurnaan, kredibiliti, kebolehbacaan, kedudukan bersaing, kesegaran dan kedudukan dalam senarai. Format data berstruktur tidak ada antara kategori mahupun faktor yang diuji — disahkan dengan membaca terus jadual taksonomi kertas itu.

Jadi markup schema membantu sitasi AI atau tidak? Bukti terkawal terbaik yang ada — kajian Ahrefs Mei 2026, 1,885 halaman berbanding 4,000 kawalan yang dipadankan — tidak menemui peningkatan sitasi yang bermakna daripada menambah JSON-LD, sama ada di Google AI Overviews, Google AI Mode atau ChatGPT. Satu ujian lain mendapati beberapa model AI utama tidak membaca data berstruktur semasa pengambilan masa nyata. Itu tidak menjadikan schema tidak berguna di tempat lain; ia cuma bukan tuas jumlah sitasi.

Dari mana datangnya angka khusus dalam pos viral itu (6.3, 14, 4 hingga 8.6)? Ia menyerupai nisbah odds sebenar dalam jadual keputusan kertas SIGIR, tetapi angka itu milik faktor harga, kesegaran dan spesifikasi/perbandingan, bukan schema. Kertas itu melaporkan angka mengikut model, bukan sebagai satu purata, dan julatnya agak luas antara enam LLM yang diuji.

Kalau saya hanya ada satu jam, apa yang patut dibaiki dahulu? Keempat-empat penapis penentu: padanan topik, harga, cap masa dan kedudukan dalam senarai. Gagal pada mana-mana satu boleh menghapuskan peluang disitasi, tanpa mengira apa-apa lagi pada halaman itu.

Patutkah saya berhenti kerja schema sepenuhnya? Tidak. Kekalkan ia betul demi hasil diperkaya dan kejelasan entiti. Cuma jangan letak kerja schema baharu di atas pembaikan keempat-empat penapis kalau jumlah sitasi AI ialah matlamat sebenar.

Penulis: Bennett Hayes, Applied GEO Analyst di Auspia, lebih 400 semakan pelaksanaan. Bennett menulis tentang pelaksanaan GEO praktikal, audit dan nota pelaksanaan yang berasaskan apa yang benar-benar diukur oleh kajian terkawal.

Terokai topik ini

Teruskan aliran pertumbuhan yang sama