Bulan ini ada satu dakwaan tersebar dalam kalangan pasukan carian, bersama satu angka yang sangat yakin: jika anda meletakkan jenama A di hadapan dalam pertanyaan perbandingan, AI Overviews Google akan menyorkan jenama A dalam kira-kira 80% kes. Songsangkan susunannya, syorkan itu turut terbalik. Tidak kira betapa jauh lebih besar jenama yang satu lagi.
Ia cerita yang menyenangkan, kerana ia menjelaskan perkara yang sesiapa yang memantau jawapan AI memang nampak sendiri: jawapan perbandingan tidak kelihatan seperti senarai hasil carian, dan tiada sesiapa di luar Google boleh mengesahkan bagaimana ia dibina. Jadi kami buat kerja yang membosankan: mengujinya. Pada 11 September 2026, kami menjalankan 102 pertanyaan perbandingan pada AI Overviews Google yang sebenar, merangkumi 16 pasangan jenama dalam kedua-dua susunan, mengulang setiap pasangan dua hingga tiga kali, dan merekodkan setiap jawapan serta setiap sumber yang dirujuk.
Hasilnya: sifar daripada 16 pasangan menukar syorkan kerana susunan perkataan. Jenama yang ditulis dahulu dalam pertanyaan muncul sebagai nama pertama dalam 49% larian, sama seperti melambung duit syiling. Yang mengubah jawapan secara konsisten ialah cara anda menulis pertanyaan dan permukaan Google mana yang menjawab.
Dakwaan itu, seperti yang tersebar
Versi yang beredar bulan ini berbunyi lebih kurang begini:
Brand A vs Brand Bmemulangkan AI Overview yang bermula dengan dan menyorkan jenama A dalam kira-kira 80% kes.Brand B vs Brand Amemberikan gambaran yang bertentangan.- Ia tetap benar walaupun jenama A jauh lebih besar dan lebih lama daripada jenama B.
- Mekanisme yang dicadangkan ialah AI Overviews memecahkan pertanyaan anda kepada pertanyaan kecil, dan jenama yang muncul dahulu dalam pertanyaan menjadi sauh bagi pertanyaan kecil itu.
Perkara terakhir itulah yang menjadikan dakwaan ini meyakinkan, dan itu juga bahagian yang mempunyai bukti paling kukuh.
Mekanismenya benar, dan itulah sebabnya dakwaan ini sampai jauh
Panduan Google tentang ciri AI generatif yang diterbitkan pada Mei 2026 mengesahkan pengembangan pertanyaan: AI Overviews dan AI Mode membuka satu pertanyaan kepada beberapa pertanyaan kecil yang berkaitan, menjalankannya serentak pada indeks, dan menggabungkannya menjadi satu jawapan daripada hasil yang dikumpulkan. Pertanyaan kecil itu apa, tidak dilaporkan di mana-mana, termasuk dalam Search Console. Jadi apabila anda melihat satu AI Overview, anda sedang melihat hasil satu proses yang tidak dapat anda perhatikan.
Kesan susunan dalam model bahasa juga benar, dan ada penyelidikan yang telah melalui semakan rakan setara di belakangnya. Satu kajian yang diterbitkan dalam PNAS Nexus pada Ogos 2026 menguji sembilan model dengan tugasan perbandingan resume dan pemilihan warna, dan mendapati kesan kedudukan bukan sekadar memecahkan seri: dalam beberapa kes, menyongsangkan susunan pilihan turut mengubah pilihan yang disukai model, lalu ia memilih pilihan yang lebih lemah. Kerja dari Columbia Business School menemui corak yang sepadan pada arah bertentangan: ChatGPT memilih pilihan pertama dalam senarai kira-kira 63% kes daripada 5,447 prompt, dan kesan itu berulang pada kadar 64.29% dalam 64,800 percubaan satu reka bentuk yang lebih mudah.
Baca kedua-dua hasil itu bersama-sama, dakwaan yang tersebar kelihatan seperti langkah seterusnya yang semula jadi: pengembangan pertanyaan memang berlaku, model bahasa memang ada tabiat pelik tentang susunan, jadi susunan itulah yang menentukan jenama yang AI sebut.
Jurangnya terletak pada langkah terakhir itu. Eksperimen tadi meminta model melihat senarai pilihan dan memilih satu. Pertanyaan perbandingan dalam AI Overviews bukan tugasan itu. Ia satu permintaan sintesis yang dijawab oleh sistem pemerolehan yang mengambil bahan daripada halaman pihak ketiga. Itulah sebabnya dakwaan ini perlu diuji, bukan sekadar diulang.
Apa yang kami jalankan
Pertanyaan | 102 pada Google AI Overviews, tambahan 18 pada AI Mode |
Pasangan jenama | 16 (10 perisian, 6 barangan pengguna) |
Susunan | Kedua-duanya, setiap susunan diulang 2–3 kali |
Gaya penulisan |
|
Permukaan | Google Search, Amerika Syarikat, bahasa Inggeris, komputer meja |
Tarikh | 11 September 2026 (dalam satu hari) |
Rekod | Jawapan melalui SERP API, satu permintaan bagi setiap pertanyaan; seluruh teks AI Overview dan semua item sumber disimpan |
Kos | Kira-kira $0.43 kredit API |
Dua keputusan reka bentuk penting. Pertama, kami menjalankan setiap pertanyaan dua hingga tiga kali, kerana satu larian yang terbalik dalam sistem yang ada sedikit kerawakan tidak membuktikan apa-apa. Kedua, kami merekod bagaimana jawapan itu dibina, bukan hanya apa yang dikatakannya: jenama mana disebut dahulu, berapa kali setiap jenama disebut, halaman mana yang dirujuk, dan berapa banyak rujukan menunjuk ke domain jenama itu sendiri.
16 pasangan jenama dipilih untuk merangkumi dua situasi: perbandingan perisian yang kedua-dua jenama ialah perkara yang orang cari (Notion vs Asana, Slack vs Microsoft Teams, Semrush vs Ahrefs, Figma vs Sketch), dan perbandingan barangan pengguna yang jenama lebih besarnya jelas lebih besar (Nike vs Adidas, Coca-Cola vs Pepsi, iPhone vs Samsung Galaxy, Netflix vs Disney+, Toyota vs Honda, iRobot Roomba vs Roborock).
Keputusan 1: jawapan tidak mengikut susunan
Daripada 100 larian yang nama pertamanya dapat dikenal pasti dengan jelas, jenama yang ditulis dahulu dalam pertanyaan muncul sebagai nama pertama 49 kali. 49 peratus.
Pasangan | Nama pertama dalam | Nama pertama dalam | Susunan mengubahnya? |
|---|---|---|---|
Notion vs Asana | Asana | Asana | Tidak |
Slack vs Microsoft Teams | Microsoft Teams | Microsoft Teams | Tidak |
Wix vs Squarespace | Wix | Wix | Tidak |
Canva vs Adobe Express | Canva | Canva | Tidak |
Mailchimp vs Klaviyo | Klaviyo | Klaviyo | Tidak |
Airtable vs Monday.com | Monday.com | Monday.com | Tidak |
Shopify vs WooCommerce | Shopify | Shopify | Tidak |
Semrush vs Ahrefs | Semrush | Semrush | Tidak |
Figma vs Sketch | Figma | Figma | Tidak |
Zoom vs Google Meet | Google Meet | Google Meet | Tidak |
Nike vs Adidas | Nike | Nike | Tidak |
Coca-Cola vs Pepsi | Coca-Cola | Coca-Cola | Tidak |
iPhone vs Samsung Galaxy | Samsung Galaxy | Samsung Galaxy | Tidak |
Netflix vs Disney+ | Netflix | Netflix | Tidak |
Toyota vs Honda | Toyota | Toyota | Tidak |
iRobot Roomba vs Roborock | Roborock | Roborock | Tidak |
Tidak ada satu pasangan pun yang majoritinya terbalik. Di mana jawapan ada kecenderungan, ia mengekalkan kecenderungan itu dalam kedua-dua susunan: AI Overviews bermula dengan Asana untuk Notion vs Asana dan Asana vs Notion, dengan Monday.com dalam kedua-dua perbandingan Airtable, dan dengan Google Meet dalam kedua-dua perbandingan Zoom. Nike mendahului Adidas dalam kedua-dua susunan. Samsung Galaxy mendahului iPhone dalam kedua-dua susunan.
Larian berulang bersetuju antara satu sama lain 93 kali daripada 100. Enam daripada tujuh pengecualian datang daripada satu pasangan yang ditulis dengan gaya berbeza, dan itulah yang menjadi cerita sebenar. Pengecualian ketujuh ialah satu larian Slack vs Microsoft Teams yang bermula dengan Slack dan bukan Teams; dua larian berikutnya kembali kepada Teams.
Ada satu perkara yang ukuran ini tidak dapat selesaikan: memulakan jawapan bukan sama dengan disyorkan. Jadi kami turut mengira bahasa yang bersifat syorkan. Dalam kesemua 60 larian pasangan perisian, ayat yang menggunakan perkataan jenis kemenangan (wins, better choice, recommend, stronger, go-to) terbahagi 40 lawan 39 antara jenama yang di hadapan dan jenama yang di belakang dalam pertanyaan. Seri tepat.

Keputusan 2: dua jawapan itu selalunya jawapan yang sama
Jika susunan menjadi sauh kepada pertanyaan kecil, dua versi pertanyaan yang sama sepatutnya memperoleh halaman yang berbeza, dan jawapannya sepatutnya berbeza. Kebanyakannya tidak.
Bagi 8 daripada 10 pasangan perisian, AI Overview untuk A vs B dan untuk B vs A sama perkataan demi perkataan. Bandingkan dua baris pertama Semrush vs Ahrefs dalam kedua-dua susunan:
Semrush ialah platform pemasaran serba lengkap, manakala Ahrefs ialah alat khusus untuk SEO dan analisis pautan balik. (petikan asal dalam bahasa Inggeris)
Ayat yang sama. Susunan fakta yang sama. Pembahagian penutup "pilih Semrush jika… / pilih Ahrefs jika…" yang sama. Tidak kira jenama mana pertanyaan itu bermula. Hanya dua pasangan menunjukkan teks yang benar-benar berbeza: Slack vs Microsoft Teams dan Shopify vs WooCommerce, dan bagi Shopify perbezaan itu terhad kepada perenggan pembuka yang ditulis secara berlainan, bukan kesimpulan yang berbeza.
Bukti sokongan menunjuk ke arah yang sama. Daripada 806 entri rujukan dalam larian pasangan perisian, rujukan ke domain kedua-dua jenama itu sendiri keluar 36 lawan 36. Tajuk halaman sumber yang menyebut kedua-dua jenama meletakkan jenama yang di hadapan 392 kali dan jenama yang di belakang 396 kali: 49.7%, lambungan duit syiling lagi. Jumlah sebutan jenama terbahagi 337 lawan 336, iaitu 50.1% lawan 49.9%.
Sistem yang pemerolehannya dipandu oleh jenama yang muncul dahulu dalam pertanyaan tidak akan menghasilkan pecahan rujukan 36 lawan 36 dan tidak akan menghasilkan teks yang sama bait demi bait.
Apa yang benar-benar menggerakkan jawapan
Ada dua perkara, dan kedua-duanya lebih berguna daripada susunan perkataan.
Gaya penulisan. Pada tiga pasangan, kami menjalankan pertanyaan gaya vs dan pertanyaan which is better, X or Y, dalam kedua-dua susunan. AI Overviews melayan dua cara bertanya ini sebagai dua soalan berbeza, dan melayan kedua-duanya dengan cara yang sama tepat dalam kedua-dua susunan.
Bagi Shopify dan WooCommerce, Shopify vs WooCommerce bermula dengan definisi produk: Shopify ialah pembina kedai hos yang serba lengkap, dan jawapannya terus menelusuri perbezaannya. Which is better, Shopify or WooCommerce bermula dengan enggan meletakkan kedudukan: tiada satu pun lebih baik secara mutlak, ia bergantung pada keperluan anda. Empat larian, pasangan yang sama, hari yang sama. Kesan pertama bertentangan, dan ia didorong semata-mata oleh gaya penulisan, bukan kedudukan.
Bagi Semrush dan Ahrefs, jawapan kepada which is better mempunyai penghakiman yang jelas, dan setiap ayat memihak kepada Ahrefs: lima daripada lima larian. Tidak ada bezanya sama ada pertanyaan ditulis Semrush or Ahrefs atau Ahrefs or Semrush. Susunan perkataan tidak bermakna apabila data perbandingan di bawahnya sendiri menganggap Ahrefs sebagai alat pautan balik yang lebih kukuh.
Permukaan. Kami menjalankan 18 pertanyaan yang sama pada Google AI Mode, iaitu permukaan yang bersifat perbualan. Ia berkelakuan berbeza daripada AI Overviews dengan cara yang kelihatan sensitif kepada susunan perkataan tetapi sebenarnya tidak. Bagi Semrush vs Ahrefs, AI Mode bermula dengan Both Semrush and Ahrefs are… atau Both Ahrefs and Semrush are… mengikut susunan pertanyaan. Ia memantulkan pertanyaan itu kembali, dan perhatikan corak yang menjadi tempat ia mendarat: Both X and Y, struktur yang tidak mengandungi sebarang kedudukan langsung. Nama yang memulakan ayat itu hanyalah gema retorik prompt.
Di bawah gema itu, kandungan AI Mode jauh kurang stabil daripada AI Overviews: persamaan teks antara larian dalam susunan yang sama hanya 0.30–0.36, dan 0.38 antara dua susunan, sedangkan AI Overviews memberikan teks yang sama perkataan demi perkataan pada kebanyakan pasangan. Pada dua daripada tiga pasangan, jawapan AI Mode sama bait demi bait antara dua susunan, dan bagi Shopify ia meletakkan WooCommerce di hadapan dalam ayat pembuka kedua-dua kali, sedangkan AI Overviews meletakkan Shopify di hadapan kedua-dua kali. Setiap permukaan sudah ada tabiat penulisan yang tetap, dan tabiat itu tidak sama.

Kisah susunan perkataan bukan cerita yang direka sepenuhnya
Ada satu ukuran yang benar-benar bergerak mengikut susunan perkataan, dan itulah yang paling ramai orang sedang pantau: senarai hasil carian tradisional.
Pada 5 daripada 10 pasangan perisian, tiga hasil organik tradisional teratas berbeza antara A vs B dan B vs A, termasuk pada pasangan yang AI Overviewnya sama dalam kedua-dua susunan. Reddit berada di sekitar kedudukan teratas dalam kebanyakan perbandingan perisian, dan benang yang muncul berubah mengikut gaya penulisan. Jadi dalam Google Search memang ada kepekaan susunan perkataan yang sebenar bagi pertanyaan perbandingan. Ia berada pada lapisan di bawah jawapan AI, bukan dalam syorkan itu sendiri. Perbezaan itulah yang menjadikan ujian ini berbaloi dilakukan, dan ia satu penemuan yang kami tidak sangka perlu kami tulis.
Ini penting untuk pelaporan. Jika alat pemantau kedudukan anda menunjukkan kedudukan berbeza antara pertanyaan perbandingan yang ada nama jenama dan yang tidak, anda sedang melihat kesan yang sebenar. Cuma ia bukan kesan yang dakwaan itu bicarakan, dan mengoptimumkan untuknya tidak akan mengubah apa yang AI Overview katakan tentang anda.
Tuas yang sebenarnya ditunjuk oleh data
Isyarat paling jelas dalam larian kami langsung tidak berkaitan dengan cara pertanyaan itu disusun. Ia berkaitan dengan kumpulan bahan perbandingan yang menjadi asas setiap jawapan.
Pada Airtable vs Monday.com, sumber yang dirujuk termasuk 18 halaman milik Monday.com dan sifar milik Airtable, dalam kedua-dua susunan. Pada Mailchimp vs Klaviyo ada enam rujukan milik Mailchimp dan sifar milik Klaviyo. Shopify vs WooCommerce memberikan tiga rujukan milik WooCommerce dan tiada satu pun milik Shopify. Pada masa yang sama, banyak pasangan tidak memunculkan domain mana-mana jenama itu langsung: jawapan itu dibina daripada artikel perbandingan pihak ketiga, laman ulasan dan benang forum.
Corak ini sepadan dengan cara pemerolehan sebenarnya berfungsi. Model tidak peduli nama mana yang anda taip dahulu. Ia peduli halaman mana yang wujud dan apa yang halaman itu katakan tentang setiap jenama. Di mana jenama memiliki kandungan perbandingannya sendiri, halaman itu ditarik masuk. Di mana ia tidak, halaman itu tidak ada dalam jawapan kepada sesiapa yang bertanya.
Cara menjalankan ujian sonsang susunan sendiri
Lima belas minit, dan tidak perlu akses API:
- Pilih lima pertanyaan perbandingan yang jenama anda ialah salah satu daripada dua nama itu dan pesaingnya pesaing sebenar.
- Jalankan setiap pertanyaan dalam kedua-dua susunan, dan jalankan setiap susunan dua kali. Empat jawapan bagi setiap pasangan, sepuluh set kesemuanya.
- Simpan jawapan sebelum anda membacanya. Ambil tangkapan skrin atau salin seluruh teks dan senarai sumber.
- Bandingkan dua perkara secara berasingan: jenama mana yang disebut dahulu, dan apa yang jawapan katakan tentang setiap jenama. Di situlah kami menemui isyarat menarik — susunannya stabil, kandungannya tidak.
- Lihat senarai rujukan, bukan hanya teks. Jika domain pesaing muncul berulang kali dan domain anda tidak, anda sudah menemui kesesakan yang sebenar.
AI Overview Citation Checker menunjukkan halaman mana yang dirujuk oleh AI Overview bagi satu pertanyaan, dan itu cara terpantas untuk melihat sama ada domain anda berada dalam longgokan rujukan itu.
Lakukannya sekurang-kurangnya dua kali, pada hari yang berbeza, sebelum membuat sebarang kesimpulan. Larian berulang kami sendiri bersetuju 93% dan bukan 100%, dan satu larian terbalik yang tunggal ialah jenis bunyi bising yang mudah menjadi catatan blog yang terlalu yakin.
Apa yang perlu dibuat dengan semua ini
Jangan rombak semula halaman perbandingan anda berdasarkan susunan perkataan. Tiada bukti ia mengubah apa yang AI Overviews syorkan, dan kalaupun suatu hari Google benar-benar memberi pemberat kepadanya, pembetulannya ialah menukar satu perkataan, yang tidak memberitahu apa-apa tentang kedudukan sebenar anda.
Anggap gaya penulisan sebagai pemboleh ubah yang sebenar. X vs Y dan which is better, X or Y ialah dua pertanyaan berbeza yang memberikan dua bentuk jawapan berbeza. Jika pembeli anda menulis perbandingan sebagai soalan, anda perlu kandungan yang menjawab soalan itu, bukan sekadar jadual spesifikasi.
Periksa sama ada halaman jenama anda sendiri muncul dalam rujukan bagi perbandingan yang anda ambil berat. Pecahan 18 lawan 0 yang kami lihat ialah angka paling boleh dilaksanakan dalam keseluruhan set data ini, dan ia berkaitan penerbitan kandungan, bukan penulisan prompt.
Jika anda sudah ada ukuran nama pertama, simpanlah, tetapi bacalah ia sebagai penerangan tentang apa yang jawapan katakan, bukan sebagai tuas yang boleh anda tarik. Dalam data kami, ia lambungan duit syiling yang mengikut kumpulan bahan, bukan pertanyaan.
Batasan
Ini data satu hari daripada satu lokasi dan satu bahasa, pada komputer meja, dikumpulkan melalui SERP API dan bukan sesi pelayar, merangkumi 16 pasangan jenama. Hasil carian berubah mengikut pemperibadian, masa dan peranti, dan satu hari tidak menolak kemungkinan ia berubah pada masa hadapan.
Kami mengukur jenama mana yang disebut dahulu, berapa kerap ia disebut, dan sumber mana yang dirujuk. Tiada satu pun daripada itu mengukur secara langsung sejauh mana jawapan itu mempengaruhi pembaca, dan jawapan yang menyebut nama anda dahulu masih boleh meninggalkan tanggapan bahawa pihak satu lagi menang.
Sampel AI Mode ialah 18 pertanyaan dalam tiga pasangan. Cukup untuk melihat permukaannya berkelakuan berbeza, tidak cukup untuk mengukurnya secara angka. Bacalah bahagian itu sebagai arah, bukan kadar.
Akhir sekali, mekanisme dalam cerita asal tidak boleh disahkan dari luar. Google mengesahkan pengembangan pertanyaan berlaku dan tidak mendedahkan pertanyaan kecil itu, jadi tiada sesiapa boleh menunjukkan pertanyaan anda menghasilkan pertanyaan kecil yang mana. Ujian kami menunjukkan menyongsangkan susunan tidak mengubah hasilnya. Ia tidak menunjukkan sebabnya.
Soalan lazim
Adakah susunan perkataan dalam pertanyaan Google memberi kesan pada AI Overviews Dalam ujian kami, tidak. Merentas 102 pertanyaan AI Overview yang merangkumi 16 pasangan jenama dalam kedua-dua susunan, jenama yang ditulis dahulu muncul sebagai nama pertama dalam 49% kes, dan tiada pasangan yang terbalik arah apabila kami menyongsangkan pertanyaan. Lapan daripada sepuluh pasangan perisian memberikan jawapan yang sama perkataan demi perkataan dalam kedua-dua susunan.
Jadi kenapa orang kata susunan mempengaruhi syorkan AI Kerana kesan susunan memang direkodkan dalam model bahasa apabila ia diminta memilih daripada senarai, dengan pilihan pertama menang kira-kira 63% kes dalam penyelidikan yang diterbitkan, dan kerana pengembangan pertanyaan Google menjadikan proses pemerolehan tidak dapat diperhatikan. Kedua-dua fakta itu benar. Tiada satu pun daripadanya bermakna pertanyaan perbandingan dalam AI Overviews akan bertukar jenama apabila anda menyusun semula namanya.
Apa yang benar-benar mengubah AI Overview bagi pertanyaan perbandingan Gaya penulisan dan permukaan. Shopify vs WooCommerce memberikan jawapan yang bermula dengan produk dalam kedua-dua susunan, manakala which is better, Shopify or WooCommerce memberikan jawapan "tiada satu pun lebih baik secara mutlak" dalam kedua-dua susunan. Pertanyaan yang sama pada AI Mode pula kembali dengan corak yang berbeza lagi dan jauh lebih berubah-ubah antara larian.
Patutkah kita mengoptimumkan untuk kedudukan nama pertama dalam AI Overviews Pantau ia, tetapi jangan optimumkan untuknya. Dalam data kami, kedudukan nama pertama mengikut kumpulan bahan sumber, bukan mengikut perkara yang kami kawal dari pihak pertanyaan. Pemboleh ubah yang boleh anda kawal ialah sama ada halaman perbandingan anda berada dalam longgokan rujukan: satu pasangan yang kami uji menarik 18 rujukan milik pesaing dan sifar daripada jenama yang satu lagi.
Bacaan berkaitan
- Cara mengoptimumkan halaman perbandingan untuk mendapat rujukan carian AI
- Kenapa artikel "best X" anda membuat AI menyorkan pesaing
- Jenis pertanyaan mana yang benar-benar diubah AI Overviews, dan berapa kosnya
Penulis: Ethan Marlowe, Ketua Pengukuran GEO di Auspia, merangkumi lebih 500 prompt. Menulis tentang pengukuran keterlihatan dalam AI, reka bentuk set prompt, dan cara membina ujian yang bertahan pada semakan kedua.




