Kelime sırası AI Overview'ların hangi markayı önerdiğini belirliyor mu? 102 sorguyla test ettik

Öne çıkanlar

Arama ekipleri arasında dolaşan bir iddiaya göre bir karşılaştırma sorgusunda markayı başa yazmak, AI Overview'ların o markayı %80'e varan oranda önermesini sağlıyor. Bunu 16 marka çifti ve 102 sorguyla test ettik: sıra hiçbir şeyi değiştirmedi. Değiştiren başka bir şeydi.

Bu ay arama ekipleri arasında, sonuna çok kendinden emin bir sayı iliştirilmiş bir iddia dolaşıyor: Bir karşılaştırma sorgusunda A markasını başa yazın, Google'ın AI Overview'ı A markasını yaklaşık %80 oranında öneriyor. Sırayı ters çevirin, öneri de onunla birlikte tersine dönüyor. Çok daha büyük olmak, büyük markayı kurtarmıyor.

Bu tatmin edici bir hikâye, çünkü AI cevaplarını takip eden herkesin kendi gözüyle gördüğü bir şeyi açıklıyor: karşılaştırma cevapları sonuç listesine hiç benzemiyor ve Google'ın dışında kimse bunların nasıl bir araya getirildiğini inceleyemiyor. Biz de sıkıcı olanı yapıp test ettik. 11 Eylül 2026'da canlı Google AI Overview'larına karşı 102 karşılaştırma sorgusu çalıştırdık: 16 marka çifti, iki sıra, her biri iki-üç tekrar, ve her cevabı ve her atıf verilen kaynağı kaydettik.

Sonuç: sıra, 16 çiftin sıfırında öneriyi değiştirdi. Sorguda başa yazılan marka, çalıştırmaların %49'unda ilk anılan oldu; bu da yazı tura neye benziyorsa o. Cevabı güvenilir biçimde değiştiren şey, sorguyu nasıl ifade ettiğiniz ve hangi Google yüzeyinin cevapladığı oldu.

İddianın dolaşımdaki hâli

Bu ay dolaşan sürüm aşağı yukarı şöyle:

  • "A markası vs B markası", zamanın yaklaşık %80'inde A markasıyla açılan ve onu öneren AI Overview'lar getiriyor.
  • "B markası vs A markası" bunun ayna görüntüsünü getiriyor.
  • Bu, A markası B markasından çok daha büyük ve eski olduğunda bile geçerli.
  • Öne sürülen mekanizma: AI Overview'lar sorgunuzu alt aramalara dağıtıyor ve sorguda ilk anılan marka bu alt aramaları çıpalıyor.

Son madde, iddiayı inandırıcı kılan şey; aynı zamanda en iyi belgelenmiş kısmı.

Mekanizma gerçek, iddia bu yüzden dolaşıyor

Google'ın Mayıs 2026'da yayımladığı üretken AI özellikleri rehberi sorgu fan-out'unu doğruluyor: AI Overview'lar ve AI Mode tek bir sorguyu birkaç ilgili alt sorguya genişletebiliyor, bunları dizine karşı paralel çalıştırabiliyor ve birleşik sonuçlardan tek bir cevap sentezleyebiliyor. Alt sorguların ne olduğu hiçbir yerde raporlanmıyor, Search Console dahil. Yani bir AI Overview'a baktığınızda, izleyemediğiniz bir sürecin çıktısına bakıyorsunuz.

Dil modellerindeki sıra etkileri de gerçek ve arkalarında hakem değerlendirmesinden geçmiş çalışmalar var. Ağustos 2026'da PNAS Nexus'ta yayımlanan bir çalışma dokuz modeli özgeçmiş karşılaştırmaları ve renk seçimi üzerinde test etti ve basit eşitlik bozucu olmayan konum etkileri buldu: bazı durumlarda seçeneklerin sırasını değiştirmek modelin hangisini tercih ettiğini tersine çevirdi ve model sonra daha kötü olan seçeneği seçti. Columbia Business School'dan bir çalışma ters yönde ilişkili bir örüntü buldu: ChatGPT 5.447 promptta listenin ilk seçeneğini yaklaşık %63 oranında seçti; bu sonuç daha basit bir kurgunun 64.800 denemesinde %64,29 ile tekrar ortaya çıktı.

Bu iki bulguyu birlikte okuyunca viral iddia doğal bir sonraki adım gibi görünüyor: fan-out var, LLM'lerin sıra tuhaflıkları var, öyleyse sıra marka önerilerini belirlemeli.

Boşluk son adımda. O deneyler bir modelden bir seçenek listesini yargılayıp birini seçmesini istiyor. AI Overview'lardaki bir karşılaştırma sorgusu o görev değil. Cevabı üçüncü taraf sayfalara dayandıran bir erişim sisteminin yanıtladığı bir sentez talebi. İddiayı tekrarlamak yerine test etmeye değer kılan da tam olarak bu.

Ne çalıştırdık

Sorgular

Google AI Overview'a karşı 102, ayrıca AI Mode'a karşı 18

Marka çiftleri

16 (10 yazılım, 6 tüketici ürünü)

Sıralar

İkisi de, sıra başına 2–3 tekrar

İfade

Tüm çiftlerde "X vs Y"; ayrıca 3 çiftte "which is better, X or Y"

Yüzey

Google Search, ABD, İngilizce, masaüstü

Tarih

11 Eylül 2026 (tek gün)

Kayıt

SERP API yanıtları, istek başına bir sorgu, her AI Overview metin öğesi ve tam referans listesi saklandı

Maliyet

Yaklaşık 0,43 dolar API kredisi

İki tasarım kararı önemli. Birincisi, her sorguyu iki ya da üç kez çalıştırdık, çünkü içinde biraz rastgelelik olan bir sistem hakkında tek bir ters dönmüş cevap hiçbir şey kanıtlamaz. İkincisi, cevabın ne söylediğini değil nasıl kurulduğunu kaydettik: hangi marka ilk anılıyor, her biri ne sıklıkla geçiyor, atıf verilen sayfalar neye benziyor ve kaç atıf her markanın kendi alan adına işaret ediyor.

16 çift iki durumu kapsayacak şekilde seçildi: iki markanın da insanların araştırdığı varlıklar olduğu yazılım karşılaştırmaları (Notion vs Asana, Slack vs Microsoft Teams, Semrush vs Ahrefs, Figma vs Sketch) ve büyük markanın bariz olduğu tüketici karşılaştırmaları (Nike vs Adidas, Coca-Cola vs Pepsi, iPhone vs Samsung Galaxy, Netflix vs Disney+, Toyota vs Honda, iRobot Roomba vs Roborock).

Sonuç 1: cevap sırayı takip etmedi

Temiz ve ölçülebilir bir ilk anma üreten 100 çalıştırmada, sorguda başa yazılan marka 49 kez ilk anılan oldu: %49.

Çift

"A vs B"de ilk anılan

"B vs A"da ilk anılan

Sıra değiştirdi mi?

Notion vs Asana

Asana

Asana

Hayır

Slack vs Microsoft Teams

Microsoft Teams

Microsoft Teams

Hayır

Wix vs Squarespace

Wix

Wix

Hayır

Canva vs Adobe Express

Canva

Canva

Hayır

Mailchimp vs Klaviyo

Klaviyo

Klaviyo

Hayır

Airtable vs Monday.com

Monday.com

Monday.com

Hayır

Shopify vs WooCommerce

Shopify

Shopify

Hayır

Semrush vs Ahrefs

Semrush

Semrush

Hayır

Figma vs Sketch

Figma

Figma

Hayır

Zoom vs Google Meet

Google Meet

Google Meet

Hayır

Nike vs Adidas

Nike

Nike

Hayır

Coca-Cola vs Pepsi

Coca-Cola

Coca-Cola

Hayır

iPhone vs Samsung Galaxy

Samsung Galaxy

Samsung Galaxy

Hayır

Netflix vs Disney+

Netflix

Netflix

Hayır

Toyota vs Honda

Toyota

Toyota

Hayır

iRobot Roomba vs Roborock

Roborock

Roborock

Hayır

Tek bir çoğunluk bile ters dönmedi. Bir cevabın tercihi olduğunda, tercihini iki sırada da korudu: AI Overview'lar hem "Notion vs Asana"da hem "Asana vs Notion"da Asana ile açtı, iki Airtable karşılaştırmasında da Monday.com ile, iki Zoom karşılaştırmasında da Google Meet ile. Nike, Adidas karşısında iki sırada da önde gitti. Samsung Galaxy, iPhone karşısında iki sırada da önde gitti.

Tekrarlanan çalıştırmalar 100'de 93 kez birbiriyle uyuştu. Yedi istisnanın altısı, farklı bir ifadeyle çalıştırılan tek bir çiftten geldi; asıl hikâye de bu çıktı. Yedincisi, Teams yerine Slack ile açılan bir Slack vs Microsoft Teams çalıştırmasıydı; sonraki iki çalıştırma Teams'e döndü.

Bu ölçümün çözemediği bir şey var: bir cevabın başında gelmek, önerilmekle aynı şey değil. Bu yüzden öneri dilini de saydık. 60 yazılım çifti çalıştırmasının tamamında, kazanma türü kelimeler kullanan cümleler (wins, better choice, recommend, stronger, go-to) sorguda başa ve sona yazılan marka arasında 40'a 39 bölündü. Tam bir beraberlik.

10 yazılım çiftinde kelime sırasını ters çevirmenin AI Overview'ın ilk hangi markayı andığını değiştirmediğini gösteren infografik: 10 çiftin 0'ında ters döndü

Sonuç 2: iki cevap genellikle aynı cevaptı

Sıra alt aramaları çıpalıyor olsaydı, bir sorgunun iki sürümü farklı sayfalar getirmeliydi ve cevaplar ayrışmalıydı. Çoğunlukla ayrışmadılar.

10 yazılım çiftinin 8'inde, "A vs B" için AI Overview ile "B vs A" için olan kelimesi kelimesine aynıydı. Semrush vs Ahrefs'in ilk satırlarını iki sırada karşılaştırın:

Semrush hepsi bir arada bir pazarlama platformudur, Ahrefs ise SEO ve backlink analizinde uzmanlaşmış bir araçtır. (Alıntının özgün dili İngilizcedir.)

Aynı cümle, aynı olgu sırası, aynı "şu durumda Semrush'ı seçin… / şu durumda Ahrefs'i seçin…" kapanışı; sorgu hangi markayla başlarsa başlasın. Yalnızca iki çiftte gerçek metin kayması görüldü: Slack vs Microsoft Teams ve Shopify vs WooCommerce; Shopify örneğinde kayma farklı bir sonuca değil, farklı ifade edilmiş bir açılış paragrafına sınırlıydı.

Destekleyici kanıt da aynı yönü gösteriyor. Yazılım çifti çalıştırmalarındaki 806 referans girdisinin tamamında, iki markanın kendi alan adlarına yapılan atıflar 36'ya 36 çıktı. İki markayı da adlandıran referans sayfası başlıkları, sorguda başa yazılan markayı 392 kez, sona yazılanı 396 kez öne koydu: %49,7, bir yazı tura daha. Toplam marka anmaları 337'ye 336, yani %50,1'e %49,9 bölündü.

Erişimi sorguda ilk görünen marka tarafından yönlendirilen bir sistem, ne 36'ya 36'lık bir atıf dağılımı ne de bayt bayt aynı metni üretirdi.

Cevabı gerçekten ne hareket ettirdi

İki şey, ve ikisi de sıradan daha faydalı.

İfade. Üç çift için hem "vs" sorgusunu hem "which is better, X or Y" sorgusunu iki sırada çalıştırdık. AI Overview'lar bunlar farklı sorularmış gibi davrandı ve bunu iki sırada da birebir aynı şekilde yaptı.

Shopify ve WooCommerce için "Shopify vs WooCommerce" bir ürün tanımıyla açıldı: Shopify hepsi bir arada barındırılan bir mağaza kurucusudur, ve cevap farkları sıraladı. "Which is better, Shopify or WooCommerce" ise onları sıralamayı reddetmekle açıldı: hiçbiri nesnel olarak daha iyi değil, ihtiyaçlarınıza bağlı. Aynı dört çalıştırma, aynı çift, aynı gün, zıt ilk izlenimler; tamamen ifadeden kaynaklandı, konumdan değil.

Semrush ve Ahrefs için "which is better" cevapları açık hüküm cümleleri içeriyordu ve hepsi Ahrefs'e paye veriyordu: beş çalıştırmanın beşi de, sorgu ister "Semrush or Ahrefs" ister "Ahrefs or Semrush" okusun. Altta yatan karşılaştırma derleminin Ahrefs'i daha güçlü backlink aracı saydığı gerçeğinin yanında sıra önemsizdi.

Yüzey. Aynı sorguların 18'ini konuşma yüzeyi olan Google AI Mode üzerinden çalıştırdık. Davranışı AI Overview'lardan, sıra hassasiyeti gibi görünen ama olmayan bir biçimde ayrılıyor. Semrush vs Ahrefs için AI Mode, sorgu sırasına göre "Both Semrush and Ahrefs are…" ya da "Both Ahrefs and Semrush are…" ile açıldı; sırayı aynen yansıttı. Ve hangi varyantta karar kıldığına dikkat edin: "Both X and Y", hiçbir sıralama iması taşımayan bir kurgu. Cümleyi açan isim, promptun biçemsel bir yankısı.

O yankının altında AI Mode'un özü AI Overview'lardan çok daha az istikrarlıydı: aynı sıra içindeki çalıştırmalar arası metin benzerliği yalnızca 0,30–0,36, sıralar arasında 0,38 iken, AI Overview'lar çiftlerin çoğunda birebir aynı metni üretti. Üç çiftin ikisinde AI Mode'un cevapları sıralar arasında bayt bayt aynıydı ve Shopify örneğinde iki seferde de açılışta WooCommerce'e sabitlendi; AI Overview'lar ise iki seferde de Shopify'a sabitlendi. Her yüzeyin oturmuş yazım alışkanlıkları var ve bunlar aynı alışkanlıklar değil.

Aynı çift olmasına rağmen "Shopify vs WooCommerce" ve "which is better, Shopify or WooCommerce" için AI Overview açılışlarını karşılaştıran, zıt cevaplar ürettiğini gösteren infografik

Sıra hikâyesi tamamen kurgu değil

Bir ölçüm gerçekten kelime sırasıyla birlikte hareket etti ve bu, çoğu insanın aslında izlediği ölçüm: klasik sonuç listesi.

10 yazılım çiftinin 5'inde, ilk üç geleneksel organik sonuç "A vs B" ile "B vs A" arasında farklıydı; buna AI Overview'ın iki sırada da aynı olduğu çift de dahil. Reddit çoğu yazılım karşılaştırmasında zirveye yakın sıralandı ve hangi başlığın göründüğü ifadeyle birlikte değişti. Yani Google Search'te karşılaştırma sorguları için gerçek bir sıra hassasiyeti var. AI cevabının altındaki katmanda duruyor, önerinin kendisinde değil. Bu ayrım, bu testi yapmaya değer kılan asıl sebep ve yazmayı beklediğimiz bulgu değildi.

Bu, raporlama açısından önemli. Sıralama takipçiniz markalı ve markasız karşılaştırma sorguları arasında konumunuzun zıpladığını gösteriyorsa, gerçek bir etki görüyorsunuz. Sadece viral iddianın tarif ettiği etki değil ve bunun için optimize etmek AI Overview'ın sizin hakkınızda söylediğini değiştirmeyecek.

Verilerin gerçekten işaret ettiği kaldıraç

Çalıştırmalarımızdaki en net sinyal sorgunun kurgusuyla hiç ilgili değildi. Her cevabın üzerine inşa edildiği karşılaştırma derlemiyle ilgiliydi.

Airtable vs Monday.com'da atıf verilen kaynaklar arasında 18 Monday.com'a ait sayfa ve sıfır Airtable'a ait sayfa vardı; iki sırada da böyleydi. Mailchimp vs Klaviyo'da altı Mailchimp'e ait atıf, sıfır Klaviyo. Shopify vs WooCommerce üç WooCommerce'e ait atıf üretti, hiç Shopify'a ait atıf üretmedi. Öte yandan pek çok çiftte iki markanın da kendi alan adı hiç görünmedi: cevap üçüncü taraf karşılaştırmalarından, inceleme sitelerinden ve forum başlıklarından bir araya getirilmişti.

Bu örüntü, erişimin gerçekte nasıl çalıştığıyla tutarlı. Model ilk hangi ismi yazdığınızı umursamıyor; hangi sayfaların var olduğunu ve her markayı nasıl tarif ettiğini umursuyor. Bir marka kendi karşılaştırma içeriğine sahipse o sayfalar içeri çekiliyor. Sahip değilse, soran herkesin cevabından eksik kalıyorlar.

Kendi sıra ters çevirme testinizi nasıl yaparsınız

On beş dakika ve API erişimi gerekmiyor:

  1. Markanızın iki isimden biri olduğu ve gerçek bir rakibiniz bulunduğu beş karşılaştırma sorgusu seçin.
  2. Her birini iki sırada da çalıştırın ve her sırayı iki kez tekrarlayın. Çift başına dört cevap, toplamda on cevap çifti.
  3. Cevapları okumadan önce kaydedin. Ekran görüntüsü alın ya da tam metni ve atıf verilen kaynakları kopyalayın.
  4. İki şeyi ayrı ayrı karşılaştırın: hangi marka ilk anılıyor ve cevap her marka hakkında ne söylüyor. İlginç sinyali bulduğumuz yer, sıranın istikrarlı, özün ise istikrarsız olduğu yerdi.
  5. Sadece metne değil atıf listesine bakın. Rakibin kendi alan adı sürekli görünüp sizinki görünmüyorsa, gerçek darboğazı buldunuz.

AI Overview Citation Checker bir AI Overview'ın bir sorgu için hangi sayfaları atıf verdiğini gösterir; alan adınızın havuza girip girmediğini görmenin en hızlı yolu bu.

Bir sonuca varmadan önce bunu en az iki kez, farklı günlerde yapın. Bizim çalıştırmalar arası uyuşmamız %100 değil %93'tü ve tek bir ters dönmüş çalıştırma, kendinden emin bir blog yazısına dönüşen tam da o tür gürültü.

Bununla ne yapmalı

Karşılaştırma sayfalarınızı kelime sırası etrafında yeniden kurmayın. AI Overview'ların önerisini değiştirdiğine dair hiçbir kanıt yok ve Google bir gün buna ağırlık verse bile düzeltme tek kelimelik bir düzenleme olurdu; bu da gerçek konumunuz hakkında hiçbir şey söylemez.

İfadeyi gerçek bir değişken olarak ele alın. "X vs Y" ile "which is better, X or Y" farklı cevaplar üreten farklı sorgular. Alıcılarınız karşılaştırmaları soru olarak kuruyorsa, yalnızca özellik özellik bir tabloya değil, o soruyu cevaplayan içeriğe ihtiyacınız var.

Önemsediğiniz karşılaştırmalarda markanızın kendi sayfalarının atıflarda görünüp görünmediğini kontrol edin. Gördüğümüz 18'e 0'lık bölünme bu veri setindeki en uygulanabilir sayı ve yayınlamakla ilgili, prompt ifadesiyle değil.

Zaten bir ilk anma metriğiniz varsa tutun, ama onu cevabın ne söylediğinin tarifi olarak görün, çekebileceğiniz bir kaldıraç olarak değil. Verilerimizde sorguyu değil derlemi takip eden bir yazı turaydı.

Sınırlar

Bu, tek bir konumdan ve tek bir dilden, masaüstünde, tarayıcı oturumu yerine SERP API üzerinden toplanmış tek günlük veri; 16 marka çifti kapsıyor. Arama sonuçları kişiselleştirme, zaman ve cihaza göre değişir ve tek bir gün gelecekteki bir değişikliği dışlayamaz.

Hangi markanın ilk anıldığını, ne sıklıkla geçtiğini ve hangi kaynaklara atıf verildiğini ölçtük. Bunların hiçbiri cevabın bir okuyucu için ne kadar ikna edici olduğunun doğrudan ölçüsü değil; markanızı ilk anan bir cevap yine de diğerinin kazandığı izlenimini bırakabilir.

AI Mode örneklemi üç çiftte 18 sorguydu; yüzeyin farklı davrandığını görmeye yetti, ölçmeye yetmedi. O bölümü bir oran değil bir yön olarak okuyun.

Son olarak, özgün hikâyedeki mekanizma iddiaları dışarıdan doğrulanamaz durumda kalıyor. Google fan-out'un gerçekleştiğini doğruluyor ve alt sorguları açıklamıyor, yani kimse sizin sorgunuzun hangi alt sorguları ürettiğini gösteremiyor. Bizim testimiz sırayı ters çevirmenin çıktıyı değiştirmediğini gösterebiliyor. Nedenini gösteremiyor.

SSS

Google sorgusundaki kelime sırası AI Overview'ları etkiliyor mu? Testimizde hayır. 16 marka çiftini iki sırada kapsayan 102 AI Overview sorgusunda, sorguda başa yazılan marka zamanın %49'unda ilk anılan oldu ve sorguyu ters çevirdiğimizde hiçbir çiftin cevabı yön değiştirmedi. On yazılım çiftinin sekizi iki sırada da kelimesi kelimesine aynı cevabı getirdi.

İnsanlar neden sıranın AI önerilerini etkilediğini söylüyor? Çünkü listeden seçim yapması istenen dil modellerinde sıra etkileri belgelenmiş durumda; yayımlanmış araştırmada ilk seçenek yaklaşık %63 oranında kazanıyor. Ve çünkü Google'ın sorgu fan-out'u erişim sürecini görünmez kılıyor. İki olgu da gerçek. Hiçbiri, AI Overview'lardaki bir karşılaştırma sorgusunun isimleri yeniden sıraladığınızda marka değiştireceği anlamına gelmiyor.

Bir karşılaştırma sorgusu için AI Overview'ı gerçekten ne değiştiriyor? İfade ve yüzey. "Shopify vs WooCommerce" iki sırada da ürün odaklı bir cevap üretti; "which is better, Shopify or WooCommerce" ise iki sırada da "hiçbiri nesnel olarak daha iyi değil" cevabını. Aynı sorgular AI Mode'da yine farklı bir çerçeveyle ve çok daha fazla çalıştırmalar arası değişkenlikle döndü.

AI Overview'larda ilk anma için optimize etmeye değer mi? İzleyin, optimize etmeyin. Verilerimizde ilk anma, sorgudan kontrol ettiğimiz bir şeyi değil kaynak derlemini takip etti. Kontrol edilebilir değişken, kendi karşılaştırma sayfalarınızın atıf havuzunda olup olmadığı: test ettiğimiz bir çift, 18 rakip sahipli atıf ve diğer markadan sıfır atıf çekti.

İlgili okumalar

Yazar: Ethan Marlowe, Auspia'da 500'den fazla prompt kapsamında GEO Ölçüm Lideri. AI görünürlük ölçümü, prompt seti tasarımı ve ikinci bir bakışı atlatan testlerin nasıl yürütüleceği üzerine yazıyor.

Bu konuyu keşfedin

Aynı büyüme çizgisini takip edin