تنتشر هذا الشهر بين فرق البحث دعوى ملتصق بها رقم واثق جدًا: ضع العلامة (أ) في مقدمة استعلام مقارنة، فيوصي AI Overview من Google بالعلامة (أ) في نحو 80% من الحالات. اعكس الترتيب، فينعكس معه التوصية. وأن تكون أكبر بكثير لا ينقذ العلامة الأكبر.
إنها قصة مريحة، لأنها تفسّر شيئًا رآه بعينه كل من يتابع إجابات الذكاء الاصطناعي: إجابات المقارنة لا تشبه قائمة النتائج إطلاقًا، ولا أحد خارج Google يستطيع فحص كيفية تجميعها. ففعلنا الشيء الممل واختبرناها. في 11 سبتمبر 2026 شغّلنا 102 استعلام مقارنة على AI Overviews الحيّة من Google، تغطي 16 زوجًا من العلامات، وكل ترتيب، بتكرارين إلى ثلاثة لكل منهما، وحفظنا كل إجابة وكل مصدر مستشهد به.
النتيجة: الترتيب غيّر التوصية في صفر من 16 زوجًا. العلامة المكتوبة أولًا في الاستعلام ذُكرت أولًا في 49% من التشغيلات، وهو بالضبط ما تبدو عليه رمية عملة معدنية. أما ما غيّر الإجابة بثبات فهو طريقة صياغتك للاستعلام، وأي واجهة من Google تجيب عنه.
الدعوى كما انتشرت
الصيغة المتداولة هذا الشهر تقول ما يلي تقريبًا:
Brand A vs Brand Bيعيد AI Overviews يفتتح بالعلامة (أ) ويوصي بها في نحو 80% من الحالات.Brand B vs Brand Aيعيد الصورة المعكوسة.- وهذا يصدق حتى عندما تكون العلامة (أ) أكبر بكثير وأقدم من العلامة (ب).
- الآلية المقترحة: تفرّع AI Overviews استعلامك إلى عمليات بحث فرعية، والعلامة الأولى المذكورة في الاستعلام تُرسي هذه البحوث الفرعية.
هذه النقطة الأخيرة هي ما يجعل الدعوى معقولة، وهي أيضًا الجزء الأفضل توثيقًا.
الآلية حقيقية، ولهذا تنتقل الدعوى
يؤكد دليل Google لميزات الذكاء الاصطناعي التوليدي، المنشور في مايو 2026، وجود تفرّع الاستعلام: يستطيع AI Overviews وAI Mode توسيع استعلام واحد إلى عدة استعلامات فرعية ذات صلة، وتشغيلها على الفهرس بالتوازي، وتركيب إجابة واحدة من النتائج المجمّعة. أما ما كانت عليه تلك الاستعلامات الفرعية فلا يُبلَّغ عنه في أي مكان، بما في ذلك Search Console. لذا حين تنظر إلى AI Overview فأنت تنظر إلى مخرجات عملية لا تستطيع مراقبتها.
آثار الترتيب في النماذج اللغوية حقيقية أيضًا، وخلفها أعمال محكّمة. دراسة منشورة في PNAS Nexus في أغسطس 2026 اختبرت تسعة نماذج على مقارنات سير ذاتية واختيار ألوان، ووجدت آثار موضع ليست مجرد فضّ تعادل: في بعض الحالات عكس تغيير ترتيب الخيارات أيّها يفضّله النموذج، ثم اختار النموذج الخيار الأسوأ. ووجد عمل من Columbia Business School نمطًا مرتبطًا في الاتجاه المعاكس: اختار ChatGPT الخيار الأول في قائمة في نحو 63% من الحالات عبر 5,447 موجّهًا، وتكررت النتيجة بنسبة 64.29% في 64,800 محاولة بإعداد أبسط.
اقرأ النتيجتين معًا، وتبدو الدعوى الفيروسية الخطوة التالية الطبيعية: التفرّع موجود، وللنماذج اللغوية شواذّ في الترتيب، إذن لا بد أن الترتيب يحدد توصيات العلامات.
الفجوة في الخطوة الأخيرة. تلك التجارب تطلب من نموذج أن يحكم على قائمة خيارات ويختار واحدًا. واستعلام المقارنة في AI Overviews ليس تلك المهمة. إنه طلب تركيب تجيب عنه منظومة استرجاع تُرسي الإجابة على صفحات طرف ثالث. وهذا بالضبط ما جعل الدعوى تستحق الاختبار لا التكرار.
ما الذي شغّلناه
الاستعلامات | 102 على Google AI Overviews، إضافة إلى 18 على AI Mode |
أزواج العلامات | 16 (10 برمجية و6 استهلاكية) |
الترتيبان | كلاهما، بتكرارين إلى ثلاثة لكل ترتيب |
الصياغة |
|
الواجهة | Google Search، الولايات المتحدة، الإنجليزية، سطح المكتب |
التاريخ | 11 سبتمبر 2026 (يوم واحد) |
التسجيل | ردود SERP API، استعلام واحد لكل طلب، مع حفظ كل عنصر نصي في AI Overview وقائمة المراجع كاملة |
التكلفة | نحو 0.43 دولار من أرصدة API |
يهمّنا قراران في التصميم. الأول أننا شغّلنا كل استعلام مرتين أو ثلاثًا، لأن إجابة معكوسة واحدة لا تثبت شيئًا في نظام فيه أي قدر من العشوائية. والثاني أننا سجّلنا كيف بُنيت الإجابة لا ما قالته فقط: أي علامة تُذكر أولًا، وكم مرة تُذكر كل منهما، وكيف تبدو الصفحات المستشهد بها، وكم استشهادًا يشير إلى النطاق الخاص بكل علامة.
اختيرت الأزواج الـ16 لتغطية حالتين: مقارنات برمجية تكون فيها العلامتان كيانين يبحث عنهما الناس (Notion vs Asana، Slack vs Microsoft Teams، Semrush vs Ahrefs، Figma vs Sketch)، ومقارنات استهلاكية تكون فيها العلامة الأكبر بديهية (Nike vs Adidas، Coca-Cola vs Pepsi، iPhone vs Samsung Galaxy، Netflix vs Disney+، Toyota vs Honda، iRobot Roomba vs Roborock).
النتيجة 1: الإجابة لم تتبع الترتيب
من بين 100 تشغيلة أنتجت ذكرًا أولًا نظيفًا وقابلًا للقياس، ذُكرت العلامة المكتوبة أولًا في الاستعلام أولًا 49 مرة: 49%.
الزوج | الأول في | الأول في | هل غيّره الترتيب؟ |
|---|---|---|---|
Notion vs Asana | Asana | Asana | لا |
Slack vs Microsoft Teams | Microsoft Teams | Microsoft Teams | لا |
Wix vs Squarespace | Wix | Wix | لا |
Canva vs Adobe Express | Canva | Canva | لا |
Mailchimp vs Klaviyo | Klaviyo | Klaviyo | لا |
Airtable vs Monday.com | Monday.com | Monday.com | لا |
Shopify vs WooCommerce | Shopify | Shopify | لا |
Semrush vs Ahrefs | Semrush | Semrush | لا |
Figma vs Sketch | Figma | Figma | لا |
Zoom vs Google Meet | Google Meet | Google Meet | لا |
Nike vs Adidas | Nike | Nike | لا |
Coca-Cola vs Pepsi | Coca-Cola | Coca-Cola | لا |
iPhone vs Samsung Galaxy | Samsung Galaxy | Samsung Galaxy | لا |
Netflix vs Disney+ | Netflix | Netflix | لا |
Toyota vs Honda | Toyota | Toyota | لا |
iRobot Roomba vs Roborock | Roborock | Roborock | لا |
لم تنقلب أي أغلبية. وحين كان لإجابة ما تفضيل، حافظت عليه في الترتيبين: افتتح AI Overviews بـ Asana في Notion vs Asana وفي Asana vs Notion، وبـ Monday.com في مقارنتي Airtable، وبـ Google Meet في مقارنتي Zoom. وتقدّمت Nike في الترتيبين أمام Adidas. وتقدّمت Samsung Galaxy في الترتيبين أمام iPhone.
وتوافقت التشغيلات المكررة مع بعضها 93 مرة من 100. وجاءت ست من الاستثناءات السبع من زوج واحد بصياغة مختلفة، وهي كما تبيّن القصة الحقيقية. أما السابع فكان تشغيلة Slack vs Microsoft Teams افتُتحت بـ Slack بدل Teams، ثم عادت التشغيلتان التاليتان إلى Teams.
وثمة أمر لا يستطيع هذا القياس حسمه: أن تتصدّر الإجابة ليس كأن تُوصى بها. لذا أحصينا أيضًا لغة التوصية. في تشغيلات الأزواج البرمجية الستين كلها، انقسمت الجمل التي استخدمت كلمات الفوز (wins، better choice، recommend، stronger، go-to) بنسبة 40 إلى 39 بين العلامة المكتوبة أولًا في الاستعلام والعلامة الثانية. تعادل تام.

النتيجة 2: الإجابتان كانتا عادةً الإجابة نفسها
لو كان الترتيب يُرسي البحوث الفرعية، لكان ينبغي لنسختي الاستعلام أن تسترجعا صفحات مختلفة، ولكانت الإجابتان تتباعدان. ولم تتباعدا في الغالب.
في 8 من أزواج البرمجيات العشرة، كان AI Overview لـ A vs B والذي لـ B vs A متطابقين كلمة بكلمة. قارن السطرين الأولين في Semrush vs Ahrefs بالترتيبين:
Semrush منصة تسويق متكاملة، بينما Ahrefs أداة متخصصة في SEO وتحليل الروابط الخلفية. (نص الاقتباس الأصلي بالإنجليزية.)
الجملة نفسها، وترتيب الوقائع نفسه، والخاتمة نفسها «اختر Semrush إذا… / اختر Ahrefs إذا…»، أيًا كانت العلامة التي بدأ بها الاستعلام. ولم يُظهر زوجان فقط انزياحًا حقيقيًا في النص: Slack vs Microsoft Teams وShopify vs WooCommerce، وفي حالة Shopify اقتصر الانزياح على فقرة افتتاحية مصاغة بشكل مختلف لا على استنتاج مختلف.
والأدلة المساندة تشير في الاتجاه نفسه. من بين 806 مدخلات مرجعية في تشغيلات الأزواج البرمجية، جاءت الاستشهادات بالنطاقين الخاصين بالعلامتين 36 مقابل 36. وعناوين الصفحات المرجعية التي تذكر العلامتين وضعت العلامة المكتوبة أولًا في الاستعلام في المقدمة 392 مرة والعلامة الثانية 396 مرة: 49.7%، رمية عملة أخرى. وانقسم مجموع ذكر العلامات 337 مقابل 336، أي 50.1% مقابل 49.9%.
النظام الذي يكون استرجاعه موجَّهًا بالعلامة التي ظهرت أولًا في الاستعلام لا يُنتج انقسامًا في الاستشهادات بنسبة 36 إلى 36 ولا نصًا متطابقًا بايتًا ببايت.
ما الذي حرّك الإجابة فعلًا
أمران، وكلاهما أنفع من الترتيب.
الصياغة. في ثلاثة أزواج شغّلنا استعلام vs واستعلام which is better, X or Y بالترتيبين. وتصرّف AI Overviews كأن هذين سؤالين مختلفين، وفعل ذلك بالشكل نفسه في الترتيبين.
في Shopify وWooCommerce، افتُتح Shopify vs WooCommerce بوصف المنتج: Shopify منشئ متاجر مستضاف متكامل، وسارت الإجابة عبر الفروق. أما Which is better, Shopify or WooCommerce فافتُتح برفض ترتيبهما: لا أحدهما أفضل موضوعيًا، والأمر يعتمد على احتياجاتك. التشغيلات الأربع نفسها، والزوج نفسه، واليوم نفسه، وانطباعان أوليان متعاكسان، سببهما الصياغة بالكامل لا الموضع.
وفي Semrush وAhrefs، احتوت إجابات which is better على جمل حكم صريحة، وكلها نسبت الأفضلية إلى Ahrefs: خمس من خمس تشغيلات، سواء قرأ الاستعلام Semrush or Ahrefs أو Ahrefs or Semrush. كان الترتيب غير ذي أثر أمام حقيقة أن مدونة المقارنات الكامنة تعتبر Ahrefs الأداة الأقوى للروابط الخلفية.
الواجهة. شغّلنا 18 من الاستعلامات نفسها على Google AI Mode، الواجهة الحوارية. ويختلف سلوكه عن AI Overviews على نحو يبدو حساسية للترتيب وليس كذلك. في Semrush vs Ahrefs افتتح AI Mode بعبارة Both Semrush and Ahrefs are… أو Both Ahrefs and Semrush are… حسب ترتيب الاستعلام، عاكسًا إياه. ولاحظ أيّ صيغة استقر عليها: Both X and Y، تركيب لا يتضمن أي إشارة إلى ترتيب الأفضلية. فالاسم الذي يفتتح الجملة ليس إلا صدى أسلوبيًا للموجّه.
وتحت هذا الصدى كان جوهر إجابات AI Mode أقل استقرارًا بكثير من AI Overviews: تشابه النص بين التشغيلات داخل الترتيب نفسه لم يزد على 0.30–0.36، و0.38 بين الترتيبين، بينما أنتج AI Overviews نصًا متطابقًا في معظم الأزواج. وفي اثنين من الأزواج الثلاثة كانت إجابات AI Mode متطابقة بايتًا ببايت بين الترتيبين، وفي حالة Shopify استقر في الافتتاح على WooCommerce في المرتين، بينما استقر AI Overviews على Shopify في المرتين. ولكل واجهة عادات كتابة مستقرة، وهي ليست العادات نفسها.

حكاية الترتيب ليست محض خيال
ثمة قياس واحد تحرّك فعلًا مع ترتيب الكلمات، وهو الذي يراقبه معظم الناس في الواقع: قائمة النتائج التقليدية.
في 5 من الأزواج البرمجية العشرة اختلفت النتائج العضوية التقليدية الثلاث الأولى بين A vs B وB vs A، بما في ذلك الزوج الذي كان فيه AI Overview متطابقًا في الترتيبين. وجاء Reddit قريبًا من القمة في معظم المقارنات البرمجية، وتغيّر أيّ موضوع بعينه ظهر مع الصياغة. إذن هناك حساسية حقيقية للترتيب في Google Search عند الاستعلامات المقارنة. وهي تقع في الطبقة الواقعة تحت إجابة الذكاء الاصطناعي، لا في التوصية نفسها. هذا التمييز هو كل سبب استحقاق هذا الاختبار، وهو ليس النتيجة التي توقعنا كتابتها.
وهذا مهم للتقارير. إن أظهر متتبع ترتيبك أن موضعك يتأرجح بين استعلامات مقارنة تحمل علامتك وأخرى لا تحملها، فأنت ترى أثرًا حقيقيًا. لكنه ليس الأثر الذي تصفه الدعوى الفيروسية، والتحسين من أجله لن يغيّر ما يقوله AI Overview عنك.
الرافعة التي تشير إليها البيانات فعلًا
لم يكن أوضح إشارة في تشغيلاتنا متعلقًا ببناء الاستعلام إطلاقًا. كان متعلقًا بمدونة المقارنات التي بُنيت منها كل إجابة.
في Airtable vs Monday.com تضمّنت المصادر المستشهد بها 18 صفحة مملوكة لـ Monday.com وصفر صفحة مملوكة لـ Airtable، في الترتيبين. وفي Mailchimp vs Klaviyo ستة استشهادات مملوكة لـ Mailchimp وصفر لـ Klaviyo. وأنتج Shopify vs WooCommerce ثلاثة استشهادات مملوكة لـ WooCommerce ولا شيء مملوكًا لـ Shopify. وفي المقابل، في أزواج كثيرة لم يظهر النطاق الخاص بأي من العلامتين إطلاقًا: جُمعت الإجابة من مقارنات طرف ثالث ومواقع مراجعات وموضوعات منتديات.
هذا النمط متسق مع كيفية عمل الاسترجاع فعلًا. لا يهم النموذج أيّ اسم كتبته أولًا؛ ما يهمه أي صفحات موجودة وكيف تصف كل علامة. وحيث تملك العلامة محتواها المقارن، تُسحب تلك الصفحات إلى الداخل. وحيث لا تملكه، تغيب عن إجابات كل من يسأل.
كيف تجري اختبارك الخاص لعكس الترتيب
خمس عشرة دقيقة ومن دون وصول إلى API:
- اختر خمسة استعلامات مقارنة تكون علامتك أحد الاسمين فيها ولديك منافس حقيقي.
- شغّل كل استعلام بالترتيبين، وشغّل كل ترتيب مرتين. أربع إجابات لكل زوج، وعشر أزواج من الإجابات إجمالًا.
- احفظ الإجابات قبل قراءتها. التقط لقطة شاشة أو انسخ النص الكامل والمصادر المستشهد بها.
- قارن أمرين منفصلين: أي علامة ذُكرت أولًا، وماذا تقول الإجابة عن كل علامة. حيث وجدنا الإشارة المثيرة كان الترتيب مستقرًا والجوهر غير مستقر.
- انظر إلى قائمة الاستشهادات لا إلى النص فقط. إن تكرر ظهور النطاق الخاص بالمنافس ولم يظهر نطاقك، فقد وجدت عنق الزجاجة الحقيقي.
يعرض لك AI Overview Citation Checker الصفحات التي يستشهد بها AI Overview لاستعلام ما، وهي أسرع طريقة لمعرفة هل نطاقك في المجموعة أصلًا.
افعل ذلك مرتين على الأقل، في يومين مختلفين، قبل أن تستنتج أي شيء. كان توافق تشغيلاتنا 93% لا 100%، والتشغيلة المعكوسة الواحدة هي بالضبط نوع الضجيج الذي يتحول إلى تدوينة واثقة.
ما العمل بهذا
لا تُعِد بناء صفحات المقارنة لديك حول ترتيب الكلمات. لا دليل على أنه يغيّر ما يوصي به AI Overviews، وحتى لو أعطاه Google وزنًا يومًا ما، فسيكون الإصلاح تعديلًا لكلمة واحدة لا يقول شيئًا عن موضعك الحقيقي.
تعامل مع الصياغة كمتغير حقيقي. X vs Y وwhich is better, X or Y استعلامان مختلفان ينتجان إجابتين مختلفتين. وإن كان مشتروك يصوغون المقارنات كأسئلة، فأنت تحتاج محتوى يجيب عن السؤال، لا جدول مواصفات فقط.
تحقق مما إذا كانت صفحات علامتك تظهر في الاستشهادات للمقارنات التي تهمك. انقسام 18 إلى 0 الذي رأيناه هو الرقم الأكثر قابلية للتنفيذ في هذه المجموعة، وهو عن النشر لا عن صياغة الموجّهات.
أبقِ مقياس الذكر الأول إن كان لديك، وتعامل معه كوصف لما تقوله الإجابة، لا كرافعة يمكنك سحبها. في بياناتنا كان رمية عملة تتبع المدونة لا الاستعلام.
الحدود
هذه بيانات يوم واحد من موقع ولغة واحدة، على سطح المكتب، جُمعت عبر SERP API لا جلسة متصفح، على 16 زوجًا من العلامات. وتتغير نتائج البحث بحسب التخصيص والزمن والجهاز، ويوم واحد لا يستطيع نفي تغيّر مستقبلي.
قسنا أي علامة تُذكر أولًا، وكم مرة تُذكر، وأي مصادر تُستشهد بها. ولا شيء من ذلك قياس مباشر لمدى إقناع الإجابة لقارئ، وقد تترك إجابة تذكر علامتك أولًا انطباعًا بأن الأخرى هي الفائزة.
كانت عيّنة AI Mode ثمانية عشر استعلامًا في ثلاثة أزواج، وهذا يكفي لرؤية أن الواجهة تتصرف بشكل مختلف ولا يكفي لقياسها كميًا. اقرأ ذلك القسم كاتجاه لا كمعدل.
وأخيرًا، تبقى دعاوى الآلية في القصة الأصلية غير قابلة للتحقق من الخارج. تؤكد Google أن التفرّع يحدث ولا تكشف الاستعلامات الفرعية، فلا يستطيع أحد أن يُظهر أي استعلامات فرعية أنتجها استعلامك. اختبارنا يستطيع أن يُظهر أن عكس الترتيب لم يغيّر المخرجات. ولا يستطيع أن يُظهر السبب.
الأسئلة الشائعة
هل يؤثر ترتيب الكلمات في استعلام Google على AI Overviews؟ في اختبارنا، لا. من بين 102 استعلام AI Overview تغطي 16 زوجًا من العلامات في الترتيبين، ذُكرت العلامة المكتوبة أولًا أولًا في 49% من الحالات، ولم يغيّر أي زوج اتجاهه حين عكسنا الاستعلام. وأعادت ثمانية من عشرة أزواج برمجية إجابات متطابقة كلمة بكلمة في الترتيبين.
لماذا يقول الناس إن الترتيب يؤثر على توصيات الذكاء الاصطناعي؟ لأن آثار الترتيب موثقة في النماذج اللغوية التي يُطلب منها الاختيار من قائمة، حيث يفوز الخيار الأول في نحو 63% من الحالات في الأبحاث المنشورة، ولأن تفرّع الاستعلام في Google يجعل عملية الاسترجاع غير مرئية. الحقيقتان صحيحتان. ولا واحدة منهما تعني أن استعلام مقارنة في AI Overviews سيبدّل العلامة حين تعيد ترتيب الأسماء.
ما الذي يغيّر AI Overview فعلًا في استعلام المقارنة؟ الصياغة والواجهة. أنتج Shopify vs WooCommerce إجابة يقودها المنتج في الترتيبين، بينما أنتج which is better, Shopify or WooCommerce إجابة «لا أحدهما أفضل موضوعيًا» في الترتيبين. وعادت الاستعلامات نفسها على AI Mode بإطار مختلف مجددًا وبتباين أكبر بكثير بين التشغيلات.
هل يستحق الأمر التحسين من أجل الذكر الأول في AI Overviews؟ راقبه ولا تحسّن من أجله. في بياناتنا تبع الذكر الأول مدونة المصادر لا شيئًا كنا نتحكم به من جهة الاستعلام. والمتغير القابل للتحكم هو هل صفحات المقارنة الخاصة بك في مجموعة الاستشهادات أصلًا: زوج واحد اختبرناه جذب 18 استشهادًا مملوكًا للمنافس وصفرًا من العلامة الأخرى.
قراءات ذات صلة
- كيف تحسّن صفحات المقارنة للحصول على استشهادات في البحث بالذكاء الاصطناعي
- لماذا تجعل مقالتك «best X» الذكاء الاصطناعي يوصي بالمنافسين
- أنواع الاستعلامات التي تغيّرها AI Overviews فعلًا وكم تكلفك
الكاتب: Ethan Marlowe، قائد قياس GEO لدى Auspia عبر أكثر من 500 موجّه. يكتب عن قياس الظهور في الذكاء الاصطناعي، وتصميم مجموعات الموجّهات، وكيفية إجراء اختبارات تصمد أمام نظرة ثانية.




