Trong giới làm search tháng này có một khẳng định đang lan truyền, kèm theo một con số rất tự tin: nếu bạn đặt thương hiệu A lên trước trong một truy vấn so sánh, AI Overviews của Google sẽ gợi ý thương hiệu A trong khoảng 80% số lần. Đảo thứ tự thì gợi ý cũng đảo theo. Việc thương hiệu kia lớn hơn bao nhiêu không tạo ra khác biệt nào.
Đó là một câu chuyện dễ chịu, vì nó giải thích đúng thứ mà bất kỳ ai theo dõi câu trả lời của AI đều thấy tận mắt: các câu trả lời so sánh không giống danh sách kết quả tìm kiếm, và không ai ngoài Google kiểm chứng được chúng được dựng nên thế nào. Nên chúng tôi làm việc nhàm chán: kiểm tra. Ngày 11 tháng 9 năm 2026, chúng tôi chạy 102 truy vấn so sánh trên AI Overviews của Google đang hoạt động thật, phủ 16 cặp thương hiệu ở cả hai thứ tự, lặp lại mỗi cặp hai đến ba lần, và ghi lại từng câu trả lời cùng từng nguồn được trích dẫn.
Kết quả: không cặp nào trong 16 cặp đổi gợi ý vì thứ tự từ. Thương hiệu được viết trước trong truy vấn xuất hiện ở vị trí tên đầu tiên trong 49% số lần chạy, đúng như tung đồng xu. Thứ thay đổi câu trả lời một cách nhất quán là cách bạn viết truy vấn và bề mặt Google nào đang trả lời.
Khẳng định, đúng như nó đang lan truyền
Bản đang lưu hành tháng này nói đại khái thế này:
Brand A vs Brand Btrả về một AI Overview mở đầu bằng và gợi ý thương hiệu A trong khoảng 80% số lần.Brand B vs Brand Acho kết quả ngược lại.- Điều đó vẫn đúng kể cả khi thương hiệu A lớn hơn và lâu đời hơn thương hiệu B rất nhiều.
- Cơ chế được đưa ra là AI Overviews tách truy vấn của bạn thành các truy vấn con, và thương hiệu đứng trước trong truy vấn trở thành điểm neo cho các truy vấn con đó.
Điểm cuối là phần khiến khẳng định này đáng tin, và cũng là phần có bằng chứng vững nhất.
Cơ chế là có thật, và đó là lý do khẳng định đi xa được
Hướng dẫn về các tính năng AI tạo sinh mà Google công bố tháng 5 năm 2026 xác nhận việc mở rộng truy vấn: AI Overviews và AI Mode mở một truy vấn thành nhiều truy vấn con liên quan, chạy chúng song song trên chỉ mục, rồi tổng hợp thành một câu trả lời duy nhất từ các kết quả gộp lại. Những truy vấn con đó là gì thì không được báo cáo ở đâu cả, kể cả trong Search Console. Nên khi bạn nhìn một AI Overview, bạn đang nhìn kết quả của một quá trình bạn không quan sát được.
Hiệu ứng thứ tự trong các mô hình ngôn ngữ cũng là thật, và có nghiên cứu đã qua bình duyệt đứng sau. Một nghiên cứu công bố trên PNAS Nexus tháng 8 năm 2026 đã thử chín mô hình với các bài so sánh hồ sơ xin việc và chọn màu, và phát hiện hiệu ứng vị trí không chỉ giới hạn ở việc phá thế hòa: trong một số trường hợp, đảo thứ tự các lựa chọn đã đổi luôn phương án mô hình ưa thích, và rồi nó chọn phương án kém hơn. Công trình của Columbia Business School tìm ra một dạng thức tương tự ở chiều ngược lại: ChatGPT chọn phương án đầu tiên trong danh sách khoảng 63% số lần trên 5.447 prompt, và hiệu ứng này lặp lại ở mức 64,29% trong 64.800 lượt thử của một thiết kế đơn giản hơn.
Đọc hai kết quả đó cùng nhau, khẳng định đang lan truyền trông như bước tiếp theo hiển nhiên: việc mở rộng truy vấn là thật, mô hình ngôn ngữ có những thói quen kỳ lạ với thứ tự, vậy thứ tự hẳn phải quyết định thương hiệu mà AI nêu tên.
Khoảng trống nằm ở bước cuối. Những thí nghiệm kia yêu cầu mô hình xem một danh sách lựa chọn và chọn một. Một truy vấn so sánh trong AI Overviews không phải bài tập đó. Nó là một yêu cầu tổng hợp do hệ thống truy xuất trả lời, hệ thống này lấy nội dung từ trang của bên thứ ba. Đó chính là lý do khẳng định này cần được kiểm tra chứ không phải chỉ được nhắc lại.
Chúng tôi đã chạy gì
Truy vấn | 102 trên Google AI Overviews, cộng thêm 18 trên AI Mode |
Cặp thương hiệu | 16 (10 phần mềm, 6 hàng tiêu dùng) |
Thứ tự | Cả hai, mỗi thứ tự lặp 2–3 lần |
Cách viết |
|
Bề mặt | Google Search, Hoa Kỳ, tiếng Anh, máy tính để bàn |
Ngày | 11 tháng 9 năm 2026 (trong một ngày) |
Cách ghi | Câu trả lời qua SERP API, một yêu cầu cho mỗi truy vấn; lưu toàn bộ văn bản của AI Overview và mọi mục nguồn |
Chi phí | Khoảng 0,43 đô la tín dụng API |
Hai quyết định thiết kế quan trọng. Thứ nhất, chúng tôi chạy mỗi truy vấn hai đến ba lần, vì một lần đảo kết quả trong một hệ thống có phần ngẫu nhiên không chứng minh được gì. Thứ hai, chúng tôi ghi lại câu trả lời được dựng thế nào chứ không chỉ nó nói gì: thương hiệu nào được nhắc trước, mỗi thương hiệu được nhắc bao nhiêu lần, những trang nào được trích dẫn, và bao nhiêu trích dẫn trỏ về tên miền của từng thương hiệu.
16 cặp thương hiệu được chọn để phủ hai tình huống: các so sánh phần mềm mà cả hai thương hiệu đều là thứ người ta tra cứu (Notion vs Asana, Slack vs Microsoft Teams, Semrush vs Ahrefs, Figma vs Sketch), và các so sánh hàng tiêu dùng nơi thương hiệu lớn rõ ràng là lớn hơn (Nike vs Adidas, Coca-Cola vs Pepsi, iPhone vs Samsung Galaxy, Netflix vs Disney+, Toyota vs Honda, iRobot Roomba vs Roborock).
Kết quả 1: câu trả lời không đi theo thứ tự
Trong 100 lần chạy xác định được rõ tên đầu tiên, thương hiệu được viết trước trong truy vấn xuất hiện ở vị trí tên đầu tiên 49 lần. 49 phần trăm.
Cặp | Tên đầu trong | Tên đầu trong | Thứ tự có đổi không |
|---|---|---|---|
Notion vs Asana | Asana | Asana | Không |
Slack vs Microsoft Teams | Microsoft Teams | Microsoft Teams | Không |
Wix vs Squarespace | Wix | Wix | Không |
Canva vs Adobe Express | Canva | Canva | Không |
Mailchimp vs Klaviyo | Klaviyo | Klaviyo | Không |
Airtable vs Monday.com | Monday.com | Monday.com | Không |
Shopify vs WooCommerce | Shopify | Shopify | Không |
Semrush vs Ahrefs | Semrush | Semrush | Không |
Figma vs Sketch | Figma | Figma | Không |
Zoom vs Google Meet | Google Meet | Google Meet | Không |
Nike vs Adidas | Nike | Nike | Không |
Coca-Cola vs Pepsi | Coca-Cola | Coca-Cola | Không |
iPhone vs Samsung Galaxy | Samsung Galaxy | Samsung Galaxy | Không |
Netflix vs Disney+ | Netflix | Netflix | Không |
Toyota vs Honda | Toyota | Toyota | Không |
iRobot Roomba vs Roborock | Roborock | Roborock | Không |
Không một cặp nào đảo chiều theo đa số. Ở đâu câu trả lời có xu hướng, nó giữ nguyên xu hướng đó ở cả hai thứ tự: AI Overviews mở đầu bằng Asana cho cả Notion vs Asana lẫn Asana vs Notion, bằng Monday.com trong cả hai phép so sánh Airtable, và bằng Google Meet trong cả hai phép so sánh Zoom. Nike dẫn trước Adidas ở cả hai thứ tự. Samsung Galaxy dẫn trước iPhone ở cả hai thứ tự.
Các lần chạy lặp lại khớp với nhau 93 trên 100 lần. Sáu trong bảy ngoại lệ đến từ một cặp duy nhất được viết theo cách khác, và nó hoá ra lại chính là câu chuyện thật. Ngoại lệ thứ bảy là một lần chạy Slack vs Microsoft Teams mở đầu bằng Slack thay vì Teams; hai lần chạy sau đó quay lại Teams.
Có một điều phép đo này không giải quyết được: mở đầu câu trả lời không giống với được gợi ý. Nên chúng tôi cũng đếm cả ngôn ngữ mang tính đề xuất. Trong toàn bộ 60 lần chạy cặp phần mềm, những câu dùng từ ngữ kiểu thắng thua (wins, better choice, recommend, stronger, go-to) chia 40 trên 39 giữa thương hiệu đứng trước và thương hiệu đứng sau trong truy vấn. Hòa tuyệt đối.

Kết quả 2: hai câu trả lời thường là cùng một câu trả lời
Nếu thứ tự neo các truy vấn con, hai phiên bản của cùng một truy vấn phải truy xuất những trang khác nhau, và các câu trả lời phải tách khỏi nhau. Phần lớn thì chúng không tách.
Với 8 trong 10 cặp phần mềm, AI Overview cho A vs B và cho B vs A giống nhau từng chữ. Hãy so hai dòng đầu của Semrush vs Ahrefs ở cả hai thứ tự:
Semrush là một nền tảng marketing tất-cả-trong-một, còn Ahrefs là công cụ chuyên biệt về SEO và phân tích backlink. (trích dẫn gốc bằng tiếng Anh)
Cùng một câu. Cùng thứ tự dữ kiện. Cùng cách kết "chọn Semrush nếu… / chọn Ahrefs nếu…". Bất kể truy vấn bắt đầu bằng thương hiệu nào. Chỉ hai cặp cho thấy văn bản lệch thật: Slack vs Microsoft Teams và Shopify vs WooCommerce, và ở trường hợp Shopify, phần lệch chỉ nằm ở đoạn mở được viết khác đi chứ không phải một kết luận khác.
Bằng chứng hỗ trợ cũng chỉ về cùng một hướng. Trong 806 mục trích dẫn ở các lần chạy cặp phần mềm, trích dẫn tới tên miền của chính hai thương hiệu chia 36 trên 36. Những tiêu đề trang nguồn có nêu cả hai thương hiệu đặt thương hiệu đứng trước trong truy vấn lên trước 392 lần và thương hiệu đứng sau lên trước 396 lần: 49,7%, lại một lần tung đồng xu. Tổng số lần nhắc thương hiệu chia 337 trên 336, tức 50,1% trên 49,9%.
Một hệ thống mà việc truy xuất bị lái bởi thương hiệu xuất hiện trước trong truy vấn sẽ không cho ra tỉ lệ trích dẫn 36 trên 36 và cũng không cho ra văn bản giống nhau từng byte.
Thứ thực sự làm câu trả lời dịch chuyển
Có hai thứ, và cả hai đều hữu ích hơn thứ tự từ.
Cách viết. Ở ba cặp, chúng tôi chạy cả truy vấn dạng vs và truy vấn which is better, X or Y, ở cả hai thứ tự. AI Overviews đối xử với hai cách hỏi này như hai câu hỏi khác nhau, và đối xử y hệt nhau ở cả hai thứ tự.
Với Shopify và WooCommerce, Shopify vs WooCommerce mở đầu bằng định nghĩa sản phẩm: Shopify là công cụ dựng cửa hàng trọn gói có hosting, rồi câu trả lời chạy qua các khác biệt. Which is better, Shopify or WooCommerce mở đầu bằng việc từ chối xếp hạng: không có cái nào tốt hơn một cách tuyệt đối, còn tùy nhu cầu của bạn. Bốn lần chạy, cùng một cặp, cùng một ngày. Ấn tượng đầu trái ngược nhau, và nó do cách viết quyết định, không do vị trí.
Với Semrush và Ahrefs, câu trả lời cho which is better có một phán quyết rõ ràng, và mọi câu đều nghiêng về Ahrefs: năm trên năm lần chạy. Truy vấn viết là Semrush or Ahrefs hay Ahrefs or Semrush không tạo khác biệt nào, khi mà chính kho dữ liệu so sánh bên dưới đã coi Ahrefs là công cụ backlink mạnh hơn.
Bề mặt. Chúng tôi chạy 18 truy vấn đó trên Google AI Mode, bề mặt mang tính hội thoại. Nó hành xử khác AI Overviews theo một cách trông như nhạy với thứ tự từ nhưng không phải. Với Semrush vs Ahrefs, AI Mode mở đầu bằng Both Semrush and Ahrefs are… hoặc Both Ahrefs and Semrush are… tùy theo thứ tự truy vấn. Nó đang phản chiếu truy vấn trở lại, và hãy để ý nó hạ cánh ở khuôn nào: Both X and Y, một cấu trúc không hề chứa xếp hạng nào. Cái tên đứng đầu câu chỉ là tiếng vọng tu từ của prompt.
Bên dưới tiếng vọng đó, nội dung của AI Mode kém ổn định hơn AI Overviews hẳn: độ tương đồng văn bản giữa các lần chạy cùng thứ tự chỉ 0,30–0,36, và 0,38 giữa hai thứ tự, trong khi AI Overviews cho văn bản giống nhau từng chữ ở phần lớn các cặp. Ở hai trong ba cặp, câu trả lời của AI Mode giống nhau từng byte giữa hai thứ tự, và ở trường hợp Shopify nó đặt WooCommerce lên trước trong câu mở đầu cả hai lần, còn AI Overviews đặt Shopify lên trước cả hai lần. Mỗi bề mặt có thói quen hành văn đã cố định, và những thói quen đó không giống nhau.

Câu chuyện thứ tự từ không phải chuyện bịa hoàn toàn
Có một phép đo thực sự dịch chuyển theo thứ tự từ, và đó lại chính là thứ phần lớn người ta đang theo dõi: danh sách kết quả tìm kiếm truyền thống.
Ở 5 trong 10 cặp phần mềm, ba kết quả organic truyền thống hàng đầu khác nhau giữa A vs B và B vs A, kể cả ở những cặp mà AI Overview giống nhau ở cả hai thứ tự. Reddit nằm quanh vị trí đầu trong hầu hết các so sánh phần mềm, và thread xuất hiện thì đổi theo cách viết. Vậy trong Google Search có độ nhạy thứ tự từ thật với các truy vấn so sánh. Nó nằm ở tầng dưới câu trả lời AI, không nằm trong phần gợi ý. Chính khác biệt đó khiến bài kiểm tra này đáng làm, và đó là một phát hiện chúng tôi không nghĩ mình sẽ phải viết ra.
Điều này quan trọng với việc báo cáo. Nếu công cụ theo dõi thứ hạng của bạn cho thấy thứ hạng dao động giữa truy vấn so sánh có tên thương hiệu và không có, bạn đang thấy một hiệu ứng thật. Chỉ là nó không phải hiệu ứng mà khẳng định kia đang nói tới, và việc tối ưu cho nó sẽ không đổi được điều AI Overview nói về bạn.
Đòn bẩy mà dữ liệu thực sự chỉ tới
Tín hiệu rõ nhất trong các lần chạy của chúng tôi không liên quan gì đến việc ghép truy vấn. Nó liên quan đến kho nội dung so sánh mà mỗi câu trả lời được dựng lên từ đó.
Ở Airtable vs Monday.com, các nguồn được trích dẫn gồm 18 trang thuộc Monday.com và không trang nào thuộc Airtable, ở cả hai thứ tự. Ở Mailchimp vs Klaviyo có sáu trích dẫn thuộc Mailchimp và không có trích dẫn nào thuộc Klaviyo. Shopify vs WooCommerce cho ba trích dẫn thuộc WooCommerce và không có trích dẫn nào thuộc Shopify. Cùng lúc đó, nhiều cặp không có tên miền của thương hiệu nào xuất hiện: những câu trả lời đó được dựng từ các bài so sánh của bên thứ ba, các trang đánh giá và thread diễn đàn.
Dạng thức này khớp với cách truy xuất vận hành. Mô hình không quan tâm bạn gõ tên nào trước. Nó quan tâm những trang nào tồn tại và chúng nói gì về từng thương hiệu. Ở đâu thương hiệu sở hữu nội dung so sánh của chính mình, những trang đó được kéo vào. Ở đâu không, chúng vắng mặt trong câu trả lời cho tất cả những ai đặt câu hỏi.
Cách tự chạy một bài kiểm tra đảo thứ tự
Mười lăm phút, và không cần quyền truy cập API:
- Chọn năm truy vấn so sánh mà thương hiệu của bạn là một trong hai cái tên và đối thủ là đối thủ thật.
- Chạy mỗi truy vấn ở cả hai thứ tự, và chạy mỗi thứ tự hai lần. Bốn câu trả lời cho mỗi cặp, tổng cộng mười bộ.
- Lưu câu trả lời lại trước khi đọc. Chụp màn hình hoặc sao chép toàn bộ văn bản và danh sách nguồn.
- So sánh hai thứ tách biệt: thương hiệu nào được nhắc trước, và câu trả lời nói gì về từng thương hiệu. Chỗ chúng tôi thấy tín hiệu đáng chú ý là chỗ thứ tự ổn định mà nội dung thì không.
- Nhìn danh sách trích dẫn chứ không chỉ văn bản. Nếu tên miền của đối thủ xuất hiện lặp lại còn của bạn thì không, bạn đã tìm ra nút thắt thật.
AI Overview Citation Checker cho biết một truy vấn được AI Overview trích dẫn những trang nào, và đó là cách nhanh nhất để xem tên miền của bạn có nằm trong đống trích dẫn hay không.
Hãy làm ít nhất hai lần, vào những ngày khác nhau, trước khi kết luận bất cứ điều gì. Các lần chạy lặp lại của chính chúng tôi khớp nhau 93% chứ không phải 100%, và một lần đảo kết quả duy nhất đúng là loại nhiễu dễ biến thành một bài blog đầy tự tin.
Dùng những điều này thế nào
Đừng đập đi làm lại các trang so sánh của bạn dựa trên thứ tự từ. Không có bằng chứng nào cho thấy nó đổi điều AI Overviews gợi ý, và kể cả nếu một ngày Google thực sự đánh trọng số cho nó, cách sửa sẽ là đổi một từ, chẳng nói lên điều gì về vị thế thật của bạn.
Hãy coi cách viết là biến số thật. X vs Y và which is better, X or Y là hai truy vấn khác nhau cho ra hai kiểu câu trả lời khác nhau. Nếu người mua của bạn viết so sánh dưới dạng câu hỏi, bạn cần nội dung trả lời câu hỏi đó chứ không chỉ một bảng thông số.
Hãy kiểm tra xem trang của chính thương hiệu bạn có xuất hiện trong các trích dẫn của những so sánh bạn quan tâm không. Tỉ lệ 18 trên 0 mà chúng tôi thấy là con số hành động được nhất trong cả tập dữ liệu, và nó thuộc về việc xuất bản nội dung, không phải viết prompt.
Nếu bạn đã có phép đo tên-đầu-tiên, hãy giữ nó, nhưng đọc nó như mô tả câu trả lời đang nói gì, không phải như một đòn bẩy bạn kéo được. Trong dữ liệu của chúng tôi, nó là một lần tung đồng xu đi theo kho nội dung, không đi theo truy vấn.
Giới hạn
Đây là dữ liệu một ngày, một địa điểm và một ngôn ngữ, trên máy tính để bàn, thu qua SERP API chứ không qua phiên trình duyệt, phủ 16 cặp thương hiệu. Kết quả tìm kiếm thay đổi theo cá nhân hóa, thời điểm và thiết bị, và một ngày không loại trừ được khả năng điều này sẽ đổi trong tương lai.
Chúng tôi đo thương hiệu nào được nhắc trước, được nhắc bao nhiêu lần, và nguồn nào được trích dẫn. Không phép đo nào trong số đó đo trực tiếp mức độ câu trả lời thuyết phục người đọc, và một câu trả lời nhắc tên bạn trước vẫn có thể để lại ấn tượng rằng bên kia thắng.
Mẫu AI Mode gồm 18 truy vấn ở ba cặp. Đủ để thấy bề mặt hành xử khác, không đủ để định lượng nó. Hãy đọc phần đó như một hướng đi, không phải một tỉ lệ.
Cuối cùng, cơ chế trong câu chuyện gốc không kiểm chứng được từ bên ngoài. Google xác nhận việc mở rộng truy vấn có diễn ra và không công bố các truy vấn con, nên không ai chứng minh được truy vấn của bạn tạo ra những truy vấn con nào. Bài kiểm tra của chúng tôi cho thấy việc đảo thứ tự không đổi kết quả. Nó không cho biết vì sao.
Câu hỏi thường gặp
Thứ tự từ trong truy vấn Google có ảnh hưởng đến AI Overviews không Trong bài kiểm tra của chúng tôi thì không. Qua 102 truy vấn AI Overview phủ 16 cặp thương hiệu ở cả hai thứ tự, thương hiệu được viết trước xuất hiện ở vị trí tên đầu tiên trong 49% số lần, và không cặp nào đảo chiều khi chúng tôi đảo truy vấn. Tám trong mười cặp phần mềm cho câu trả lời giống nhau từng chữ ở cả hai thứ tự.
Vậy vì sao người ta nói thứ tự ảnh hưởng đến gợi ý của AI Vì hiệu ứng thứ tự được ghi nhận trong các mô hình ngôn ngữ khi được yêu cầu chọn từ một danh sách, với lựa chọn đầu tiên thắng khoảng 63% số lần trong nghiên cứu đã công bố, và vì việc mở rộng truy vấn của Google khiến quá trình truy xuất không quan sát được. Cả hai dữ kiện đều đúng. Không dữ kiện nào trong đó có nghĩa là một truy vấn so sánh trong AI Overviews sẽ đổi thương hiệu khi bạn đổi vị trí các tên.
Điều gì thực sự làm AI Overview đổi với một truy vấn so sánh Cách viết và bề mặt. Shopify vs WooCommerce cho một câu trả lời mở đầu bằng sản phẩm ở cả hai thứ tự, còn which is better, Shopify or WooCommerce cho một câu trả lời "không có cái nào tốt hơn tuyệt đối" ở cả hai thứ tự. Cùng truy vấn đó trên AI Mode lại trả về một khuôn khác nữa và biến động giữa các lần chạy cao hơn nhiều.
Có nên tối ưu cho vị trí tên đầu tiên trong AI Overviews không Hãy theo dõi, nhưng đừng tối ưu cho nó. Trong dữ liệu của chúng tôi, vị trí tên đầu tiên đi theo kho nội dung nguồn chứ không theo thứ chúng tôi kiểm soát từ phía truy vấn. Biến số bạn kiểm soát được là liệu các trang so sánh của bạn có nằm trong đống trích dẫn hay không: một cặp chúng tôi thử kéo về 18 trích dẫn thuộc đối thủ và không trích dẫn nào thuộc thương hiệu kia.
Đọc thêm
- Cách tối ưu trang so sánh để được AI search trích dẫn
- Vì sao bài "best X" của bạn khiến AI gợi ý đối thủ
- Loại truy vấn nào AI Overviews thực sự thay đổi, và bạn phải trả giá bao nhiêu
Tác giả: Ethan Marlowe, Trưởng nhóm Đo lường GEO tại Auspia, phụ trách hơn 500 prompt. Viết về đo lường hiển thị trong AI, thiết kế bộ prompt và cách dựng những bài kiểm tra trụ được ở lần soi thứ hai.




