Sprawdzacz widoczności w AI: gdy liczba cytowań nie zgadza się z odpowiedzią

Najważniejsze wnioski

Te same 20 promptów, trzy powierzchnie AI, jeden dzień. Gemini cytował medianę 47 źródeł na odpowiedź, Perplexity dwadzieścia, a ChatGPT nie zacytował nic w 12 z 20 promptów, wymieniając jedynie dostawców. Oto dwa sygnały, które sprawdzacz widoczności musi rozdzielać.

Dwa sprawdzacze widoczności w AI mogą przeczytać te same odpowiedzi tego samego dnia i wydać przeciwne werdykty. Jeden zwraca liczbę cytowań, drugi nie zwraca nic, bo odpowiedź wymieniła twoją markę z nazwy i poleciła ją, ani razu jej nie linkując.

We wrześniu 2026 roku przepuściliśmy dwadzieścia promptów przez trzy powierzchnie AI i na każdej odpowiedzi zapisaliśmy dwa sygnały: markę, którą odpowiedź wymieniła w treści, oraz domenę, którą odpowiedź podała jako źródło. To nie są dwa ujęcia jednego pomiaru. Rozchodzą się w przewidywalnych miejscach, a właśnie te miejsca są najużyteczniejszą częścią raportu.

Krótka wersja: Perplexity cytował źródła w każdym prompcie, Gemini zwracał medianę 47 źródeł na odpowiedź, a ChatGPT nie zwrócił żadnego cytowania w 12 z 20 promptów, choć i tak wymienił dostawców w 13 z nich. Zmienność między uruchomieniami na jednej powierzchni to osobna kwestia i mierzyliśmy ją wcześniej w artykule zmienność uruchomień trackera widoczności w AI.

Co uruchomiliśmy

Pozycja

Ustawienie

Prompty

Dwadzieścia pytań, jakie kupujący zadałby o narzędzia widoczności w AI

Powierzchnie

ChatGPT (gpt-5-2025-08-07), Gemini (gemini-2.5-flash), Perplexity (sonar)

Wyszukiwanie w sieci

Włączone na wszystkich trzech powierzchniach

Region i język

Stany Zjednoczone, angielski

Data

12 września 2026

Zebrane odpowiedzi

60

Koszt całego uruchomienia

1,444 dolara, czyli 0,024 dolara za odpowiedź

Powtórne uruchomienie

Powtórzyliśmy te same pięć promptów, żeby sprawdzić, czy zachowanie jest stabilne

Koszt odpowiedzi mieścił się między 0,006 dolara w Perplexity a 0,037 dolara w Gemini. Najtańsza powierzchnia dała najbardziej spójną listę źródeł, a najdroższa nie była tą, która zwróciła najwięcej źródeł.

Dwa sygnały mierzone osobno

Każdą odpowiedź przechwyciliśmy dwa razy: raz jako tekst, raz jako listę źródeł, którą powierzchnia dołączyła do tego tekstu.

Powierzchnia

Znaczniki źródeł

Na odpowiedź

Odpowiedzi bez cytowań

Różne domeny na odpowiedź

ChatGPT (gpt-5)

90

od 0 do 18, mediana 0

12 z 20

od 0 do 10

Gemini 2.5 Flash

989

od 14 do 122, mediana 47

0 z 20

od 3 do 23

Perplexity

399

od 19 do 20

0 z 20

od 16 do 20

Te trzy listy nie są tym samym typem obiektu i właśnie tutaj sprawdzacz myli się najpierw.

Wykres słupkowy pokazujący medianę liczby źródeł dołączonych do jednej odpowiedzi: na swoich dwudziestu promptach ChatGPT ma 0, Gemini 47, a Perplexity 20

Gemini dołącza źródło niemal do każdego twierdzenia. Ta sama strona może zająć w jednej odpowiedzi wiele miejsc i dlatego liczby są tak wysokie: przez 20 odpowiedzi Gemini domena semrush.com zajęła 44 miejsca, maxaeo.ai dwadzieścia sześć, google.com dwadzieścia dwa, adobe.com dwadzieścia jeden, a medium.com dwadzieścia. Wysoka liczba znaczników na tej powierzchni mówi o tym, jak drobno model rozkłada materiał, a nie o tym, jak szeroko znana jest twoja marka.

Perplexity ujawnia panel z sufitem. Zwrócił dokładnie dwadzieścia źródeł w 19 z 20 promptów i dziewiętnaście w dwudziestym. To ustala mianownik: twój udział w odpowiedzi Perplexity to zawsze udział z dwudziestu, więc zdobycie miejsca oznacza, że ktoś gdzieś indziej miejsce stracił.

ChatGPT zwraca listę źródeł tylko wtedy, gdy szukał. Zapytanie wyszukiwania wysłał w 8 z 20 promptów, a w pozostałych dwunastu nie zacytował niczego. W tych dwunastu wciąż odpowiedział na pytanie i wciąż wymienił narzędzia. Jeden przykład bez redakcji: zapytany o najlepsze narzędzia do śledzenia wzmianek o marce w wynikach wyszukiwania AI wymienił Brand24, Mention, BuzzSumo, Talkwalker i Google Alerts, nie dołączając źródła do żadnego z nich. Lista kontrolna, której używamy do audytu odpowiedzi ChatGPT pod kątem tego wzorca awarii, jest w artykule lista kontrolna widoczności w ChatGPT.

Wymieniona z nazwy, ale niecytowana

Następnie policzyliśmy dla 27 marek i mediów, w ilu z 60 odpowiedzi marka została wymieniona w treści, a w ilu zacytowano jej domenę jako źródło. Obie kolumny rozchodzą się w obu kierunkach naraz.

Marka

Odpowiedzi, które ją wymieniły

Odpowiedzi, które zacytowały jej domenę

Semrush

18

15

Reddit

16

14

Otterly

14

6

Ahrefs

13

16

Profound

11

6

Peec AI

11

2

Frase

5

9

HubSpot

5

8

ZipTie

5

0

Siftly

4

5

Keyword.com

4

5

Nightwatch

3

4

LLM Pulse

2

6

Cognizo

1

6

MaxAEO

1

7

Searchable

1

5

AirOps

0

5

Menra

0

4

W tej tabeli są dwa wzorce. Peec AI, Otterly, Profound i ZipTie są polecane w odpowiedziach znacznie częściej, niż linkuje się ich strony. MaxAEO, Cognizo, LLM Pulse, Searchable, AirOps i Menra mają odwrotnie: ich strony są wciągane jako źródła, podczas gdy odpowiedź ani raz nie wymienia nazwy firmy. Sprawdzacz patrzący tylko na linki uzna drugą grupę za widoczną, a pierwszą za niewidoczną. Sprawdzacz patrzący tylko na wzmianki zrobi odwrotnie.

Zgrupowany wykres słupkowy porównujący, jak często pięć marek było wymienianych z nazwy w odpowiedziach AI i jak często ich domeny były cytowane jako źródła, na podstawie 60 odpowiedzi

Przez wszystkie 60 odpowiedzi trzy powierzchnie razem zacytowały 432 różne domeny. Na ChatGPT przypada 47 z nich, czyli 11 procent, na Gemini 184 (43 procent), na Perplexity 285 (66 procent). Którąkolwiek powierzchnię sprawdzasz, patrzysz na próbkę ze znacznie większego wszechświata źródeł. Nie obejmuje to własnej powierzchni Google, gdzie obecność mierzy się inaczej i opisujemy to w artykule tracker AI Overview.

Co sprawdzacz musi rejestrować

Sprawdzacz widoczności zwracający jedną liczbę wyrzuca trzy ze swoich czterech pól. Oto cztery, które warto zachować.

Pole

Forma zapisu

Dlaczego zmienia werdykt

Czy powierzchnia szukała

tak lub nie

Odpowiedź, która nie szukała, nie może wytworzyć cytowań, więc jej zero nie jest sygnałem widoczności

Czy marka została wymieniona w treści odpowiedzi

liczba odpowiedzi

Jedyny sygnał, który przeżywa na odpowiedzi bez uzasadnienia

Czy domena jest na liście źródeł

liczba odpowiedzi

Sygnał, o którym większość narzędzi raportuje samotnie

Mianownik

liczba odpowiedzi oraz liczba miejsc na źródła w odpowiedzi

Panel z ustalonymi dwudziestoma miejscami i lista na 47 znaczników nie dają się porównywać jako procenty

Praktyczna konsekwencja to fałszywe zero. W naszych danych 13 z 20 odpowiedzi ChatGPT wymieniło co najmniej jednego dostawcę, podczas gdy tylko 8 z 20 zacytowało cokolwiek, czyli około jednej czwartej odpowiedzi tej powierzchni zaraportuje zero cytowań dla marki, którą ta sama odpowiedź wymieniła z nazwy i poleciła.

Jak robić to, nie oszukując siebie

Wzorzec awarii, gdy oddasz tę pracę agentowi, to nie błędna liczba, lecz pewna siebie liczba policzona z pola, którego nigdy nie zebrano.

  • Przechwyć surowy ładunek, zanim cokolwiek policzysz. Zachowaj tekst odpowiedzi, listę źródeł, identyfikator modelu i wartość logiczną tego, czy wysłano zapytanie wyszukiwania. Metryki pochodne buduje się w kodzie na drugim etapie, a nie umieszcza w prompcie zbierającym.
  • Każ agentowi cytować, a nie streszczać. Kryterium „zaraportuj, ile razy wystąpiła marka" produkuje prozę. Kryterium „zwróć dosłownie tekst odpowiedzi i listę źródeł" produkuje dane, które możesz sprawdzić ponownie.
  • Uruchom ten sam prompt ponownie, zanim uwierzysz w zmianę. Powtórzyliśmy pięć promptów i decyzja o wyszukiwaniu zgadzała się w 5 przypadkach na 5, czyli nagły skok liczby cytowań to raczej wersja modelu albo edycja promptu niż szum.
  • Zostaw identyfikator modelu w każdym wierszu. Te same dwadzieścia promptów na tym samym punkcie końcowym przez gpt-4o zwróciło znaczniki źródeł tylko w 2 z 20 przypadków wobec 8 z 20 przy gpt-5.
  • Zaplanuj budżet. Pełne uruchomienie 60 odpowiedzi kosztowało 1,444 dolara, więc przy tych stawkach cotygodniowa wersja tej samej kontroli to około 6 dolarów miesięcznie.

Ograniczenia

  • Jeden dzień, jeden region, angielski, trzy powierzchnie. Odpowiedzi różnią się między regionami.
  • Jedna wersja modelu na powierzchnię. Nawet w naszych uruchomieniach zachowanie przesuwało się między wersjami modelu.
  • Rozpoznawanie marek to dopasowanie ciągu znaków po nazwie, więc marka polecona wyłącznie nazwą produktu może zostać pominięta.
  • Wyszukiwanie w sieci włączaliśmy przez API. Aplikacje konsumenckie mogą szukać częściej niż te uruchomienia albo rzadziej.
  • Koszt obejmuje tylko generowanie odpowiedzi, bez czasu na przechowywanie czy przegląd.

Częste pytania

Dlaczego ChatGPT zaraportował zero cytowań w 12 z 20 promptów?

Bo odpowiedział na te prompty bez wyszukiwania. Model, który ani razu nie pobierze strony, nie może jej zacytować. To zero opisuje więc uruchomienie, a nie twoją markę. Zanim odczytasz liczbę cytowań z dowolnej powierzchni czatu, najpierw sprawdź, czy ta powierzchnia w ogóle korzystała z sieci.

Czy wzmianka ma wartość, jeśli nie ma żadnego linku?

Na odpowiedzi bez uzasadnienia to cały sygnał, a do tego sygnał, który przychodzi przed linkiem. W naszych danych wzmiankę i link zdobywa się z różnych źródeł: wzmianka idzie za treścią porównawczą i recenzencką, a link za stronami ustrukturyzowanymi tak, by je cytowano.

Czy scalać wzmianki i cytowania w jeden wynik widoczności?

Nie. Jak pokazuje tabela marek, rozchodzą się systematycznie w obu kierunkach, a scalony wynik ukrywa, które z nich się ruszyło. Raportuj je jako dwie linie i pozwól czytelnikowi zobaczyć tę lukę.

Którą powierzchnię sprawdzać najpierw?

Jeśli chcesz stabilnego, taniego panelu o stałej szerokości, wybierz Perplexity, bo długość jego listy się nie zmienia. Jeśli chcesz szerokości, wybierz Gemini, który dotarł do 184 ze 432 domen, które widzieliśmy. ChatGPT tylko z dołączoną kontrolą wiarygodności, inaczej jedna piąta jego odpowiedzi zostanie odczytana jako niewidoczna marka.

Spojrzenie Auspia: raportuj wzmianki i cytowania jako dwie osobne linie i zapisuj, czy powierzchnia szukała, zanim zapiszesz cokolwiek innego. Pojedynczy wynik widoczności ukrywa dokładnie tę lukę, która mówi ci, co naprawić dalej, a najtańsza poprawka w naszych danych nie polegała na dodaniu treści, lecz na sprawdzeniu powierzchni, która naprawdę zajrzała do sieci.

Autor: Adrian Cole

Poznaj ten temat

Kontynuuj tę samą ścieżkę wzrostu