Como encontrar as fontes que moldam as respostas de IA no seu setor

Principais pontos

Um mapa de citações registra quais páginas um motor de IA realmente puxou, não apenas se a sua marca apareceu. Aqui está o método completo e a configuração para rodar com Codex, Claude Code, ChatGPT e Hermes Agent.

O que você vai ter no final

Um mapa de citações é um registro das páginas que um motor de IA realmente puxou quando respondeu às perguntas dos seus compradores. Não é se a sua marca apareceu na resposta. É de quais fontes aquela resposta foi montada.

Já rodei isso em categorias suficientes para saber que o primeiro resultado costuma ser constrangedor. As equipes assumem que o próprio site sustenta essas respostas. Na maioria das vezes, não sustenta. Em uma categoria B2B, as páginas do próprio fornecedor representavam uma fração mínima, enquanto um site de avaliações que ninguém tinha reivindicado fazia a maior parte do trabalho.

É esse o ponto de fazer isso. Você para de adivinhar e começa a olhar as páginas reais.

Ao terminar este roteiro, você terá:

  • De 10 a 20 perguntas de compra reais para uma categoria de produto ou serviço, escritas como um cliente perguntaria
  • Cada pergunta rodada nos motores de IA que seus compradores realmente usam, com as fontes citadas registradas e datadas
  • Essas fontes organizadas por tipo, para você ver de onde vêm as respostas da sua categoria
  • Uma lista curta de páginas em que um concorrente é citado e você não, cada uma com um próximo passo legítimo
  • Responsáveis e uma data de revisão, para o mapa não apodrecer numa pasta compartilhada

Para quem é: um responsável interno de SEO, GEO ou conteúdo, ou um estrategista de agência que consegue recomendar trabalho mesmo quando outra pessoa executa. Nenhuma ferramenta paga é obrigatória, embora ajude em escala.

Pré-requisitos: um navegador, uma planilha e permissão de leitura no seu próprio site. Para as versões com agente, uma instalação funcionando do agente escolhido e uma pasta para apontá-lo.

Tempo: cerca de duas horas para a primeira passada em uma categoria. Desse total, uns 45 minutos são rodar prompts e copiar fontes. Esses 45 minutos são justamente a parte que vale a pena entregar a um agente, e o resto é a parte que precisa do seu julgamento.

O que significa estar pronto: você consegue nomear os três ou quatro tipos de fonte que sustentam as respostas da sua categoria, apontar páginas específicas em que você está ausente e um concorrente está presente, e passar para alguém uma tarefa com uma URL anexada. Se você só tem uma lista de domínios e a vaga sensação de que o Reddit importa, ainda não terminou.

A visão da Auspia: a maioria das equipes vai direto para "precisamos de mais menções de marca" porque nunca olhou de que a resposta foi realmente montada. O mapa transforma esse instinto vago em uma página sobre a qual dá para agir.

Antes de começar: as duas decisões que definem tudo

Duas escolhas determinam o que o resto produz. As duas são fáceis de errar e as duas são chatas de desfazer depois.

Escolha uma categoria, não o negócio inteiro. Uma empresa que vende software e também opera um braço de serviços tem dois ecossistemas de fontes diferentes. Mapear os dois ao mesmo tempo produz uma média que não descreve nenhum dos dois. Pegue a categoria com mais receita em jogo e deixe o resto para o próximo trimestre.

Escolha os motores com critério. Google AI Overview, ChatGPT, Perplexity e Gemini não bebem do mesmo poço. Uma fonte que perdeu peso em um motor pode continuar contando em outro. Rode pelo menos dois. Se não souber quais dois, pergunte ao time comercial qual interface os clientes mencionam, ou olhe o tráfego de referência vindo de domínios de IA.

Trace uma fronteira agora. Este é um exercício de observação, não de prova. Você está registrando o que um motor devolveu em um dia específico. As respostas mudam entre execuções, então uma observação isolada é um dado, não uma tendência. Date tudo, ou o arquivo inteiro fica inútil em um mês.

Passo 1: montar o conjunto de perguntas

Escreva de 10 a 20 perguntas que um cliente faria ao escolher. Não palavras-chave. Perguntas, nas palavras do próprio cliente.

Este é o passo que as pessoas apressam, e é o passo que decide se o resto vale a pena. Um conjunto de perguntas feito a partir de exportações de palavras-chave produz um mapa de como as pessoas pesquisam. Um conjunto feito a partir de anotações de ligações de vendas produz um mapa de como as pessoas compram. Não são a mesma lista.

Materiais que você pode usar:

  • As perguntas pré-compra mais frequentes que o time comercial recebe
  • Tickets de suporte dos primeiros 30 dias após a compra
  • O bloco de "outras perguntas" das suas principais buscas comerciais
  • Sua própria pesquisa de palavras-chave, reescrita em forma de pergunta
  • Buscas comparativas de concorrentes que seus compradores fazem

Misture formas de pergunta, porque cada uma puxa fontes diferentes.

Forma da pergunta

Exemplo

Fontes que costuma trazer

Adequação de categoria

"O que uma empresa de logística de médio porte deve olhar ao escolher uma ferramenta de rotas?"

Listas editoriais, sites de avaliação

Comparação direta

"Ferramenta A ou ferramenta B para um time de 20 pessoas?"

Páginas comparativas, tópicos de comunidade

Risco e objeção

"A ferramenta A é realmente segura o bastante para dados de saúde?"

Fóruns, análises de conformidade, documentação do fornecedor

Preço e valor

"Quanto custa de verdade a ferramenta A por assento?"

Páginas de preço, tópicos de comunidade, sites de avaliação

Implementação

"Quanto tempo leva para migrar da ferramenta B?"

Documentação, tutoriais no YouTube, fóruns

Resultado esperado: uma planilha com uma linha por pergunta, uma coluna para a forma da pergunta e uma coluna para o motor em que você vai rodá-la.

Verificação de qualidade: releia a lista e pergunte se um comprador real digitaria cada uma. Se uma pergunta só faz sentido para quem já conhece a taxonomia do seu produto, reescreva. Dez perguntas que um comprador realmente faria valem mais que cinquenta que soam como exportação de palavras-chave.

Caminho de recuperação: se você não chegar a dez perguntas, o problema é de pesquisa, não de mapeamento. Puxe as últimas 20 anotações de ligações de vendas ou os últimos 50 tickets de suporte e extraia perguntas dali antes de continuar.

Tabela mostrando cinco formas de pergunta (adequação de categoria, comparação direta, risco, preço e implementação) e os tipos de fonte que cada uma costuma trazer

A forma da pergunta é a variável escondida. Uma pergunta de comparação direta e uma de risco sobre o mesmo produto não devolvem as mesmas fontes.

Passo 2: rodar as perguntas e capturar as fontes

Aqui está o núcleo mecânico, e é aqui que o trabalho manual desmorona. Faça cinco perguntas à mão para entender como o resultado deve ser. Depois automatize o resto.

Para cada pergunta, em cada motor:

  1. Abra uma conversa nova. O contexto anterior muda o que o motor recupera.
  2. Faça a pergunta exatamente como você escreveu.
  3. Abra o painel de citações ou a lista de fontes. Na maioria dos motores é um ícone pequeno perto da resposta, não uma lista visível.
  4. Registre cada URL citada, mais o domínio e o tipo de fonte.
  5. Anote a data, o motor e se a resposta citou algo ou não.

Registre nesta estrutura:

Campo

Por que importa

ID da pergunta

Liga cada observação à pergunta de compra

Motor

Permite separar padrões por motor depois

Data e hora

As respostas derivam; uma linha sem data não serve em um mês

URL citada

A página real, não só o domínio

Domínio

Para agrupar e contar frequências

Tipo de fonte

própria, varejo/marketplace, comunidade, diretório de avaliações, editorial

Concorrente presente

Sim/não, e qual

Nossa marca presente

Na resposta, nas fontes, nas duas ou em nenhuma

A última linha merece uma pausa. Uma marca pode ser nomeada na resposta sem que nenhuma de suas páginas seja citada. Também pode ser citada sem aparecer com destaque. São dois sinais diferentes, e se você só acompanha "aparecemos?", vai ler os dois errado. Já vi equipes comemorarem uma menção que vinha de uma página argumentando contra elas.

Resultado esperado: uma tabela longa, uma linha por fonte citada, por pergunta e por motor.

Verificação de qualidade: em pelo menos três linhas, clique e confirme que a página citada realmente sustenta a afirmação pela qual foi citada. Os motores às vezes citam uma página que menciona o assunto sem responder à pergunta. Essas linhas são ruído e devem ser marcadas.

Caminho de recuperação: se um motor não devolver citações para uma pergunta, isso é um achado, não uma falha. Registre como zero fontes e siga. Perguntas respondidas sem recuperação são perguntas que o seu próprio conteúdo não consegue influenciar.

Diagrama do ciclo de captura: fazer a pergunta de compra, abrir o painel de citações, registrar a URL citada e o tipo de fonte, e marcar se aparecem um concorrente e a sua marca

O ciclo é simples e tedioso. Essa combinação é exatamente o que o torna um bom candidato para um agente.

Passo 3: classificar as fontes por tipo

Agora comprima a tabela longa numa imagem da sua categoria. Classifique cada URL citada em um de cinco baldes:

  • Própria: seu site, ou o de um concorrente
  • Varejo e marketplace: fichas de produto, páginas de comparação de preço, lojas de aplicativos
  • Comunidade e UGC: Reddit, YouTube, Quora, fóruns, tópicos do Discord indexados
  • Diretórios de avaliação e plataformas B2B: G2, Capterra, Clutch, Trustpilot, diretórios setoriais
  • Editorial independente e referência: imprensa setorial, notícias, Wikipédia, análises de analistas, blogs independentes

Conte por balde e por motor, e você tem seu mapa de citações.

O que você procura não é um número único. É a forma. Algumas categorias são sustentadas quase inteiramente por tópicos de comunidade e imprensa setorial, e o site próprio da marca quase não aparece. Outras são dominadas por fichas de produto, porque a ficha em si contém a resposta. Essa mistura depende do que os compradores perguntam, não de quão bom é o site de alguém. É difícil de aceitar quando você passou dois anos trabalhando no site.

Resultado esperado: uma tabela pequena, uma linha por tipo de fonte, uma coluna por motor, mostrando a fatia das fontes citadas.

Verificação de qualidade: se um balde concentra mais de uns 70% das suas citações, confira cinco URLs dentro dele para confirmar que são mesmo desse tipo. Um agregador de tráfego alto pode se disfarçar de fonte editorial quando na verdade é um diretório.

Caminho de recuperação: se as contagens parecerem aleatórias, provavelmente você misturou formas de pergunta e isso escondeu o padrão. Divida a tabela por forma de pergunta e olhe de novo. Perguntas de preço e de risco costumam ter perfis de fonte completamente diferentes.

Passo 4: encontrar as lacunas em que um concorrente é citado e você não

Filtre a tabela longa para as linhas em que um concorrente aparece e sua marca não. Essa lista filtrada é sua lista de trabalho. Ela é bem mais útil que um mandato genérico de "precisamos de mais menções", porque cada linha já traz uma URL e uma pergunta de cliente. Entregue para alguém na segunda-feira e a pessoa já consegue começar.

Para cada linha, abra a página citada e responda a três perguntas:

  1. O nosso produto realmente pertence a esta página?
  2. Se pertence, o que falta: uma ficha que nunca reivindicamos, uma comparação da qual estamos ausentes, um tópico em que ninguém nos mencionou, uma avaliação que nunca pedimos?
  3. Qual é a menor ação legítima que nos colocaria ali?

A terceira pergunta é onde entra a disciplina. A ação muda conforme o balde. Errar aqui é como um SEO acaba mandando e-mail frio para jornalistas sobre um tópico do Reddit.

Tipo de fonte

Ação legítima

O que não fazer

Diretório de avaliação

Reivindicar e completar o perfil, pedir avaliações aos clientes

Comprar avaliações ou plantar falsas

Tópico de comunidade

Responder com honestidade como funcionário identificado, declarando o vínculo

Fazer astroturfing ou largar um link sem contribuir

Editorial

Propor um ângulo realmente útil que o veículo ainda não cobriu

Enviar o mesmo release para 200 domínios

Marketplace ou ficha de varejo

Corrigir especificações, imagens e descrição para os fatos serem recuperáveis

Enfiar palavras-chave na ficha

Página própria

Reestruturar para o fato específico ficar fácil de achar e citar

Adicionar um bloco de FAQ que não responde nada

Resultado esperado: uma lista filtrada e priorizada. Ordene pela frequência com que a fonte aparece no seu conjunto de perguntas, não por quão prestigioso o domínio soa. Um tópico de fórum citado em seis das suas vinte perguntas passa na frente de uma publicação setorial citada uma vez, e além disso é bem mais fácil de resolver.

Verificação de qualidade: para cada linha que você mantiver, confirme que consegue dizer a pergunta de cliente correspondente. Se não conseguir, descarte a linha. Páginas citadas para perguntas que ninguém no seu pipeline faz só distraem.

Caminho de recuperação: se a lista filtrada ainda estiver enorme, você não filtrou com força suficiente. Limite a primeira passada a dez linhas, ordenadas por frequência de citação, e trabalhe essas antes de reabrir a lista completa.

Matriz associando cada um dos cinco tipos de fonte à ação legítima e à tática a evitar

Mesma lacuna, reparo diferente. Tratar toda citação ausente como problema de outreach é como as equipes acabam vendendo um tópico do Reddit para um editor.

Passo 5: entregar a metade mecânica para um agente

Os passos 2 e 3 são os que mais consomem tempo e menos exigem julgamento. Essa é a definição de trabalho que vale a pena delegar. O conjunto de perguntas e a priorização ficam com uma pessoa, porque são os dois pontos em que um erro de julgamento derruba o exercício inteiro.

Os quatro agentes abaixo conseguem rodar o mesmo método. O que muda é onde o método mora e como o resultado volta. Escolha por isso, não por qual modelo ganhou um benchmark neste mês.

Codex

Ideal quando você quer que o mapa viva num repositório e produza um artefato revisado a cada execução. Se o seu site já está no git, este é o caminho com menos atrito.

Monte uma pasta de projeto com um diretório citation-map/, um questions.csv com o seu conjunto de perguntas e um SKILL.md que declare o método: quais motores checar, quais campos registrar, como classificar uma fonte e como o arquivo de saída deve ser. Guarde um arquivo por execução, nomeado pela data, para acumular histórico em vez de sobrescrever.

Peça ao Codex para rodar as perguntas, acrescentar linhas ao arquivo da execução atual e produzir uma tabela-resumo da fatia de fontes por motor. Como a saída é um arquivo dentro de um repositório, você ganha um diff que pode revisar antes de qualquer coisa ser tratada como definitiva. Esse passo de revisão é o ponto: você está conferindo as classificações, não refazendo a captura.

Uma regra precisa estar no SKILL.md de qualquer jeito: o agente registra o que observou e não infere uma citação que não viu. Inventar fontes é o modo de falha mais danoso deste fluxo. Uma regra escrita mais uma checagem por amostragem de três linhas barra a maior parte, e as três linhas que você confere devem mudar a cada execução.

Claude Code

Ideal quando o método precisa ser lido contra uma política escrita explícita, e quando você quer revisar as páginas capturadas com contexto longo.

Coloque o método num CLAUDE.md ou num skill de projeto, incluindo suas definições de tipo de fonte e o esquema de saída exato. Aponte o Claude Code para a pasta de execução e peça que classifique cada URL citada e sinalize qualquer linha em que o conteúdo da página não sustente de fato a citação.

O segundo trabalho é o que vale a pena pagar. Ler 200 páginas citadas e julgar se cada uma realmente responde à pergunta é penoso para uma pessoa e razoável para um agente com um padrão escrito. Peça um indicador de confiança por linha e revise você mesmo só as de baixa confiança.

ChatGPT

Ideal quando você quer o menor custo de montagem e o trabalho é uma sessão única em vez de uma execução recorrente.

Cole o método como instrução personalizada ou prompt de projeto salvo, anexe sua lista de perguntas e trabalhe em lotes por motor. Peça a saída como tabela com exatamente as colunas do passo 2, para colar direto na planilha.

A pegadinha é que o ChatGPT também é uma das superfícies que você está medindo. Se você está mapeando as citações do próprio ChatGPT, faça isso numa sessão limpa sem o seu método carregado, ou contamina a observação. Use uma sessão para capturar e outra para organizar.

Hermes Agent

Ideal quando você quer que o método persista como skill e melhore entre execuções sem você precisar reexplicar.

Instale o método do mapa de citações como skill do Hermes com o conjunto de perguntas e o esquema de saída, e rode numa cadência; mensal costuma ser o certo. Como o skill e sua memória persistem, as correções que você fizer no primeiro mês passam para o segundo. Se o agente classificou mal um diretório como fonte editorial, você corrige a regra uma vez.

O preço é que memória persistente precisa de revisão periódica. A cada poucas execuções, leia o arquivo do skill e confira se as correções acumuladas ainda descrevem o método que você quer, e não um monte de exceções pontuais que ninguém sabe explicar.

Tabela comparativa de Codex, Claude Code, ChatGPT e Hermes Agent mostrando no que cada um é melhor, onde o método é guardado e o principal trade-off

Os quatro rodam os mesmos cinco passos. Escolha por onde o método deve morar, não por qual modelo tira a melhor nota num benchmark.

Passo 6: verificar o mapa antes de agir com base nele

Não distribua trabalho a partir de um mapa não verificado. Rode esta checagem primeiro. Cinco minutos aqui economizam um trimestre de esforço na direção errada.

  • Rode três perguntas de novo uma semana depois. Se a mistura de fontes mudar por completo, seu conjunto de perguntas é volátil demais ou sua amostra é pequena demais. Registre a variação em vez de tratar a primeira passada como verdade absoluta. Alguma variação é normal; uma troca total é um alerta.
  • Confirme o motor, não só a resposta. Uma fonte que aparece no Perplexity pode faltar no ChatGPT para a mesma pergunta. Mantenha as colunas por motor separadas no resumo; um total combinado esconde exatamente o sinal que você precisa.
  • Confira também as suas próprias citações. Se a sua marca for citada, abra a página. Às vezes o motor cita uma página em que você é mencionado de forma crítica, ou uma que você não controla. Isso é informação útil, não uma vitória.
  • Confirme a data em cada linha. Um mapa de citações sem data não se compara com nada depois.
  • Confira a contagem de fontes. Se uma pergunta devolveu 40 fontes e o resto devolveu três, verifique se você capturou um painel de "relacionados" em vez das citações reais.

O que significa estar pronto: você consegue entregar a um colega a tabela-resumo e uma lista de trabalho filtrada, e ele consegue agir sem perguntar o que significa nenhuma linha.

Manter o mapa

Rode a passada completa a cada trimestre com o mesmo conjunto de perguntas, e uma passada leve mensal nas cinco perguntas de maior valor comercial. Guarde as execuções antigas. O sinal interessante raramente é a foto. É a deriva: um tipo de fonte que cresce em silêncio, ou um concorrente que começa a aparecer num balde em que antes não estava.

Revise o conjunto de perguntas duas vezes por ano. As perguntas de compra mudam com o seu produto e o seu mercado, e um conjunto desatualizado produz o mapa de uma categoria que você não vende mais.

Uma coisa a resistir: transformar isso num dashboard. O resultado é uma lista de trabalho com responsáveis e URLs. Se no fim ninguém tem uma tarefa, o mapa não fez o trabalho dele.

Perguntas frequentes

Preciso de uma ferramenta paga de visibilidade em IA para fazer isso? Não. A versão manual funciona para uma categoria e leva meio dia. As ferramentas ganham o custo quando você acompanha muitas categorias ou mercados, ou quando quer linhas de tendência histórica sem manter a planilha você mesmo.

Quantas perguntas bastam? De 10 a 20 por categoria. Com menos de dez você não distingue um padrão de uma coincidência. Com mais de vinte na primeira passada você não termina a análise, que é a parte que gera a lista de trabalho.

Devo incluir perguntas em que já aparecemos? Sim. Saber quais fontes sustentam você é tão útil quanto saber quais deixam você de fora, e mostra o que proteger quando você mexer no conteúdo.

E se o motor der uma resposta diferente a cada vez? Isso é normal e vale registrar. Rode a mesma pergunta três vezes e anote a variação. Se o conjunto de fontes for completamente diferente a cada vez, trate essa pergunta como de baixa confiança e dê menos peso a ela na priorização.

Posso só usar a lista de fontes do próprio motor sem abrir as páginas? Para a captura inicial, sim. Para as linhas em que você vai agir, não. Você precisa ler a página para julgar se a sua marca realmente pertence ali e o que seria uma contribuição útil.

No que isso difere do monitoramento de posições? O monitoramento de posições diz onde suas páginas aparecem numa lista de resultados. Um mapa de citações diz de quais páginas uma resposta foi montada. Uma página pode ser a primeira e nunca ser citada, e uma que não ranqueia em lugar nenhum pode ser a espinha dorsal de uma resposta. Essa diferença é o que faz valer a pena dedicar meio dia.

Autor: Ethan Marlowe, responsável de medição GEO na Auspia com mais de 500 prompts analisados. Ele escreve sobre monitoramento de prompts, relatórios de citação, dashboards de visibilidade e como distinguir uma mudança real de visibilidade em IA do ruído entre execuções.

Explore este tópico

Continue na mesma linha de crescimento