Qwairy
Playbook: Preparação técnica

Relacione observações de crawlers de IA, citações e tráfego de referência

Crie um sistema de observação por página que mantenha separados os crawlers, a saúde técnica, as evidências de citação e o tráfego de referência do GA4, mostrando onde investigar a seguir.
Execução guiada: 30 minAvançadoAtualizado a 23 de ago. de 2026
Plano do fluxo de trabalho
v1.0

Resultado pretendido

Um mapa de observabilidade por página que reúne ocorrências dos bots, estado do site, citações e tráfego de referência de IA

  1. Definir a cobertura

  2. Acrescentar o estado das páginas

  3. Comparar os resultados observados

  4. Priorizar as verificações

Execução rápida

Execute o fluxo de trabalho num clique

Nada a preencher: o prompt é executado tal como está e pede-lhe o que ainda precisar.
Requer o conector MCP do Qwairy

«Executar no Claude» e «Executar no ChatGPT» abrem um novo separador do navegador com o prompt já escrito. Nada é enviado até o submeter.

Lista de verificaçãoVerifique os dados de entrada e os resultadosPúblico, ferramentas, resultado esperado e pré-requisitos.
Ideal para
Equipas de SEO técnicoProgramadoresEquipas de análise de dados
O que obtém
  • Ponto de partida da cobertura dos bots e das páginas
  • Matriz de dados por página de vários sinais
  • Comparação entre citações e páginas de destino do tráfego de referência
  • Lista de verificações por ordem de prioridade
Antes de começar
  • Um plano Qwairy Starter ou superior com monitorização ativa
  • Claude ou ChatGPT com o conector MCP do Qwairy ativado
  • Dados recentes de monitorização suficientes para o tema selecionado
O playbook em detalheComo funciona o fluxo de trabalhoO que cada etapa obtém, a decisão GEO que permite tomar e o prompt completo.6 min de leitura5 secções

Cada página com ocorrências de crawlers, mas sem citações observadas, levanta uma questão: cabe à engenharia, à equipa editorial ou, por enquanto, a ninguém? Este fluxo de trabalho mantém quatro camadas de dados separadas e responde à questão página a página, com uma regra que para no primeiro critério satisfeito.

O problema GEO que resolve

Há dois atalhos indevidos: observado significa processado; citado significa clicado. get_crawler_activity baseia-se num estado resumido dos bots, não em eventos HTTP guardados, e deixa isso explícito. Para cada bot, devolve a data da primeira e da última observação e o total de ocorrências de todo o histórico, com uma nota de que os eventos brutos não estão disponíveis. Não há códigos de estado, conteúdo das respostas, linhas por página nem parâmetro de período. Uma sessão vinda da IA também nunca identifica a citação anterior ao clique.

Os períodos diferem por definição, outra fonte discreta de cálculos errados. Devido ao atraso dos dados do GA4, o intervalo de get_referrer_analytics termina um dia antes de hoje. Os intervalos de get_search_console_metrics e get_bing_metrics terminam hoje.

As etapas do fluxo de trabalho

1. Verifique primeiro o estado da ligação. get_crawler_activity devolve o indicador de ligação e todos os bots observados, com datas da primeira e da última observação e o total histórico de ocorrências. Se a última observação de um bot antecede o período escolhido, não existe observação desse bot no período atual nesta camada, independentemente do que aparece na tabela de páginas.

2. Ordene as páginas por atividade observada dos crawlers. get_page_performance devolve ocorrências por caminho, até cinco bots principais por caminho e um grupo explícito para a cauda longa. O limite de linhas é 100. Compare o número de linhas devolvidas com o total de grupos de páginas antes de interpretar uma ausência como zero.

3. Acrescente o estado técnico por página. get_site_diagnostics devolve as pontuações técnica, de conteúdo, AEO e de desempenho por página monitorizada, o número de problemas em aberto por gravidade e a data e hora da última auditoria, começando pelos piores resultados. A ferramenta só lê páginas monitorizadas. Um caminho percorrido por crawlers que nunca tenha sido registado não aparece.

4. Acrescente evidências de citação e tráfego de referência. get_page_presence inclui o estado e o número de citações por página; get_source_urls recupera os URLs citados exatos; get_referrer_analytics devolve sessões vindas da IA e as principais páginas de destino. Use o mesmo período de evidência de 30 dias nas duas ferramentas de citações. Devido ao atraso do GA4, o período de analytics pode terminar um dia antes.

5. Cruze os dados e atribua responsabilidades. Faça a correspondência por uma chave normalizada de domínio e caminho. Identifique cada ausência com rigor: não devolvido, não observado, explicitamente não citado ou não auditado.

O que uma execução realmente devolve

Uma execução válida devolve quatro conjuntos separados: observações dos bots, diagnósticos das páginas monitorizadas, evidências de citação das páginas no período solicitado e sessões vindas da IA no período de analytics. O número de linhas pode variar mesmo quando todas as chamadas funcionam.

Ainda assim, seria errado ler as linhas como um funil. Uma página monitorizada pode não ser citada sem sequer ser elegível para citação. Uma sessão de referência nunca identifica a citação que a precedeu. A linha que exige ação é um URL observado numa camada e ausente do inventário operacional seguinte, com a ausência descrita com precisão.

Como aproveitar os resultados

Primeiro, uma condição; depois, uma regra de encaminhamento.

A condição: se qualquer indicador connected vier como false, a lista de tarefas contém exatamente um item, ligar essa integração. Uma tabela vazia de uma fonte desligada não constitui um resultado. Outras duas ausências também não são zeros: uma página fora da lista das principais páginas de destino pode ter ficado excluída de uma lista truncada; uma página fora da tabela de crawlers pode estar no grupo da cauda longa. Nunca divida as citações pelas ocorrências dos crawlers, mesmo quando os períodos pedidos coincidem. Os conjuntos observados e os sistemas de recolha são diferentes.

Depois, aplique a regra de encaminhamento a cada página com ocorrências de crawlers e sem citação. Pare no primeiro critério satisfeito. Se a página estiver completamente ausente de get_site_diagnostics, não é monitorizada: registe-a e volte a executar a análise. Trata-se de um URL sem gestão, não de um diagnóstico. Se a data da última auditoria e as pontuações forem null, a página nunca foi auditada: agende a auditoria e pare. Um ou mais problemas CRITICAL em aberto exigem um pedido à engenharia, não um briefing editorial. Se houver pontuações e nenhum problema CRITICAL em aberto, o conteúdo e a autoridade passam para a equipa editorial.

O prompt completo

Quero uma auditoria da observação dos sinais de IA por página. Se monitorizar várias marcas, pergunta qual devo usar. Mantém os pedidos dos crawlers, o estado técnico, as citações e o tráfego de referência da IA em quatro camadas separadas, nunca como um funil. Usa os últimos 30 dias. Pergunta-me primeiro qual é o meu domínio canónico e quais são os aliases de URL, pois nenhuma ferramenta sabe que domínios me pertencem.

1. Chama get_crawler_activity. Indica o valor de connected e cada bot com firstSeen, lastSeen e as ocorrências de todo o histórico. Descreve o resultado como uma visão histórica do estado dos bots, sem eventos brutos nem códigos de estado, e assinala cada bot cujo lastSeen antecede o período.
2. Chama get_page_performance para 30 dias. Indica connected, o intervalo de datas devolvido, as linhas de páginas com ocorrências e principais bots, e o grupo da cauda longa. Compara as linhas devolvidas com o total de grupos de páginas e assinala qualquer truncagem. Se a ligação estiver ativa, mas não houver linhas de páginas, indica-o em vez de concluíres que não houve atividade de crawlers.
3. Chama get_site_diagnostics. Devolve cada página monitorizada com as suas quatro pontuações, o número de problemas por gravidade e a data e hora da última auditoria. Trata uma pontuação null como não auditada, nunca como o número zero.
4. Chama get_page_presence com period 30 e depois get_source_urls com period 30 quando for necessário o URL exato de uma citação. Mantém em ambas as chamadas os filtros de tema, etiqueta, fornecedor ou etapa do funil. Usa NOT_CITED apenas quando a ferramenta devolver esse valor. Nunca dividas citações por ocorrências de crawlers.
5. Chama get_referrer_analytics para 30 dias e, se houver ligação, get_search_console_metrics e get_bing_metrics por página. Mostra todos os intervalos de datas devolvidos e assinala que o intervalo do GA4 termina um dia antes.

Se qualquer indicador connected for false, para e devolve uma única tarefa: ligar essa integração.

Caso contrário, cria a matriz com o domínio canónico e o caminho normalizado. Encaminha cada página percorrida por crawlers e sem citação, parando no primeiro critério satisfeito. Se faltar nos diagnósticos do site, regista-a como página monitorizada. Se a data da última auditoria e as pontuações forem null, agenda a auditoria. Um problema CRITICAL em aberto exige um pedido à engenharia. Nos restantes casos, é trabalho editorial. Inclui as evidências e o responsável em cada linha.
Ponha o fluxo de trabalho em prática

Execute este playbook com os seus próprios dados de visibilidade em IA.

Ligue o Qwairy ao Claude, obtenha os sinais exatos do fluxo de trabalho e saia com um resultado pronto a executar.