Qwairy
Playbook de Preparación técnica

Examine el estado técnico GEO antes del próximo despliegue de su sitio

Examine los últimos estados técnicos registrados por Qwairy, los bloqueos de rastreadores, los problemas de páginas y las pruebas de citación, y convierta después las conclusiones en un backlog GEO priorizado y comprobable.
ejecución guiada de 10 minPrincipianteActualizado el 23 ago 2026
Esquema del flujo de trabajo
v1.0

Resultado esperado

Una auditoría técnica lista para el despliegue, con las correcciones de rastreo y citación priorizadas

  1. Comprobar los accesos

  2. Probar las páginas clave

  3. Clasificar los riesgos

  4. Preparar el despliegue

Ejecución rápida

Ejecute el flujo de trabajo con un solo clic

No hay nada que rellenar: el prompt se ejecuta tal cual y le pide lo que aún necesite.
Requiere el conector MCP de Qwairy

«Ejecutar en Claude» y «Ejecutar en ChatGPT» abren una nueva pestaña del navegador con el prompt ya escrito. No se envía nada hasta que usted lo confirme.

Lista de comprobaciónRevise los datos de entrada y los entregablesPúblico, herramientas, resultado esperado y requisitos previos.
Ideal para
Equipos SEODesarrolladoresEquipos web
Usted obtiene
  • Auditoría del acceso de los rastreadores de IA
  • Revisión de robots.txt y llms.txt
  • Mapa de la elegibilidad para ser citado
  • Lista de correcciones previas al despliegue
Antes de empezar
  • Un plan Qwairy Starter o superior con monitorización activa
  • Claude o ChatGPT con el conector MCP de Qwairy activado
  • Datos de monitorización recientes suficientes sobre el tema elegido
Desglose del playbookCómo funciona el flujo de trabajoQué extrae cada paso, la decisión GEO que permite tomar y el prompt completo.6 min de lectura5 secciones

Dos listas describen su sitio y rara vez coinciden: las páginas que eligió monitorizar y las URL que los motores citan realmente. Compárelas y lea después la fotografía técnica, porque la comparación determina qué parte de ella importa. Nada de esto requiere una integración de registros ni de analítica, así que, una vez conectados sus registros de rastreadores y GA4, la guía de observabilidad determina de quién es el problema de cada página rastreada pero no citada.

El problema GEO que resuelve

Fusionar las dos listas es lo que el producto ya hace. get_page_presence etiqueta cada página como WORKING a partir de tres citaciones, NEEDS_ATTENTION con una o dos, NOT_CITED con cero y DISCOVERED para una ruta citada que nunca formó parte del conjunto monitorizado. Lea DISCOVERED primero: los motores citaron algo que nadie registró, así que tampoco nadie lo mantiene.

La unión es donde esto se tuerce. get_page_presence agrupa por ruta normalizada; get_source_urls agrupa por la URL bruta exacta, y su filtro de dominio usa una igualdad exacta de cadenas, de modo que un dominio raíz y su host www son para él valores sin relación. Una comparación descuidada fabrica carencias que solo son diferencias de mayúsculas y de nombres de host.

El estado técnico llega después y responde a una pregunta: ¿hay algo bloqueado? Un robots.txt ajustado para Google puede seguir siendo inadecuado para la recuperación de información, porque OpenAI distingue OAI-SearchBot, que rige la inclusión en los resultados de búsqueda de ChatGPT, de GPTBot, que rige el uso para el entrenamiento.

Las etapas del flujo de trabajo

1. Construya los dos inventarios. get_page_presence devuelve la vista fusionada de las páginas con el número de citaciones, el número de preguntas distintas, la posición media y los proveedores. get_source_urls, filtrado sobre su cadena de dominio, clasifica las URL exactas citadas. Aplique a ambos el mismo periodo de pruebas y los mismos filtros opcionales de proveedor, tema, etiqueta o etapa del embudo. Ninguno devuelve el texto de los prompts.

2. Compárelos con una clave normalizada. Ponga el host en minúsculas, quite www, elimine los parámetros de consulta y el fragmento, y suprima la barra final. Conserve la URL bruta junto a cada clave, para que una separación entre nombres de host siga siendo visible en lugar de leerse como una carencia.

3. Lea la fotografía técnica una sola vez. get_technical_status devuelve los estados registrados de robots.txt, llms.txt y del sitemap, una puntuación de preparación para la IA, los identificadores de rastreadores marcados como Disallowed, el número de problemas por gravedad y los problemas de páginas abiertos, cada uno con su URL. Es un análisis registrado, no un rastreo en directo.

4. Ordene el backlog según la regla siguiente, no según el nivel de esfuerzo.

Qué devuelve realmente una ejecución

Una ejecución válida devuelve cada página monitorizada, además de cualquier ruta citada pero no monitorizada observada dentro del periodo de pruebas solicitado. Las filas DISCOVERED pueden superar el mismo umbral de tres citaciones que las páginas monitorizadas; las filas NOT_CITED pueden ser numerosas sin representar defectos técnicos.

Esa distribución es lo que hace que la regla del backlog importe más que el recuento bruto. Una página DISCOVERED por encima del umbral abre la lista porque ya obtiene citaciones sin estar gestionada. Una página NOT_CITED solo justifica un trabajo técnico cuando el análisis técnico registrado incluye además un problema que la afecta.

Cómo aprovechar los resultados

Tres estados vacíos se parecen sin ser equivalentes. Un bloque técnico null significa que la marca nunca se analizó, mientras que un array blockedCrawlers vacío significa que sí se analizó y que nada está prohibido. Y una marca sin dominio configurado devuelve cero páginas y cero estadísticas, lo que no describe un sitio sano. Resuelva esos casos antes de ordenar nada.

Trabaje después la lista de arriba abajo y resista la tentación de reordenarla.

Los identificadores bloqueados van primero: un blockedCrawlers no vacío es un defecto de acceso a escala de todo el sitio que prevalece sobre cualquier elemento de página, porque ningún trabajo de contenido permite rodearlo. Después, cada página DISCOVERED con tres citaciones o más se incorpora al conjunto monitorizado en este ciclo, ya que obtiene citaciones sin estar gestionada. Vienen después las páginas monitorizadas NOT_CITED que figuran también en la lista de problemas abiertos devuelta, el único subconjunto acompañado de pruebas técnicas. Después, las páginas NOT_CITED restantes, una cuestión editorial que no debería llegar al equipo técnico. Deje NEEDS_ATTENTION tal cual: una o dos citaciones equivalen a una sola respuesta que se mueve, y se moverá de nuevo sin usted.

El prompt completo

Quiero comparar mis páginas monitorizadas con las URL que los motores de IA citan realmente en los últimos 30 días. Lista las marcas que monitorizo y pregunta cuál usar si hay más de una.

1. Ejecuta get_page_presence con period 30. Devuelve cada página con su estado, WORKING, NEEDS_ATTENTION, NOT_CITED o DISCOVERED, además de su número de citaciones, su número de preguntas distintas, su posición media y sus proveedores. No afirmes que la herramienta devuelve el texto de los prompts.
2. Ejecuta get_source_urls con mi dominio y period 30, conservando todos los filtros de proveedor, tema, etiqueta o etapa del embudo del paso 1. Su filtro de dominio exige una coincidencia exacta de cadena, así que, si el resultado vuelve vacío, inténtalo de nuevo con el otro host antes de concluir que no existe ninguna citación en ese alcance.
3. Compara ambos con una clave normalizada: host en minúsculas sin www, ruta en minúsculas, parámetros de consulta y fragmento eliminados, barra final suprimida. Conserva la URL bruta junto a cada clave. Señala las páginas monitorizadas sin citación y las URL citadas sin página monitorizada. Califica toda pareja que difiera únicamente por el host o por las mayúsculas como un artefacto de unión, no como una carencia.
4. Ejecuta get_technical_status. Presenta los estados registrados de robots.txt, llms.txt y del sitemap, la puntuación de preparación para la IA, los identificadores Disallowed, el número de problemas por gravedad y los problemas de páginas abiertos devueltos. Describe el resultado como un análisis registrado, no como un rastreo en directo. Si el bloque técnico es null, indica que la marca nunca se analizó en lugar de presentar un resultado sano.
5. Produce un backlog ordenado: primero los identificadores Disallowed como un único elemento a escala de todo el sitio; después las páginas DISCOVERED con tres citaciones o más; después las páginas NOT_CITED presentes en la lista de problemas devuelta; después las páginas NOT_CITED restantes como trabajo editorial; y por último NEEDS_ATTENTION sin acción este ciclo. Da a cada elemento su línea de pruebas y una etapa de validación. Cuando un nivel esté vacío, indícalo y sigue adelante.
Ponga el flujo de trabajo en marcha

Ejecute este playbook con sus propios datos de visibilidad en la IA.

Conecte Qwairy a Claude, extraiga las señales exactas del flujo de trabajo y obtenga un resultado listo para ejecutar.