Ocho preguntas para hacerle a tu agencia actual sobre GEO
Tu agencia nunca te ha hablado de GEO. Antes de cambiar a nadie, hazle estas ocho preguntas, empezando por si tu sitio deja pasar a los rastreadores de IA.
Si tu agencia nunca te ha hablado de GEO, la forma más rápida de saber si eso importa es hacerle ocho preguntas concretas. Empieza por la más simple: ¿tu sitio deja pasar a los rastreadores de IA? Un sitio puede rankear perfecto en Google y seguir siendo invisible dentro de ChatGPT por algo tan doméstico como una línea en el robots.txt. Abajo están las preguntas que nosotros le mandaríamos a un ejecutivo de cuenta, y cómo suena una buena respuesta.
Nada de esto asume que tu agencia trabaja mal. A la mayoría la contrataron para ganar posiciones en Google y las siguen ganando. La pregunta es si alguien está viendo la otra superficie: esa donde la respuesta aparece arriba de los enlaces.
¿Los rastreadores de IA tienen permiso de entrar a nuestro sitio?
Va primero porque es binaria, se revisa en dos minutos y, si está mal, tumba todo lo demás en silencio. Los motores que responden preguntas no usan Googlebot: cada empresa opera sus propios agentes y los separa por función.
- OpenAI usa
OAI-SearchBotpara que los sitios aparezcan en las funciones de búsqueda de ChatGPT,GPTBotpara entrenar modelos yChatGPT-Userpara las páginas que consulta en vivo cuando alguien pregunta algo (documentación de rastreadores de OpenAI). - Anthropic usa
ClaudeBot,Claude-UseryClaude-SearchBot, y se controlan por separado desde elrobots.txt(documentación de rastreadores de Anthropic). - Perplexity usa
PerplexityBotpara mostrar y enlazar sitios en sus resultados, yPerplexity-Userpara las consultas que hace un usuario en vivo (documentación de rastreadores de Perplexity).
Fíjate en lo que dice la propia documentación de OpenAI sobre el agente de búsqueda: los sitios excluidos de OAI-SearchBot no aparecen en las respuestas de búsqueda de ChatGPT. Eso es un interruptor, no una estrategia. Muchos sitios bloquearon estos agentes durante la ola de consejos de "bloquea a los scrapers de IA" de 2023 y 2024, y nadie volvió a revisar la decisión. Pídele a tu agencia que te lea el robots.txt actual, línea por línea.
¿Tenemos bloqueado Google-Extended y sabemos qué nos cuesta?
Esta merece pregunta aparte porque el intercambio es sutil, y ahí se nota qué tan bien piensa una agencia. Google-Extended es el control con el que un editor decide si el contenido que Google rastrea puede usarse para entrenar los modelos Gemini y para grounding, es decir, alimentar con contenido del índice de búsqueda para mejorar la precisión de las respuestas. La documentación de Google es explícita: no afecta la inclusión del sitio en el buscador ni se usa como señal de posicionamiento (documentación de rastreadores de Google).
O sea: bloquearlo no te cuesta nada en Google Search y sí te puede costar presencia en las respuestas de Gemini. Es una decisión de negocio con argumentos de los dos lados. La respuesta equivocada no es "lo bloqueamos"; la respuesta equivocada es "no sabemos".
¿En qué motores nos mencionan hoy y a quién nombran en nuestro lugar?
Nadie mejora lo que no ha medido. Una respuesta seria se parece a esto: un conjunto fijo de preguntas de tu categoría, hechas en sesiones limpias en ChatGPT, Perplexity, Gemini y Claude, registrando tres cosas cada vez. Si te mencionaron, si te citaron con enlace y a quién nombraron en tu lugar.
Esa última columna es la más útil. Las marcas que salen cuando un comprador pregunta por tu categoría son tu competencia real por la demanda que llega desde la IA, y muy seguido no son los competidores que traes en la lámina trimestral.
Si tu agencia te propone un plan de contenido antes de enseñarte esa foto, está adivinando.
¿Cómo van a medir el tráfico que llega desde respuestas de IA?
Pídeles que abran el reporte enfrente de ti. En GA4 vive en adquisición de tráfico, segmentado por origen de la sesión (documentación de Google Analytics), y los dominios que vale la pena vigilar son chatgpt.com, perplexity.ai, gemini.google.com, claude.ai y copilot.microsoft.com.
Hay dos respuestas que te deben preocupar. Una es la agencia que no sabe nombrar los orígenes que buscaría: eso significa que nadie lo está midiendo. La otra es la que te reporta todo junto como un número de "referral", que te confirma que el canal existe pero no te dice sobre qué motor trabajar.
¿Nuestro contenido responde la pregunta en el primer párrafo?
Las respuestas generativas cambiaron para qué sirve la parte de arriba de una página. Google ya coloca resúmenes generados con IA arriba de la lista clásica de enlaces en muchas búsquedas (anuncio de Google sobre AI Overviews), y el bloque que un modelo levanta suele ser corto, autocontenido y directo.
Abre cualquier artículo que tu agencia haya publicado este trimestre y revisa tres cosas:
- ¿El primer párrafo responde la pregunta del título, o arranca con historia de la empresa y contexto de industria?
- ¿Los encabezados están escritos como preguntas que un comprador realmente escribiría?
- ¿Cada afirmación no obvia trae un enlace a una fuente que se pueda abrir?
La tercera es donde se cae casi todo el contenido de agencia, incluido el nuestro antes de que apretáramos nuestras propias reglas. Un dato sin fuente se lee como no verificable, y un texto no verificable es mala base para construir una respuesta.
¿Qué estamos haciendo con datos estructurados?
GEO no es solo redacción. Los motores se apoyan en señales legibles por máquina: datos estructurados en JSON-LD para que la página diga con claridad qué es y quién la publica (documentación de datos estructurados de Google), y consistencia de entidades: el mismo nombre de organización, la misma dirección y la misma descripción en todos lados, con vocabulario como schema.org/Organization.
No necesitas entender la implementación. Necesitas confirmar que alguien de su lado sí la entiende, y que está en un plan con fecha.
¿Qué opinan de llms.txt?
Esta pregunta calibra más de lo que técnicamente pide. llms.txt es una propuesta publicada por Jeremy Howard el 3 de septiembre de 2024: un archivo markdown en la raíz del dominio que le da a los modelos un mapa curado del sitio, pensado para caber en su ventana de contexto (la propuesta llms.txt). Sigue siendo una propuesta abierta de la comunidad; ningún motor grande ha anunciado que la trate como requisito para citar o posicionar.
Por eso las dos respuestas extremas te dicen algo. Una agencia que te vende llms.txt como arreglo obligatorio está prometiendo de más sobre algo no comprobado. Una que nunca lo ha oído no está leyendo el terreno por el que te va a cobrar. La respuesta que quieres está en medio: saben qué es, tienen una postura sobre si vale la hora que toma, y te la pueden explicar.
¿Quién escribe el inglés?
Si vendes en México y al mercado hispano de Estados Unidos, tu contenido compite por citas en dos idiomas. Traducir una versión para producir la otra deja un texto de segunda mano que un lector nativo detecta en la primera línea. Pregunta directo quién escribe cada idioma, y si las dos versiones se escriben o se convierten.
Este punto lo desarrollamos, junto con el resto de la evaluación, en nuestra guía para elegir una agencia de GEO, que es la pieza hermana de esta para cuando la conversación pasa de arreglar a reemplazar.
¿Cómo suena una buena respuesta?
Una buena respuesta es específica y en partes incómoda. Suena así: esto dice hoy tu robots.txt, aquí te mencionan y aquí no, este es el reporte que daríamos seguimiento, esto arreglaríamos primero y esto cuesta más o menos. No suena a promesa de que vas a aparecer en ChatGPT: nadie controla eso, y quien lo asegura está describiendo un resultado que no puede entregar.
Si la conversación se atora, consigue la foto por tu cuenta primero. Nosotros la hacemos sin costo: un diagnóstico de 30 minutos que te muestra, con capturas, qué responde cada motor cuando preguntan por tu categoría. Llévasela a tu agencia como línea base. Una agencia buena la va a agradecer.