Cómo hacer que tu web sea legible para la búsqueda con IA
Lista práctica para aparecer y ser citado en Google, ChatGPT, Claude y Perplexity: acceso de rastreadores, indexación, contenido con respuestas y datos estructurados.

Qué lee realmente la búsqueda con IA
Los asistentes que responden citando fuentes, como la búsqueda de ChatGPT, Claude, Perplexity y las funciones de IA de Google, siguen dependiendo de la web abierta. Descargan páginas, deciden de qué trata cada una y citan o enlazan las que responden con más claridad.
Por eso la visibilidad en IA es sobre todo un problema técnico y editorial, no un truco nuevo. Si un rastreador no puede llegar a una página, no sabe cuál es la URL real o no encuentra una respuesta directa en el texto, es poco probable que la cite, por buena que sea la empresa detrás.
Esta es la lista que usamos en nuestro propio sitio. Nada en ella garantiza posiciones ni citas; elimina los motivos por los que una página se pasaría por alto.
1. Deja entrar a los rastreadores adecuados
Empieza por robots.txt. Muchos sitios bloquean rastreadores de IA por accidente: una regla general copiada de una plantilla, un ajuste de pruebas que llegó a producción o un plugin de seguridad.
Cada rastreador cumple una función distinta, así que decide con criterio:
- Los rastreadores de búsqueda y respuesta, como OAI-SearchBot, Claude-SearchBot y PerplexityBot, descargan páginas para mostrarlas y citarlas en respuestas.
- Los agentes activados por el usuario, como ChatGPT-User y Claude-User, recuperan una página cuando alguien pregunta por ella.
- Los rastreadores de entrenamiento, como GPTBot y ClaudeBot, recopilan contenido para entrenar modelos. Google-Extended controla si Google puede usar el contenido para Gemini; no afecta a la Búsqueda de Google.
Bloquear el entrenamiento y permitir la búsqueda es una opción legítima. Bloquearlo todo y esperar ser citado, no.
2. Haz que cada página sea indexable e inequívoca
Un rastreador puede llegar a una página y aun así recibir la orden de ignorarla. Comprueba si hay noindex en la etiqueta meta robots y en la cabecera X-Robots-Tag; ambas se olvidan con facilidad tras un lanzamiento.
Cada página debe declarar una única URL canónica. En sitios multilingües, los enlaces hreflang indican qué versión de idioma mostrar, y una entrada x-default cubre al resto. El sitemap XML debe incluir solo URL canónicas e indexables que devuelvan HTTP 200.
3. Escribe respuestas, no eslóganes
Las respuestas de IA se construyen con fragmentos. Un fragmento es útil cuando responde por sí solo a una pregunta concreta, sin que el lector necesite el resto de la página.
- Usa encabezados que coincidan con las preguntas que hace la gente.
- Da la respuesta directa en las primeras una o dos frases de cada sección y después añade detalle.
- Sé concreto: nombra entregables, pasos, límites y lo que no está incluido.
- Mantén las afirmaciones verificables. Los superlativos vagos rara vez se citan; las afirmaciones concretas, sí.
Esto también es, simplemente, buena escritura para personas, y esa es la idea: la misma claridad sirve a ambos públicos.
4. Añade datos estructurados que coincidan con la página
Los datos estructurados (JSON-LD con tipos de schema.org) expresan hechos sobre una página de forma que las máquinas los lean sin adivinar: que es una Organización, un Servicio, un Artículo con fecha de publicación o una lista de preguntas y respuestas.
Marca solo lo que es visible en la página y mantenlo exacto. Unos datos estructurados que contradicen el contenido son peores que no tenerlos.
5. Considera un archivo llms.txt
llms.txt es un breve archivo Markdown en la raíz del sitio que resume qué hace la organización y enlaza sus páginas más importantes. Es una convención emergente, no un estándar, y ningún asistente está obligado a leerlo.
Mantenerlo cuesta poco y ofrece un resumen limpio y legible a cualquier herramienta que lo lea. Trátalo como un índice útil, no como una palanca de posicionamiento.
6. Revísalo cada semana
La visibilidad técnica se rompe en silencio. Un despliegue cambia un ajuste, una plantilla pierde la etiqueta canónica, una página nueva sale sin descripción. Nadie lo nota hasta que cae el tráfico.
En nuestro propio sitio ejecutamos una auditoría automática semanal que revisa el acceso de rastreadores, el sitemap, llms.txt, los códigos de estado, los tiempos de respuesta, títulos, descripciones, noindex, etiquetas canónicas y hreflang, encabezados y datos estructurados, y envía por correo un informe con puntuación. El objetivo es detectar regresiones en días, no en meses.
7. Mantén las páginas rápidas y legibles sin JavaScript
Muchos rastreadores, incluidos varios de IA, leen el HTML que envía el servidor y no ejecutan JavaScript de forma fiable. Si el texto principal, los encabezados o los enlaces solo aparecen después de cargar los scripts, algunos sistemas verán una página vacía.
Sirve el contenido importante en el HTML inicial, mantén las páginas rápidas y no escondas las respuestas detrás de pestañas, ventanas emergentes o scroll infinito. Una página que carga rápido y se lee bien con los scripts desactivados es más fácil de procesar para cualquier rastreador.
8. Sé coherente sobre quién eres
Los sistemas de IA intentan averiguar a qué organización pertenece una página y si es una fuente fiable sobre el tema. Pónselo fácil:
- Usa el mismo nombre de empresa, descripción y datos de contacto en todo el sitio.
- Mantén una página Sobre nosotros clara que diga qué haces, para quién y qué no haces.
- Añade datos estructurados de Organization con tu nombre, sitio web y logotipo.
- Asegúrate de que los perfiles externos que controlas te describan del mismo modo.
Las descripciones incoherentes dificultan que cualquier sistema relacione tus páginas con tu organización.
Cómo medir la visibilidad en IA
Todavía no existe un único panel para las citas de IA, así que combina varias señales:
- Google Search Console y Bing Webmaster Tools muestran problemas de indexación e impresiones de búsqueda por página.
- El tráfico de referencia de asistentes de IA, como las visitas desde chatgpt.com o perplexity.ai, aparece en la mayoría de herramientas de analítica.
- Un conjunto fijo de preguntas planteado cada mes a los principales asistentes muestra si te mencionan y cómo. Las respuestas varían entre intentos, así que fíjate en tendencias, no en resultados aislados.
Anota qué cambias y cuándo, para poder relacionar las mejoras con el trabajo que las causó.
Errores comunes que conviene revisar primero
- Una etiqueta noindex o una regla Disallow que quedó del entorno de pruebas.
- Un ajuste de CDN o de seguridad que bloquea los rastreadores de IA aunque robots.txt los permita. Algunos servicios ya lo ofrecen y otros lo activan por defecto.
- Versiones de idioma de la misma página sin hreflang, que compiten entre sí.
- Respuestas importantes disponibles solo dentro de imágenes, PDF o scripts.
- Metadescripciones escritas como eslóganes en lugar de como resumen de la página.
Cada uno se corrige rápido una vez detectado. Lo difícil es notarlos, y por eso una revisión periódica importa más que una auditoría puntual.
Un plan de 30 días
Si empiezas desde cero, este orden prioriza las correcciones más importantes:
- Semana 1: revisa robots.txt, los ajustes de CDN y seguridad, las etiquetas noindex, las URL canónicas y el sitemap. Corrige todo lo que bloquee o confunda a los rastreadores.
- Semana 2: enumera las diez preguntas que más hacen tus clientes y comprueba si tu sitio responde cada una con claridad en una página concreta.
- Semana 3: reescribe o crea las páginas que responden a esas preguntas, con respuestas directas en las primeras líneas, y añade datos estructurados precisos.
- Semana 4: configura Search Console y Bing Webmaster Tools, registra una línea base de respuestas de IA para tu conjunto de preguntas y programa una revisión técnica semanal.
Después del primer mes, el trabajo se vuelve rutina: sigue respondiendo bien a nuevas preguntas y evita que se rompan los fundamentos técnicos.
Preguntas frecuentes
¿El GEO es distinto del SEO? En gran parte es la misma base, con más énfasis en respuestas claras y citables y en el acceso de los rastreadores de IA. Un sitio fácil de entender para los buscadores suele serlo también para los asistentes de IA.
¿Debemos bloquear los rastreadores de entrenamiento? Es una decisión de negocio. Bloquearlos no detiene a los rastreadores de búsqueda y respuesta, siempre que los permitas por separado.
¿llms.txt mejora el posicionamiento? No hay pruebas de ello. Es un resumen de bajo coste que algunas herramientas pueden leer.
¿Cuándo veremos resultados? Las correcciones técnicas surten efecto a medida que se vuelven a rastrear las páginas, lo que puede llevar de días a semanas. Ser citado con más frecuencia depende de la calidad del contenido y de la competencia, y nunca está garantizado.
Lo que esto no hace
Un sitio técnicamente limpio es la base, no el resultado. Que una página sea citada sigue dependiendo de si es la respuesta más útil a la pregunta. Eso es trabajo editorial: entender qué pregunta tu público y responderlo mejor que nadie.
Si quieres revisar tu sitio con esta lista, consulta nuestro servicio de SEO y visibilidad en búsqueda con IA.
Lecturas relacionadas
Una grabación, muchas piezas útiles: cómo reutilizarla