Cómo optimizar tu sitio web para motores de respuesta

Retrato de Louise Linehan

Por Louise Linehan

Especialista en marketing de contenidos en Ahrefs

Revisado por

Tu contenido puede ser excelente y aun así no aparecer nunca en una respuesta de IA.

Toda táctica de optimización para IA da por hecho que los sistemas de IA pueden llegar a tus páginas, leerlas y averiguar quién eres. Nada de eso está garantizado. Aproximadamente el 5,89 % de los sitios web bloquea GPTBot directamente, ChatGPT parece abandonar las páginas que tardan más de unos dos segundos en responder, y la mayoría de los rastreadores de IA no ejecutan JavaScript en absoluto.

La buena noticia es que esta es la parte más fácil de corregir del AEO. Nada de esto te consigue una cita por sí solo, pero cualquiera de estos problemas puede hacer que, sin darte cuenta, pierdas todas las citas que de otro modo habrías conseguido.

Sigue aprendiendo en YouTube


Parte 1

No bloquees los rastreadores de IA en robots.txt

Ninguno de los consejos de esta guía sirve si los rastreadores de IA no pueden leer tus páginas. Las páginas bloqueadas no pueden citarse, y a menudo ocurre por accidente.

Analizamos unos 140 millones de sitios web y descubrimos que GPTBot es ahora el bot de IA más bloqueado (5,89 % de los sitios), con ClaudeBot muy cerca.

Cloudflare bloquea las plataformas de IA de forma predeterminada, así que comprueba que tu CDN no te haya dejado fuera sin avisar.

Diagrama: un archivo robots.txt bloquea a un rastreador, dibujado como una araña rosa que sostiene una “a” naranja, de modo que el rastreador no puede llegar a la página web y la página no puede citarse en la búsqueda con IA.

“Permitir rastreadores de IA” no es una sola decisión, porque cada plataforma ejecuta varios bots que hacen trabajos distintos.

Solo OpenAI ejecuta tres:

  • GPTBot recopila contenido para el entrenamiento
  • OAI-SearchBot crea el índice de búsqueda del que ChatGPT obtiene resultados
  • ChatGPT-User recupera una página en directo cuando alguien pregunta por ella a mitad de la conversación

Las compensaciones son distintas en cada caso. Bloquear GPTBot evita que tu contenido entre en los datos de entrenamiento del siguiente modelo, que es la decisión que los editores suelen sopesar. Bloquear OAI-SearchBot te elimina del índice en el que busca ChatGPT, que es lo que hoy te cuesta citas y tráfico de referencia. Muchos sitios bloquean el segundo por accidente cuando en realidad pretendían bloquear solo el primero.

La forma más rápida de ver en qué punto estás es usar una herramienta como AI Crawler Access Checker, que lee tu robots.txt y te dice qué rastreadores tienen permitido el acceso.

Resultados del Comprobador de acceso de rastreadores de IA para ahrefs.com, cargados desde ahrefs.com/robots.txt. Los 27 rastreadores enumerados, desde Amazonbot hasta anthropic-ai, aparecen como permitidos, y las entradas de GPTBot y OpenAI están marcadas.

Para ver qué bots aparecen de verdad, en lugar de cuáles están permitidos, consulta Bot Analytics de Ahrefs. Hace un seguimiento de las visitas en 12 categorías de bots, incluido un filtro de IA específico, usando datos del lado del servidor a través de Cloudflare, así que funciona sin añadir JavaScript a tu sitio.


Parte 2

No ocultes contenido tras JavaScript pesado

Los rastreadores de IA suelen leer el HTML sin procesar y, en su mayoría, no renderizan JavaScript como lo haría un navegador.

Eso significa que cualquier cosa que solo aparezca después de JS del lado del cliente puede ser invisible para ellos.

Ve sobre seguro y usa renderizado del lado del servidor para darle a tu página la mejor oportunidad de visibilidad en IA.


Parte 3

Mejora la velocidad de tu página

Las páginas que cargan lento pueden afectar negativamente a tu rendimiento en la búsqueda tradicional, pero, si acaso, parece tener una penalización aún mayor en los motores de respuestas. La velocidad de página parece ayudar a decidir si llegas a entrar siquiera en la ventana de contexto del modelo.1

Comprueba la velocidad de página (conocida como tiempo hasta el primer byte) en Site Audit:

1
Ve al informe de Page Explorer
2
Configura un filtro Advanced para: Tiempo hasta el primer byte (ms) > 200
3
Luego ordena por tráfico orgánico para encontrar tu contenido más importante que quizá necesite optimización
Explorador de páginas de Site Audit de Ahrefs con insignias numeradas del 1 al 3: en el encabezado del explorador de páginas, en un filtro avanzado donde el tiempo hasta el primer byte (ms) actual es mayor que 200 y en la columna de Tráfico orgánico. El filtro devuelve 162 resultados.

Parte 4

No te molestes con llms.txt

llms.txt es un estándar propuesto para un archivo Markdown en tu dominio raíz (p. ej., website.com/llms.txt) que indica a los LLM dónde se encuentra tu mejor contenido: documentación, políticas, taxonomías de producto. En principio, es como robots.txt para modelos de lenguaje.

Pero en la práctica, ningún proveedor importante de LLM se ha comprometido a leerla. Ni OpenAI, ni Anthropic, ni Google.

Comprobamos qué pasa realmente cuando un sitio web añade llms.txt. En 137.000 dominios que usan Ahrefs Web Analytics, el 28% publica un archivo llms.txt. De los ~38.000 con uno válido, el 97% recibió cero solicitudes para él en el mes que medimos.

El 97 % de los archivos llms.txt nunca se solicitan

Estudio de Ahrefs de 137.000 dominios usando Ahrefs Web Analytics.

Gráfico de barras de dominios: 137K en total, 38K con un llms.txt válido y 1,1K cuyo archivo recibió alguna solicitud. Un corchete sobre la última barra marca que el 97 % de los archivos no recibe ninguna solicitud.

Del pequeño porcentaje de archivos que sí se recuperaron, el 96 % de las solicitudes provenía de bots. Slackbot, el bot de vista previa de links, obtuvo llms.txt con más frecuencia que PerplexityBot. En resumen, los motores de búsqueda de IA más importantes no parecen usarlo.

Google ha sido explícito al respecto. Su guía sobre optimización para funciones de IA generativa tiene una sección literalmente titulada “mythbusting” que dice a los propietarios de sitios que no hacen falta archivos legibles por máquinas como llms.txt para aparecer en la búsqueda con IA generativa. John Mueller fue más allá y lo comparó con la antigua metaetiqueta de keywords:

Comillas

Que yo sepa, ninguno de los servicios de IA ha dicho que use LLMs.TXT (y puedes ver en los registros del servidor que ni siquiera lo comprueban). Para mí, es comparable a la metaetiqueta de palabras clave: es lo que el propietario de un sitio afirma sobre de qué trata su sitio… (¿El sitio es realmente así? Bueno, puedes comprobarlo. Llegados a ese punto, ¿por qué no comprobar el sitio directamente?)

John Mueller, Search Advocate, Google

Entonces, ¿deberías crear uno? Si publicas documentación para desarrolladores, cuesta unos diez minutos y hay un caso de uso plausible. Mueller lo describió como “una muleta temporal, quizá para ahorrar algunos tokens” para herramientas de programación con IA que analizan documentación. Para todos los demás, es trabajo sin retorno medible, además de un pequeño inconveniente: facilita que los competidores extraigan tu contenido en bloque.


Parte 5

Corrige las URL que la IA se inventa sobre tu sitio

Los asistentes de IA se inventan links a tu sitio web, y lo hacen a menudo. Comprobamos el estado HTTP de 16 millones de URL citadas por ChatGPT, Perplexity, Copilot, Gemini, Claude y Mistral, y descubrimos que los asistentes de IA envían a los visitantes a páginas 404 con 2,87 veces más frecuencia que la Búsqueda de Google.

ChatGPT es, con diferencia, el peor infractor. El 1,01 % de sus URL en las que se hace clic devuelven un 404, frente a un valor de referencia de Google del 0,15 %.

Tasas 404 por canal de referencia

Datos de Web Analytics: 16.000.000 URL analizadas.

Gráfico de barras de la tasa 404 estimada por referente de IA: ChatGPT 1,01%, Perplexity 0,31%, Copilot 0,34%, Gemini 0,21%, Claude 0,58% y Mistral 0,12%.

Perplexity (0,87%) y Gemini (0,86%) están casi exactamente en la misma tasa que la propia Google: 0,84% para las URL citadas. Tiene sentido, ya que ambos recuperan información del índice de Google, así que heredan sus enlaces rotos en lugar de inventarse los suyos.

Las URL inventadas se infieren a partir de tus patrones existentes. Una URL alucinada habitual en nuestro sitio era ahrefs.com/keywords, porque hablamos de palabras clave constantemente y el modelo dio por sentado que debía existir una página así. No existe.

Esta es una de las pocas victorias realmente gratuitas en AEO. Alguien con una intención real preguntó por tu producto, fue enviado a tu sitio y se topó con un callejón sin salida. Te encontrarás con tres tipos distintos:

  • URLs alucinadas. Páginas que un modelo inventó a partir de la estructura de tus URL.
  • URL obsoletas. Páginas que existieron en algún momento, recordadas por datos de entrenamiento u otras fuentes de datos desactualizadas.
  • URL mal escritas o variantes. Casi aciertos en páginas reales.

Por ese motivo, hemos añadido un filtro a Web Analytics que te ayudará a encontrar URL alucinadas en solo dos clics. Si buscas una alternativa sencilla a Google Analytics, gratis hasta 1 millón de eventos al mes, échale un vistazo:

Informe de páginas de Ahrefs Web Analytics con el desplegable de páginas de salida resaltado. En el menú abierto, la opción “Posible 404” resaltada enumera páginas que reciben visitas, pero tienen un título que contiene 404 o “not found”, lo cual puede ocurrir cuando los chatbots de IA generan URL alucinadas.

Si se sigue solicitando una URL alucinada, el modelo te está diciendo qué página esperan encontrar tus visitantes.


Parte 6

Conviértete en una entidad reconocida

En última instancia, todas las tácticas de esta guía dependen de una sola cosa: si los sistemas de IA reconocen tu marca como una entidad distinta.

¿Sabías esto?

Una entidad es cualquier cosa distinta del mundo real que un motor de búsqueda o la IA puede reconocer y diferenciar del resto: una persona, un lugar, una empresa, un producto o un concepto concretos (como “Dmytro Gerasymenko”, “Ahrefs” o “Singapur”), y no solo las palabras usadas para describirla.

Un AI Overview sobre Ahrefs con tres entidades resaltadas en amarillo y etiquetadas a su lado: Ahrefs como entidad de empresa, Dmytro Gerasymenko como entidad de persona y Singapur como entidad de ubicación.

Knowledge Graph de Google—una base de datos de 54 mil millones de entidades y más de 1,6 billones de hechos sobre cómo se relacionan—ya no es solo el motor que hay detrás de los paneles de conocimiento.

Ahora es la infraestructura central de AI Overviews, AI Mode y Gemini.

Si tu marca no está claramente establecida como entidad, con señales coherentes en tu sitio, datos estructurados y fuentes autorizadas de terceros, te arriesgas a ser invisible en las respuestas de IA, no solo en los links azules.

A menudo se presenta Schema como una forma rápida de ganar visibilidad en IA, y la correlación superficial parece convincente: las páginas citadas por la IA tienen casi tres veces más probabilidades de tener JSON-LD.

Schema es mucho más común en las páginas citadas por la IA

Estudio de Ahrefs sobre 6 millones de páginas (2 millones por grupo).

Gráfico de barras de páginas con y sin JSON-LD: el 18,3 % de las páginas no citadas lo tiene, frente al 51,6 % de las páginas citadas como referencia y el 53,1 % de las páginas citadas en línea.

Pero la correlación no implica causalidad. Hicimos un seguimiento de 1.885 páginas que añadieron JSON-LD frente a 4.000 controles y no encontramos ninguna mejora significativa en AI Mode ni en ChatGPT, y sí una ligera caída en AI Overview que no pudimos atribuir al Schema.

Entonces, ¿schema no sirve para nada? No, pero su papel es lento e indirecto, no una táctica de resultado rápido.

Puedes comprobar si Google ya te reconoce usando la API de Knowledge Graph de Google o un verificador gratuito para ver qué tipo de entidad te ha asignado y si los atributos son correctos.

Por ejemplo, Knowledge Graph Tool de Carl Hendy te muestra resultados para personas, empresas, productos, lugares y otras entidades.

La herramienta de búsqueda del Knowledge Graph de Google en audits.com con una búsqueda de “CNN”. Encontró 20 resultados, encabezados por Cable News Network, Inc., tipificada como corporación y organización, seguida de CNN Türk y CNN Brazil.

A partir de ahí, intenta conseguir menciones de publicaciones de autoridad y mantén tus datos coherentes en todas partes: el mismo nombre, descripción y categoría en tu sitio, tus perfiles y los listados de terceros.

Luego añade schema donde sea natural, priorizando los tipos que definen tu entidad y sus relaciones:

  • Schema de Organization y sameAs enlazado a tus perfiles de Wikipedia, Wikidata y redes sociales

  • Schema de persona para los autores de tu sitio

  • Schema de producto para tus ofertas

Consejo

Encuentra tus páginas con mayor autoridad y asegúrate de que lleven un marcado Schema limpio.

Puedes hacerlo yendo al informe Explorador de páginas en Site Audit y ordenando por “Valoración de página”.

Clasificación de la página (PR) muestra la solidez del perfil de backlinks internos y externos de la URL en relación con otras URL incluidas en el rastreo.

Luego, revisa la columna “Elementos de schema” para auditar tu schema existente y la columna “Problemas de datos estructurados” para detectar datos estructurados faltantes o no válidos.

Explorador de páginas de Site Audit de Ahrefs ordenado por PR, con la columna PR y las columnas de elementos de Schema y de problemas de datos estructurados resaltadas. La página de inicio tiene un PR de 77 y un schema Organization con un error de validación de Schema.org, y la página de precios incluye los schemas FAQPage y Organization con el mismo error.

Parte 7

Prepárate para el marketing de agente a agente

Te dejo con esta reflexión final: cada vez más “lectores” en los que intentas influir son en realidad agentes de IA que navegan y compran en nombre de tu audiencia.

De hecho, en junio de 2026 el CEO de Cloudflare, Matthew Prince, reveló que el tráfico agéntico (bot/rastreador/agente) había superado por primera vez el 50% en la historia de internet.2, 3

Una publicación en X del CEO de Cloudflare, Matthew Prince, del 3 de junio de 2026, que dice: “Bueno, eso pasó más rápido de lo que predije. Pensé que sería a finales de 2027, luego a principios de 2027, pero el tráfico agentivo está creciendo tan rápido que, por primera vez en la historia de Internet, los bots ya han superado al tráfico humano en línea”. Incluye un link a la página Traffic Worldwide de Cloudflare Radar.

Lejos de ser un caso extremo o una novedad, las búsquedas de “IA agéntica” se han multiplicado por 84 en tres años, a medida que el coste de ejecutar un agente ha bajado de dólares a céntimos.

Volumen de búsqueda mensual en EE. UU.

Palabras clave: “IA agéntica” y “qué es la IA agéntica”

Gráfico de líneas del volumen de búsqueda mensual en EE. UU. de 2023 a 2026. “agentic AI” (azul) sube desde casi nada en 2024 hasta 122.175, mientras que “what is agentic AI” (rosa) alcanza su pico a mediados de 2025 y termina en 14.206.

Fuente: Ahrefs vía Agent A

Todavía no necesitas reconstruir tu web solo para agentes de IA. Pero el consejo de siempre de crear contenido exclusivamente para humanos y no preocuparte por los robots probablemente ya no se sostiene tanto como antes.

Este capítulo trata de influir en la IA en la que confía el ser humano, y el marketing de agente a agente es eso, pero llevando la idea un paso más allá.

Retrato de Louise Linehan
Guía creada porLouise Linehan

Louise es especialista en marketing de contenidos en Ahrefs. En los últimos diez años, ha ocupado puestos sénior de contenido en marcas SaaS: Pi Datametrics, BuzzSumo y Cision. Durante este tiempo, ha publicado cientos de artículos de blog, liderado investigaciones de referencia en el sector y desarrollado programas de seminarios web dirigidos por expertos.

Louise aprendió SEO desde cero durante su etapa en la empresa de SEO Pi. A las pocas semanas de incorporarse, publicó un artículo sobre canibalización que captó la atención del mayor referente de SEO de aquel momento: Rand Fishkin. Desde entonces, ha escrito sobre temas que van desde el link building manipulativo hasta la sindicación de contenidos y la previsión de la demanda de búsqueda. En su tiempo libre, ha profundizado en sus conocimientos prácticos de SEO creando sitios web para dos negocios locales.

Puedes leer las palabras de Louise en publicaciones del sector como Search Engine Watch, The Drum, The Telegraph y Spin Sucks.

Revisado por

Explora todas las guías de AEO

/01

¿Qué es la optimización para motores de respuesta (AEO)?

Empieza aquí. Qué es el AEO, en qué se diferencia del SEO y los siete pasos para empezar.

/02

Cómo funcionan los motores de respuesta

Qué ocurre realmente entre un prompt y una respuesta, y en qué punto tu marca puede entrar en el proceso.

/03

Cómo hacer un seguimiento de la visibilidad en IA

No puedes optimizar lo que no puedes ver. Siete formas de medir dónde aparece tu marca en las respuestas de IA.

/04

Cómo elegir los mejores prompts para hacer un seguimiento

Haz un seguimiento de grupos de prompts, no de respuestas aisladas. Once sitios donde encontrar las consultas que vale la pena supervisar.

/05

Cómo optimizar el contenido para motores de respuesta

Posicionarte hace que te tengan en cuenta. Así consigues que te citen: los temas, los formatos y los cambios on-page que funcionan.

/06

Cómo supervisar y conseguir menciones de marca en las respuestas de IA

La IA recomienda las marcas que ha visto mencionadas en otros sitios. Aquí te explicamos cómo supervisar esas menciones y conseguir más.

/07

Cómo optimizar tu sitio web para motores de respuesta

Las correcciones técnicas que determinan si la IA puede acceder a tus páginas, leerlas y entender quién eres.