
Por Louise Linehan
Profissional de marketing de conteúdo na Ahrefs
Seu conteúdo pode ser ótimo e ainda assim nunca aparecer em uma resposta de IA.
Toda tática de otimização para IA pressupõe que os sistemas de IA conseguem acessar suas páginas, lê-las e entender quem você é. Nada disso é garantido. Cerca de 5,89% dos sites bloqueiam o GPTBot diretamente, o ChatGPT parece abandonar páginas que demoram mais de cerca de dois segundos para responder, e a maioria dos rastreadores de IA não executa JavaScript.
A boa notícia é que esta é a parte mais fácil de corrigir do AEO. Nada aqui garante uma citação por si só, mas qualquer um desses problemas pode, silenciosamente, custar todas as citações que você teria conquistado.
Continue aprendendo no YouTube
Nenhuma das dicas deste guia importa se os rastreadores de IA não conseguem ler suas páginas. Páginas bloqueadas não podem ser citadas, e isso muitas vezes acontece por acidente.
Analisamos cerca de 140 milhões de sites e descobrimos que o GPTBot agora é o bot de IA mais bloqueado (5,89% dos sites), com o ClaudeBot logo atrás.
Por padrão, a Cloudflare bloqueia plataformas de IA, então verifique se a sua CDN não deixou você de fora sem avisar.
“Permitir rastreadores de IA” não é uma decisão só, porque cada plataforma executa vários bots que fazem tarefas diferentes.
Só a OpenAI roda três:
As compensações são diferentes em cada caso. Bloquear o GPTBot mantém seu conteúdo fora dos dados de treinamento do próximo modelo; essa é a decisão que os editores geralmente estão avaliando. Bloquear o OAI-SearchBot remove você do índice em que o ChatGPT pesquisa, e é isso que hoje custa citações e tráfego de referência. Muitos sites bloqueiam o segundo por acidente, quando pretendiam bloquear apenas o primeiro.
A forma mais rápida de ver como você está é com uma ferramenta como o AI Crawler Access Checker, que lê seu robots.txt e informa quais rastreadores têm permissão para acessar seu site.

Para ver quais bots realmente estão aparecendo — e não apenas quais são permitidos — confira o Bot Analytics da Ahrefs. Ele rastreia visitas em 12 categorias de bots, incluindo um filtro dedicado de IA, usando dados do lado do servidor via Cloudflare, então funciona sem adicionar nenhum JavaScript ao seu site.
Rastreadores de IA tendem a ler o HTML bruto e, na maioria das vezes, não renderizam JavaScript do jeito que um navegador faz.
Isso significa que qualquer coisa que só aparece depois de JS do lado do cliente pode ficar invisível para eles.
Para garantir, use renderização do lado do servidor e dê à sua página a melhor chance de visibilidade em IA.
Páginas com carregamento lento podem impactar negativamente seu desempenho na pesquisa tradicional, mas, ao que tudo indica, a penalidade é ainda maior em mecanismos de resposta. A velocidade da página parece ajudar a decidir se você entra ou não na janela de contexto do modelo.1
Verifique a velocidade da página (conhecida como time-to-first-byte) no Site Audit:
llms.txt é um standard proposto para um arquivo Markdown no seu domínio raiz (por exemplo, website.com/llms.txt) que informa aos LLMs onde está seu melhor conteúdo: documentação, políticas, taxonomias de produto. Em princípio, é como o robots.txt para modelos de linguagem.
Mas, na prática, nenhum grande provedor de LLM se comprometeu a lê-lo. Nem a OpenAI, nem a Anthropic, nem o Google.
Verificamos o que realmente acontece quando um site adiciona llms.txt. Entre 137.000 domínios que usam o Ahrefs Web Analytics, 28% publicam um arquivo llms.txt. Dos ~38.000 com um arquivo válido, 97% receberam zero solicitações para ele no mês que medimos.
97% dos arquivos llms.txt nunca são solicitados
Estudo da Ahrefs com 137.000 domínios usando o Ahrefs Web Analytics.

Da pequena parcela de arquivos que chegou a ser buscada, 96% das solicitações vieram de bots. O Slackbot, o bot de prévia de links, buscou llms.txt mais vezes do que o PerplexityBot. Em resumo: os mecanismos de busca de IA mais importantes não parecem usá-lo.
O Google tem sido explícito sobre isso. O guia dele sobre otimizar para recursos de IA generativa tem uma seção literalmente intitulada “mythbusting” que diz aos proprietários de sites que arquivos legíveis por máquina, como llms.txt, não são necessários para aparecer na busca com IA generativa. John Mueller foi além, comparando isso à antiga meta tag keywords:
Até onde sei, nenhum dos serviços de IA disse que usa LLMs.TXT (e dá para perceber, ao olhar os logs do servidor, que eles nem verificam isso). Para mim, é comparável à meta tag de palavras-chave — é o que o proprietário de um site afirma que o site dele aborda… (O site é mesmo assim? Bem, dá para verificar. Nesse ponto, por que não verificar o site diretamente?)
John Mueller, Search Advocate, Google
Então, você deveria criar um? Se você publica documentação para desenvolvedores, isso leva cerca de dez minutos e há um caso de uso plausível. Mueller descreveu isso como uma “muleta temporária, talvez para economizar alguns tokens” para ferramentas de programação com IA que analisam documentação. Para todos os outros, é um esforço sem retorno mensurável, além de uma pequena desvantagem: tornar seu conteúdo mais fácil para concorrentes copiarem em massa.
Os assistentes de IA inventam links para o seu site — e fazem isso com frequência. Verificamos o status HTTP de 16 milhões de URLs citadas por ChatGPT, Perplexity, Copilot, Gemini, Claude e Mistral e constatamos que os assistentes de IA enviam visitantes para páginas 404 2,87x mais vezes do que a Pesquisa Google.
O ChatGPT é o pior disparado. 1,01% das URLs clicadas por ele retornam um 404, contra uma base do Google de 0,15%.
Taxas de 404 por canal de referência
Dados da Análise da Web – 16.000.000 URLs analisadas.

Perplexity (0,87%) e Gemini (0,86%) ficam quase exatamente na mesma taxa de 0,84% do próprio Google para URLs citadas. Isso faz sentido, já que ambos recuperam dados do índice do Google, então herdam seus links desfeitos em vez de inventarem os próprios.
As URLs inventadas são inferidas a partir dos seus padrões existentes. Uma URL alucinada comum para o nosso site era ahrefs.com/keywords, porque falamos de palavras-chave o tempo todo e o modelo assumiu que uma página assim deveria existir. Mas não existe.
Esta é uma das poucas vitórias realmente gratuitas em AEO. Alguém com intenção real perguntou sobre seu produto, foi direcionado ao seu site e deu de cara com um beco sem saída. Você encontrará três tipos diferentes:
Por esse motivo, adicionamos um filtro à Análise da Web que ajudará você a encontrar URLs alucinadas em apenas dois cliques. Se você está procurando uma alternativa simples ao Google Analytics, grátis para até 1 milhão de eventos por mês, confira:
Se uma URL alucinada continua sendo solicitada, o modelo está dizendo qual página seus visitantes esperam que você tenha.
Todas as táticas deste guia, no fim das contas, dependem de uma coisa: se os sistemas de IA reconhecem sua marca como uma entidade distinta.
Você sabia?
Uma entidade é qualquer coisa distinta do mundo real que um mecanismo de busca ou uma IA consiga reconhecer e diferenciar de todo o resto — uma pessoa, lugar, empresa, produto ou conceito específico (como “Dmytro Gerasymenko”, “Ahrefs” ou “Singapura”) — em vez de apenas as palavras usadas para descrevê-la.

O Knowledge Graph do Google — um banco de dados com 54 bilhões de entidades e mais de 1,6 trilhão de fatos sobre como elas se relacionam — não é mais apenas o mecanismo por trás dos painéis de conhecimento.
Agora, ela é a infraestrutura central para AI Overviews, AI Mode e Gemini.
Se sua marca não estiver claramente estabelecida como uma entidade, com sinais consistentes em todo o seu site, dados estruturados e fontes externas autoritativas, você corre o risco de ficar invisível nas respostas de IA — e não apenas nos links azuis.
O Schema costuma ser vendido como um ganho rápido de visibilidade em IA, e a correlação superficial parece convincente: páginas citadas por IA têm quase três vezes mais chance de ter JSON-LD.
Schema é bem mais comum em páginas citadas por IA
Estudo da Ahrefs com 6 milhões de páginas (2 milhões de páginas por grupo).

Mas correlação não é causa. Nós acompanhamos 1.885 páginas que adicionaram JSON-LD em comparação com 4.000 controles e não encontramos nenhum aumento relevante no AI Mode ou no ChatGPT, e uma pequena queda no AI Overview que não conseguimos atribuir ao schema.
Então schema é inútil? Não, mas seu papel é lento e indireto, não uma tática de ganho rápido.
Você pode verificar se o Google já reconhece você usando a API Knowledge Graph do Google ou um verificador gratuito para ver qual tipo de entidade ele atribuiu a você e se os atributos estão corretos.
Por exemplo, a Knowledge Graph Tool do Carl Hendy mostra resultados para pessoas, empresas, produtos, lugares e outras entidades.

A partir daí, tente conquistar menções em publicações com autoridade e manter seus fatos consistentes em todos os lugares: o mesmo nome, descrição e categoria em seu site, seus perfis e listagens de terceiros.
Em seguida, adicione schema onde fizer sentido, priorizando os tipos que definem sua entidade e seus relacionamentos:
Schema de Organization e sameAs com links para sua Wikipédia, Wikidata e perfis sociais
Schema de pessoa para os autores do seu site
Schema de produto para suas ofertas
Dica
Encontre suas páginas de maior autoridade e garanta que elas tenham uma marcação de schema limpa.
Você pode fazer isso acessando o relatório Explorador de páginas em Site Audit e ordenando por “Classificação da página”.
O Page Rating (PR) mostra a força do perfil de backlinks internos e externos da sua URL em relação a outras URLs incluídas no seu rastreamento.
Depois, confira a coluna “Itens de schema” para auditar seu schema existente e a coluna “Problemas de dados estruturados” para identificar dados estruturados ausentes ou inválidos.
Deixo você com este pensamento final: um número cada vez maior dos “leitores” que você tenta influenciar são, na verdade, agentes de IA navegando e comprando em nome do seu público.
De fato, em junho de 2026, o CEO da Cloudflare, Matthew Prince, revelou que o tráfego agêntico (bot/rastreador/agente) havia ultrapassado a marca de 50% pela primeira vez na história da internet.2, 3

Longe de ser um caso isolado ou uma novidade, as buscas por “IA agentiva” cresceram 84 vezes em três anos, à medida que o custo de executar um agente caiu de dólares para centavos.
Você ainda não precisa reformular seu site só por causa de agentes de IA. Mas o velho conselho de criar conteúdo apenas para humanos e não se preocupar com robôs provavelmente já não se sustenta tanto quanto antes.
Este capítulo é sobre influenciar a IA em que o humano confia, e o marketing agente a agente é isso — só que levado um passo além.

Louise é profissional de marketing de conteúdo na Ahrefs. Nos últimos dez anos, ela ocupou cargos seniores de conteúdo em marcas SaaS: Pi Datametrics, BuzzSumo e Cision. Nesse período, publicou centenas de posts no blog, liderou pesquisas de referência no setor e desenvolveu programas de webinars conduzidos por especialistas.
Louise aprendeu os fundamentos de SEO durante sua passagem pela Pi, uma empresa de SEO Enterprise. Poucas semanas depois de entrar, publicou um artigo sobre canibalização que chamou a atenção do maior nome em SEO na época: Rand Fishkin. Desde então, escreveu sobre temas que vão de link building manipulativo a sindicação de conteúdo e previsão de demanda de pesquisa. No tempo livre, aprofundou sua compreensão prática de SEO criando sites para dois negócios locais.
Você pode ler os textos de Louise em publicações do setor como Search Engine Watch, The Drum, The Telegraph e Spin Sucks.
Comece por aqui. O que é o AEO, como ele difere do SEO e os sete passos para começar.
O que realmente acontece entre um prompt e uma resposta — e onde sua marca pode entrar no processo.
Você não consegue otimizar o que não consegue ver. Sete maneiras de medir onde sua marca aparece em respostas de IA.
Acompanhe clusters de prompts, não respostas isoladas. Onze lugares para encontrar as consultas que valem a pena monitorar.
Ranquear faz você ser considerado. Veja como ser citado — os temas, formatos e mudanças na página que funcionam.
A IA recomenda as marcas que já viu serem discutidas em outros lugares. Veja como monitorar essas menções e conseguir mais menções desse tipo.
Os ajustes técnicos que determinam se a IA consegue alcançar suas páginas, lê-las e entender quem você é.