Ajuste de Site para IA: seu site é legível pelos modelos?
De nada adianta ter o melhor conteúdo se o rastreador da IA recebe 403 no robots.txt ou uma página em branco esperando o JavaScript rodar.
Testamos as perguntas do seu mercado nas 5 plataformas e mostramos onde você aparece. Sem compromisso.
- ChatGPT (GPT-4o)
- Google Gemini
- Perplexity AI
- Microsoft Copilot
- Claude (Anthropic)
Esta capability trata de acesso e renderização. Performance, Core Web Vitals e tempo de carregamento são outro serviço — Otimização de Velocidade para Sites WordPress. Um site lento pode ser perfeitamente legível por um modelo.
O que costuma estar bloqueando
Quatro achados recorrentes — nenhum deles aparece em relatório de SEO tradicional.
O robots.txt bloqueia crawlers de IA sem ninguém saber
Muitos plugins de segurança e configurações de CDN incluem regras que barram GPTBot, ClaudeBot, PerplexityBot e afins por padrão. O site fica invisível para o canal inteiro, e nada indica isso no painel.
O conteúdo só existe depois que o JavaScript roda
Blocos carregados por script, abas que só montam no clique, conteúdo em iframe. O HTML bruto que o crawler recebe está vazio, mesmo que o usuário veja a página completa.
Não existe llms.txt
É o arquivo que declara, em texto, o que o site é e quais páginas importam. Barato de publicar e ainda raro no Brasil — o que o torna um diferencial enquanto durar.
A hierarquia de títulos está quebrada
Dois H1 na mesma página, H3 antes de H2, títulos usados como elemento de estilo. O modelo usa essa hierarquia para entender do que a página trata.
Como fazemos o ajuste
Medir o que o crawler recebe, corrigir, remedir.
Requisitamos as páginas principais simulando cada crawler de IA e registramos o código de resposta. É onde os bloqueios aparecem.
Comparamos o que vem no HTML da resposta com o que o navegador monta. A diferença é exatamente o que o modelo não vê.
Ajuste de robots.txt, liberação de user-agents, renderização do conteúdo crítico no servidor, correção da hierarquia de títulos.
Publicação e manutenção do arquivo, com as páginas que importam e a descrição da empresa em linguagem direta.
O que você recebe
Código de resposta de cada user-agent de IA nas páginas principais, antes e depois.
Com decisão explícita sobre cada crawler de IA — liberado ou bloqueado, e por quê.
Quais blocos de conteúdo não existem no HTML bruto e o que fazer com cada um.
Arquivo na raiz, com as páginas prioritárias e a descrição da empresa.
Um H1 por página, sequência de H2-H6 coerente, sem título usado como estilo.
Cada correção é reverificada — sem isso, não há como afirmar que foi resolvida.
Os crawlers que testamos
Cada plataforma usa um ou mais user-agents próprios.
- GPTBot
- Coleta de conteúdo para treino
- OAI-SearchBot
- Indexação para a busca do ChatGPT
- ChatGPT-User
- Acesso ao vivo quando o usuário pede
- ClaudeBot
- Coleta de conteúdo
- PerplexityBot
- Indexação a criação
- Google-Extended
- Controle de uso do conteúdo em produtos de IA do Google
As outras frentes do método
O que seu público pergunta às IAs
Onde sua marca aparece hoje
Por que os modelos citam uns e não outros
Conteúdo que o modelo consegue usar
Crawler, render e llms.txt
Declarar a entidade em JSON-LD
Share of voice mês a mês
O que muda quando a busca responde
O método completo, das 9 páginas do cluster
Trabalho entregue
Perguntas frequentes sobre Ajuste de Site para IA
Ajuste de site para IA é a mesma coisa que Core Web Vitals?
Não. Core Web Vitals mede experiência de carregamento para o usuário — LCP, CLS, INP. Ajuste para IA mede se o crawler consegue acessar e interpretar o conteúdo. Um site pode ter nota perfeita de performance e ser completamente invisível para os modelos.
O que é o llms.txt?
Um arquivo de texto na raiz do site que descreve, em linguagem direta, o que a empresa faz e quais páginas importam. Funciona como um resumo dirigido a modelos de linguagem. Não é padrão oficial de nenhum órgão, mas é barato de publicar e o custo de estar errado é próximo de zero.
Devo liberar todos os crawlers de IA?
É uma decisão de negócio, não técnica. Liberar aumenta a chance de ser citado; bloquear protege o conteúdo de ser usado em treino sem retorno. A recomendação padrão para empresa que quer aparecer é liberar os bots de busca e citação, e decidir caso a caso sobre os de treino.
Meu site é em React. Funciona?
Funciona se o conteúdo crítico for renderizado no servidor ou pré-renderizado. Se depender inteiramente do JavaScript no cliente, o crawler recebe uma página vazia. O diagnóstico mostra exatamente quais blocos estão nessa condição.
Esses ajustes afetam o Google?
Positivamente, em geral. Hierarquia de títulos correta e conteúdo no HTML bruto são requisitos antigos de SEO. A única decisão que envolve trade-off é o Google-Extended, que controla o uso do conteúdo nos produtos de IA do Google sem afetar o ranqueamento na busca.
Sua empresa aparece nas IAs?
Testamos as principais perguntas do seu mercado no ChatGPT, Gemini, Perplexity, Copilot e Claude. Você recebe um relatório documentando onde aparece, onde não aparece e quem está sendo citado no seu lugar. Trinta minutos de conversa, zero compromisso.