Atualizado em 8 de outubro de 2026, por João Leite, Founder da murmur.

O checklist técnico para aparecer no ChatGPT confere se o robô da IA entra no site, lê o texto e acha cada página. A lista serve também ao Claude, ao Gemini, ao Perplexity e ao Google AIO, o resumo escrito por IA que abre muitas buscas do Google. São 23 itens em cinco blocos: acesso do robô, texto legível, página achada, página que responde e empresa reconhecida. O llms.txt fica fora da lista, e o schema entra só para descrever o que está na tela: nos testes publicados que a murmur reuniu até outubro de 2026, nenhum dos dois mostrou ganho de citação.

  • Sem o robô de busca liberado, o site deixa de ser mostrado nas respostas. Segundo a OpenAI, o site fechado para o OAI-SearchBot não aparece nas respostas com busca do ChatGPT e só entra como link de navegação.
  • O texto tem de chegar pronto no HTML. Os robôs da OpenAI e da Anthropic não executavam JavaScript na medição da Vercel de dezembro de 2024.
  • No Google AIO, só entra página que o Google já guardou no índice. O Google pede a página indexada e qualificada para aparecer na busca com um trecho de texto.
  • O robots.txt não vale igual para todas as IAs. Num estudo de julho de 2026, com 200 tentativas em dez assistentes, o Claude respeitou o bloqueio e o Gemini abriu as páginas bloqueadas.
  • llms.txt e schema não mostraram ganho de citação. A Ahrefs achou 97% dos llms.txt válidos sem nenhum acesso em maio de 2026, e o schema não aumentou as citações no ChatGPT.

A murmur, agência de GEO no Brasil que coloca marcas nas respostas do ChatGPT, do Claude, do Google AIO e de outros agentes de IA, publica este checklist. Com cada cliente, a murmur mede onde a marca falta nas respostas, produz e estrutura as páginas que respondem ao comprador e acompanha a mudança semana a semana.

Acesso do robô: o robots.txt e a hospedagem deixam a IA entrar

O acesso vem primeiro no checklist, porque a IA só cita a página que o robô de busca dela consegue abrir. O robô de IA (crawler) é o visitante automático que cada empresa de IA manda aos sites para ler as páginas. O robots.txt é o arquivo, na raiz do site, com a regra de cada robô.

  1. O robots.txt fica na raiz de cada endereço. O Google escreve que o arquivo vale só para o endereço em cuja raiz ele está, e por isso blog.suaempresa.com.br precisa do próprio arquivo. Abra seusite.com.br/robots.txt no navegador e confira se ele responde.
  2. O OAI-SearchBot, robô de busca do ChatGPT, está liberado. A OpenAI escreve que o site fechado para ele não aparece nas respostas com busca do ChatGPT, e a mudança no arquivo pode levar cerca de 24 horas para valer na busca do ChatGPT. O treino dos modelos se decide à parte, como explica o guia sobre os robôs de IA da OpenAI e da Anthropic.
  3. O Claude-SearchBot, robô de busca do Claude, está liberado. Segundo a Anthropic, quem desliga esse robô pode perder visibilidade e precisão nos resultados de busca do Claude.
  4. O PerplexityBot está liberado, e o servidor aceita as faixas de IP dele. A documentação do Perplexity recomenda as duas coisas para o site aparecer na busca dele, e o passo a passo fica no guia sobre como aparecer no Perplexity.
  5. O Googlebot está liberado, e o Google-Extended é uma decisão à parte. Para o Google, a IA faz parte da Pesquisa, e as regras do robots.txt para o Googlebot controlam o acesso dela ao site. O Google-Extended controla outra coisa: o treino dos próximos modelos Gemini e o uso do texto nas respostas do aplicativo Gemini.
  6. A hospedagem, o firewall e a CDN deixam os robôs de IA passar. Esses serviços de proteção às vezes tratam o robô como ataque, mesmo com o robots.txt aberto. O jeito de achar esse bloqueio aparece no guia sobre a hospedagem que barra os robôs de IA.

O robots.txt não segura todas as IAs do mesmo jeito. Num estudo publicado em julho de 2026, Gabriel Lopez-Fonseca e colegas, da Universidade Politécnica de Madri e da ETH Zurique, testaram dez assistentes de IA. Nas 200 tentativas, 20 por assistente, o Claude abriu as páginas liberadas e nenhuma das bloqueadas, e o Gemini, o DeepSeek, o Grok e o Qwen abriram páginas liberadas e bloqueadas. O teste mediu o assistente abrindo a página a pedido de quem conversa, e não o robô que monta o índice de busca. A conclusão dos autores:

“these findings show that robots.txt cannot be assumed to reliably govern inference-time web access by AI assistants”

Para quem quer aparecer, a leitura é a inversa: no Claude, um bloqueio esquecido no robots.txt barra a página, mesmo quando alguém pede ao assistente que a abra.

Texto legível: o que o robô lê sem executar JavaScript

O texto que a IA pode citar é o que chega pronto no HTML, o código que o servidor entrega antes de qualquer script rodar. JavaScript, nesse caso, é o código que termina de montar a página no navegador de quem a abre.

  1. A resposta, o preço e a data estão no HTML que o servidor entrega. Em dezembro de 2024, a Vercel e a MERJ viram os robôs da OpenAI e da Anthropic baixarem o JavaScript sem executá-lo. Como conferir está no guia sobre o texto pronto no HTML.
  2. Nada do que responde fica atrás de aba, acordeão, botão ou imagem. Se o texto só carrega depois do clique, o robô que não executa JavaScript não o recebe. Num teste da Otterly com cinco IAs, um número posto só dentro de uma imagem não foi lido por nenhuma delas.

A murmur achou esse defeito no diagnóstico da Mindo, estúdio de motion design de São Paulo. Em 29 de maio de 2026, a Mindo ficou fora de todas as 63 respostas que medimos em três IAs, e o site dela, montado dentro do navegador, chegava em branco ao robô. Liberar robô nenhum resolveria aquilo, porque faltava texto para ler.

A IA só cita a página que encontra, e no Google AIO a página entra pelo índice do Google.

  1. A página aparece na busca comum do Google, com título e trecho. Para virar link de apoio no AI Overview e no AI Mode, o Google pede a página indexada e qualificada para mostrar um trecho. A inspeção de URL do Search Console diz se a página está no índice.
  2. Nenhum noindex ou nosnippet esquecido nas páginas que devem aparecer. São as marcas que pedem ao Google para não listar a página ou não mostrar trecho dela. O Google lista noindex, nosnippet, data-nosnippet e max-snippet como os controles que limitam o que a página mostra na Pesquisa. Como a IA faz parte da Pesquisa, segundo o Google, a regra vale também para o AI Overview.
  3. O site está incluído nos recursos de IA generativa no Search Console. Desde 31 de agosto de 2026, o Search Console tem um controle para a IA generativa da Pesquisa, e incluir o site é o padrão. Confira em Configurações se alguém mudou. O que mais conta no Google AIO está no guia sobre o AI Overview e o AI Mode.
  4. O sitemap traz todas as páginas que devem ser achadas, e o robots.txt aponta para ele. O sitemap é o arquivo que entrega aos buscadores, de uma vez, os endereços do site. O protocolo dos sitemaps permite apontar o arquivo no robots.txt, numa linha que começa com Sitemap: e traz o endereço completo.
  5. A data de cada página no sitemap é a da última mudança de verdade. O campo lastmod guarda essa data, e o Google só o usa quando ela confere com a página.
  6. Cada página nova recebe link de uma página que o buscador já conhece. O Google conta que descobre páginas novas pelos links de páginas que ele já visitou e pelo sitemap. Nenhum estudo reunido até outubro de 2026 mediu o efeito do link interno na citação das IAs, e a página sem link nenhum depende do sitemap ou de links de outros sites.
  7. Cada página tem um endereço só. Quando a mesma página abre em dois endereços, o redirecionamento e a tag canonical, que aponta o endereço principal, dizem ao Google qual guardar. O Google recomenda esses métodos e escreve que nenhum deles é obrigatório.
  8. O site está verificado no Search Console e no Bing Webmaster Tools, com o sitemap enviado. Os dois painéis mostram que páginas o Google e o Bing guardaram. O que cada um mostra sobre as IAs está no guia sobre o Search Console e o Bing Webmaster Tools.
  9. O site avisa o Bing pelo IndexNow quando uma página entra, muda ou sai. O IndexNow é o aviso que o site manda aos buscadores participantes, em vez de esperar que eles passem por lá. Pela lista oficial do IndexNow, o aviso chega ao Bing, à Yandex, à Naver, à Seznam.cz, à Yep e à Amazon. O Google não está nela. A OpenAI nomeia a Microsoft entre os provedores de busca do ChatGPT e não diz em que perguntas cada um entra, tema do guia sobre o ChatGPT search.

Sobre a data do sitemap, a página do Google sobre como criar o arquivo diz:

O Google usa o valor <lastmod> se ele estiver correto de maneira consistente e comprovável (por exemplo, com base na comparação com a última data de modificação da página).

Na mesma página, mudar só o ano do aviso de direitos autorais não conta como atualização, e mudar o texto principal, os dados estruturados ou os links conta.

Página que responde: o que a IA recorta para montar a resposta

A página que responde traz a resposta no começo, com as palavras de quem pergunta e o dado escrito no próprio texto. A IA monta a resposta com trechos, e o trecho que se entende sozinho é o que ela consegue usar.

  1. A primeira frase responde a pergunta, e o título e os cabeçalhos usam as palavras do comprador. O passo a passo está no guia sobre como escrever um texto para aparecer no ChatGPT. O que torna um trecho fácil de citar está no guia sobre citabilidade por IA.
  2. Preço, prazo, número e data estão escritos no texto, e não só na imagem ou na marcação. Nenhuma das cinco IAs testadas pela searchVIU em outubro de 2025 encontrou o preço posto só na marcação da página.
  3. A data de atualização aparece na tela e é a mesma da marcação. A regra do Google para a data tem duas partes: um rótulo visível, como “Atualizado em”, e o mesmo valor nos dados estruturados.
  4. O schema, se existir, descreve só o que está na tela. O schema é um bloco no código da página que descreve para as máquinas o nome, o preço ou o endereço. Na comparação da Ahrefs com 1.885 páginas, publicada em maio de 2026, as citações no AI Overview caíram 4,6% depois do schema, em relação às páginas que não mexeram, e no ChatGPT a variação ficou dentro do acaso.

Empresa reconhecida: o mesmo nome em todo lugar e as páginas da empresa

As IAs confundem empresas de nome parecido, e a defesa é usar o mesmo nome, junto do que a empresa faz, em todo lugar.

  1. Nome e descrição iguais no site, no LinkedIn e nos perfis da empresa. O nome leva o que separa a empresa de outra de mesmo nome. Perfil por perfil, o passo a passo está no guia sobre o nome e os dados iguais em todo lugar.
  2. O site tem as páginas que o comprador procura: o serviço, o preço ou do que ele depende, os casos e quem responde pela empresa. A conta de quantas páginas fazer, e em que ordem, aparece no guia sobre quantas páginas publicar para aparecer no ChatGPT.

O que cada item vale no ChatGPT, no Claude, no Google AIO, no Perplexity e no Gemini

O acesso do robô vale nas cinco IAs, e o que muda é o caminho de cada uma até a página.

itemChatGPTClaudeGoogle AIOPerplexityGemini
robô liberadoOAI-SearchBot, pela OpenAIClaude-SearchBot, pela Anthropic; respeitou o bloqueio no estudo de 2026regras do Googlebot, pelo GooglePerplexityBot e faixas de IP, pela documentação do PerplexityGoogle-Extended para o aplicativo; abriu páginas bloqueadas no estudo de 2026
texto no HTMLnão executava JavaScript em 2024 (Vercel)não executava JavaScript em 2024 (Vercel)o Google processa JavaScript que não esteja bloqueadonão executava JavaScript em 2024 (Vercel)a Vercel escreveu em 2024 que o Gemini usa a infraestrutura do Googlebot, que renderiza JavaScript
por onde a página é achadabusca da OpenAI, com provedores de foraBrave Search, segundo a MERJ e a Profoundíndice do Googleíndice próprio do Perplexity, segundo a documentação deleíndice do Google, nas respostas do aplicativo
schemavariação dentro do acaso (Ahrefs); preço só na marcação não achado (searchVIU)preço só na marcação não achado (searchVIU)citações caíram 4,6% (Ahrefs)preço só na marcação não achado (searchVIU)preço só na marcação não achado (searchVIU)

O robô liberado vale para as cinco IAs. O texto pronto no HTML foi condição no ChatGPT, no Claude e no Perplexity na medição de 2024, e o relato de 2026 sobre o robô da OpenAI está no guia sobre o texto no HTML. No Google AIO, o texto no HTML é mais conforto que condição, porque o Google escreve que processa o JavaScript que não esteja bloqueado. O schema não aparece a favor em nenhuma das cinco. O Claude e o Gemini se separam no robots.txt: no estudo de 2026, o Claude seguiu o bloqueio, e o Gemini abriu as páginas bloqueadas. A ligação entre o Claude e o Brave Search, que a Anthropic não confirma, aparece no guia sobre como fazer sua empresa ser citada pelas IAs.

O impacto de cada mudança: o que as fontes mostram e o que ninguém mediu

Nos estudos que a murmur reuniu até outubro de 2026, nenhum comparou entre si o efeito dos itens do checklist na citação das IAs. As fontes apontam três bloqueios que podem impedir a página de chegar à IA. O robô barrado está nas regras da OpenAI e da Anthropic, o texto fora do HTML na medição da Vercel de 2024, e a página fora do índice na regra do Google para o AI Overview.

Duas coisas comuns não têm prova a favor. Num teste da Otterly de 14 dias, no site da própria Otterly, a cópia em markdown de duas páginas não recebeu nenhuma visita de robô de IA. Na conta da Ahrefs com 75 mil marcas, de dezembro de 2025, o número de links recebidos acompanhou pouco o aparecimento da marca nas respostas, e a Ahrefs escreve que correlação não é causa. Os links de outros sites são o assunto do guia sobre backlinks para aparecer na IA.

Como usar o checklist no site da sua empresa

Use o checklist depois de ver o que as IAs respondem hoje, e confira os blocos na ordem, do acesso à empresa reconhecida. Leve as perguntas do seu comprador ao ChatGPT, ao Claude e ao Google AIO e marque as respostas em que a empresa entra. Se ela não aparece em nenhuma, comece pelo acesso, pelo texto e pelo índice. Se aparece em parte, olhe a página que responde a cada pergunta em que ela falta.

Anote o item que falhou, a data do conserto e o que mudou. Depois, refaça as mesmas perguntas. O jeito de montar essa conta está no guia sobre como medir a presença da marca no ChatGPT.

Na murmur, o checklist é o ponto de partida, e o trabalho é a página que responde

Na murmur, o checklist é a condição de partida, e o trabalho está na página que responde ao comprador. A murmur trabalha em cima do que o site do cliente já mostra. O estudo do setor decide que perguntas ganham página, e os guias saem num subdomínio da marca do cliente. O site principal fica com o time do cliente: quando a medição mostra algo a ajustar nele, isso chega ao time como sugestão.

Na Mindo, o diagnóstico de 29 de maio de 2026 achou o site em branco para o robô, e o guia foi para guia.mindo.com.br com o texto pronto no HTML, inteiro no ar em 22 de junho. O que mudou depois nas respostas do ChatGPT está no caso da Mindo. Para ver que páginas chegam às respostas num mercado, a maioria dos estudos por setor da murmur mostra os sites que as IAs usaram como fonte numa rodada de perguntas de compra.

Perguntas frequentes

O llms.txt entra no checklist?

O llms.txt fica fora do checklist, porque os dados publicados não mostram efeito dele para aparecer no ChatGPT. Em maio de 2026, a Ahrefs olhou 137.210 sites, e 97% dos llms.txt válidos não tiveram nenhum acesso no mês. A busca do Google dispensa o arquivo, nas palavras do guia do Google para os recursos de IA, e, nas páginas sobre os robôs, nem a OpenAI nem a Anthropic dizem que eles abrem o llms.txt. Quando a plataforma cria o arquivo sem trabalho, não há motivo para tirá-lo. O formato está no guia sobre o llms.txt.

O checklist vale igual para o ChatGPT, o Gemini, o Perplexity e o Google AIO?

O checklist vale para todas no acesso do robô e na página que responde, e muda na porta de entrada. O Google AIO e as respostas do aplicativo Gemini usam o índice do Google. O Perplexity tem índice próprio, e o Claude cita sobretudo páginas do topo do Brave Search, segundo a MERJ e a Profound.

A velocidade do site muda a citação?

Nenhum estudo reunido até outubro de 2026 mediu a ligação entre a velocidade do site e a citação pelas IAs. Numa página de março de 2025, o Bing lista o tempo de carregamento por último entre os parâmetros de busca, que ele diz estarem em ordem geral de importância. Mantenha o site leve pela pessoa que visita, sem contar com efeito nas respostas.

Dá para fazer o checklist sozinho, sem agência?

Dá. Exige quem leia HTML, entenda de robôs e refaça a conferência a cada troca de plataforma, de hospedagem ou de robots.txt. As ferramentas são gratuitas: o navegador, o Search Console e o Bing Webmaster Tools. O checklist não escreve a página que responde ao comprador, nem mostra se a empresa passou a aparecer. No site principal, a ajuda da murmur é o diagnóstico e a sugestão ao time do cliente, e as páginas novas saem num subdomínio da marca.

Com que frequência revisar o checklist?

Revise o checklist a cada mudança no site, na hospedagem ou no robots.txt, e a cada robô novo anunciado pelas empresas de IA. A data e o sitemap se conferem a cada página publicada. As respostas das IAs pedem outra frequência, explicada no guia sobre com que frequência medir a presença da marca.

Por onde começar, e onde a murmur entra

Comece pelo que as IAs respondem hoje sobre o seu mercado, e depois pelo primeiro item da lista que falhar no seu site. Com o endereço do site, o diagnóstico gratuito da murmur mostra em menos de dois minutos, e sem cadastro, as respostas do ChatGPT, do Claude, do Perplexity e do Google AIO às perguntas do seu mercado. Conserte esse primeiro item, confira o seguinte e refaça as perguntas depois de cada conserto.

Leia também

Referências