Ferramenta de diagnóstico

Verificador de prontidão para IA

Os assistentes de IA estão virando a porta de entrada da web. Esta verificação diz se o ChatGPT, o Claude, o Perplexity e a IA do Google conseguem rastrear seu site, entendê-lo e citá-lo: llms.txt, regras de robots.txt para rastreadores de IA, dados estruturados, sitemap e metadados, cada item pontuado e com a correção.

A verificação baixa alguns arquivos públicos (página inicial, robots.txt, llms.txt, sitemap) pelo nosso servidor. Nada fica armazenado.

O que significa estar "pronto para IA"

Buscar já foi sinônimo de dez links azuis; cada vez mais, é uma única resposta sintetizada pelo ChatGPT, pelo Claude, pelo Perplexity ou pelos resultados de IA do Google. Esses sistemas só recomendam sites que conseguem rastrear, interpretar e nos quais confiam, e os sinais em que eles se apoiam não são idênticos aos do SEO clássico.

Três camadas importam. Acesso: seu robots.txt decide quais rastreadores de IA podem ler o site, e bloquear o bot errado tira você por completo das respostas dele. Compreensão: dados estruturados (JSON-LD) e metadados limpos são o que os mecanismos de resposta interpretam com mais confiança ao decidir do que suas páginas tratam. Orientação: um arquivo llms.txt na raiz do site dá aos sistemas de IA um mapa curado do que importa, em um formato feito para modelos de linguagem.

Este verificador lê exatamente o que um rastreador de IA leria e pontua as três camadas, com uma correção concreta para tudo o que sinalizar.

O que é verificado

  • llms.txt: presente na raiz do site e no formato llmstxt.org válido (título, resumo, seções com links)
  • robots.txt: regras de acesso para 11 grandes rastreadores de IA (GPTBot, ClaudeBot, PerplexityBot, Google-Extended e outros), com o impacto em busca versus treinamento explicado
  • Dados estruturados: blocos JSON-LD na página inicial e quais tipos schema.org eles declaram
  • Sitemap: descobrível via robots.txt ou no local padrão
  • Metadados: title, meta description, URL canônica, tags Open Graph e H1

Ainda não tem llms.txt?

Gere um arquivo válido a partir do seu sitemap em cerca de um minuto, grátis.

Abrir o gerador de llms.txt →

Do blog

Todos os guias →

Frequently asked questions

O que é llms.txt?
Um arquivo em markdown simples na raiz do site (como o robots.txt, mas para modelos de linguagem) que nomeia seu site, o resume e lista links para as páginas mais importantes. Os sistemas de IA que o suportam usam o arquivo como um mapa curado, em vez de adivinhar a partir do HTML bruto. O formato é definido em llmstxt.org.
Bloquear o GPTBot prejudica meu ranqueamento no Google?
Não. O ranqueamento clássico do Google não se importa com o GPTBot. Mas bloquear um rastreador de busca por IA tira você das respostas daquele mecanismo: bloqueie o PerplexityBot e o Perplexity não consegue citá-lo; bloqueie o GPTBot e a busca do ChatGPT pula seu site. O Google-Extended é a exceção: ele só controla o treinamento do Gemini, não a busca.
O llms.txt é um padrão oficial?
É uma proposta da comunidade (llmstxt.org) com adoção crescente, ainda que desigual. Custa um arquivo de texto pequeno, várias ferramentas de IA já o leem e nenhuma é prejudicada por ele — o que faz dele um seguro barato, não uma aposta.
Qual a diferença em relação ao SEO tradicional?
O SEO clássico otimiza para algoritmos de ranqueamento; a prontidão para IA otimiza para ser lido, entendido e citado pelos mecanismos de resposta. Eles se sobrepõem (sitemaps, dados estruturados, bons metadados), mas a prontidão para IA acrescenta a política de acesso dos rastreadores e o llms.txt, e dá menos peso a links e palavras-chave.
Minha pontuação está baixa. O que corrijo primeiro?
Em ordem de impacto: desbloqueie os rastreadores de busca por IA que você quer que o citem, adicione dados estruturados JSON-LD às páginas principais e depois adicione um llms.txt. Problemas de metadados (title, description, canônica) são vitórias rápidas que geralmente se resolvem em uma tarde.