Guia

Erros de sitemap XML: como corrigir cada um

Do namespace errado ao "Não foi possível buscar" do Search Console: o sintoma, a causa e a correção exata de cada erro comum de sitemap.

Por Equipe WebDoctor·16 de julho de 2026·5 min de leitura


Quase todo erro de sitemap XML nasce de um punhado de causas: namespace errado ou ausente, caracteres especiais sem escape, URLs relativas, datas de lastmod fora do formato W3C, arquivos acima dos limites do protocolo ou um servidor que responde com HTML em vez de XML. Este guia percorre cada um, com o sintoma que provoca e a correção exata.

Namespace errado ou ausente

É o erro mais comum e o mais barato de corrigir. O elemento raiz precisa declarar o namespace oficial do protocolo, letra por letra:

<urlset xmlns="http://www.sitemaps.org/schemas/sitemap/0.9">

Um erro de digitação, um "https" dentro da URL do namespace (ela usa http mesmo) ou o namespace antigo 0.84 fazem o parser rejeitar o arquivo inteiro, ainda que todas as URLs estejam perfeitas. A correção é copiar a declaração acima sem nenhuma alteração. O mesmo vale para índices: <sitemapindex> usa exatamente o mesmo namespace. A referência oficial está em sitemaps.org.

Caracteres sem escape nas URLs

O XML reserva cinco caracteres, e todos aparecem em URLs reais: &, <, >, aspas duplas e aspas simples. Um & cru em uma query string interrompe o parse do arquivo a partir daquela linha, e tudo que vem depois é descartado.

<!-- errado: o parser quebra aqui -->
<loc>https://example.com/busca?cor=azul&tam=m</loc>

<!-- certo: & escapado como &amp; -->
<loc>https://example.com/busca?cor=azul&amp;tam=m</loc>

Se o seu gerador monta as URLs por concatenação de strings, troque-o por uma biblioteca XML de verdade, que faz o escape sozinha. É um erro que nunca acontece com serialização correta.

URLs relativas ou sem esquema

Cada <loc> deve ser uma URL absoluta, com esquema e host: https://example.com/pagina/. Caminhos relativos como /pagina/ e URLs sem esquema como //example.com/pagina/ são inválidos. A causa típica é um gerador caseiro que emite os caminhos sem o domínio; configure a URL base do site na ferramenta que monta o arquivo e regenere.

lastmod inválido ou no futuro

O <lastmod> aceita apenas datas no formato W3C: 2026-07-16 ou, com hora, 2026-07-16T09:30:00+00:00. Formatos regionais como 16/07/2026 e timestamps Unix são inválidos. Datas no futuro são um problema à parte: o Google afirma que só leva o lastmod em conta quando ele é consistentemente verdadeiro, e datas implausíveis derrubam essa confiança para o arquivo inteiro. Gere a data a partir da modificação real do conteúdo, nunca carimbando "agora" em todas as páginas.

Mais de 50.000 URLs ou 50 MB

O protocolo limita cada arquivo a 50.000 URLs e 50 MB descompactado. Passou de qualquer um dos dois, divida o sitemap em vários arquivos e liste-os em um índice — o processo completo está no nosso guia de índices de sitemaps. A maioria dos CMS e geradores faz a divisão automaticamente; se o seu não faz, dividir por tipo de conteúdo (produtos, posts, categorias) mantém os arquivos fáceis de depurar.

O sitemap responde 404, redireciona ou devolve HTML

A URL do sitemap precisa retornar HTTP 200 com conteúdo XML. Três falhas aparecem o tempo todo: o arquivo foi movido e a URL antiga responde 404; a URL redireciona (às vezes em cadeia) até uma página de erro; ou o servidor devolve uma página HTML — um erro bonito, uma tela de login, uma página de manutenção — servida no endereço do sitemap.xml. Teste com o navegador ou com curl -I: o status deve ser 200 e o content-type, XML. Se houver redirecionamento de http para https ou de www para sem www, atualize a URL enviada aos buscadores para a forma final.

URLs em um host diferente

As URLs listadas devem morar no mesmo host que serve o sitemap — incluindo a mesma forma com ou sem www e o mesmo esquema. Um sitemap servido em https://www.example.com/sitemap.xml que lista URLs https://example.com/… tem todas as entradas ignoradas. O mesmo vale para misturar http e https. Escolha a forma canônica do domínio e gere tudo — site, sitemap e URLs internas — nessa forma única.

Páginas bloqueadas pelo robots.txt ou com noindex

O sitemap diz "rastreie isto"; o robots.txt ou a meta tag noindex dizem "não". Sinais contraditórios não geram erro de validação, mas desperdiçam rastreamento e enchem os relatórios do Search Console de avisos. A regra é simples: o sitemap lista apenas páginas que você quer ver indexadas — canônicas, indexáveis e liberadas no robots.txt. Removeu uma seção do índice? Remova-a também do sitemap.

"Não foi possível buscar" no Google Search Console

Esse status genérico costuma ter uma destas causas: a URL enviada está errada (confira caractere por caractere), o servidor bloqueia o Googlebot por firewall ou proteção anti-bot, o robots.txt impede o acesso ao próprio arquivo do sitemap, ou o servidor demora demais para responder. Também aparece temporariamente logo após o envio — espere um dia antes de investigar. Se persistir, teste a URL com a ferramenta de inspeção de URL do próprio Search Console e verifique os logs do servidor pelos acessos do Googlebot. A documentação de referência está em developers.google.com.

Sintoma, causa e correção em uma tabela

SintomaCausa provávelCorreção
O validador rejeita o arquivo inteiroNamespace errado ou XML malformadoDeclare o namespace 0.9 exato; valide a sintaxe
O parse quebra no meio do arquivo&, < ou aspas sem escape em uma URLSerialize com biblioteca XML; escreva &amp;
Entradas individuais inválidasURLs relativas ou sem esquemaConfigure a URL base e gere URLs absolutas
Avisos de data em várias entradaslastmod fora do formato W3C ou no futuroUse AAAA-MM-DD com a data real de modificação
Arquivo recusado por tamanhoMais de 50.000 URLs ou 50 MBDivida e liste os arquivos em um índice
"Não foi possível buscar" no Search Console404, redirecionamento, bloqueio ou timeoutGaranta HTTP 200 com XML na URL final
URLs enviadas, mas ignoradasHost, www ou esquema diferente do sitemapPadronize tudo na forma canônica do domínio
Avisos de "página bloqueada" por URLrobots.txt ou noindex contradizem o sitemapListe apenas páginas indexáveis e liberadas

Corrigiu? Verifique antes de reenviar: cole o arquivo ou informe a URL no nosso validador de sitemap XML e confirme que erros e avisos zeraram. Depois, reenvie no Search Console e acompanhe o status por alguns dias. Para evitar que os erros voltem, vale seguir as boas práticas de manutenção de sitemap.

sitemaperrosSEO técnico

Frequently asked questions

Qual é o erro de sitemap mais comum?
O namespace errado ou ausente no elemento raiz, seguido de perto pelo & sem escape nas URLs. Os dois derrubam o parse do arquivo inteiro, então são também os primeiros a verificar.
O Google penaliza um site por erros no sitemap?
Não existe penalidade. O custo é indireto: entradas inválidas são ignoradas, o rastreamento fica menos eficiente e páginas novas demoram mais para serem descobertas.
Posso misturar URLs http e https no mesmo sitemap?
Não vale a pena. Liste apenas a forma canônica (normalmente https). URLs no esquema errado redirecionam ou são tratadas como não canônicas, e o sitemap perde valor como sinal.
Como confirmo que a correção funcionou?
Revalide o arquivo em um validador até zerar erros e avisos, reenvie o sitemap no Google Search Console e acompanhe o relatório de sitemaps nos dias seguintes.

Fazer uma verificação

Continue lendo