SEO
Como diagnosticar problemas no sitemap XML, passo a passo
Um sitemap deve ser uma lista limpa das páginas que você quer ver indexadas. Veja como conferir se o seu carrega, é interpretado sem erros e lista apenas URLs ativos e indexáveis — e como corrigi-lo quando não é o caso.
Nesta página
Um sitemap XML é uma lista dos URLs que você gostaria que os mecanismos de busca rastreassem e indexassem. Ele não garante a indexação, mas um sitemap limpo ajuda os buscadores a encontrar páginas novas e atualizadas, enquanto um bagunçado desperdiça a atenção deles com redirecionamentos, erros e páginas que você pediu para não indexar. Se o arquivo em si ainda é novidade para você, comece por robots.txt e sitemap.xml explicados.
Os problemas de sitemap se dividem em dois grupos: o arquivo em si (ele pode ser encontrado e lido?) e o conteúdo (os URLs listados merecem estar ali?). Verifique nessa ordem.
Parte 1: o sitemap pode ser encontrado e lido?
Ele está onde os mecanismos de busca procuram?
Não existe um local único obrigatório; então, facilite a descoberta. Adicione ao seu robots.txt uma linha absoluta Sitemap: https://example.com/sitemap.xml e envie o sitemap no Google Search Console e no Bing Webmaster Tools. Muitas plataformas geram um em /sitemap.xml, /sitemap_index.xml ou /wp-sitemap.xml.
Ele retorna 200 com XML?
Abra o URL do sitemap no navegador e confira o status nas ferramentas de desenvolvedor. Falhas comuns: um 404 depois de uma mudança de plugin, um redirecionamento para a página inicial, uma página de login ou um erro "soft" — uma resposta 200 que, na verdade, é uma página de erro em HTML. A resposta deve ser XML (application/xml ou text/xml), ou XML comprimido com gzip no caso de arquivos .xml.gz.
Ele é interpretado sem erros?
O elemento raiz precisa ser <urlset> (uma lista de páginas) ou <sitemapindex> (uma lista de outros sitemaps). Espaços em branco sobrando ou avisos do PHP antes da declaração <?xml, caracteres & sem escape nos URLs (eles devem ser escritos como &) e uma saída truncada por timeout são os culpados de sempre. Um navegador que exibe "Erro de análise de XML" está dizendo exatamente onde olhar.
Ele está dentro dos limites?
Um arquivo de sitemap pode ter no máximo 50.000 URLs e 50 MB sem compressão. Sites maiores dividem os URLs em vários arquivos e os listam em um índice de sitemaps. Confira se todo sitemap filho citado no índice também carrega.
Parte 2: os URLs certos estão listados?
Cada URL do seu sitemap deve ser o endereço final, canônico e indexável de uma página que retorna 200. Qualquer outra coisa passa uma mensagem contraditória. Procure por:
- URLs que retornam 404, 410 ou 5xx. Páginas excluídas que ficaram em um sitemap estático, ou produtos que saíram de estoque e foram removidos.
- URLs que redirecionam. Muitas vezes é a forma antiga do URL depois de uma migração, ou a versão
http://ou semwww. Liste o destino no lugar. - Páginas com noindex. Listar uma página e dizer aos mecanismos de busca para não indexá-la é uma contradição. Veja o que significa noindex.
- URLs não canônicos. Versões com parâmetros ou duplicatas cuja canônica aponta para outro lugar. Saiba mais em como corrigir problemas de canônica.
- Outros hosts. Um sitemap só pode listar URLs do próprio host, a menos que você tenha verificado o envio entre sites; hostnames de homologação ou de CDN são um vazamento clássico.
- Duplicatas. O mesmo URL listado duas vezes, muitas vezes com e sem barra no final.
- URLs bloqueados pelo robots.txt. Os mecanismos de busca não conseguem rastrear o que você proibiu, então listar isso não serve para nada.
Datas em lastmod
<lastmod> deve usar o formato W3C Datetime, como 2026-09-24 ou 2026-09-24T10:30:00+00:00, e refletir a última alteração relevante na página. O Google diz que usa o lastmod quando ele é consistentemente preciso e que ignora priority e changefreq. Um sitemap que carimba todos os URLs com a data de hoje a cada build ensina os mecanismos de busca a ignorar o campo.
Verifique o seu robots.txt e o seu sitemap
O verificador de SEO gratuito do Rudra busca o seu robots.txt e os sitemaps declarados e informa se eles carregam e são interpretados sem erros, se listam a página testada e se trazem datas lastmod válidas.
Como verificar com o Rudra
O verificador de SEO de página única
O verificador de SEO gratuito do Rudra lê o seu robots.txt e os sitemaps que ele declara (até três, seguindo um índice de sitemaps até os primeiros sitemaps filhos) e recorre aos locais mais comuns quando nenhum é declarado. Ele aponta sitemaps que não podem ser acessados, que não são interpretados, que não listam a página testada ou que não têm datas lastmod, além de notas informativas sobre URLs repetidos, URLs em outros hosts e valores de lastmod que não são datas válidas. Também sinaliza problemas de sintaxe no robots.txt e uma regra que bloqueie o site inteiro.
Uma varredura do site
Só visitando os URLs listados dá para saber se eles realmente funcionam. Uma varredura de site do Rudra (conta gratuita, iniciada pelo seu painel) registra os URLs do seu sitemap e os compara com o que o rastreamento encontrou em cada endereço: URLs do sitemap que retornaram 4xx ou 5xx, URLs marcados com noindex, URLs que redirecionaram e URLs em outros hosts. Os URLs que o rastreamento não alcançou, por causa do limite de páginas do seu plano ou de regras do robots, são contados como "não rastreados", e não reportados como quebrados — portanto, um rastreamento pequeno de um sitemap grande vai mostrar muitos deles, e isso é esperado.
Search Console
O relatório Sitemaps mostra se o Google conseguiu ler cada arquivo e quantos URLs descobriu. O relatório Indexação de páginas, filtrado por um sitemap, informa quais URLs listados não estão indexados e por quê.
Como corrigir as causas mais comuns
- Gere o sitemap pelo seu CMS ou framework, e não à mão, para que páginas excluídas e despublicadas saiam automaticamente.
- Exclua as páginas com noindex, as redirecionadas e as canonicalizadas para outro URL nas configurações do seu plugin de SEO ou do gerador de sitemap.
- Use a sua forma preferencial de URL em todo lugar — protocolo, host e barra final — para que sitemap, canônicas e links internos estejam de acordo.
- Só atualize o lastmod quando o conteúdo mudar.
- Reenvie depois de grandes mudanças, como uma migração, e acompanhe o relatório Sitemaps em busca de erros de leitura.
Perguntas frequentes
Eu preciso de um sitemap?
Sites pequenos e bem interligados podem ser rastreados sem problemas sem um. O sitemap ajuda mais em sites grandes, em sites novos com poucos links apontando para eles e em sites que adicionam ou atualizam páginas com frequência.
Listar uma página no sitemap faz com que ela seja indexada?
Não. O sitemap ajuda os mecanismos de busca a descobrir URLs; se eles vão indexar a página depende da qualidade dela, de duplicação e de sinais como noindex ou tags canônicas.
Imagens ou PDFs devem estar no meu sitemap?
Você pode listá-los, e existem extensões de sitemap para imagens, mas a prioridade é que toda página HTML importante esteja listada com o seu URL canônico.
Por que a varredura do site diz que muitos URLs do sitemap não foram rastreados?
O rastreamento para no limite de páginas do seu plano e respeita o robots.txt, então pode não alcançar todos os URLs que o seu sitemap lista. Esses URLs não são tratados como quebrados — apenas não foram verificados naquele rastreamento.