SEO
O que significa noindex? Como funciona, quando usar e como encontrá-lo
O noindex mantém uma página fora dos resultados de busca. Veja como funciona, em que difere de um bloqueio no robots.txt, quando é a ferramenta certa — e como flagrar o que ficou ativo por acidente.
Nesta página
noindex é uma instrução para os mecanismos de busca: vocês podem visitar esta página, mas não a mostrem nos resultados. É um dos controles mais úteis que você tem sobre o que aparece na busca — e, quando fica ativo por acidente, um dos mais prejudiciais, porque nada na página parece errado para quem a visita.
Duas formas de definir o noindex
A meta tag robots
No <head> da página: <meta name="robots" content="noindex">. O nome robots vale para todos os mecanismos de busca; você pode mirar em um deles usando o nome próprio, como googlebot. As diretivas podem ser combinadas: noindex, nofollow também pede aos rastreadores que não sigam os links da página, e none significa o mesmo que noindex, nofollow.
O cabeçalho X-Robots-Tag
As mesmas diretivas podem ser enviadas como um cabeçalho de resposta HTTP: X-Robots-Tag: noindex. Essa é a única opção para arquivos que não são HTML, como PDFs, e é fácil aplicá-la ao site inteiro na configuração do servidor — que é justamente como ela acaba esquecida por engano. Você não vai vê-la no código-fonte da página; confira os cabeçalhos de resposta nas ferramentas de desenvolvedor ou com curl -I.
noindex não é a mesma coisa que um bloqueio no robots.txt
Este é o mal-entendido mais comum. O Disallow no robots.txt impede os rastreadores de buscar uma página; o noindex os impede de indexá-la. Para ver um noindex, o rastreador precisa buscar a página — então, se você bloqueia um URL no robots.txt, o rastreador nunca vê o noindex. O URL pode até aparecer nos resultados, sem descrição, se outros sites apontarem para ele.
Portanto: para manter uma página fora da busca, permita o rastreamento e use noindex. O Google deixou de aceitar regras noindex dentro do robots.txt em 2019. Nosso guia sobre robots.txt e sitemap.xml explica para que o robots.txt realmente serve.
Quando o noindex é a ferramenta certa
- Páginas de agradecimento, de confirmação e de conta, que não têm valor na busca.
- Páginas de resultados da busca interna do site.
- Páginas rasas de tags, arquivos ou filtros que você não quer ver concorrendo com as suas páginas principais.
- Sites de homologação e de pré-visualização — de preferência também protegidos por senha, já que o
noindexnão impede ninguém de visitá-los. - Landing pages de campanha que duplicam o seu conteúdo principal.
O noindex não é a ferramenta certa para duplicatas que você quer consolidar em um único URL — para isso, use uma canônica ou um redirecionamento, como explicamos em como corrigir problemas de canônica. E não combine noindex com uma canônica que aponta para outra página: um diz "descarte esta página", a outra diz "esta página é uma cópia daquela".
Como o noindex acaba ficando ativo por acidente
- Uma configuração do site de homologação copiada para produção no lançamento.
- A caixa "Evitar que mecanismos de busca indexem este site" do WordPress, em Configurações → Leitura, deixada marcada.
- Um padrão de plugin de SEO que define tipos inteiros de conteúdo, como produtos ou categorias, como noindex.
- Um cabeçalho
X-Robots-Tagadicionado na configuração do servidor ou da CDN para homologação e implantado em todos os ambientes. - Um template de página que adiciona
noindexquando um campo está vazio.
Verifique se uma página é indexável
O verificador de SEO gratuito do Rudra procura noindex na meta tag robots e no cabeçalho X-Robots-Tag, confere o robots.txt e resume o resultado como indexável ou não, com o motivo.
Como verificar uma página
Passe a página pelo verificador de SEO gratuito do Rudra. Ele procura noindex e nofollow (ou none) na meta tag robots e no cabeçalho X-Robots-Tag, confere se o robots.txt bloqueia a página e registra um redirecionamento HTTP ou um status de erro — e então mostra um veredito único de "indexável", com o motivo. Ele também sinaliza como conflito uma página noindex cuja canônica aponta para outro lugar e registra diretivas que limitam o snippet, como nosnippet, que não bloqueiam a indexação, mas mudam a aparência do resultado. Um noindex custa 30 pontos na nota de SEO, porque tira a página da busca por completo.
Para um site inteiro, uma varredura de site do Rudra conta as páginas indexáveis e as noindex e sinaliza as páginas noindex listadas no seu sitemap. No Google Search Console, o relatório Indexação de páginas lista as páginas "Excluída pela tag 'noindex'", e a Inspeção de URL mostra se um URL específico pode ser indexado.
Como remover um noindex
- Descubra de onde ele vem: do código-fonte da página (meta tag), dos cabeçalhos de resposta (
X-Robots-Tag), das configurações do CMS, das configurações do plugin de SEO ou da configuração do servidor. - Remova-o na origem e limpe qualquer cache de página ou de CDN.
- Verifique de novo a página no ar para confirmar que tanto a tag quanto o cabeçalho sumiram.
- Confirme que a página não está bloqueada no robots.txt e que está no seu sitemap.
- No Search Console, use a Inspeção de URL e solicite a indexação das páginas importantes. O novo rastreamento ainda pode levar dias ou semanas.
Perguntas frequentes
O noindex remove uma página do Google imediatamente?
Não. O Google precisa rastrear a página de novo para ver a diretiva. Para remoções urgentes, a ferramenta Remoções do Search Console oculta um URL temporariamente enquanto o noindex entra em vigor.
Páginas noindex ainda transmitem sinais de link?
Os rastreadores ainda podem seguir os links de uma página noindex, a menos que você adicione nofollow. Com o passar do tempo, os mecanismos de busca podem rastrear uma página com noindex com menos frequência; por isso, não dependa de páginas noindex como caminho principal até conteúdos importantes.
Páginas noindex devem estar no meu sitemap?
Não. O sitemap deve listar as páginas que você quer ver indexadas. Listar páginas noindex envia sinais contraditórios.
noindex é a mesma coisa que nofollow?
Não. O noindex mantém a página fora dos resultados; o nofollow pede aos rastreadores que não sigam os links dela. Os dois podem ser usados separadamente ou juntos.