iLoveSEO

Guia

Noindex: o que é, quando usar e os erros que tiram seu site do ar

Noindex é uma instrução que diz ao buscador para não incluir aquela página nos resultados de busca. Ela é lida dentro da página — o que significa que o robô precisa poder acessá-la para obedecer.

Por Cícero Moura7 min de leitura

Noindex é a forma correta de manter uma página fora do Google sem tirá-la do ar. A página continua existindo, continua acessível por quem tem o link, continua funcionando — ela apenas não disputa espaço nos resultados.

A frase que mais economiza tempo neste tema é esta: noindex controla a indexação, não o acesso. Quase todo problema sério com essa tag nasce de confundir as duas coisas, e a confusão tem consequência assimétrica — o erro mais comum é justamente o que faz páginas importantes sumirem sem aviso.

O que é noindex? {#o-que-e}

Noindex é uma diretiva para robôs de busca que pede a exclusão de uma página do índice. Índice, aqui, é o banco de dados gigante de onde o buscador tira os resultados — o conceito está detalhado em mecanismo de busca.

Na prática, uma página com noindex:

  • Continua no ar e acessível por link direto.
  • Continua sendo rastreada pelo robô, ao menos por um tempo.
  • Não aparece nos resultados de busca.
  • Ainda passa autoridade pelos links que contém, ao menos enquanto o Google continuar processando a página.

O terceiro item é o objetivo; o segundo é o detalhe que muita gente ignora e que explica o erro mais comum deste artigo. Para respeitar a instrução, o robô precisa baixar e ler a página. Uma ordem que ninguém consegue ler não é obedecida — é só ignorada.

Como aplicar o noindex? {#como-aplicar}

Há duas formas, e a escolha depende do tipo de arquivo.

Meta tag no HTML, dentro do <head> da página:

```html
<meta name="robots" content="noindex">
```

Para instruir apenas o Google, trocando robots por googlebot:

```html
<meta name="googlebot" content="noindex">
```

Cabeçalho HTTP, quando a página não é HTML — PDF, imagem, planilha:

```
X-Robots-Tag: noindex
```

O cabeçalho é a única saída para arquivos que não têm <head> onde colocar uma meta tag. Sabe aquele PDF de proposta comercial que apareceu no Google? Ele não tem HTML — o X-Robots-Tag é o que resolve, configurado no servidor.

Uma observação sobre um caminho que não funciona mais: houve uma época em que se usava Noindex: dentro do robots.txt. O Google descontinuou o suporte a isso e a instrução é ignorada. Se você encontrar essa recomendação em algum tutorial antigo, ela está desatualizada.

Qual a diferença entre noindex, robots.txt e canonical? {#diferencas}

São três ferramentas frequentemente trocadas entre si, e cada uma resolve um problema diferente:

![Tabela comparando noindex, robots.txt e canonical: o que cada um faz e se o robô precisa ler a página](imagens/iloveseo-noindex-tres-ferramentas.png)

| | O que faz | O robô lê a página? | Força |
|---|---|---|---|
| noindex | Tira dos resultados | Sim, precisa ler | Diretiva (obedecida) |
| robots.txt | Impede o acesso | Não | Diretiva (obedecida) |
| canonical | Indica a versão preferida | Sim | Sugestão (pode ser ignorada) |

A leitura dessa tabela em uma frase: robots.txt é uma porta trancada; noindex é um bilhete dentro da sala; canonical é uma sugestão de qual sala é a principal.

Isso já antecipa o problema: um bilhete dentro de uma sala trancada nunca é lido. Voltamos a ele na seção do erro grave.

Quando usar noindex? {#quando-usar}

Os casos legítimos são mais específicos do que a maioria imagina:

  1. Páginas de agradecimento e confirmação — o "obrigado pelo cadastro" não serve a ninguém que chegue pela busca, e ainda distorce a contagem de conversões.
  2. Resultados de busca interna do site — geram infinitas URLs de baixo valor.
  3. Páginas de teste, staging ou ambiente de homologação.
  4. Versões para impressão de páginas que já existem em formato normal.
  5. Páginas de perfil ou área logada sem valor público.
  6. Arquivos e paginações de baixo valor, quando não agregam nada além de repetir listagens.
  7. Conteúdo temporário — página de campanha que vai sair do ar em um mês.
  8. Termos, políticas e páginas legais, quando não houver intenção de ranquear com elas.

Vale traduzir o item 1, que é o mais frequente e o mais mal resolvido. Sabe quando o relatório mostra conversões demais e você descobre que a página de obrigado estava recebendo tráfego orgânico? Pessoas chegavam direto pelo Google numa página que só faz sentido depois do formulário. O dado fica errado e o visitante fica confuso — dois problemas resolvidos por uma linha de HTML.

Quando NÃO usar noindex? {#quando-nao-usar}

Aqui mora mais risco do que na lista anterior:

  • Para resolver conteúdo duplicado. O instrumento certo é o canonical. Noindex remove a página; canonical consolida os sinais na versão preferida — que é o que você quer.
  • Em páginas com bons backlinks. Você joga fora autoridade que alguém já te deu — e autoridade é justamente o que mais custa a construir, como explicamos em o que é SEO.
  • Como faxina de conteúdo fraco em massa. Melhorar ou consolidar costuma render mais que esconder.
  • Em páginas que já recebem tráfego relevante. Parece óbvio e acontece com frequência em migrações.
  • Como substituto de senha. Noindex não protege nada: a página continua pública para quem tiver o link.

O último ponto merece ênfase porque é uma falha de segurança disfarçada de decisão de SEO. Noindex não é controle de acesso. Documento sensível se protege com autenticação, não com uma instrução para buscadores — que, aliás, só os buscadores que quiserem vão respeitar.

Qual o erro mais grave com noindex? {#erro-grave}

O erro campeão é combinar noindex com bloqueio no robots.txt achando que é reforço:

```

robots.txt

Disallow: /pagina-secreta/
```
```html
<!-- dentro da /pagina-secreta/ -->
<meta name="robots" content="noindex">
```

Isso não é cinto e suspensório — é a anulação de um pelo outro. O robots.txt impede o robô de baixar a página; sem baixar, ele nunca lê a meta tag. Resultado: a instrução de noindex nunca chega, e se houver links externos apontando para a URL, ela pode continuar aparecendo nos resultados, geralmente sem título nem descrição.

A correção é contraintuitiva e vale memorizar: para tirar uma página do Google, deixe o robô entrar. Remova o bloqueio do robots.txt e mantenha só o noindex.

Existe um segundo erro, mais raro e mais caro: noindex aplicado no template. Uma tag colocada num componente compartilhado — cabeçalho, layout padrão — se propaga para o site inteiro. É o cenário clássico de "o site sumiu do Google da noite para o dia", e costuma vir de um ambiente de teste que foi para produção com a configuração errada. Vale uma verificação sempre que houver deploy grande.

Noindex e nofollow são a mesma coisa? {#nofollow}

Não, e as duas podem aparecer juntas, o que aumenta a confusão:

  • noindex — não inclua esta página nos resultados.
  • nofollow — não siga os links que estão nesta página.

São independentes. Uma página pode ser indexada e ter seus links não seguidos, ou o contrário. A combinação noindex, nofollow pede as duas coisas ao mesmo tempo — e é usada com menos frequência do que se aplica, porque na maioria dos casos você quer o noindex e não tem motivo para desperdiçar os links.

Há uma consequência de longo prazo pouco comentada: uma página mantida em noindex por muito tempo tende a ser rastreada cada vez menos, e os links dela acabam perdendo relevância na prática. Se a página tem links internos importantes, isso é um argumento contra deixá-la fora do índice indefinidamente.

Como verificar se o noindex está funcionando? {#verificar}

Quatro checagens, da mais rápida à mais confiável:

  1. Ver o código-fonte da página e procurar a meta tag no <head>. Rápido, mas não prova que o Google já processou.
  2. Usar o operador site: no Google para ver se a URL ainda aparece. O uso de operadores está detalhado em operadores de pesquisa do Google.
  3. Inspecionar a URL no Search Console, que mostra explicitamente se a página foi excluída por noindex.
  4. Conferir os cabeçalhos HTTP, para o caso de a instrução vir por X-Robots-Tag e não estar no HTML.

Uma questão de expectativa: a remoção não é imediata. O robô precisa revisitar a página para ver a instrução, e isso pode levar de dias a semanas dependendo da frequência com que ele passa por ali. Se a urgência for real, o Search Console tem uma ferramenta de remoção temporária que age mais rápido, enquanto o noindex faz o trabalho definitivo.

Quais são as alternativas ao noindex? {#alternativas}

Antes de aplicar noindex, vale conferir se outro instrumento não resolve melhor. Cada um serve a uma intenção diferente:

| Situação | Instrumento certo |
|---|---|
| Página duplicada de outra | canonical |
| Página removida em definitivo | Status 410 |
| Página que mudou de endereço | Redirecionamento 301 |
| Conteúdo que ninguém pode ver | Autenticação |
| Página válida, mas sem valor na busca | noindex |

A diferença entre o 404 e o 410 é pequena e útil: o primeiro diz "não encontrei", o segundo diz "foi removido de propósito". O segundo tende a sair do índice mais rápido, justamente porque não deixa margem para o buscador achar que foi um problema temporário.

Sabe quando você tira do ar uma página antiga e ela insiste em aparecer no Google por semanas? Frequentemente ela está devolvendo 404 — ou, pior, uma página de erro bonita que responde 200 e faz o buscador acreditar que está tudo certo. Esse último caso, chamado de soft 404, é o que mais prolonga a permanência de conteúdo morto no índice.

Uma checagem rápida evita esse caso: abra a URL removida e confira o código de resposta que ela devolve. Se vier 200, você tem um soft 404 no colo, e nenhuma quantidade de espera vai resolver — o buscador está sendo informado, a cada visita, de que aquela página está perfeitamente saudável.

E vale registrar a regra que resume esta seção: noindex é para página que deve existir e não deve ranquear. Se a página não deve nem existir, o instrumento é outro. Vale checar também se a página bloqueada não está sendo listada no seu sitemap XML — mandar o buscador indexar e pedir que não indexe ao mesmo tempo é um sinal contraditório que só atrasa a remoção.

Conclusão {#conclusao}

Noindex é uma ferramenta de precisão, não uma vassoura. Ela serve para tirar dos resultados páginas que existem por razões operacionais e não têm nada a oferecer a quem chega pela busca — e serve mal para praticamente todo o resto.

O próximo passo prático: rode uma busca com site:seudominio.com.br e olhe o que aparece. Se houver páginas de agradecimento, resultados de busca interna ou ambientes de teste na lista, você acabou de encontrar os primeiros casos legítimos de noindex do seu site.

Dúvidas frequentes

Perguntas frequentes

Noindex tira a página do ar?

Não. A página continua publicada, acessível por link direto e funcionando normalmente. O noindex apenas pede que ela não apareça nos resultados de busca. Para tirar do ar de verdade, é preciso remover a página ou proteger com autenticação.

Quanto tempo o noindex leva para funcionar?

De alguns dias a algumas semanas. O buscador precisa rastrear a página novamente para ler a instrução, e o intervalo depende da frequência com que ele visita aquela URL. Para urgências, a ferramenta de remoção do Search Console age mais rápido, mas é temporária.

Posso usar noindex para resolver conteúdo duplicado?

Não é o instrumento certo. Para duplicidade, use a tag canonical, que consolida os sinais na versão preferida. O noindex simplesmente remove a página dos resultados, jogando fora qualquer autoridade que ela tivesse.

Noindex e robots.txt podem ser usados juntos?

Podem, mas quase nunca devem. Se o robots.txt bloqueia o acesso, o robô não consegue ler a meta tag de noindex, e a instrução nunca é aplicada. Para remover uma página do índice, deixe o rastreador acessá-la e use apenas o noindex.

Uma página com noindex ainda passa autoridade pelos links?

Inicialmente sim, mas o efeito tende a diminuir. Páginas mantidas fora do índice por muito tempo passam a ser rastreadas com menos frequência, e os links contidos nelas perdem relevância prática. Se a página tem links internos importantes, vale reconsiderar.

Leia também

Ilustração retrô de uma planta de arquitetura desenrolada, o mapa das páginas de um site

Guia

Sitemap XML: o que é, para que serve e como criar

Sitemap é o arquivo que lista as páginas do site para os buscadores. Veja para que serve de verdade, como criar, enviar ao Google e os erros comuns.

Cícero Moura03 de set. de 20266 min de leitura
Ilustração retrô de uma bússola de bolso aberta, a direção que o guia de SEO oferece a quem começa

Pilar

O que é SEO: o guia completo para começar do zero

SEO é o conjunto de técnicas para fazer um site ser encontrado nos buscadores. Entenda como funciona, os 4 pilares, como aplicar e por onde começar.

Cícero Moura03 de set. de 202614 min de leitura