Pular para o conteúdo principal
← Todos os guias

Por que páginas não são indexadas

Uma página pode ficar fora do índice do Google por diversos motivos: acesso ou diretivas, página duplicada ou tratamento canônico, um rastreamento que ainda não aconteceu ou um rastreamento que não levou à indexação. Search Console reporta o status da indexação; a correção depende de qual status você realmente possui.

Comece com o status, não com um diagnóstico

O relatório de indexação de páginas inclui problemas técnicos genuínos e exclusões esperadas. Uma regra robots.txt, diretiva noindex, requisito de autenticação ou falha na resposta podem impedir a indexação; status duplicados e canônicos podem estar funcionando exatamente como pretendido; e um URL descoberto pode simplesmente ainda não ter sido rastreado.

O estado mais enganoso é “Rastreado – atualmente não indexado”. Isso confirma que o Google buscou a página, mas não a adicionou ao índice naquele momento. O Google diz explicitamente que a página pode ou não ser indexada posteriormente e que não há necessidade de reenviá-la apenas por causa desse status.

Os status que são erros de verdade

Estes descrevem algo do seu lado que impediu o armazenamento. O Google rotula a origem de cada um como Site quando você mesmo pode corrigir, e como Google quando a causa está do lado deles. Corrigir a resposta subjacente é o conserto inteiro.

StatusO que significaOrigem
Erro de servidor (5xx)O servidor devolveu um erro de nível 500Google
Erro de redirecionamentoUma cadeia de redirecionamentos entrou em laço ou falhouSite
URL bloqueada pelo robots.txtO robots.txt negou a permissão de downloadSite
URL marcada como ‘noindex’A página serviu uma diretiva noindexSite
Soft 404 (404 brando)Uma mensagem de não encontrado devolvida com código 200Site
Bloqueada por solicitação não autorizada (401)A página exigiu credenciaisSite
Não encontrada (404)A URL devolveu um 404Site
Bloqueada por acesso proibido (403)O servidor devolveu um 403Site
Bloqueada por outro problema 4xxAlguma outra resposta 4xxSite

Dois deles merecem atenção extra por serem tão frequentemente autoinfligidos. Um 404 brando significa que você devolve uma página gentil de «não há nada aqui» com status 200: o buscador vê sucesso e conteúdo raso em vez de ausência, então diga a verdade com um 404 ou 410. E um 401 ou 403 em páginas que deveriam ser públicas costuma significar que uma regra de staging ou um firewall foi para produção.

Os status que parecem erros e não são

São os que geram mais trabalho desperdiçado. Cada um deles é o Google relatando uma decisão que ele tomou, não uma falha que você introduziu. Persegui-los consome a atenção de que os problemas reais precisam.

StatusO que de fato significa
Página alternativa com tag canônica adequadaA consolidação funcionando exatamente como pretendido
Duplicada sem canônica selecionada pelo usuárioVocê não declarou canônica, então o Google escolheu uma
Duplicada, o Google escolheu canônica diferenteVocê declarou uma e o Google discordou
Página com redirecionamentoUma URL não canônica redirecionando, conforme o projeto
Detectada, mas não indexada no momentoConhecida, mas ainda não baixada
Rastreada, mas não indexada no momentoBaixada, avaliada e posta de lado

Vale separar os dois status de duplicata. «Sem canônica selecionada pelo usuário» significa que você nunca declarou uma e o Google escolheu por você: quase sempre inofensivo, mas você abriu mão de uma decisão que podia tomar. «O Google escolheu canônica diferente» significa que você declarou uma e foi contrariado, sinal de que a página que indicou não é a que o buscador considera principal.

Ler «rastreada, mas não indexada» com honestidade

Este status significa que o Google rastreou a página, mas não a indexou naquele momento. Ele não identifica uma causa universal e o teste de inspeção URL ao vivo não pode prever o sucesso da indexação com certeza. Não vale a pena inventar um erro técnico que o relatório não nomeou.

Em sites baseados em templates, vale revisar páginas quase duplicadas, sinais canonical, links internos e se cada página adiciona informações que páginas semelhantes não oferecem. São verificações de diagnóstico, não uma afirmação de que toda URL com esse status falhou em um limite de qualidade.

  1. Abra a Inspeção de URL e confirme que a página devolve 200, é autocanônica e renderiza seu conteúdo principal.
  2. Compare-a com as três irmãs mais próximas. Se der para trocar os valores substituídos e obter uma página equivalente, o buscador também vê isso.
  3. Verifique se algo a liga internamente com texto âncora descritivo, ou se ela só existe no sitemap.
  4. Pergunte o que esta página responde que nenhuma irmã responde. Se não houver resposta, esse é o achado.
  5. Mude a página para que a resposta exista e então solicite indexação — nessa ordem.

«Detectada, mas não indexada» é outro sinal

Este significa que a URL é conhecida mas não foi baixada. Num site pequeno costuma ser um estado passageiro. Em escala é o sintoma mais claro que o Google nomeia de uma restrição real de crawl budget: URLs demais, procura de menos, e a fila nunca chega até elas.

Se uma fatia grande das suas URLs está aqui, o trabalho produtivo é reduzir quantas URLs de baixo valor você pede ao buscador que considere — consolidar duplicatas, devolver 404 corretos para o que já se foi, encurtar cadeias de redirecionamento — em vez de reenviar páginas uma a uma.

Trabalhar o relatório em vez dos sintomas

O relatório é organizado por causa, o que dá vontade de trabalhá-lo de cima para baixo por volume. Resista. Mil URLs em «Página com redirecionamento» normalmente são um mapa de redirecionamentos que funciona, ao passo que quarenta em «Soft 404» são um defeito real afetando páginas reais.

  • Conserte primeiro tudo da tabela de erros: é inequívoco e mecânico.
  • Descarte os status informativos, a menos que o volume contrarie sua intenção, como uma consolidação canônica que você nunca projetou.
  • Trate «rastreada, mas não indexada» como um atraso editorial, não técnico.
  • Só revalide depois que a resposta ou o conteúdo subjacente realmente mudarem.

Teste no seu próprio site

Perguntas e respostas

Reenviar uma URL força a indexação?

Não. Solicitar indexação recoloca um rastreio na fila; não anula a decisão que veio depois do anterior. Reenvie depois que a página mudou, não no lugar de mudá-la.

Por que algumas páginas localizadas são indexadas e outras não?

Páginas de template que diferem só por um nome substituído leem-se como quase duplicatas. Buscadores costumam indexar um subconjunto e descartar o resto, e quais sobrevivem segue a procura do mercado mais do que a marcação. O conserto é dar aos idiomas descartados algo próprio a dizer, não ajustar suas tags.

«Página alternativa com tag canônica adequada» é problema?

Não. Relata a consolidação canônica funcionando conforme projetado. Só merece um olhar se o volume for muito maior do que sua estratégia canônica explicaria, o que sugeriria a geração de URLs que você não pretendia.

Qual a diferença entre 404 brando e 404?

Um 404 diz a verdade: não há nada aqui. Um 404 brando mostra uma mensagem de não encontrado devolvendo 200, então o buscador registra o download bem-sucedido de uma página rasa. Devolva 404 ou 410 de verdade para tudo que realmente se foi.

Quanto esperar antes de tratar a não indexação como decisão?

Compare com o próprio site em vez do relógio. Se páginas comparáveis publicadas junto foram indexadas em dias e esta está parada há semanas, ela foi avaliada, não atrasada.