← voltar Janela de escritório em Londres molhada pela chuva ao anoitecer, caderno com anotações manuscritas e chá frio sobre uma mesa, clima editorial cinematográfico

Rastreado Atualmente Não Indexado: Como Eu Resolvo

Em 2021, um escritório local de solicitadores em Manchester procurou a Seahawk depois que seu blog tinha ficado parado no Search Console por quatro meses. Quarenta e três posts. Zero indexados. Cada um deles mostrando "Rastreado, atualmente não indexado." A agência anterior tinha encolhido os ombros e dito que Google estava "apenas sendo lento." Acessei o site em uma tarde e identifiquei a causa raiz em noventa minutos. Conteúdo insuficiente, descrições meta duplicadas em páginas de áreas de prática vazando para o orçamento de rastreamento do blog, e um sitemap Yoast configurado incorretamente apontando para arquivos de categoria com noindex.

Essa frase, "Rastreado, atualmente não indexado," é um dos estatutos mais frustrantes que o Google Search Console pode mostrar. Significa que Google encontrou a página. Gastou recursos baixando-a. E então olhou para o que havia ali e disse: não vale a pena. Entender por que Google toma essa decisão, e corrigir isso sistematicamente, é algo que tive que ficar muito bom em 12.000+ sites.

---

O Que "Rastreado Atualmente Não Indexado" Realmente Significa

Existe um equívoco comum de que esse status significa que Google ainda não teve tempo de indexar. Não é o que significa. Google rastreou a URL. Tomou uma decisão deliberada de não incluí-la no índice. Esse é um problema completamente diferente, e exige uma resposta diferente.

As duas causas amplas são sinais de qualidade e sinais técnicos. Sinais de qualidade: Google não acha que a página agrega valor suficiente para servir os usuários. Sinais técnicos: algo na sua configuração está confundindo o Googlebot ou contradizendo sua intenção. Ambos são corrigíveis. Nenhum se corrige sozinho.

Vale a pena ler a documentação própria do Google sobre como o Google Search funciona se você quer entender o pipeline do rastreamento até a indexação. É árido mas útil.

---

Passo Um: Puxe o Panorama Completo no Search Console

Não adivinhe. Abra o Google Search Console e vá para Pages (antigamente Coverage). Filtre para "Rastreado, atualmente não indexado." Exporte a lista. Você quer o conjunto de URL completo, não apenas uma amostra.

Depois faço referência cruzada dessa lista contra um rastreamento do Screaming Frog do mesmo site. Toda vez. Screaming Frog vai te contar a contagem de palavras da página (via extração customizada ou as métricas de legibilidade integradas), se está no sitemap XML, o status de sua tag canônica, sua diretiva de meta robots, contagem de links internos para a página, e código de resposta. Essa combinação te diz a maioria do que você precisa.

O Que Estou Procurando Primeiro

  • Páginas com menos de 300 palavras de conteúdo do corpo
  • Páginas com descrições meta idênticas ou quase idênticas a outras páginas indexadas
  • Páginas não incluídas no sitemap XML
  • Páginas recebendo zero links internos
  • URLs de paginação órfãos ou páginas de arquivo insuficiente sendo rastreadas

No caso dos solicitadores de Manchester, os posts do blog tinham média de 180 palavras. Esse era o problema central. Tudo o mais era secundário.

---

O Problema de Qualidade: Google Acha Que Sua Página Não É Boa o Suficiente

É desconfortável ouvir, mas é a causa mais comum que vejo. O limiar de qualidade do Google se moveu consideravelmente desde 2022. Páginas que teriam silenciosamente permanecido no índice três anos atrás estão sendo ativamente excluídas agora.

Conteúdo Fino

Se uma página tem menos de 400-500 palavras e não apresenta sinais fortes de E-E-A-T (biografia do autor, citações, insights originais), o Google frequentemente a rastreia e a estaciona. Eu vi isso particularmente com:

  • Páginas de produtos WooCommerce com cópia do fabricante colada literalmente
  • Páginas de anúncio imobiliário com descrições de propriedade em duas linhas
  • Páginas de localização construídas a partir de um template com apenas o nome da cidade trocado
  • Páginas de FAQ antigas que respondem uma pergunta em um parágrafo

A solução não é apenas adicionar palavras. Adicionar preenchimento piora as coisas. A solução é adicionar informações úteis e específicas que um humano realmente gostaria de ler. Para os advogados, reescrevi seus posts do blog para incluir resultados reais de casos (anonimizados), referências específicas da legislação do Reino Unido e exemplos práticos. As contagens de palavras passaram de 180 para 900. Oito semanas depois, trinta e uma das quarenta e três postagens foram indexadas.

Conteúdo Duplicado e Quase Duplicado

O relatório de conteúdo duplicado do Screaming Frog é seu aliado aqui. Mas também execute as URLs pelo Copyscape ou Siteliner se estiver preocupado com duplicação entre sites. Tive clientes no setor de e-commerce onde o fornecedor estava fornecendo a mesma descrição de produto para quarenta outros varejistas. O Google indexa uma e ignora o resto. Isso não é um bug, é funcionando conforme previsto.

A quase-duplicação interna é mais traiçoeira. Se você tem um site com páginas de serviço para "Encanador em Leeds", "Encanador em Sheffield", "Encanador em Bradford", e elas são 95% idênticas além do nome da cidade, o Google vai escolher uma e suprimir o resto. Vi esse padrão causar sistemas inteiros de busca facetada caírem no inferno de "Rastreada, atualmente não indexada".

---

O Problema Técnico: Algo na Sua Configuração Está Enviando Sinais Mistos

Às vezes o conteúdo é genuinamente bom e o Google ainda está recusando indexar. É aqui que você investiga os sinais técnicos.

Confusão de Tag Canônica

Este é o culpado técnico número um que encontro. Uma página é canonicalizada para si mesma (correto), mas em algum lugar anterior, uma página de categoria ou uma URL paginada tem uma canônica apontando para a página que você quer indexada. O Google às vezes interpreta isso como um sinal de que a fonte canônica é uma duplicada. Vi temas WordPress fazer isso automaticamente de formas genuinamente difíceis de detectar sem um rastreamento.

Verificação: toda página em sua lista "Rastreada, atualmente não indexada" tem uma canônica autorreferenciadora? Alguma outra coisa no site tem uma canônica apontando para essas URLs inesperadamente?

Problemas de Sitemap XML

Seu sitemap deve listar apenas URLs que você ativamente quer indexadas. Isso parece óbvio. Na prática, Yoast, Rank Math e a maioria dos outros plugins de SEO vão alegremente incluir páginas noindexadas, URLs paginadas e arquivos de tag no seu sitemap se você não tomar cuidado. O Google vê uma URL no seu sitemap, a rastreia, encontra um noindex ou conteúdo thin, e é um crédito de rastreamento desperdiçado, mais um sinal de confiança de que você realmente não sabe o que está fazendo com seu site.

Audito sitemaps com um processo simples:

  1. Baixe o XML do sitemap
  2. Importe cada URL para uma planilha
  3. Execute cada URL pelo Screaming Frog (ou use a exportação em massa)
  4. Sinalize qualquer URL que está noindexada, redireciona ou retorna um status não-200
  5. Remova essas URLs do sitemap

Isso sozinho limpou status "Rastreada, atualmente não indexada" para três clientes no último ano. Sem tocar no conteúdo.

PageRank (sim, ainda é relevante, sim, até em 2024) flui através de links internos. Uma página sem links internos apontando para ela é efetivamente invisível para o Googlebot em termos de autoridade. O Google pode rastreá-la via sitemap e depois decidir que não é importante o suficiente para indexar porque nada no site está apontando para ela.

Páginas órfãs são comuns. Uso o relatório "Orphan URLs" do Screaming Frog (em Site Structure) para encontrá-las. Adicione três a cinco links internos relevantes para cada página que está no bucket "not indexed" e você verá movimento em quatro a seis semanas.

---

Crawl Budget: Quando É Realmente um Problema de Capacidade

Para sites menores (menos de 1.000 páginas), crawl budget quase nunca é o problema real. Sei que as pessoas jogam essa explicação por aí bastante. Mas para grandes sites de e-commerce (tínhamos uma varejista de moda na Seahawk com 80.000 SKUs), realmente importa.

Se o Googlebot está gastando suas visitas rastreando sua navegação facetada infinita, seus parâmetros de session ID ou suas páginas de resultados de busca interna, não está chegando às páginas de produto que realmente importam. A documentação do Google sobre crawl budget é um dos poucos guias oficiais de SEO que eu realmente recomendaria ler do início ao fim.

Solução: bloqueie parâmetros de URL que geram páginas quase duplicadas via a ferramenta URL Parameters (se ainda estiver usando o Search Console antigo) ou via robots.txt para o Googlebot, e certifique-se de que suas páginas de busca interna estão com noindex. Isso libera capacidade de rastreamento para as páginas que importam.

---

Solicitando Indexação: Quando Usar e Quando Não Usar

O botão "Request Indexing" no Search Console é útil para URLs individuais de alta prioridade depois que você fez alterações. Não é um substituto para corrigir a causa subjacente. Vejo freelancers clicando compulsivamente nesse botão em páginas que não tocaram. Não faz nada por si só.

Minha regra: corrija primeiro, solicite segundo. Depois de fazer alterações substanciais em conteúdo, tags canônicas ou links internos, envie a URL via ferramenta URL Inspection. Aguarde duas a quatro semanas. Se ainda não estiver indexada depois disso, o problema subjacente não foi corrigido.

Mais uma coisa: a cota de solicitação de indexação é limitada. Não a desperdice em páginas que ainda têm conteúdo fino ou configurações canônicas quebradas. Você está apenas pedindo ao Google que confirme sua própria decisão.

---

Quanto Tempo Leva para Limpar?

Honestamente, varia mais do que a maioria dos guias de SEO admite. Vi páginas passarem de "Crawled, currently not indexed" para indexadas em cinco dias após atualização de conteúdo. Vi outras levarem doze semanas. Os fatores que parecem importar mais:

  • Quanta autoridade o domínio tem no geral (domínios mais antigos e com links veem reconsideração mais rápida)
  • Se a correção foi relacionada a conteúdo (mais lenta) ou técnica (mais rápida)
  • Com que frequência o Googlebot visita o site (verifique o relatório Crawl Stats no Search Console)

Defina uma planilha de rastreamento. Anote a data em que fez alterações. Verifique o Search Console a cada duas semanas. Não entre em pânico se nada se mover na semana um.

---

FAQ

Por que o Google rastreia uma página mas depois não a indexa?

Rastreamento e indexação são etapas separadas no pipeline do Google. Rastreamento significa apenas que o Googlebot baixou a página. Indexação significa que o Google decidiu que vale a pena mostrar nos resultados de busca. A lacuna acontece quando a avaliação de qualidade do Google determina que a página não adiciona valor suficiente, duplica conteúdo existente no índice ou contém sinais conflitantes como uma tag noindex em algum lugar da cadeia.

Submeter uma URL no Search Console garante indexação?

Não. Coloca a URL em uma fila de prioridade para análise, mas o Google ainda faz sua própria decisão de qualidade. Se a página tem conteúdo fino ou problemas técnicos, submetê-la apenas acelera o Google confirmando que não a indexará.

Uma página pode ser indexada depois de ficar presa nesse status por muito tempo?

Sim, absolutamente. Limpei URLs que estavam em "Crawled, currently not indexed" por mais de um ano, uma vez que o conteúdo foi devidamente melhorado. O Google reavalia. Não é uma blacklist permanente. Dito isso, se uma página esteve nesse status por mais de seis meses, vale a pena se perguntar honestamente se merece ser indexada.

Esse status é o mesmo que "Discovered, currently not indexed"?

Não, e a distinção importa. "Discovered, currently not indexed" significa que o Google conhece a URL, mas ainda não a rastreou. É frequentemente um problema de crawl budget ou link interno. "Crawled, currently not indexed" significa que já foi avaliada e deixada de lado. Ambas precisam de atenção, mas as correções são ligeiramente diferentes.

---

Não existe uma solução mágica única para "Rastreado, mas não indexado no momento." Na minha experiência, quase sempre é um problema de qualidade de conteúdo ou um sinal técnico, geralmente uma combinação dos dois. Comece pelos dados, corrija o que encontrar e dê tempo. Google não está tentando puni-lo. Apenas precisa de uma razão para se importar com a página. Dê uma a ele.

← voltar