← volver Ventana de oficina londinense mojada por lluvia al anochecer, cuaderno con notas manuscritas y té frío sobre un escritorio, ambiente editorial cinematográfico

Crawled Currently Not Indexed: Cómo lo Arreglo

En 2021, un despacho de abogados local en Mánchester llegó a Seahawk después de que su blog llevaba cuatro meses muerto en Search Console. Cuarenta y tres artículos. Cero indexados. Todos mostrando "Rastreado, actualmente no indexado." La agencia anterior se había encogido de hombros y les dijo que Google "simplemente estaba siendo lento." Abrí el sitio una tarde y encontré la causa raíz en noventa minutos. Contenido delgado, descripciones meta duplicadas en páginas de áreas de práctica que se filtraban al presupuesto de rastreo del blog, y un mapa del sitio Yoast mal configurado que apuntaba a archivos de categorías con noindex.

Esa frase, "Rastreado, actualmente no indexado," es uno de los estados más frustrantes que Google Search Console puede mostrarte. Significa que Google encontró la página. Gastó recursos descargándola. Y luego miró lo que había y dijo: no vale la pena. Entender por qué Google toma esa decisión, y arreglarlo sistemáticamente, es algo en lo que he tenido que ser muy bueno en más de 12,000 sitios.

---

Qué Significa Realmente "Rastreado Actualmente No Indexado"

Existe una idea errónea común de que este estado significa que Google aún no ha llegado a indexar. Eso no es lo que significa. Google rastreó la URL. Tomó una decisión deliberada de no incluirla en el índice. Ese es un problema completamente diferente, y requiere una respuesta diferente.

Las dos causas amplias son señales de calidad y señales técnicas. Señales de calidad: Google no cree que la página agregue suficiente valor a los usuarios. Señales técnicas: algo en tu configuración está confundiendo a Googlebot o contradice tu intención. Ambas son reparables. Ninguna se repara sola.

Vale la pena leer la documentación propia de Google sobre cómo funciona Google Search si quieres entender el pipeline desde rastreo hasta índice. Es árida pero útil.

---

Paso Uno: Obtén la Imagen Completa en Search Console

No adivines. Abre Google Search Console y ve a Páginas (anteriormente Cobertura). Filtra a "Rastreado, actualmente no indexado." Exporta la lista. Quieres el conjunto de URLs completo, no solo una muestra.

Luego hago referencia cruzada de esa lista contra un rastreo de Screaming Frog del mismo sitio. Cada vez. Screaming Frog te dirá el recuento de palabras de la página (mediante extracción personalizada o las métricas de legibilidad integradas), si está en el sitemap XML, su estado de etiqueta canónica, su directiva meta robots, el recuento de enlaces internos a la página, y código de respuesta. Esa combinación te dice la mayoría de lo que necesitas.

Lo Que Estoy Buscando Primero

  • Páginas con menos de 300 palabras de contenido de cuerpo
  • Páginas con descripciones meta idénticas o casi idénticas a otras páginas indexadas
  • Páginas no incluidas en el sitemap XML
  • Páginas que reciben cero enlaces internos
  • URLs de paginación huérfanas o páginas de archivo delgadas siendo rastreadas

En el caso del despacho de abogados de Mánchester, los artículos del blog promediaban 180 palabras. Ese era el problema central. Todo lo demás era secundario.

---

El Problema de Calidad: Google Piensa que tu Página No es Suficientemente Buena

Es incómodo escucharlo pero es la causa más común que veo. El umbral de calidad de Google se ha movido considerablemente desde 2022. Las páginas que se hubieran quedado quietas en el índice hace tres años ahora están siendo excluidas activamente.

Contenido Delgado

Si una página tiene menos de 400-500 palabras y no presenta señales sólidas de E-E-A-T (biografía del autor, citas, perspectiva original), Google a menudo la rastreará y la estacionará. He visto esto particularmente con:

  • Páginas de productos de WooCommerce con texto del fabricante copiado textualmente
  • Páginas de listados inmobiliarios con descripciones de propiedades de dos líneas
  • Páginas de ubicación construidas desde una plantilla con solo el nombre de la ciudad intercambiado
  • Páginas de preguntas frecuentes antiguas que responden una pregunta en un párrafo

La solución no es solo agregar palabras. Agregar relleno lo empeora. La solución es agregar información útil y específica que un humano realmente quiera leer. Para los abogados, reescribí sus publicaciones de blog para incluir resultados de casos reales (anonimizados), referencias específicas a la legislación del Reino Unido y ejemplos prácticos. Los recuentos de palabras pasaron de 180 a 900. Ocho semanas después, treinta y uno de los cuarenta y tres posts estaban indexados.

Contenido duplicado y casi duplicado

El informe de contenido duplicado de Screaming Frog es tu aliado aquí. Pero también ejecuta las URLs a través de Copyscape o Siteliner si te preocupa la duplicación entre sitios. He tenido clientes en el sector del comercio electrónico donde su proveedor proporcionaba la misma descripción de producto a otros cuarenta minoristas. Google indexa una e ignora el resto. Eso no es un error, está funcionando como se esperaba.

La casi-duplicación interna es más engañosa. Si tienes un sitio con páginas de servicios para "Plomero en Leeds", "Plomero en Sheffield", "Plomero en Bradford", y son 95% idénticas excepto por el nombre de la ciudad, Google va a elegir una y suprimir el resto. He visto este patrón causar que sistemas enteros de búsqueda facetada caigan en el infierno de "Rastreado, actualmente no indexado".

---

El problema técnico: algo en tu configuración está enviando señales contradictorias

A veces el contenido es genuinamente bueno y Google se niega a indexarlo. Aquí es donde profundizas en señales técnicas.

Confusión en etiquetas canónicas

Este es el culpable técnico número uno que encuentro. Una página se canonicaliza a sí misma (correcto), pero en algún lugar anterior, una página de categoría o una URL paginada tiene una canónica que apunta a la página que quieres indexar. Google a veces interpreta esto como una señal de que la fuente canónica es un duplicado. He visto temas de WordPress hacer esto automáticamente de formas genuinamente difíciles de detectar sin un rastreo.

Verifica: ¿cada página en tu lista "Rastreado, actualmente no indexado" tiene una canónica que se auto-referencia? ¿Algo más en el sitio tiene una canónica que apunta a estas URLs inesperadamente?

Problemas en mapas de sitio XML

Tu mapa de sitio debe listar solo las URLs que realmente quieres indexar. Eso parece obvio. En la práctica, Yoast, Rank Math y la mayoría de otros plugins de SEO incluirán felizmente páginas sin indexar, URLs paginadas y archivos de etiquetas en tu mapa de sitio si no tienes cuidado. Google ve una URL en tu mapa de sitio, la rastrea, encuentra una noindex o contenido delgado, y eso es un crédito de rastreo desperdiciado, además de una señal de confianza de que realmente no sabes qué estás haciendo con tu sitio.

Audito mapas de sitio con un proceso simple:

  1. Descarga el XML del mapa de sitio
  2. Importa cada URL en una hoja de cálculo
  3. Ejecuta cada URL a través de Screaming Frog (o usa la exportación masiva)
  4. Marca cualquier URL que sea sin indexar, redirija o devuelva un estado no-200
  5. Elimina esas URLs del mapa de sitio

Esto solo ha solucionado estados "Rastreado, actualmente no indexado" para tres clientes en el último año. Sin tocar el contenido en absoluto.

Brechas en enlazado interno

PageRank (sí, sigue siendo relevante, sí, incluso en 2024) fluye a través de enlaces internos. Una página sin enlaces internos que apunten a ella es efectivamente invisible para Googlebot en términos de autoridad. Google puede rastrearla a través del sitemap y luego decidir que no es lo suficientemente importante para indexarla porque nada en el sitio está apuntando a ella.

Las páginas huérfanas son comunes. Uso el reporte "Orphan URLs" de Screaming Frog (bajo Site Structure) para encontrarlas. Agrega tres a cinco enlaces internos relevantes a cada página que esté en la categoría "no indexada" y a menudo verás movimiento dentro de cuatro a seis semanas.

---

Presupuesto de rastreo: cuándo es realmente un problema de capacidad

Para sitios más pequeños (menos de 1,000 páginas), el presupuesto de rastreo casi nunca es el problema real. Sé que muchos usan esta explicación. Pero para grandes sitios de comercio electrónico (teníamos una minorista de moda en Seahawk con 80,000 SKUs), realmente importa.

Si Googlebot está gastando sus visitas rastreando tu navegación facetada infinita, tus parámetros de ID de sesión o tus páginas de resultados de búsqueda interna, no está llegando a las páginas de productos que realmente importan. La documentación de Google sobre presupuesto de rastreo es uno de los pocos documentos de orientación SEO oficial que realmente recomendaría leer de inicio a fin.

Solución: bloquea parámetros de URL que generen páginas casi duplicadas a través de la herramienta URL Parameters (si aún usas Search Console antiguo) o vía robots.txt para Googlebot, y asegúrate de que tus páginas de búsqueda interna estén marcadas como noindex. Esto libera capacidad de rastreo para las páginas que importan.

---

Solicitar indexación: cuándo usarla y cuándo no

El botón "Request Indexing" en Search Console es útil para URLs individuales de alta prioridad después de hacer cambios. No es un sustituto para corregir la causa subyacente. Veo a freelancers presionando ese botón compulsivamente en páginas que no han tocado. No hace nada por sí solo.

Mi regla: corrige primero, solicita después. Después de hacer cambios sustanciales en contenido, etiquetas canónicas o enlaces internos, envía la URL a través de la herramienta URL Inspection. Dale dos a cuatro semanas. Si aún no está indexada después de eso, el problema subyacente no está resuelto.

Una cosa más: la cuota de solicitud de indexación es limitada. No la gastes en páginas que aún tengan contenido delgado o configuraciones canónicas rotas. Solo le estás pidiendo a Google que confirme su propia decisión.

---

¿Cuánto tiempo tarda en aclararse?

Honestamente, varía más de lo que admiten la mayoría de guías SEO. He visto páginas cambiar de "Rastreada, actualmente no indexada" a indexada en cinco días después de una actualización de contenido. He visto otras tomar doce semanas. Los factores que parecen importar más:

  • Cuánta autoridad tiene el dominio en general (los dominios más antiguos y enlazados ven reconsideración más rápida)
  • Si la corrección fue relacionada con contenido (más lenta) o técnica (más rápida)
  • Con qué frecuencia Googlebot visita el sitio (revisa el reporte Crawl Stats en Search Console)

Configura una hoja de cálculo de seguimiento. Anota la fecha en que hiciste cambios. Revisa Search Console cada dos semanas. No entres en pánico si nada se mueve en la semana uno.

---

FAQ

¿Por qué Google rastrea una página pero luego no la indexa?

Rastreo e indexación son pasos separados en el pipeline de Google. Rastreo simplemente significa que Googlebot descargó la página. Indexación significa que Google decidió que vale la pena mostrarla en resultados de búsqueda. La brecha ocurre cuando la evaluación de calidad de Google determina que la página no agrega suficiente valor, duplica contenido existente en el índice o contiene señales conflictivas como una etiqueta noindex en algún lugar de la cadena.

¿Enviar una URL en Search Console garantiza indexación?

No. Pone la URL en una cola de prioridad para revisión pero Google sigue tomando su propia decisión de calidad. Si la página tiene contenido delgado o problemas técnicos, enviarla solo acelera que Google confirme que no la indexará.

¿Puede una página ser indexada después de estar atrapada en este estado durante mucho tiempo?

Sí, absolutamente. He despejado URLs que habían estado en "Rastreada, actualmente no indexada" durante más de un año, una vez que el contenido fue debidamente mejorado. Google reevalúa. No es una lista negra permanente. Dicho esto, si una página ha estado en ese estado durante más de seis meses, vale la pena preguntarse honestamente si merece ser indexada.

¿Es este estado lo mismo que "Descubierta, actualmente no indexada"?

No, y la distinción importa. "Descubierta, actualmente no indexada" significa que Google conoce la URL pero aún no la ha rastreado. A menudo es un problema de presupuesto de rastreo o de enlaces internos. "Rastreada, actualmente no indexada" significa que ya fue evaluada y apartada. Ambas necesitan atención pero las correcciones son ligeramente diferentes.

---

No existe una solución mágica única para "Rastreado, actualmente no indexado". Por mi experiencia, casi siempre es un problema de calidad de contenido o una falla de señales técnicas, y generalmente una combinación de ambos. Comienza con los datos, arregla lo que encuentres y dale tiempo. Google no intenta castigarte. Solo necesita una razón para importarle la página. Dásela.

← volver