Saltar al contenido principal
← Todas las guías

Por qué las páginas no se indexan

Una página puede quedar fuera del índice de Google por varios motivos: acceso o directivas, tratamiento de duplicados y canonical, un rastreo que aún no ha ocurrido o un rastreo que no terminó en indexación. Search Console informa del estado; la solución depende del que realmente tenga la URL.

Comience con el estado, no con un diagnóstico

El informe de indexación de páginas incluye tanto problemas técnicos reales como exclusiones esperadas. Una regla de robots.txt, una directiva noindex, un requisito de autenticación o una respuesta fallida pueden impedir la indexación; los estados de duplicado y canonical pueden funcionar exactamente como se esperaba; y una URL descubierta puede simplemente no haber sido rastreada todavía.

El estado más engañoso es "Rastreado, actualmente no indexado". Confirma que Google obtuvo la página pero no la agregó al índice en ese momento. Google dice explícitamente que la página puede indexarse o no más adelante y que no es necesario volver a enviarla solo por este estado.

Los estados que sí son errores

Estos describen algo de tu lado que impidió almacenar la página. Google etiqueta la fuente de cada uno como Sitio web cuando puedes arreglarlo tú, y como Google cuando la causa está de su lado. Corregir la respuesta subyacente es la solución completa.

EstadoQué significaFuente
Error del servidor (5xx)El servidor devolvió un error de nivel 500Google
Error de redirecciónUna cadena de redirecciones se cicló o fallóSitio web
URL bloqueada por robots.txtrobots.txt retiró el permiso de descargaSitio web
URL marcada como ‘noindex’La página sirvió una directiva noindexSitio web
Error 404 blandoUn mensaje de no encontrado devuelto con código 200Sitio web
Bloqueada por solicitud no autorizada (401)La página exigió credencialesSitio web
No encontrada (404)La URL devolvió un 404Sitio web
Bloqueada por acceso prohibido (403)El servidor devolvió un 403Sitio web
Bloqueada por otro problema 4xxAlguna otra respuesta 4xxSitio web

Dos de estos merecen atención extra porque suelen ser autoinfligidos. Un soft 404 significa que devuelves una página amable de «aquí no hay nada» con estado 200: el buscador ve éxito y contenido escaso en lugar de ausencia, así que di la verdad con un 404 o un 410. Y un 401 o 403 en páginas que querías públicas suele significar que una regla de staging o un cortafuegos llegó a producción.

Los estados que parecen errores y no lo son

Estos generan el mayor desperdicio de trabajo. Cada uno de ellos es Google informando de una decisión que tomó, no de un fallo que introdujiste. Perseguirlos consume la atención que necesitan los problemas reales.

EstadoQué significa realmente
Página alternativa con etiqueta canónica adecuadaLa consolidación funcionando tal como se pretendía
Duplicada sin canónica seleccionada por el usuarioNo declaraste canónica, así que Google eligió una
Duplicada, Google eligió una canónica distintaDeclaraste una y Google discrepó
Página con redirecciónUna URL no canónica redirigiendo, según lo diseñado
Descubierta: actualmente sin indexarConocida pero aún no descargada
Rastreada: actualmente sin indexarDescargada, evaluada y apartada

Los dos estados de duplicado conviene separarlos. «Duplicada sin canónica seleccionada por el usuario» significa que nunca declaraste una canónica y Google eligió por ti: casi siempre inofensivo, pero has cedido una decisión que podrías tomar tú. «Google eligió una canónica distinta» significa que sí declaraste una y te la revocaron, lo que indica que la página que propusiste no es la que el buscador considera principal.

Leer «rastreada, actualmente sin indexar» con honestidad

Este estado significa que Google rastreó la página pero no la indexó en ese momento. No identifica una causa universal, y la prueba en vivo de Inspección de URLs tampoco puede predecir con certeza si se indexará. No tiene sentido inventar un error técnico que el informe no menciona.

En sitios basados en plantillas, conviene revisar la similitud entre páginas, las señales canonical, los enlaces internos y si cada página aporta información que sus páginas hermanas no ofrecen. Son comprobaciones de diagnóstico, no una afirmación de que toda URL con este estado haya fallado un umbral de calidad.

  1. Abre la Inspección de URL y confirma que la página devuelve 200, es autocanónica y renderiza su contenido principal.
  2. Compárala con sus tres hermanas más cercanas. Si puedes intercambiar los valores sustituidos y obtener una página equivalente, el buscador también lo ve.
  3. Comprueba si algo enlaza internamente hacia ella con texto ancla descriptivo, o si solo existe en el sitemap.
  4. Pregunta qué responde esta página que ninguna hermana responde. Si no hay respuesta, ese es el hallazgo.
  5. Cambia la página para que la respuesta exista y entonces solicita indexación, en ese orden.

«Descubierta, actualmente sin indexar» es otra señal

Este significa que la URL se conoce pero no se ha descargado. En un sitio pequeño suele ser un estado pasajero. A escala es el síntoma más claro que Google nombra de una restricción real de presupuesto de rastreo: demasiadas URL, poca demanda, y la cola nunca llega a ellas.

Si una parte grande de tus URL está aquí, el trabajo productivo es reducir cuántas URL de bajo valor pides al buscador que considere —consolidar duplicados, devolver 404 correctos para lo que ya no está, recortar cadenas de redirección— en lugar de reenviar páginas una a una.

Trabajar el informe en vez de los síntomas

El informe se organiza por causa, lo que tienta a trabajarlo de arriba abajo por volumen. Resístete. Mil URL bajo «Página con redirección» suelen ser un mapa de redirecciones que funciona, mientras que cuarenta bajo «Error 404 blando» son un defecto real que afecta a páginas reales.

  • Arregla primero todo lo de la tabla de errores: es inequívoco y mecánico.
  • Descarta los estados informativos salvo que el volumen contradiga tu intención, como una consolidación canónica que nunca diseñaste.
  • Trata «rastreada, actualmente sin indexar» como un atraso editorial, no técnico.
  • Vuelve a validar solo cuando la respuesta o el contenido subyacente hayan cambiado de verdad.

Pruébalo en tu propia web

Preguntas y respuestas

¿Reenviar una URL fuerza la indexación?

No. Solicitar indexación vuelve a encolar un rastreo; no anula la decisión que siguió al anterior. Reenvía después de que la página haya cambiado, no en lugar de cambiarla.

¿Por qué unas páginas localizadas se indexan y otras no?

Las páginas de plantilla que solo difieren en un nombre sustituido se leen como casi duplicados. Los buscadores suelen indexar un subconjunto y descartar el resto, y cuáles sobreviven sigue la demanda del mercado más que el marcado. La solución es dar a los idiomas descartados algo propio que decir, no ajustar sus etiquetas.

¿Es un problema «Página alternativa con etiqueta canónica adecuada»?

No. Informa de la consolidación canónica funcionando según lo diseñado. Solo merece un vistazo si el volumen es mucho mayor de lo que tu estrategia canónica explicaría, lo que sugeriría que se generan URL que no pretendías.

¿Cuál es la diferencia entre 404 blando y 404?

Un 404 dice la verdad: aquí no hay nada. Un 404 blando muestra un mensaje de no encontrado mientras devuelve un 200, así que el buscador registra la descarga exitosa de una página escasa. Devuelve un 404 o 410 real para todo lo que realmente ya no está.

¿Cuánto debo esperar antes de tratar la no indexación como una decisión?

Compara contra el propio sitio, no contra el reloj. Si páginas comparables publicadas a la vez se indexaron en días y esta lleva semanas, ha sido evaluada, no retrasada.