indexación
que el buscador guarde tu página en su catálogo
Paso siguiente al rastreo: el buscador decide si guarda la página en su índice, el catálogo del que salen los resultados. Una página rastreada pero no indexada no aparece en ninguna búsqueda.
Dos pasos distintos que casi todo el mundo mezcla
Antes de que una página pueda aparecer en un resultado tienen que pasar dos cosas seguidas, y son independientes:
- El rastreo: un programa del buscador llega a la URL y se descarga lo que hay.
- La indexación: el buscador analiza lo descargado y decide si lo guarda en su índice, que es el catálogo del que se sacan después los resultados.
La confusión habitual es dar por hecho que lo primero implica lo segundo. No es así. Google puede visitar una página cien veces y no guardarla nunca. Cuando en una reunión alguien dice «pero si Google ya ha entrado», está describiendo el paso uno y suponiendo el dos.
Y la consecuencia es tajante: una página que no está en el índice no compite por nada. No es que salga baja: es que no existe para el buscador. Antes de mirar posiciones, palabras clave o enlaces, lo primero siempre es comprobar si la página está dentro.
Qué mira el buscador para decidir
No hay una lista oficial de requisitos, pero por lo que documenta Google y por lo que se ve en los informes, la decisión gira alrededor de tres preguntas:
- ¿Es accesible? Si la página devuelve un error, redirige a otro sitio, está
bloqueada por una etiqueta
noindexo depende de un JavaScript que no llega a ejecutarse, no hay nada que guardar. - ¿Es la versión buena? Cuando varias URL muestran lo mismo —con y sin barra final, con parámetros de campaña, versiones de filtros—, el buscador elige una como canónica y descarta el resto. Las descartadas aparecen como no indexadas aunque estén perfectamente.
- ¿Merece el sitio en el índice? Guardar páginas cuesta dinero. Si el contenido es fino, repetido o generado en masa, el buscador puede sencillamente decidir que no compensa. Esta es la parte incómoda y la que nadie quiere oír.
El índice no es infinito ni tu web tiene derecho adquirido a estar en él. Se revisa, y páginas que llevaban años dentro pueden salir.
Lo que me encuentro en las auditorías
Cuando abro el informe de indexación de páginas de Search Console de una web que nunca lo ha mirado, el patrón se repite con una fidelidad casi aburrida: hay muchísimas más URL de las que el cliente cree y la mayoría de las no indexadas no son un problema, son basura técnica que nunca debió existir.
Los sospechosos habituales:
- Resultados de buscador interno indexables, que multiplican URL sin fin.
- Filtros de catálogo combinables entre sí: tres filtros generan cientos de direcciones con el mismo producto.
- Páginas de etiquetas de blog creadas sin criterio, cada una con un artículo dentro.
- Versiones de pruebas o de un entorno de desarrollo que se quedaron abiertas.
En un caso de comercio en Tenerife, el sitio tenía unas doscientas páginas de verdad y decenas de miles de direcciones rastreables. Google se pasaba el presupuesto de rastreo dando vueltas por combinaciones de filtros mientras fichas nuevas tardaban semanas en entrar. La solución no fue pedir indexación de nada: fue cerrar el grifo para que lo que se rastrea sea lo que importa.
El otro hallazgo típico es el contrario y más doloroso: la página de servicio
que da dinero está fuera del índice desde hace meses por una etiqueta noindex
que se quedó puesta desde el desarrollo. Pasa más de lo que parece, y suele
descubrirse mirando, no adivinando.
Cómo se comprueba de verdad
Tres herramientas, en este orden:
- La inspección de URL de Search Console. Es la única fuente fiable para una página concreta: te dice si está indexada, qué versión considera canónica y cuándo la rastreó por última vez.
- El informe de indexación de páginas. Da el panorama agregado y agrupa los motivos de exclusión. Ahí es donde se ve si el problema es de veinte páginas o de veinte mil.
- Una búsqueda con
site:sirve para una comprobación rápida de campo, pero no da cifras exactas ni sustituye a lo anterior.
El sitemap ayuda a que el buscador descubra antes lo que quieres que mire, pero no es una orden. Estar en el sitemap no indexa nada; solo señala.
Por qué le importa a un negocio
Porque es el filtro anterior a todo lo demás. Se puede invertir un año en contenido, en diseño y en enlaces y no ver ni una visita si las páginas no están dentro del catálogo. Todo el trabajo posterior —posicionamiento, conversión, tráfico orgánico— parte de aquí.
Y porque es de las pocas cosas del SEO que da resultados rápidos. Recuperar una página comercial que llevaba meses excluida por un error técnico puede notarse en cuestión de días, sin escribir una línea nueva. Es el sitio donde el diagnóstico barato tiene el mejor retorno.
Errores frecuentes
Confundir «Google ha entrado» con «Google la ha guardado». Son dos hechos distintos y el informe los distingue con claridad. Dar por buena la primera lleva a buscar el problema en el contenido cuando está en la etiqueta.
Pedir indexación una y otra vez desde Search Console. El botón de solicitar indexación no es un ruego que se atienda por insistencia. Si la página se excluye por duplicada, por fina o por bloqueada, se puede pulsar cien veces y seguirá fuera. Primero se arregla la causa, después se avisa.
Interpretar toda exclusión como un fallo. Un carrito, un panel de usuario o una página de agradecimiento no deben estar en el índice. Un informe con miles de URL excluidas puede estar perfectamente sano; lo que importa es si las excluidas son las que quieres dentro.
Bloquear en robots.txt una página que quieres sacar del índice. Es el
clásico contradictorio: si impides el rastreo, el buscador no puede leer la
etiqueta que le dice que la quite, y la URL puede seguir apareciendo sin
descripción. Para sacar algo del índice hay que dejar entrar y usar noindex.
Meterlo todo dentro por sistema. Más páginas indexadas no es mejor. Un catálogo lleno de versiones parecidas reparte señales, provoca canibalización y hace que el buscador dedique su tiempo a lo irrelevante. Indexar es una decisión editorial, no un contador que hay que subir.
Términos relacionados
- rastreo el paseo que un buscador da por tu web
- posicionamiento el lugar que ocupas en los resultados
- tráfico orgánico visitas que llegan sin pagar anuncios
- contenido duplicado el mismo texto repetido en varias direcciones
- canibalización dos páginas tuyas compitiendo entre sí
- datos estructurados etiquetas ocultas que explican el contenido a las máquinas