Una página que nunca entra al índice de Google no va a rankear. La mayoría de los tickets de «por qué no rankea esto» empiezan una capa antes: la URL está bloqueada, redirigida, canonicalizada hacia otro lado o simplemente nunca se conservó.
Esta guía es el flujo de trabajo. Cómo revisar si Google indexó una URL, cómo leer un informe técnico de indexabilidad, qué corregir cuando la página está fuera y cuándo escalar a un pulso de preparación o a una auditoría técnica completa. La herramienta que le corresponde es el Comprobador de indexación. Córrelo para las cinco señales de bloqueo. Usa esta página para el orden del trabajo.
Qué significa de verdad «indexada»
Rastrear es que Googlebot descargue la URL. Indexar es que Google decida conservarla y dejarla elegible para resultados. Son pasos distintos. Una página puede ser rastreable y aun así quedarse fuera del índice.
El informe de Páginas de Search Console es donde Google etiqueta los motivos: excluida por noindex, bloqueada por robots.txt, página alternativa con canonical adecuado, rastreada pero no indexada, y el resto. Una herramienta gratis en el navegador no puede inventar esas etiquetas del lado de Google. Lo que sí puede decirte es si tu página está enviando una señal que bloquea la indexación antes de que Googlebot siquiera vea la página con claridad.
Ese es el trabajo del Comprobador de indexación de Scrawl. No consulta el índice de Google. No hay una API pública gratis para eso. Descarga la URL e informa los bloqueos técnicos de la página y de la respuesta.
Qué revisa de verdad el Comprobador de indexación
Pega una URL pública en el Comprobador de indexación. Sin login. Gratis. Sin límites de uso en la página de la herramienta.
El informe cubre cinco señales (las mismas cinco que documenta la herramienta en vivo):
- Estado HTTP — quieres un 200 limpio en la URL que te importa
- robots.txt — si una regla Disallow bloquea la ruta para Googlebot
- noindex — meta robots en el HTML y
X-Robots-Tagen las cabeceras (View Source no muestra la cabecera) - Canonical — si
rel=canonicalapunta a otro lado - Redirecciones — si la URL se va a otro lugar en lugar de servir el contenido
Una página que falla en cualquiera de estas no está «lista para ser conservada». Una página que pasa las cinco es indexable. Igual puede ser nueva, tener pocos enlaces o quedar fuera por razones de calidad. Indexable no es lo mismo que ya indexada.
Para la respuesta definitiva de «¿esta URL está en Google ahora mismo?», usa Inspección de URLs en Search Console en una propiedad que sea tuya. La documentación de recrawl de Google también es donde pides un rastreo de URLs individuales después de corregir algo. El operador site: en Google Search es una prueba de olfato rápida. No es confiable para páginas nuevas o recién cambiadas, y la página de la herramienta en vivo dice lo mismo.
Cómo correr la revisión
- Abre el Comprobador de indexación.
- Pega la URL de producción completa: HTTPS, el host que quieres indexado, no staging.
- Corre la revisión.
- Lee cada señal fallida. Corrige esas primero. Luego confirma en Search Console.
Sáltate staging con autenticación básica y hosts de preview. Si el comprobador no puede descargar lo que Googlebot ve en producción, el informe es ruido.
Cómo leer el resultado
Trata el informe como un tablero de triaje, no como una nota de ranking.
Las cinco pasan. La página está técnicamente limpia. Si Search Console sigue diciendo que no está indexada, el problema se movió a descubrimiento, calidad, duplicación o prioridad de rastreo. No sigas cazando un noindex fantasma. Mira los enlaces internos, el sitemap y el motivo del informe de Páginas.
Falla el estado HTTP. Soft 404, 404 reales, 5xx o un estado de redirección inesperado. Restaura la página, devuelve un 404/410 honesto si debería desaparecer, o pon una sola redirección permanente al destino real. No tires todo a la homepage.
robots.txt bloquea la ruta. Abre https://yourdomain.com/robots.txt y encuentra el Disallow. Confírmalo con el Tester de robots.txt de Google contra la URL que te importa. Los restos de staging que salen a producción como Disallow: / siguen siendo el bug clásico de lanzamiento.
Hay noindex. La documentación de noindex de Google es directa: cuando Googlebot ve la regla, la página sale de los resultados. La regla puede vivir en una meta tag:
<meta name="robots" content="noindex">O en una cabecera HTTP:
X-Robots-Tag: noindexGoogle también señala que robots.txt no debe bloquear la URL si dependes de noindex. Si Googlebot no puede descargar la página, nunca ve la etiqueta, y la URL puede seguir apareciendo por otras señales. Quita el noindex de staging que se quedó, tanto del HTML como de las cabeceras del CDN. Vuelve a revisar la misma URL.
El canonical apunta a otro lado. Google puede conservar la otra URL en lugar de la tuya. Confírmalo con el Comprobador de canonical. Autoreferencia en las páginas de dinero que son únicas. Nunca apuntes a un 404, a una redirección, a una URL con noindex o a una variante con parámetros que no quieres en el índice.
Redirecciones. Si pegaste una URL que debería ser la página final y salta, corrige la cadena. Googlebot va a seguir varios saltos; eso no es motivo para publicarlos. Aterriza en la URL final con una sola redirección permanente cuando puedas.
Cuando la página no está indexada: orden de corrección
Trabaja la pila de arriba hacia abajo. Las capas de abajo son movimiento desperdiciado si las de arriba están rotas.
P0 — tú mismo estás bloqueando la URL. Disallow de robots en una sección en vivo. noindex en una plantilla que genera dinero. Canonical al host equivocado. Un estado que no es 200 en la dirección en vivo. Bucle de redirección. Corrígelo esta semana. Vuelve a correr el comprobador en la misma URL después del deploy.
P1 — limpia en lo técnico, y aun así falta en Search Console. Envía o refresca el sitemap XML con las URLs canonical en 200. Agrega enlaces internos desde páginas que Google ya rastrea. En Search Console, abre Inspección de URLs en la URL que genera dinero y solicita indexación si administras la propiedad. Google dice que el rastreo después de una solicitud puede tardar desde unos días hasta unas semanas, que la inclusión no está garantizada y que martillar la misma URL con solicitudes repetidas no la hace más rápida. Hay una cuota.
P2 — «Crawled — currently not indexed» (o algo parecido) sin bloqueo técnico. Eso suele ser calidad, duplicación o pedirle a Google que conserve un montón de URLs filtradas casi idénticas. Reescribir titles no salva un problema de arquitectura. Escala al checklist de auditoría SEO técnica.
Después de cualquier cutover, revisa por muestreo las URLs nuevas que generan dinero de la misma forma. La secuencia completa está en el checklist SEO de migración de sitio.
Empareja el check de índice con un pulso de preparación
El comprobador de indexación responde: «¿hay algo en esta URL que bloquee la indexación?»
Cuando la página está limpia pero se siente débil (title faltante, schema roto, indexabilidad blanda en otra parte de la plantilla), corre la Puntuación de preparación SEO en la misma URL. Es un pulso de 0 a 100 de una sola URL que cruza tags on-page, indexabilidad, datos estructurados, contenido y enlaces, cabeceras de seguridad y señales de IA. No es un pronóstico de ranking. El texto que lo acompaña es la guía de la puntuación de preparación SEO.
El orden que sigue cómo el trabajo depende de sí mismo:
- Comprobador de indexación para bloqueos duros
- Puntuación de preparación SEO para el resto del pulso de la URL
- Checklist de auditoría técnica cuando el paciente es todo el sitio
- Checklist de migración cuando las URLs se movieron
Patrones que se repiten
noindex de staging en un producto en vivo. HTTP 200. robots.txt permite la ruta. La meta robots sigue diciendo noindex,follow por el tema. Eso solo explica una caída en Search Console. Quita la etiqueta (y cualquier X-Robots-Tag que coincida). Vuelve a revisar. Luego solicita indexación en las URLs que generan dinero.
Canonical a la categoría. La URL de producto devuelve 200. El canonical apunta a /category/widgets. Google conserva la categoría. Corrige la plantilla para que los productos únicos se canonicalicen a sí mismos. Confírmalo con el Comprobador de canonical.
Bloqueada por robots, «corregida» solo en el CMS. Alguien activó «permitir motores de búsqueda» en WordPress mientras el CDN o el robots.txt de la raíz siguen haciendo Disallow de la ruta. Prueba el archivo en vivo, no la pantalla de ajustes.
Corregiste el noindex y luego esperaste. Google tiene que volver a rastrear antes de que el cambio importe. Solicita indexación para las URLs críticas. Vigila Inspección de URLs y el informe de Páginas. No quemes la cuota refrescando la misma URL cada hora.
Errores que te hacen perder la tarde
Tratar un pase técnico como «ya estamos indexados». Pasar significa indexable. Indexada es la decisión de Search Console.
Usar `site:` como prueba. Sirve como mirada rápida. No es confiable para cambios recientes. La página de la herramienta lo dice; créelo.
Pulir titles mientras robots todavía bloquea. Un title brillante en una URL con Disallow o noindex es un borrador.
Ignorar `X-Robots-Tag`. View Source no lo va a mostrar. Las cabeceras sí.
Revisar staging. Otro host, otro robots, otra respuesta.
Saltarte la nueva revisión después del deploy. Las auditorías que nunca vuelven a pegarle a producción son la forma en que la regla de staging sobrevive tres sprints.
Cuándo dejar los muestreos y auditar el sitio
Escala cuando:
- Las plantillas que generan dinero comparten el mismo noindex o un canonical malo
- El informe de Páginas es una pared de rastreadas-pero-no-indexadas en URLs que pasan los cinco checks
- Una migración dejó hosts mezclados, Disallows residuales o un sitemap lleno de redirecciones
- Necesitas el orden completo de rastreo → índice → arquitectura → CWV
Eso es el checklist de auditoría SEO técnica. Para la noche del cutover, usa el checklist SEO de migración de sitio. Es otro trabajo.
Cierre
Corre el Comprobador de indexación en las URLs que pagan las cuentas. Limpia cada señal fallida. Confirma las mismas URLs en Search Console. Vuelve a revisar después del deploy. Ese es todo el ciclo.
Si los bloqueos ya no están y la página sigue sin quedarse, deja de retocar meta tags. Abre el comprobador de preparación y después el checklist de auditoría.
FAQ
¿Qué es un comprobador de indexación de Google?
Una herramienta que prueba si una URL está técnicamente libre para ser indexada. La versión de Scrawl revisa el estado HTTP, robots.txt, noindex (meta y X-Robots-Tag), desajustes de canonical y redirecciones. No consulta el índice en vivo de Google.
¿Cómo reviso si Google indexó una página?
Usa Inspección de URLs en Google Search Console para la respuesta definitiva en una propiedad que sea tuya. Para un precheck técnico gratis, pega la URL en el Comprobador de indexación. El operador site: es solo una señal rápida.
¿Por qué Google no indexa mi página?
Causas técnicas comunes: meta noindex o X-Robots-Tag, un Disallow en robots.txt, un canonical que apunta a otro lado, redirecciones o un estado que no es 200. Google también puede rastrear una página limpia y aun así negarse a indexarla por calidad o por duplicación. Lee el motivo del informe de Páginas antes de reescribir titles.
¿El Comprobador de indexación de Scrawl dice «indexada» o «no indexada»?
No. Informa si hay señales de bloqueo. Search Console responde si Google conservó la URL.
¿El Comprobador de indexación es gratis?
Sí. Gratis, sin login y sin límites de uso en la página de la herramienta.
¿Cuánto tarda Google en indexar una página nueva?
La documentación de recrawl de Google dice que el rastreo después de una solicitud puede tardar de unos días a unas semanas, y que pedir un rastreo no garantiza la inclusión. Los enlaces internos fuertes y un sitemap limpio ayudan al descubrimiento. No hay un SLA publicado de «indexada para el martes».
¿Cuál es la diferencia entre rastreada e indexada?
Rastreada significa que Googlebot descargó la página. Indexada significa que Google la conservó y puede mostrarla en resultados. Una página puede estar rastreada y aun así excluida.
¿Cómo hago que Google indexe una página más rápido?
Quita primero las señales de bloqueo. Enlaza la URL desde páginas que Google ya rastrea. Inclúyela en el sitemap XML. Luego usa Inspección de URLs → Solicitar indexación para un conjunto chico de URLs que generan dinero. No spamees la misma solicitud: Google indica que hay una cuota y que repetir no acelera el rastreo.
¿Cuándo debo usar el comprobador de preparación SEO en su lugar?
Cuando los cinco checks de indexabilidad pasan, pero la URL sigue viéndose débil en tags, schema o higiene relacionada. Empieza con la Puntuación de preparación SEO. Usa el comprobador de indexación cuando sospechas un bloqueo duro.
¿Lo necesito si ya tengo Search Console?
Sí, como precheck y como pase de control después del deploy. Search Console te dice qué decidió Google. El comprobador te dice qué sigues enviando tú que haría esa decisión fácil.