Veredicto de indexabilidad
Si esta página puede indexarse de verdad — y si no, exactamente qué archivo abrir.
Haz una auditoría SEO completa de la página que tienes abierta y después rastrea el resto del sitio con un clic. Crawlhive es un analizador SEO gratuito que encuentra lo que una sola página no puede mostrar: títulos duplicados, páginas huérfanas y problemas de SEO técnico que dejan páginas fuera de Google sin que te enteres. Todo ocurre en tu navegador; tus páginas nunca se suben.
Dos términos que se usan como sinónimos y responden a preguntas distintas.
El SEO técnico es la parte que ignora tus textos por completo y hace una pregunta más estrecha: ¿puede un buscador llegar a esta página, tiene permiso para indexarla y la estructura del sitio ayuda o estorba? Cubre las reglas de robots, la etiqueta canonical, los códigos de estado HTTP, las redirecciones, el sitemap, la profundidad de clic y los Core Web Vitals — la fontanería que decide si tu contenido llega a competir.
Una auditoría SEO revisa todo lo que en una página o un sitio afecta a que los buscadores lo encuentren, lo lean y lo posicionen: título y descripción, estructura de encabezados, enlaces internos, imágenes, datos estructurados, velocidad y si la página puede indexarse. El análisis SEO de un sitio entero añade los problemas que solo aparecen a nivel global, como dos páginas compartiendo el mismo título.
Abre la página en Chrome, ejecuta encima una extensión de análisis SEO gratis y lee la lista de problemas ordenada por impacto. Para el sitio completo necesitas una herramienta que siga los enlaces internos y compare las páginas entre sí: es la única forma de ver títulos duplicados, páginas huérfanas y profundidad de clic. Crawlhive hace ambas cosas, gratis y sin subir nada.
Sin configuración, sin crear un proyecto, sin pegar ninguna URL. La página que miras es la que se audita.
La tuya o la de un competidor: el análisis funciona igual en ambas.
O usa Ctrl+Shift+S. Inicia sesión con Google una vez; una cuenta vale para todas nuestras extensiones.
Un número sobre 100, con cada problema ordenado por los puntos que te está costando.
Un clic rastrea el resto del sitio y encuentra lo que una sola página no puede mostrar.
Markdown para el correo al cliente, JSON para tus herramientas, CSV para una hoja de cálculo.
Una auditoría web seria tiene que mirar más allá de una URL, porque algunos de los problemas de SEO más caros son invisibles desde una sola página. Dos páginas compitiendo con el mismo título. Una página a la que nada enlaza. Una sección a cinco clics de la portada, donde los rastreadores casi no llegan. Nada de eso se ve mirando una URL.
Un clic sigue los enlaces internos desde la página en la que estás y lee el HTML de cada una. El resultado es un grafo de enlaces de tu sitio, construido sin una sola petición extra más allá de las propias páginas.
Los límites son deliberadamente conservadores: solo el mismo origen, las rutas
bloqueadas en robots.txt se saltan sin hacer petición, un tope de
40 páginas, tres peticiones a la vez y nada que parezca destructivo —cerrar
sesión, borrar, pagar— se toca jamás. Es tu servidor, y el rastreo se puede
detener en cualquier momento.
Ocho paneles, un clic, y ninguna página sale de tu navegador.
Si esta página puede indexarse de verdad — y si no, exactamente qué archivo abrir.
Títulos duplicados, páginas huérfanas, profundidad de clic, enlaces rotos, noindex global.
LCP, CLS, TTFB y FCP, con cada archivo que bloquea el primer renderizado.
Esquema H1-H6 con avisos de jerarquía y detección de duplicados.
Sin texto alternativo, carga diferida y archivos mucho mayores que la caja donde se dibujan.
Validados contra lo que Google exige de verdad, no un simple "detectado".
Autorreferencia, códigos duplicados, códigos inválidos y URLs relativas.
Markdown, JSON y CSV — listos para el correo a un cliente o una hoja de cálculo.
Cuatro situaciones en las que la respuesta no está a la vista en la página.
Un noindex que viaja de staging a producción es el error más caro
del SEO, precisamente porque nada en la página lo delata. Puede quedarse
semanas mientras el tráfico se drena en silencio. Treinta segundos de
comprobación tras cada release son el seguro más barato que existe.
Las auditorías de agencia empiezan casi siempre con los mismos hallazgos: títulos duplicados, H1 ausentes, páginas huérfanas, enlaces internos rotos. Rastrea el sitio, exporta en Markdown y el primer borrador ya está escrito.
Antes de reescribir el contenido, revisa lo aburrido: ¿es indexable?, ¿el canonical apunta a otra parte?, ¿cuántos enlaces internos recibe?, ¿a qué profundidad está? "Casi nada enlaza a ella" es una respuesta sorprendentemente frecuente.
Sus datos estructurados, su estructura de encabezados, su configuración de hreflang, cómo está enlazado su sitio. Todo está en el HTML que ya te sirven — sin login, sin herramienta, sin permisos.
La misma auditoría se lee distinto según por qué la abriste.
El veredicto de indexabilidad y los hallazgos del rastreo son las dos cosas de las que vive una auditoría técnica. Todo se exporta, así que el informe deja de ser una captura y pasa a ser un entregable.
Treinta segundos después de un despliegue: ¿se coló un noindex?,
¿se rompió un canonical?, ¿el H1 solo aparece cuando corre el JavaScript?
Más barato que enterarse por la gráfica de tráfico tres semanas después.
Una auditoría web para un cliente suele abrir con títulos duplicados, H1 que faltan y páginas huérfanas. Rastrea, exporta en Markdown y el borrador está hecho.
No hace falta jerga para usarlo: una puntuación, una lista ordenada y los puntos que devuelve cada arreglo. Si una página no posiciona, las causas técnicas aburridas se descartan primero.
La mayoría de extensiones gratuitas leen la página en la que estás y se detienen ahí.
| Extensión gratuita típica | Crawlhive | |
|---|---|---|
| Alcance | Una página | La página y después todo el sitio |
| Títulos duplicados | No los ve | Se encuentran en el rastreo |
| Páginas huérfanas | Imposible | Sitemap comparado con el grafo de enlaces |
| Profundidad de clic | Imposible | Medida desde tu página de inicio |
| Cabecera X-Robots-Tag | Se suele omitir | Se lee junto a meta robots y robots.txt |
| Vista previa en buscador | Recuento de caracteres | Medida en píxeles, con la fuente de Google |
| Core Web Vitals | Rara vez incluidos | LCP, CLS, TTFB, FCP |
| Adónde van tus páginas | A menudo a un servidor | A ningún sitio — se leen donde están |
| ¿Necesita programa de escritorio? | No | No — funciona en el navegador |
| Precio | Plan gratuito con límites | Gratis |
Lo que hace posible el rastreo sin pedir permisos de host es dónde se ejecuta el
lector: dentro del propio origen de la página. Las peticiones al
mismo origen no requieren permiso, y por eso se pueden leer
robots.txt, las cabeceras de respuesta y el sitemap.
Conviene decirlo claro, porque son las tres cosas que más se esperan de una herramienta SEO.
Lee lo que tu página y tu sitio contienen realmente: indexabilidad, estructura, enlaces, velocidad, datos estructurados — y rastrea el sitio para encontrar lo que una página no puede mostrar.
Nada de seguimiento de posiciones, nada de datos de backlinks, ninguna métrica de autoridad de dominio y ninguna conjetura de IA. Eso necesita bases de datos de terceros y una suscripción; esto lee tu propio HTML.
Si necesitas backlinks o posiciones de palabras clave, necesitas una plataforma de pago con su propio índice — Ahrefs, Semrush y Moz existen justo para eso. Crawlhive cubre la otra mitad del trabajo, la que puedes verificar tú mismo, y lo hace sin subir una sola página. Tampoco es un servicio de agencia: es una extensión que instalas y usas cuando quieras.
Las páginas que auditas se leen donde están y no salen de tu navegador.
El lector se ejecuta dentro de la pestaña que ya tienes abierta. Ningún contenido se envía a ningún sitio.
Las únicas peticiones se dirigen al sitio que auditas: su robots.txt, su sitemap, sus páginas.
Solo nombre, correo e imagen de perfil, para que una cuenta valga en todas nuestras extensiones.
Sin scripts de seguimiento, sin anuncios; nada de tu navegación llega a nosotros ni a nadie.
Sí. No hay plan de pago, ni sistema de créditos, ni límite mensual de páginas. Solo hace falta iniciar sesión con Google para que una cuenta valga en todas nuestras extensiones.
Abre la página, pulsa la extensión y lee la puntuación con la lista de problemas ordenada. Para el sitio completo, abre la pestaña Sitio e inicia el rastreo: de ahí salen los títulos duplicados, las páginas huérfanas y la profundidad de clic.
Mira si los buscadores pueden llegar, leer e indexar tus páginas en lugar de fijarse en las palabras: indexabilidad, canonicals, reglas de robots, códigos de estado, estructura del sitio y velocidad.
En cualquier página que puedas abrir en Chrome, incluidas webs que no son tuyas. No funciona en las páginas de error del navegador ni en direcciones chrome://, que Chrome bloquea para todas las extensiones.
Hasta 40 por ejecución, solo el mismo origen, tres peticiones a la vez. Las rutas bloqueadas en robots.txt se saltan sin petición y el rastreo se puede detener cuando quieras.
No. Los datos de backlinks y el seguimiento de posiciones necesitan un índice de terceros y una suscripción. Crawlhive lee lo que tu página y tu sitio contienen de verdad.
No. Se leen dentro de la pestaña que ya tienes abierta y las únicas peticiones van al sitio auditado. Lo único que nos llega es la identidad de tu cuenta al iniciar sesión.
Sí: Markdown para pegarlo en un correo a un cliente, JSON para tus propias herramientas y CSV para enlaces, imágenes y resultados del rastreo.
Indexada e indexable son preguntas distintas. Crawlhive responde a la segunda: si algo en la página, en sus cabeceras o en robots.txt lo está bloqueando. Para saber si Google la ha indexado, consulta Search Console.
Compara dos listas: todas las URL de tu sitemap y todas las alcanzables siguiendo enlaces internos. Lo que está en la primera y no en la segunda está huérfano. El rastreo construye ambas listas mientras se ejecuta.
Sí. La auditoría lee el HTML que recibe cualquier visitante, así que funciona en cualquier sitio que puedas abrir: datos estructurados, encabezados, hreflang y estructura de enlaces incluidos.
En Chrome y otros navegadores Chromium: Edge, Brave y Opera. La interfaz sigue el idioma de tu navegador en 49 idiomas.
Para comprobar SEO web de una página concreta basta con abrirla y ejecutar la extensión: obtienes indexabilidad, título y descripción medidos, encabezados, enlaces, datos estructurados y velocidad en una sola pasada.
Las auditorías SEO online suelen pedir tu URL y descargar la página desde su servidor. Aquí no: el análisis ocurre dentro de tu navegador, así que el contenido nunca sale de tu equipo. Es la diferencia práctica entre una herramienta web y una extensión.
No. Esto es una herramienta que usas tú, no un servicio de agencia con precio y entregable. Te da los mismos datos técnicos con los que empieza cualquier auditoría profesional, pero el análisis y las decisiones siguen siendo tuyos.
Trata el número como una lista de tareas, no como una nota. La puntuación sirve porque cada problema debajo indica los puntos que te está costando, así que el orden de arreglo deja de ser opinión. Vuelve a ejecutarla y sabrás si el cambio funcionó.
Casi todos los consejos de SEO empiezan por palabras clave y contenido. Esa es la mitad visible. La otra mitad decide si algo de eso llega a leerse: ¿puede un rastreador alcanzar la página?, ¿tiene permiso para indexarla?, ¿la estructura del sitio la empuja hacia delante o la entierra? Aquí está cómo comprobar cada cosa, en el orden que encuentra primero los problemas caros.
Antes que nada, resuelve si la página es siquiera elegible para aparecer en búsquedas. Todo lo demás es esfuerzo perdido si la respuesta es no, y esa respuesta no se ve mirando la página.
Hay tres mecanismos distintos que pueden dejar una página fuera del índice, y solo uno está en el HTML que puedes ver:
robots. La que lee cualquier extensión SEO. Un noindex aquí es una instrucción directa de no indexar.X-Robots-Tag. Hace exactamente lo mismo, pero viaja en la respuesta HTTP: invisible en el código fuente y omitida de forma rutinaria.
Un noindex que pasa de staging a producción es el error más caro del
SEO justo por esto: la página se ve perfectamente normal, el tráfico se drena
durante semanas y a nadie se le ocurre mirar las cabeceras de respuesta.
robots.txt controla el rastreo, no la indexación, y sus reglas son
menos obvias de lo que parecen. Cuando varias reglas coinciden con la misma URL
gana la coincidencia más larga, y cuando dos reglas de igual longitud se
contradicen, Allow vence a Disallow. Los comodines
hacen que esto sea difícil de razonar a ojo.
Una página bloqueada no puede rastrearse, así que su noindex nunca
se verá: por eso bloquear una página en robots.txt es la forma equivocada de
sacarla de los resultados. Los dos mecanismos resuelven problemas distintos y se
confunden con frecuencia.
El consejo habitual —mantén los títulos entre 50 y 60 caracteres— es una aproximación burda de algo que Google mide de otra manera. Los resultados se cortan por anchura en píxeles, y los caracteres no son iguales: un título en mayúsculas o lleno de letras anchas se agota mucho antes de lo que sugiere el recuento, mientras que uno de letras estrechas sobrevive bastante más allá de 60.
Medir la anchura real en la fuente que Google usa es la única forma de saber dónde cae el corte. Es un detalle pequeño que decide si tu llamada a la acción sobrevive en el resultado o la sustituyen unos puntos suspensivos.
La comprobación habitual es "¿tiene la página exactamente un H1?", y merece la pena saberlo, pero la señal más útil es el esquema completo. Encabezados que se saltan niveles —un H2 seguido directamente de un H4— suelen significar que la página se está maquetando en lugar de estructurando, y el documento ya no describe su propia jerarquía.
Los encabezados duplicados también importan. Dos H2 idénticos suelen indicar que una plantilla repite una sección que debería haberse unificado, y son una señal fiable de que la página creció por acumulación y no por diseño.
La mayoría de herramientas te dicen que se ha detectado un tipo de esquema. Esa es la parte fácil. Lo que determina si obtienes un resultado enriquecido es si están presentes las propiedades obligatorias: un Product sin ofertas no produce ningún resultado enriquecido, por correcto que parezca el marcado.
Así que la salida útil no es "Product detectado" sino "Product detectado, pero sin ofertas, así que no habrá resultado enriquecido". Esa diferencia es todo el sentido de comprobarlo.
La primera pasada de un rastreador lee el HTML tal como llega del servidor. Si tu título, tu H1 o tu canonical solo aparecen después de que corra el JavaScript, no están ahí en esa primera lectura. Google acaba renderizando las páginas, pero renderizar es un segundo paso, más lento y menos seguro.
Comparar lo que envió el servidor con lo que acabó teniendo el navegador te dice qué partes de tu página dependen de esa segunda pasada. Todo lo crítico para la indexación debería estar en la primera.
Todo lo anterior es sobre una sola URL. Los hallazgos que más cambian el posicionamiento son estructurales, y solo aparecen cuando miras el sitio como un grafo:
href eliminaría.Los Core Web Vitals redujeron un tema difuso a tres cosas medibles, y dos suelen arreglarse sin tocar el servidor. LCP es lo que tarda en pintarse el elemento visible más grande — casi siempre una imagen de cabecera o un titular retenido por una hoja de estilos que bloquea el renderizado. CLS es cuánto salta la maqueta mientras carga, casi siempre porque una imagen o un anuncio no tienen espacio reservado.
TTFB es el que apunta al servidor, y conviene separarlo del resto: un primer byte lento empeora todas las demás métricas y ningún trabajo de front-end lo arreglará.
Hay un desperdicio concreto que vale la pena revisar en cualquier sitio: imágenes servidas mucho más grandes que la caja donde se dibujan. Un archivo de 128 píxeles mostrado a 24 son bytes que el visitante descarga y nunca ve. La densidad de pantalla importa aquí —en una pantalla 2× un archivo de 400 píxeles en una caja de 200 es lo correcto, no un despilfarro— y los vectores quedan exentos, porque un SVG no tiene resolución que malgastar.
Una auditoría completa del sitio es un trabajo trimestral para la mayoría. La comprobación de indexabilidad no: ejecútala después de cada despliegue que toque plantillas y en cualquier página que pierda tráfico de golpe. Tarda segundos y caza el fallo que más caro sale.
Cuando hagas la pasada completa, arregla en este orden: lo que bloquea la indexación, luego los problemas estructurales (duplicados, huérfanas, profundidad), luego los detalles on-page y por último la velocidad. Ese orden no es cuestión de gustos: una página que no puede indexarse no gana nada con un LCP más rápido.
Gratis, sin límite de páginas, y nada de lo que audites sale de tu navegador.
Añadir Crawlhive a Chrome — GratisCrawlhive es una extensión de navegador independiente. No está afiliada, respaldada ni patrocinada por Google. Chrome es una marca registrada de Google LLC.
Todas nuestras herramientas son gratis y funcionan directamente en tu navegador.