Veredito de indexabilidade
Se esta página pode mesmo ser indexada — e, se não, exatamente qual arquivo abrir.
Faça a análise de SEO completa da página que está aberta e depois rastreie o resto do site com um clique. O Crawlhive é uma ferramenta gratuita para analisar site que encontra o que uma página sozinha não mostra: títulos duplicados, páginas órfãs e problemas de SEO técnico que tiram páginas do Google sem ninguém perceber. Tudo roda no seu navegador; suas páginas nunca são enviadas.
Dois termos usados como sinônimos que respondem a perguntas diferentes.
A análise de SEO verifica tudo o que, numa página ou num site, afeta a capacidade dos buscadores de encontrar, ler e posicionar o conteúdo: título e descrição, estrutura de cabeçalhos, links internos, imagens, dados estruturados, velocidade e se a página pode ser indexada. Uma análise de site completa estende as mesmas checagens a todas as páginas e acrescenta os problemas que só aparecem no nível do site, como duas páginas com o mesmo título.
SEO técnico é a parte que ignora o seu texto e faz uma pergunta mais estreita: o buscador consegue chegar nesta página, tem permissão para indexá-la e a estrutura do site ajuda ou atrapalha? Cobre regras de robots, tag canonical, códigos de status HTTP, redirecionamentos, sitemap, profundidade de cliques e Core Web Vitals — o encanamento que decide se o seu conteúdo chega a competir.
Abra a página no Chrome, rode em cima dela uma extensão de análise de SEO gratuita e leia a lista de problemas ordenada por impacto. Para o site inteiro é preciso uma ferramenta que siga os links internos e compare as páginas entre si — é o único jeito de ver títulos duplicados, páginas órfãs e profundidade de cliques. O Crawlhive faz as duas coisas, de graça, sem enviar nada.
Sem configuração, sem criar projeto, sem colar URL. A página que você está vendo é a que é auditada.
A sua ou a de um concorrente — a análise funciona igual nas duas.
Ou use Ctrl+Shift+S. Entre com o Google uma vez; uma conta vale para todas as nossas extensões.
Um número de 0 a 100, com cada problema ordenado pelos pontos que está custando.
Um clique rastreia o resto do site e encontra o que uma página sozinha não mostra.
Markdown para o e-mail do cliente, JSON para suas ferramentas, CSV para planilha.
Uma auditoria de site séria precisa olhar além de uma URL, porque alguns dos problemas de SEO mais caros são invisíveis a partir de uma página só. Duas páginas competindo com o mesmo título. Uma página para a qual nada aponta. Uma seção a cinco cliques da home, onde os rastreadores quase não chegam. Nada disso se vê olhando uma URL.
Um clique segue os links internos da página em que você está e lê o HTML de cada uma. O resultado é um grafo de links do seu site — construído sem nenhuma requisição extra além das próprias páginas.
Os limites são propositalmente conservadores: só a mesma origem, caminhos
bloqueados no robots.txt são pulados sem requisição, teto de 40
páginas, três requisições por vez e nada que pareça destrutivo — sair,
excluir, finalizar compra — é tocado. O servidor é seu, e o rastreio pode ser
parado a qualquer momento.
Oito painéis, um clique, e nenhuma página sai do seu navegador.
Se esta página pode mesmo ser indexada — e, se não, exatamente qual arquivo abrir.
Títulos duplicados, páginas órfãs, profundidade de cliques, links quebrados, noindex global.
LCP, CLS, TTFB e FCP, com cada arquivo que bloqueia a primeira renderização.
Esquema H1-H6 com avisos de hierarquia e detecção de duplicados.
Sem texto alternativo, carregamento tardio e arquivos bem maiores que a caixa onde aparecem.
Validados contra o que o Google realmente exige, não um simples "encontrado".
Autorreferência, códigos duplicados, códigos inválidos e URLs relativas.
Markdown, JSON e CSV — prontos para o e-mail do cliente ou para a planilha.
Quatro situações em que a resposta não está visível na página.
Um noindex que viaja do ambiente de teste para produção é o erro
mais caro do SEO, justamente porque nada na página denuncia. Pode ficar ali
semanas enquanto o tráfego escoa em silêncio. Trinta segundos de checagem
depois de cada deploy é o seguro mais barato que existe.
Auditorias de agência começam quase sempre com os mesmos achados: títulos duplicados, H1 faltando, páginas órfãs, links internos quebrados. Rastreie o site, exporte em Markdown e o primeiro rascunho já está escrito.
Antes de reescrever o conteúdo, cheque o chato: ela é indexável?, o canonical aponta para outro lugar?, quantos links internos recebe?, a que profundidade está? "Quase nada aponta para ela" é uma resposta surpreendentemente comum.
Os dados estruturados dele, a estrutura de cabeçalhos, a configuração de hreflang, como o site é linkado por dentro. Tudo está no HTML que ele já serve para você — sem login, sem ferramenta, sem permissão.
Velocidade não é um assunto separado do SEO — os Core Web Vitals são sinal de ranqueamento e o painel de Velocidade mostra os três que importam, medidos na página que você abriu:
Isso responde à pergunta prática: o problema está no servidor (TTFB alto) ou no front-end (arquivos bloqueando, imagens pesadas)? A resposta muda completamente quem precisa resolver.
A maioria das extensões gratuitas lê a página em que você está e para por aí.
| Extensão gratuita comum | Crawlhive | |
|---|---|---|
| Alcance | Uma página | A página e depois o site inteiro |
| Títulos duplicados | Não enxerga | Encontrados no rastreio |
| Páginas órfãs | Impossível | Sitemap comparado com o grafo de links |
| Profundidade de cliques | Impossível | Medida a partir da sua página inicial |
| Cabeçalho X-Robots-Tag | Costuma ser ignorado | Lido junto com meta robots e robots.txt |
| Prévia da busca | Contagem de caracteres | Medida em pixels, na fonte do próprio Google |
| Core Web Vitals | Raramente incluídos | LCP, CLS, TTFB, FCP |
| Para onde vão suas páginas | Muitas vezes para um servidor | Para lugar nenhum — lidas onde estão |
| Precisa de programa instalado? | Não | Não — roda no navegador |
| Preço | Plano grátis com limites | Grátis |
O que torna o rastreio possível sem pedir permissões de host é onde o leitor roda:
dentro da própria origem da página. Requisições para a mesma origem
não exigem permissão, e por isso robots.txt, os cabeçalhos de resposta
e o sitemap podem ser lidos.
Vale dizer com clareza, porque são as três coisas que mais se espera de uma ferramenta de SEO.
Lê o que a sua página e o seu site realmente contêm: indexabilidade, estrutura, links, velocidade, dados estruturados — e rastreia o site para achar o que uma página não mostra.
Sem monitoramento de posições, sem dados de backlinks, sem métrica de autoridade de domínio e sem chute de IA. Isso exige bancos de dados de terceiros e assinatura; aqui se lê o seu próprio HTML.
Se você precisa de backlinks ou de posições de palavras-chave, precisa de uma plataforma paga com índice próprio — Ahrefs, Semrush e Moz existem exatamente para isso. O Crawlhive cobre a outra metade do trabalho, a que você mesmo pode verificar, e faz isso sem enviar uma única página.
As páginas que você audita são lidas onde estão e não saem do seu navegador.
O leitor roda dentro da aba que você já tem aberta. Nenhum conteúdo é mandado para lugar nenhum.
As únicas requisições vão para o site auditado: o robots.txt dele, o sitemap dele, as páginas dele.
Só nome, e-mail e foto de perfil, para que uma conta valha em todas as nossas extensões.
Sem scripts de rastreamento, sem anúncios; nada da sua navegação chega a nós nem a ninguém.
É. Não existe plano pago, sistema de créditos nem limite mensal de páginas. Só é preciso entrar com o Google para que uma conta valha em todas as nossas extensões.
Abra a página, clique na extensão e leia a pontuação com a lista de problemas ordenada. Para o site inteiro, abra a aba Site e inicie o rastreio: é dali que saem títulos duplicados, páginas órfãs e profundidade de cliques.
Ela olha se os buscadores conseguem alcançar, ler e indexar suas páginas, em vez de olhar as palavras: indexabilidade, canonicals, regras de robots, códigos de status, estrutura do site e velocidade.
Em qualquer página que você consiga abrir no Chrome, inclusive sites que não são seus. Não funciona nas páginas de erro do navegador nem em endereços chrome://, que o Chrome bloqueia para todas as extensões.
Até 40 por execução, só a mesma origem, três requisições por vez. Caminhos bloqueados no robots.txt são pulados sem requisição e o rastreio pode ser parado quando você quiser.
Não. Dados de backlinks e monitoramento de posições exigem índice de terceiros e assinatura. O Crawlhive lê o que a sua página e o seu site realmente contêm.
Não. Elas são lidas dentro da aba que você já tem aberta, e as únicas requisições vão para o site auditado. A única coisa que chega até nós é a identidade da sua conta no login.
Dá: Markdown para colar num e-mail para o cliente, JSON para suas próprias ferramentas e CSV para links, imagens e resultados do rastreio.
Indexada e indexável são perguntas diferentes. O Crawlhive responde à segunda: se algo na página, nos cabeçalhos ou no robots.txt está bloqueando. Para saber se o Google indexou de fato, consulte o Search Console.
Compare duas listas: todas as URLs do seu sitemap e todas as alcançáveis seguindo links internos. O que está na primeira e não na segunda está órfão. O rastreio monta as duas listas enquanto roda.
Pode. A análise lê o HTML que qualquer visitante recebe, então funciona em qualquer site que você consiga abrir — dados estruturados, cabeçalhos, hreflang e estrutura de links inclusos.
Faz. O painel de Velocidade traz LCP, CLS, TTFB e FCP, os arquivos que bloqueiam a renderização, o peso da página por tipo e as imagens maiores que a caixa onde aparecem.
Uma auditoria SEO completa começa exatamente com o que ele entrega: indexabilidade, estrutura, links internos, dados estruturados e velocidade, mais o rastreio que revela títulos duplicados e páginas órfãs. O que fica de fora são backlinks e posições, que exigem bases de terceiros.
Abra o site do concorrente e rode a análise normalmente. Você vê os dados estruturados dele, a estrutura de cabeçalhos, o hreflang e — com o rastreio — como o site é linkado por dentro. Tudo isso está no HTML que ele já entrega para qualquer visitante.
No Chrome e nos outros navegadores Chromium: Edge, Brave e Opera. A interface segue o idioma do seu navegador, em 49 idiomas.
Trate o número como lista de tarefas, não como nota. A pontuação só é útil porque cada problema abaixo dela mostra quantos pontos está custando, então a ordem de correção deixa de ser opinião. Rode de novo e o número diz se a mudança funcionou.
Quase todo conselho de SEO começa por palavras-chave e conteúdo. Essa é a metade visível. A outra metade decide se algo disso chega a ser lido: um rastreador consegue alcançar a página?, tem permissão para indexá-la?, a estrutura do site empurra essa página para frente ou a enterra? Abaixo está como checar cada coisa, na ordem que encontra primeiro os problemas caros.
Antes de tudo, resolva se a página é sequer elegível para aparecer na busca. Todo o resto é esforço perdido se a resposta for não — e essa resposta não se vê olhando a página.
Três mecanismos diferentes podem manter uma página fora do índice, e só um deles está no HTML que você consegue ver:
robots. A que toda extensão de SEO lê. Um noindex aqui é instrução direta para não indexar.X-Robots-Tag. Faz exatamente o mesmo, mas viaja na resposta HTTP — invisível no código-fonte e ignorado rotineiramente.
Um noindex que sai do ambiente de teste para produção é o erro mais
caro do SEO exatamente por isso: a página parece completamente normal, o tráfego
escoa ao longo de semanas e ninguém pensa em olhar os cabeçalhos de resposta.
O robots.txt controla o rastreio, não a indexação, e suas regras são
menos óbvias do que parecem. Quando várias regras batem com a mesma URL, vence a
correspondência mais longa; quando duas regras de mesmo tamanho discordam,
Allow ganha de Disallow. Curingas tornam isso difícil
de conferir a olho.
Uma página bloqueada não pode ser rastreada, então o noindex dela
nunca será visto — é por isso que bloquear uma página no robots.txt é o jeito
errado de tirá-la dos resultados. Os dois mecanismos resolvem problemas
diferentes e são confundidos o tempo todo.
O conselho conhecido — mantenha os títulos entre 50 e 60 caracteres — é uma aproximação grosseira de algo que o Google mede de outro jeito. Os resultados são cortados por largura em pixels, e caracteres não são iguais: um título em maiúsculas ou cheio de letras largas acaba bem antes do que a contagem sugere, enquanto um de letras estreitas passa tranquilamente dos 60.
Medir a largura real na fonte que o Google realmente usa é o único jeito de saber onde cai o corte. É um detalhe pequeno que decide se a sua chamada sobrevive no resultado da busca ou vira reticências.
A checagem comum é "a página tem exatamente um H1?", e vale saber, mas o sinal mais útil é o esquema inteiro. Cabeçalhos que pulam níveis — um H2 seguido direto de um H4 — normalmente significam que a página está sendo estilizada em vez de estruturada, e o documento já não descreve a própria hierarquia.
Cabeçalhos duplicados também importam. Dois H2 idênticos costumam indicar que um template repete uma seção que deveria ter sido unificada, e são um sinal confiável de que a página cresceu por acúmulo, não por projeto.
A maioria das ferramentas diz que um tipo de schema foi detectado. Essa é a parte fácil. O que determina se você ganha um resultado rico é se as propriedades obrigatórias estão lá — um Product sem ofertas não produz resultado rico nenhum, por mais correta que a marcação pareça.
Então a saída útil não é "Product encontrado", e sim "Product encontrado, mas sem ofertas, logo não haverá resultado rico". Essa diferença é o sentido inteiro de fazer a checagem.
A primeira passada de um rastreador lê o HTML como ele chega do servidor. Se o seu título, o seu H1 ou o seu canonical só aparecem depois que o JavaScript roda, eles não estão lá nessa primeira leitura. O Google acaba renderizando as páginas, mas renderizar é um segundo passo, mais lento e menos garantido.
Comparar o que o servidor mandou com o que o navegador acabou tendo mostra quais partes da sua página dependem dessa segunda passada. Tudo o que é crítico para a indexação pertence à primeira.
Tudo acima é sobre uma URL só. Os achados que mais mudam ranqueamento são estruturais e só aparecem quando você olha o site como um grafo:
href resolveria.Uma auditoria completa do site é trabalho trimestral para a maioria. A checagem de indexabilidade não: rode depois de todo deploy que mexa em templates e em qualquer página que perca tráfego de repente. Leva segundos e pega a falha que custa mais caro.
Quando fizer a passada completa, corrija nesta ordem: o que bloqueia a indexação, depois os problemas estruturais (duplicados, órfãs, profundidade), depois os detalhes on-page e por último a velocidade. Essa ordem não é questão de gosto — uma página que não pode ser indexada não ganha nada com um LCP mais rápido.
Grátis, sem limite de páginas, e nada do que você audita sai do seu navegador.
Adicionar o Crawlhive ao Chrome — GrátisO Crawlhive é uma extensão de navegador independente. Não é afiliada, endossada nem patrocinada pelo Google. Chrome é uma marca registrada da Google LLC.
Todas as nossas ferramentas são gratuitas e rodam direto no seu navegador.