Analisador de Log de Servidor (Crawl Budget)
Analisa logs de acesso Apache e Nginx e mostra quanto do rastreamento vai para cada bot, quais URLs o Googlebot visita e onde o crawl budget se perde.
Aceita Common Log Format e Combined. O arquivo é lido nesta aba e nada é enviado para servidor nenhum.
Resumo
Rastreamento por agente
Status HTTP entregue
Desperdício de crawl budget
URLs em que um rastreador do Google levou redirecionamento ou erro. A prioridade pesa 5xx por 2, 4xx por 1,5 e 3xx por 1.
URLs mais rastreadas
Tipo de recurso
Quando os bots passam
Por hora do dia
Como ler os painéis
A coluna de agente sai do user-agent, casado por substring numa ordem fixa para que Googlebot-Image nunca seja contado como Googlebot puro. A linha cujo user-agent não tem assinatura conhecida mas traz bot, spider ou crawler cai em Outros bots; o resto vira tráfego humano e sai do recorte por padrão.
O painel de desperdício é o que pede ação: todo redirecionamento e todo erro entregue a um rastreador do Google é uma requisição que não produziu página indexável. Uma fatia grande de arquivos estáticos no painel de recursos costuma significar que imagens e assets estão comendo requisições que deveriam chegar às páginas de produto e de artigo.
Ler o access.log para achar onde o crawl budget vaza
O arquivo de log do servidor é o único lugar que registra o que os buscadores realmente pediram ao seu site, linha por linha, sem amostragem. Cole o conteúdo do access.log aqui e a página separa cada requisição por agente, por código de resposta, por URL e por hora, mostrando quanto do rastreamento foi para páginas úteis e quanto se perdeu em redirecionamento, erro e arquivo estático.
A leitura aceita Common Log Format e Combined, os dois padrões que Apache e Nginx gravam por omissão. O agente sai do user-agent por comparação de substring numa ordem fixa, então Googlebot-Image, Googlebot-News e AdsBot aparecem separados do Googlebot comum em vez de somados a ele. Quem não tem assinatura conhecida mas traz bot, spider ou crawler no texto cai em Outros bots.
O painel que costuma render decisão é o de desperdício: toda URL em que um rastreador do Google levou 301, 404 ou 500 está consumindo requisição sem devolver página indexável. A prioridade multiplica os hits pelo peso da faixa, 2 para 5xx, 1,5 para 4xx e 1 para 3xx, para você atacar primeiro o que dói mais. São analisadas até 50 mil linhas por vez e nada é enviado para servidor nenhum.
Perguntas frequentes
Onde eu encontro esse arquivo de log?
Dá para saber se o Googlebot do log é verdadeiro?
Qual o limite de linhas e o que acontece se eu passar dele?
Ferramentas Relacionadas
Analisador de Meta Tags
Cole o HTML de uma página e veja todas as meta tags (description, keywords, Open Graph, Twitter, viewport, robots) extraídas e organizadas. Tudo no navegador.
Analisador de Title (SEO)
Analisa o comprimento do title tag em caracteres e estima pixels para sugerir corte ótimo no Google.
Analisador de Title e Description
Verifique se seu <title> (50-60 chars) e meta description (150-160 chars) estão no tamanho ideal para Google. Mostra preview do snippet. Tudo no navegador.