Testador de robots.txt
Implementa as regras de match usadas pelo Googlebot / Bingbot: grupos são indexados por user-agent, o UA mais específico vence (exato > substring > *), e dentro dum grupo o padrão coincidente mais longo vence (empates favorecem Allow sobre Disallow). Suporta o wildcard * e a âncora de fim-de-caminho $. Também mostra cada declaração Sitemap:, então você pode verificar que as URLs do sitemap são alcançáveis.
- Permitidoregra: Allow: /admin/
- Permitidoregra: Allow: /admin/public/
- Bloqueadoregra: Disallow: /
- Bloqueadoregra: Disallow: /private/
- https://example.com/sitemap.xml
Matches UA por substring são insensíveis a maiúsculas. Padrão mais longo vence; empates vão pra Allow.
Como usar
- Cole seu robots.txt na caixa superior.
- Adicione casos de teste (user-agent, caminho) — defina UA pra '*' pra testar o grupo catch-all.
- Leia o veredicto e a regra que o produziu à direita.
Perguntas frequentes
- Como funciona o match mais longo?
- Dentro do grupo UA correspondente, a regra com o padrão mais longo que ainda coincide com o caminho vence. Allow e Disallow são pesados só por comprimento de padrão — um Allow com padrão mais longo vence um Disallow com padrão mais curto.
- O que $ no final dum padrão significa?
- Ancora o padrão ao final do caminho URL. /foo$ coincide com /foo exatamente, não com /foo/bar. Útil pra bloquear extensões específicas como /*.pdf$.
- Uma regra Disallow mantém a página fora dos resultados de busca?
- Não de forma confiável. Ela impede que rastreadores bem-comportados busquem a página, mas uma URL ligada por outros sites ainda pode ser listada, porque o rastreador nunca lê a página e, portanto, nunca vê uma tag noindex nela. Para tirar algo do índice, permita o rastreamento e devolva noindex, ou coloque a página atrás de autenticação.
- Um robots.txt vale para os meus subdomínios?
- Não. O arquivo se aplica a exatamente um esquema, host e porta, então example.com e www.example.com precisam cada um do seu, e uma porta diferente também. Ele também precisa ficar na raiz daquele host — um robots.txt dentro de um subdiretório simplesmente não é lido.
Ferramentas relacionadas
Parser de User Agent
Parseia string User-Agent em navegador, engine, OS, dispositivo e CPU. Detecta 20+ bots incluindo GPTBot, ClaudeBot, PerplexityBot.
Construtor de Cabeçalhos CORS
Compõe cabeçalhos de resposta Access-Control-* de uma checklist, com quatro presets e avisos ao vivo pras combinações perigosas.
Construtor de Registro DMARC
Componha um registro TXT `_dmarc` — política, política de subdomínio, rollout por porcentagem, alinhamento, reporting rua/ruf — com avisos de segurança.
Divisor de Registro TXT (Chunks de 255 Bytes)
Divida um registro TXT SPF, DKIM ou DMARC longo nos chunks de 255 bytes que o protocolo DNS requer — emite sintaxe BIND, arquivo zone genérico, Cloudflare ou Route 53.
Referência de URIs /.well-known/*
Catálogo pesquisável de well-known URIs registrados com IANA — `security.txt`, `openid-configuration`, `apple-app-site-association`, `acme-challenge` e 30+ mais, com referências RFC e casos de uso.
Construtor e parser de registros DKIM
Construa ou parseie um registro DNS TXT DKIM (DomainKeys Identified Mail) — cole sua chave pública, escolha selector, tipo de chave (RSA/Ed25519), hash e flags, e obtenha o registro completo, o hostname `selector._domainkey` e uma versão fragmentada para registros acima de 255 caracteres.