robots.txt テスター
Googlebot / Bingbot が使用するマッチングルールを実装:グループは user-agent でキー付けされ、最も具体的な UA が勝つ(完全一致 > 部分文字列 > *)、グループ内では最長の一致パターンが勝つ(同点では Allow が Disallow に勝つ)。* ワイルドカードと $ パス終端アンカーをサポート。すべての Sitemap: 宣言も表示するため、サイトマップ URL が到達可能か健全性チェックできる。
- 許可ルール: Allow: /admin/
- 許可ルール: Allow: /admin/public/
- 拒否ルール: Disallow: /
- 拒否ルール: Disallow: /private/
- https://example.com/sitemap.xml
部分文字列 UA マッチは大文字小文字を区別しない。最長パターンが勝つ;同点では Allow。
使い方
- robots.txt を上のボックスに貼り付け。
- (user-agent、パス)テストケースを追加 — UA を '*' にすると catch-all グループをテスト。
- 右側で判定とそれを生成したルールを読む。
よくある質問
- 最長一致はどう機能する?
- 一致した UA グループ内で、パスにまだ一致する最長パターンのルールが勝つ。Allow と Disallow はパターン長でのみ重み付けされる — 長いパターンの Allow は短いパターンの Disallow に勝つ。
- パターンの末尾の $ は何を意味する?
- URL パスの末尾にパターンをアンカーする。/foo$ は /foo に正確に一致するが、/foo/bar には一致しない。/*.pdf$ のような特定のファイル拡張子をブロックするのに便利。
- Disallowを書けば検索結果に出なくなりますか?
- 確実ではありません。行儀のよいクローラーがそのページを取得しなくなるだけで、他のサイトからリンクされているURLは掲載されることがあります。クローラーはページを読まないので、そこに書かれたnoindexにも気づけないからです。索引から外したいなら、むしろクロールを許可してnoindexを返すか、認証の後ろに置いてください。
- robots.txtはサブドメインにも効きますか?
- 効きません。このファイルはスキーム・ホスト・ポートが一致する範囲にだけ適用されるので、example.comとwww.example.comにはそれぞれ必要ですし、ポートが違えばまた別に必要です。置き場所もそのホストのルートでなければならず、サブディレクトリに置いたrobots.txtは読まれません。
関連ツール
User Agent パーサー
User-Agent 文字列をブラウザ・エンジン・OS・デバイス・CPU に解析。GPTBot・ClaudeBot・PerplexityBot を含む 20 以上のボットを検出。
CORS ヘッダービルダー
チェックリストから Access-Control-* レスポンスヘッダーを構成、4 つのプリセットと危険な組み合わせのライブ警告付き。
DMARC レコードビルダー
`_dmarc` TXT レコードを構成 — ポリシー、サブドメインポリシー、パーセンテージロールアウト、アライメント、rua/ruf レポート — 安全警告付き。
TXT レコードスプリッター(255 バイトチャンク)
長い SPF、DKIM、または DMARC TXT レコードを、DNS プロトコルが要求する 255 バイトチャンクに分割 — BIND、汎用ゾーンファイル、Cloudflare、または Route 53 構文を出力。
/.well-known/* URI リファレンス
IANA登録のwell-known URIの検索可能カタログ — `security.txt`·`openid-configuration`·`apple-app-site-association`·`acme-challenge` 他30+、RFCリファレンス·使用例付き。
DKIMレコード ビルダー & パーサー
DKIM(DomainKeys Identified Mail)の DNS TXT レコードを構築・解析 — 公開鍵を貼り付け、selector・鍵タイプ(RSA/Ed25519)・ハッシュ・フラグを設定すれば、フルレコード + `selector._domainkey` ホスト名 + 255文字超用の DNS 分割版まで生成。