Robots.txt とは?完全入門ガイド
robots.txt の基本構文、仕組み、検索エンジンクローラーに対するアクセスルールの正しい設定方法を学べます。User-agent、Allow、Disallow、Sitemap、Crawl-delay の詳しい説明を含みます。
プロ向けの robots.txt / sitemap.xml 検証ツールです。rule conflict、format error、blocking issue を解析し、
SEO スコア、改善提案、即時検証を提供し、処理はすべてブラウザー内で行うため入力データを外部へ送信しません。
ブラウザのセキュリティ制限(CORS)
ブラウザーのセキュリティ制約(CORS)により、他サイトの robots.txt や sitemap.xml を直接読み取ることはできません。内容をツールへ貼り付けて解析してください。将来バックエンドサービスを追加した場合には、この機能を拡張できます。
問題は検出されませんでした。内容は良好です!
解析を実行すると、検出された問題に対する改善例と修正例がここに表示されます。
Robots.txt と Sitemap に関するよくある質問
/robots.txt robots.txt の有無を確認し、記載されたルールに基づいてクロール動作を判断します。「User-agent」で対象クローラーを指定し、「Disallow」と「Allow」でアクセス権限を制御します。robots.txt はあくまで「紳士協定」であり、セキュリティ機構ではない点に注意してください。悪意のあるプログラムはこれらのルールを無視できます。
lastmod(最終更新日)、changefreq(更新頻度)および priority(priority)などのメタデータ。SEO において Sitemap は検索エンジンがページをより早く発見・インデックスする助けとなり、新規サイト、大規模サイト、更新頻度の低いサイトでは特に有効です。Google Search Console へ Sitemap を送信することで、インデックス効率を大きく改善できる場合があります。
Disallow: /、つまりすべてのパスがブロックされ、検索エンジンが Web サイト内のどのページもクロールできなくなります。その結果、① Web ページが検索結果から消える、またはインデックスされない、② すでに登録済みのページが削除される可能性がある、③ Google 検索結果からサイト内容を確認できなくなる、といった問題が起きます。Web サイトのメンテナンス中など、特定の状況で一時的にのみ使用し、必ず次と組み合わせることを強く推奨します Allow: / 細かな制御用ルールです。SEO penalty の調査や test をしたい場合に利用します。 noindex 代わりに meta タグを使用します。
Sitemap: この指定で sitemap.xml の場所を示すと、クローラーがサイトマップを直接見つけられます。② sitemap に robots.txt でブロックされた URL が含まれていないことを確認してください。含まれている場合、クローラーは先に robots.txt を読み、禁止されていることを確認すると、sitemap 内の該当 URL を無視します。③ robots.txt で管理画面や一時アーカイブなどの機密性の高い領域を保護し、sitemap では高品質なコンテンツを送信します。両者を併用することで、検索エンジンのクロール効率を最大化できます。
https://你的網域/robots.txt および https://你的網域/sitemap.xml 元の内容を確認します。② このツールの「Paste Content」モードに内容を貼り付けて分析します。③ Google Search Console の「Page Index」と「Sitemaps」レポートで公式の検出結果を確認します。④ Google の「Robots Testing Tool」で特定 URL がブロックされているかテストします。このツールでは、データ漏えいを心配せずにオフライン確認とリアルタイム確認を行えます。
lastmod(最終更新日)— Google はこの日付を参考にページが更新されたか判断します。特に news や頻繁に更新される Web サイトでは重要です。② changefreq(更新頻度)— ページがどの程度の頻度で変更される可能性があるかを示します。ただし Google は、この値はあくまで参考情報であり、実際のクロール頻度はアルゴリズムによって決まると説明しています。③ priority(Priority 0.0~1.0)サイト内の他ページと比較した重要度を示します。Google は priority と changefreq は現在ランキング要因ではないと明言していますが、lastmod を正しく設定することは、クローラーがサイトをより効率的に巡回する助けになります。
Robots.txt と Sitemap のベストプラクティスを詳しく見る
robots.txt の基本構文、仕組み、検索エンジンクローラーに対するアクセスルールの正しい設定方法を学べます。User-agent、Allow、Disallow、Sitemap、Crawl-delay の詳しい説明を含みます。
sitemap.xml の構造、作成方法、送信方法を理解できます。XML の書式と URL 仕様から Google Search Console への送信まで、サイトマップの SEO ベストプラクティスをまとめて確認できます。
Googlebot が Sitemap を発見し、ダウンロード、解析、インデックス登録へ進む処理を詳しく解説します。Google の Sitemap 処理上の制限、インデックス優先度の考え方、よくあるインデックス問題を理解できます。
robots.txt でよくある設定ミスを整理します。サイト全体の誤ブロック、構文エラー、ルール競合、Sitemap 指定漏れ、不適切な Crawl-delay などを検出し、具体的な修正案と推奨例を提示します。
効果的な Sitemap 戦略を学べます。URL の優先順位、更新頻度、多言語サイト対応、画像・動画 Sitemap、動的生成と自動送信のベストプラクティスを扱います。
Web サイトの刷新やドメイン移行では robots.txt と sitemap の扱いが重要です。301 redirect の設定、robots.txt と sitemap の更新、URL 変更の送信、SEO 順位を維持するための重要な手順を確認しましょう。
このツールは robots.txt と sitemap.xml を包括的に検証し、Web サイトが検索エンジンの技術仕様に沿っているか確認するのに役立ちます。
Robots.txt 分析
ルール競合、ブロック検出
Sitemap 解析
形式、重複、完全性
SEO スコアリングシステム
エラー / 警告 / 提案
即時検証
入力内容をすぐに再解析します