検索エンジン仕様・即時生成と検証
Robots.txt Generator Robots.txt ジェネレーター
検索エンジン仕様に沿った robots.txt をすばやく作成し、複数の User-agent と Allow/Disallow rule に対応します。
一般的な template、sitemap setting、real-time validation を内蔵しています。
📖 Robots.txt 完全ガイド:検索エンジン仕様と SEO のアドバイス
robots.txt の仕組みとベストプラクティスを詳しく見る
機能紹介
Robots.txt Generator は ToolHub が提供する無料のオンライン robots.txt 作成ツールです。グラフィカル UI から複数グループを追加できます。 User-agent(Googlebot、Bingbot、Baiduspider、YandexBot など)の設定 Allow / Disallow ルール、告知 Sitemap、調整 Crawl-delay 付き ホスト、右側に対応する robots.txt が即座に生成され、構文、ブロック範囲、重複ルールも自動検証されます。WordPress、Blog、E-commerce など 7 種類の定番テンプレートを内蔵し、基本設定をワンクリックで作成できます。
robots.txt とは何ですか?
robots.txt Web サイトの「crawler 指示ファイル」で、サイトの root directory に配置します。標準化された形式で、検索エンジン crawler にクロール可能なページと避けるべきページを伝えます。次の仕様に従います Robots Exclusion Protocol(REP)、SEO の技術最適化における基本的なリンクです。
一般的な robots.txt は 1 つ以上の "rule group" で構成され、各 group には User-agent に対応 Allow / Disallow ルール:
User-agent: * Disallow: /admin/ Disallow: /private/ Allow: /images/ Sitemap: https://example.com/sitemap.xml
robots.txt の使い方は?
ルールグループ(User-agent)
各ルールグループは次で始まります User-agent: 最初に、そのルールを適用するクローラーを指定します。一般的な利用ルールは * すべての crawler を表します。Googlebot など特定 crawler 専用 rule も設定できます。注意:Google は最初に一致した User-agent グループのみを使用します, そのため最も specific な crawler rule を先に配置してください。
Allow と Disallow
Disallow 指定したパスをブロックします。Allow 指定した path を開きます(Google は Allow を標準サポート)。Path は / から始める必要があります。 / 先頭、たとえば Disallow: /admin/. Allow と Disallow が同時に存在する場合、一致するパスルールのうち最長のものが優先されます——これは「まず広い範囲を block し、その後 subdirectory を許可する」考え方の基礎です。
Sitemap 宣言
Sitemap: このディレクティブは XML Sitemap の場所をクローラーへ伝えます。User-agent とは無関係で、通常は robots.txt の末尾に置き、複数の Sitemap を宣言できます。すべての Web サイトで robots.txt に Sitemap を記載することを推奨します。
Crawl-delay と Host
Crawl-delay クローラーの各リクエスト間隔を秒数で設定します(Google は非対応)。Host 主要ドメインを宣言します(Yandex 対応。IP ドメインの重複インデックス回避に利用)。
よくある間違いと回避方法
- サイト全体をブロック — 単独で使用
Disallow: / この設定ではサイト全体が index されなくなり、影響が非常に大きくなります。意図した設定か必ず確認してください。
- パス形式エラー — 先頭のスラッシュがありません(
Disallow: admin/)またはパスの代わりに URL を使用(Disallow: https://…)はよくある誤りです
- 大文字小文字混在 — 命令名は小文字である必要があります(
user-agent、disallow), 値は大文字・小文字を区別します
- 繰り返しと競合のルール — 同じ path を重複宣言すると保守が難しくなります。同じ名前の User-agent group を繰り返した場合、後者が無効になることがあります。
- セキュリティ保護目的で robots.txt を誤用すること — あくまで protocol であり firewall ではありません。機密ページには別途 verification mechanism を設けてください。
SEO アドバイス
- ブロックするがインデックス可能なままにする — 検索結果へ出す必要のない機能ページ(カート、アカウント、管理画面など)はブロック対象になり得ますが、重要なコンテンツページを誤って除外しないでください。
- Sitemap を必ず宣言してください — crawler が訪問するたびに content map をすぐ把握できるようにします。
- CSS / JS のブロッキングを避ける — modern SEO では CSS/JS file を block すると Google が page rendering を正しく理解できなくなります。
- 変更後に検証 — deploy 後は Search Console の robots.txt testing tool でも確認してください。
- シンプルに保つ — robots.txt は簡潔で明確に保ってください。複雑すぎるルールはミスの原因になります。
ブラウザー互換性
このツールは最新の Web 標準に基づいて開発され、Google Chrome、Mozilla Firefox、Apple Safari、Microsoft Edge、Opera の最新バージョンに対応しています。最良の使用体験のため、ブラウザは最新版を利用することをおすすめします。
プライバシー保護
ToolHub はデータのプライバシーを重視しています。Robots.txt Generator は 100% 純フロントエンド構成、すべてのルール生成と検証はブラウザー内で完結し、データが外部サーバーへ送信されることはありません。入力したルール内容を保存、解析、共有することもありません。