Skip to content
robots.txtジェネレーター
Tools

robots.txtジェネレーター

新着

allow/disallowルールとサイトマップ行を含む有効なrobots.txtを作成。

Quick presets
Generated robots.txt
Test a URL Check whether your rules allow or block a path — same longest-match logic Google uses.

Disallow blocks crawling, not indexing. A blocked URL can still appear in Google if other sites link to it. To remove a page from search results, keep it crawlable and add a noindex meta tag or X-Robots-Tag header. robots.txt is also a public file and is not a security measure — protect private pages with real authentication.

robots.txt syntax cheat-sheet
Directive What it does
User-agent: *Which crawler the rules apply to (* = all bots).
Disallow: /pathAsk crawlers not to crawl URLs that start with this path.
Allow: /pathPermit a path, typically an exception inside a disallowed area.
Crawl-delay: 10Seconds between requests. Bing & Yandex honor it; Google ignores it.
Sitemap: https://…Absolute URL of your sitemap. Can appear anywhere in the file.
*Wildcard — matches any sequence of characters in a path.
$Anchors a rule to the end of the URL, e.g. /*.pdf$.
#A comment — the rest of the line is ignored by crawlers.

Runs entirely in your browser. Nothing is uploaded.

ブラウザで動くrobots.txtジェネレーター(無料・インストール不要)

このrobots.txtジェネレーターは、シンプルなフォームから正しい構文のrobots.txtファイルを自動生成します。構文を覚える必要はなく、ソフトウェアのインストールも不要です。プリセットを選ぶか、独自のクロールルールを追加するだけでファイルがリアルタイムで完成し、コピーまたはダウンロードしてサイトのルートディレクトリに設置するだけです。すべてブラウザ上で処理されるため、設定した内容がサーバーにアップロードされることはありません。

手軽に使えるrobots.txtサンプルから始めたい方も、特定のクローラー向けのカスタムrobots.txtを作りたい方も、WordPressやBlogger、あるいはAI学習ボットをブロックするファイルが必要な方も、数秒で準備が整います。競合ツールの多くにはない内蔵パステスターで、公開前にルールの動作を確認できます。

構文を暗記せずにクロールルールを作成する

各ルールグループはユーザーエージェントと、Allow(許可)またはDisallow(禁止)するパス、オプションのクロールディレイをセットで設定します。*で全クローラーを対象にするか、GooglebotBingbotのように特定のボット名を入力してください。入力中に主要なクローラー名がサジェストされます。ボットごとに異なるルールを設定する場合は、グループをいくつでも追加できます。

パスは1行1つで入力します。ツールが各パスを正しいDisallow:またはAllow:ディレクティブに変換し、グループを正しい順序でまとめます。サイトマップURLを追加すると、クローラーがすべてのページを発見できるよう絶対パスのSitemap:行として末尾に追記されます。GoogleはこれをSearch Consoleから直接送信したサイトマップと併用して活用します。

WordPress・Blogger・AIボットブロック用プリセット

ワンクリックで用途別の設定を即座に読み込めます。全許可全禁止は両極端をカバーし、WordPressプリセットは推奨デフォルト設定(/wp-admin/をブロックしつつ、プラグインに必要なAJAX通話のために/wp-admin/admin-ajax.phpを開放)を読み込みます。BloggerプリセットはGoogleが推奨するBlogger向け設定で、重複コンテンツを避けるために/searchを除くすべてのページを許可します。

AIボットブロックプリセットは、GoogleやBingの検索インデックスには残しつつ、AIモデルの学習に自分のコンテンツを使われたくない場合に役立ちます。GPTBot(OpenAI)、CCBot(Common Crawl)、Google-Extended(Gemini)、ClaudeBot(Anthropic)、PerplexityBotなどを一括でブロックしながら、通常の検索クローラーはそのままにします。ニューヨーク・タイムズやガーディアン紙など多くの大手メディアが2023年に同様のブロックを追加しました。

公開前にURLをテストして安心確認

テスト機能のないジェネレーターは半分しか仕事をしていません。内蔵のパステスターで任意のURLまたはパスとクローラー名を入力すると、現在のルールで許可・ブロックのどちらになるかを確認でき、どのAllowまたはDisallowルールが適用されるかも表示されます。Googleが採用するのと同じ最長一致ロジック(より詳細なルールが優先され、同じ長さの場合はAllowが勝つ)に基づいて判定します。

入力しながらリアルタイムで、よくあるミスへの警告も表示されます。パスの先頭スラッシュ欠落、相対パスのサイトマップURL、Googlebotへのクロールディレイ設定(Googlebotはこれを無視し、Search Consoleで個別設定が必要)などを事前に修正することで、公開後にSearch Consoleで調査する手間を省けます。

クロールとインデックスの違い、よくある設定ミス

robots.txtで最も多い誤解が「Disallowを設定すればGoogleの検索結果からページを除外できる」という思い込みです。実際には、クロールを止めるだけであり、他のページからリンクされているURLは検索結果に表示され続けることがあります。Googleはスニペットなしでそのページを表示する場合すらあります。検索結果からページを除外するには、ページをクロール可能なままにして、ページ自体にnoindexディレクティブを追加してください。robots.txtでブロックすると、Googleはそのnoindex指示を読み取れなくなり、URLがインデックスに残り続けるリスクがあります。

また、robots.txtは公開ファイルで、あくまで推奨事項である点に注意が必要です。決まったURLに置かれ、誰でも読め、セキュリティバリアにはなりません。行儀の良いボットだけが従い、悪意あるボットは無視します。クロールバジェットの最適化や重複・薄いコンテンツページの整理には有効ですが、本当に保護が必要なデータを隠す目的では使わないでください。それには認証を使いましょう。このジェネレーターはすべてブラウザ内で動作するため、サイト内のパス情報がデバイスの外に出ることはありません。

Frequently asked questions

robots.txtとは何ですか?何のために使いますか?

robots.txtは、サイトのルートに置くテキストファイルで、検索エンジンのクローラーがどのURLをクロールしてよいか、または避けるべきかを伝えます。たとえば「Disallow: /cart/」とすることで、ショッピングカートのページをクロールしないよう指示し、SEOにとって重要なページにクロールバジェットを集中させることができます。robots.txtはRobots Exclusion Protocol(現在はRFC 9309として標準化)の一部で、Google・Bing・その他の主要クローラーが従います。ただし、クロールを制御するものであり、アクセス制限やセキュリティのためのものではありません。誰でもyoursite.com/robots.txtで内容を読めるため、プライバシー保護ツールとしては機能しません。

robots.txtファイルの作り方を教えてください

上のビルダーを使ってください。プリセットを選ぶか、ルールグループを追加して、User-agent(全クローラー対象は *)を設定し、Disallow・Allowするパスを入力します。オプションでCrawl-delayを設定し、サイトマップURLを貼り付けます。リアルタイムで出力が更新されるので、コピーまたはダウンロードしてrobots.txtとして保存し、サイトのルートフォルダにアップロードしてhttps://yoursite.com/robots.txtでアクセスできるようにしてください。コーディングは不要で、公開前にパステスターでルールを確認できます。

technicalseo.comやseoptimer.comのrobots.txtジェネレーターと何が違いますか?

TechnicalSEO.comのrobots.txtジェネレーターやSEOptimerも正しいファイルを生成できますが、どちらも特定のURLにどのルールが適用されるかを確認できる内蔵パステスターがありません。このツールにはあります。パスとクローラー名を入力すると、Googleが適用するのと同じ最長一致ロジックを使って、現在のルールで許可・ブロックのどちらになるかを表示します。また、よくあるミス(先頭スラッシュ欠落、相対パスのサイトマップURL、Googlebotへのクロールディレイ設定など)をリアルタイムで警告します。これらすべてがブラウザ内で動作し、データはサーバーに送信されません。

robots.txtファイルはどこに置けばいいですか?

ドメインのルートディレクトリに置き、https://yoursite.com/robots.txtでアクセスできる必要があります。/blog/robots.txtのようなサブフォルダに置いてもクローラーには無視されます。サブドメインにはそれぞれ独自のファイルが必要で、blog.yoursite.comとshop.yoursite.comにはそれぞれ別のrobots.txtが必要です。WordPressではFTPやホスティングのファイルマネージャーからアップロードするか、Yoast SEOなどのプラグインを使って管理できます。Bloggerでは「設定 → 検索設定 → カスタムrobots.txt」から設定できます。

robots.txtのUser-agentとは何ですか?

User-agentは、ルールブロックが適用されるクローラーを指定します。「User-agent: *」はすべてのクローラーを対象とし、「User-agent: Googlebot」はGoogleのメインウェブクローラーのみを対象にします。複数のグループを設定できます(例:全員を許可しつつGPTBotだけブロック)。各クローラーは自分の名前に最も一致するグループのルールに従います。主な値には、Googlebot、Bingbot、Googlebot-Image、GPTBot(OpenAI / ChatGPT)、CCBot(Common Crawl、多くのAI学習データセットで使用)、Google-Extended(GoogleのGemini)、PerplexityBotなどがあります。

AllowとDisallowの違いは何ですか?

Disallowはクローラーに対象URLを取得しないよう要求し、Allowは許可します。Allowは主に、禁止フォルダ内で例外を設定するために使います。たとえば「Disallow: /wp-admin/」と「Allow: /wp-admin/admin-ajax.php」を組み合わせると、WordPressの管理エリアをブロックしつつ、プラグインが必要とするAJAXファイルだけを通すことができます。ルールが競合する場合、Googleは最も詳細な(最長の)一致パスに従い、同じ長さの場合はAllowが勝ちます。Bingも同じロジックを使用し、Yandexはエッジケースで若干異なります。

robots.txtにサイトマップを追加する方法は?

完全な絶対URLで「Sitemap:」行を追加します(例:Sitemap: https://example.com/sitemap.xml)。ファイル内のどこに置いてもよく、User-agentグループとは独立しています。複数のサイトマップを別々の行に記載することもできます。上のサイトマップフィールドにURLを貼り付けると、ツールが正しい位置に行を配置します。Googleのドキュメントでは、この方法とSearch Consoleからの直接送信を併用することを推奨しており、両方の方法でGoogleがすべてのページを発見しやすくなります。

Googleにページをクロールさせないようにするには?

そのページのパスに対してDisallowルールを追加します(例:Disallow: /draft-page/)。ただし、クロールを止めることと検索結果から除外することは別物です。DisallowされたURLも、他のサイトからリンクされている場合は検索結果に表示され続けることがあります。ページをGoogleの検索結果から完全に除外するには、noindexディレクティブ(meta name='robots' content='noindex')またはX-Robots-Tagヘッダーを追加し、robots.txtではブロックしないようにしてください。robots.txtでブロックすると、Googleはページをクロールできず、noindexの指示も読み取れなくなります。

robots.txtでインデックスを止められますか?

いいえ。robots.txtはクロールを制御するものであり、インデックスを制御するものではありません。URLをDisallowしてもGoogleはそのコンテンツを取得しませんが、他のページからリンクされている場合、URLは検索結果に表示され続けることがあります。説明文なしのURLだけが表示されることもあります。ページをインデックスから除外するには、ページ自体にnoindexディレクティブを追加し、Googleがそのディレクティブを読み取れるようクロール可能な状態にしておいてください。これはSEOで最もよくある誤りの一つです。Disallowルールを追加してページを検索結果から除外しようとし、なぜまだ表示されるのかと悩む方が多くいます。

Google Search Consoleの「robots.txtにブロックされています」とは?

Google Search Consoleで「robots.txtにブロックされています」と表示されるのは、GoogleがURLを発見したものの、robots.txtがそのURLのクロールを禁止しているため、ページが取得・インデックス登録されなかったことを意味します。そのページを公開すべき場合は、該当するDisallowルールを削除するか範囲を絞ってください。管理者ページ、ステージング環境、薄いコンテンツページなど意図的なブロックであれば、そのままで問題ありません。ファイルを編集する前に、このジェネレーターのパステスターで、どのルールが対象URLをブロックしているかを確認してください。

クロールディレイ(Crawl-delay)とは何ですか?

Crawl-delayはクローラーに対し、リクエスト間に一定の秒数待つよう要求することで、サーバーへの負荷を軽減します。「Crawl-delay: 10」は約10秒に1リクエストを意味します。BingとYandexはこれを尊重しますが、Googlebotは完全に無視します。Googleのクロールレートを調整するにはSearch ConsoleのCrawl Statsレポートを使ってください。クロールによってサーバーが本当に高負荷な場合のみ追加することをお勧めします。値が大きいとサイトのインデックス更新が遅くなります。

WordPressやBlogger用のrobots.txtはどう作りますか?

上のWordPressまたはBloggerプリセットをクリックしてください。WordPressの標準ファイルは管理エリアをブロックしつつ、クローラーが必要とするAjaxファイルを開放します(User-agent: * / Disallow: /wp-admin/ / Allow: /wp-admin/admin-ajax.php)。Bloggerのデフォルトはすべてを許可しつつ検索ページを除外します(User-agent: * / Disallow: /search / Allow: /)。サイトマップURLを追加し、WordPressではYoast SEOを使うかFTP経由でファイルをアップロードし、BloggerではSettings → Search preferences → Custom robots.txtに貼り付けてください。

robots.txtをテスト・検証する方法は?

このツールのパステスターを使ってください。URLまたはパス(例:/blog/post-1)とクローラー名を入力すると、現在のルールで許可・ブロックのどちらになるか、どのルールが適用されるかをGoogleと同じ最長一致ロジックで表示します。ビルダーはリアルタイムで、先頭スラッシュ欠落、相対パスのサイトマップURL、Googlebotへのクロールディレイ設定などのよくあるミスも警告します。公開後は、Google Search Consoleのrobots.txtレポートでライブファイルを確認し、URLインスペクションツールで個別のページをチェックしてください。

robots.txtは安全ですか?

robots.txtは安全に使用できますが、セキュリティツールではありません。yoursite.com/robots.txtで誰でも読める公開ファイルのため、「秘密の」フォルダをそこに記載すると、チェックする人に逆に知らせてしまいます。Google・Bing・Appleなどの行儀の良いクローラーはルールに従いますが、悪意あるボットは完全に無視することがあります。機密ページを保護するには、適切な認証(ログイン・パスワード・IPホワイトリスト)やサーバーサイドのアクセス制御を使ってください。プライベートデータを隠す目的でDisallowに頼ってはいけません。

AIボットによる学習からコンテンツを守るには?

各AI学習クローラーに対して個別のUser-agentグループを作成し、それぞれに「Disallow: /」を追加してください。主要なもの:GPTBot(OpenAI / ChatGPT)、CCBot(Common Crawl、多くのAI学習データセットで使用)、Google-Extended(GoogleのGeminiおよびVertex AI)、ClaudeBot(Anthropic / Claude)、PerplexityBot、Applebot-Extended、meta-externalagent(Meta / Llama)。このジェネレーターの「AIボットブロック」プリセットを使えばワンクリックで一括設定でき、Googlebot・Bingbotなど通常の検索クローラーには影響せず、コンテンツの検索インデックスは維持されます。