コードを一から書くことなく、ウェブサイト用の適切な robots.txt ファイルを作成できます。
この無料ツールを使用すると、検索エンジンのボットに対してサイトのどの部分をクロールし、どの部分をスキップすべきかを指示するルールを作成できます。オプションを入力し、ファイルを生成して、ウェブサイトのルートディレクトリにアップロードしてください。
Robots.txt は、ウェブサイトのルートフォルダーに配置されるシンプルなテキストファイルです(例:https://yoursite.com/robots.txt)。
Google などの検索エンジンがサイトを訪れる際、さまざまなボットに提供されているクロール指示を理解するためにこのファイルを確認します。
これを使用して以下のことが行えます:
これはユーザーからページを隠すものではなく、セキュリティツールでもありません。準拠している検索エンジンのボットが従う可能性のあるクロール指示を提供するだけです。
すべての小規模なウェブサイトに複雑な robots.txt が必要なわけではありませんが、以下のような場合に役立ちます:
適切に記述された robots.txt ファイルは、検索エンジンがアクセスさせたいウェブサイトの領域にクロールを集中させるのに役立ちます。

robots.txt という名前で保存します。アップロード後、ブラウザで https://yourdomain.com/robots.txt を開き、ファイルが正しく読み込まれていることを確認してください。また、Google サーチコンソールのURL 検査ツールを使用して、特定のURLにGoogleがアクセスできるかどうかを確認することもできます。robots.txt はクロールを制御するものであり、Googleの検索結果からページを直接削除するものではないことに注意してください。
| ディレクティブ | 機能 |
|---|---|
| User-agent | ルールが適用されるボットを指定します。 |
| Disallow | ページやフォルダーのクロールをブロックします。 |
| Allow | ページやパスへのアクセスを許可します。例外処理に便利です。 |
| Sitemap | XML サイトマップの場所を検索エンジンのボットに伝えます。 |
| Crawl-delay | クローラーのリクエスト間の一時停止を提案します。サポート状況は検索エンジンによって異なる場合があります。 |
注意
このジェネレーターは、選択したオプションに基づいて標準の robots.txt ファイルを作成します。公開する前に、最終的なコードを必ず注意深く確認してください。不適切なルールにより、検索エンジンがサイト上の重要なコンテンツにアクセスできなくなる可能性があります。