无需从头编写代码,即可为您的网站创建合适的 robots.txt 文件。
这个免费工具可帮助您构建规则,告诉搜索引擎蜘蛛您网站的哪些部分可以抓取,哪些区域应该跳过。填写选项、生成文件,并将其上传到您网站的根目录。
Robots.txt 是一个简单的文本文件,位于您网站的根文件夹中(例如:https://yoursite.com/robots.txt)。
当像 Google 这样的搜索引擎访问您的网站时,它们会查找此文件,以了解为不同蜘蛛提供的抓取指令。
您可以使用它来:
它不会向用户隐藏页面,也不是安全工具。它仅提供合规的搜索引擎蜘蛛可能会遵循的抓取指令。
并非每个小型网站都需要复杂的 robots.txt,但在以下情况下它会变得非常有用:
一份编写良好的 robots.txt 文件可以帮助搜索引擎将其抓取集中在您希望它们访问的网站区域。

robots.txt。上传后,在浏览器中打开 https://yourdomain.com/robots.txt 并检查文件是否正确加载。您还可以使用 Google 搜索控制台的网址检查工具来检查 Google 是否可以访问特定 URL。请记住,robots.txt 控制的是抓取,并不会直接从 Google 的搜索结果中移除页面。
| 指令 | 它的作用 |
|---|---|
| User-agent | 指定该规则适用于哪个蜘蛛。 |
| Disallow | 阻止抓取某个页面或文件夹。 |
| Allow | 允许访问某个页面或路径,这对于例外情况非常有用。 |
| Sitemap | 告诉搜索引擎蜘蛛您的 XML 站点地图位于何处。 |
| Crawl-delay | 建议在抓取请求之间暂停。不同搜索引擎的支持情况可能会有所不同。 |
注意
本生成器根据您选择的选项创建一个标准的 robots.txt 文件。在发布最终代码之前,请务必仔细检查。不正确的规则可能会阻止搜索引擎访问您网站上的重要内容。