免费 Robots.txt 生成器

Robots.txt 生成器

免费 Robots.txt 生成器:允许、禁止和 AI 爬虫 | We.Inc

免费生成 robots.txt:允许或阻止所有爬虫、禁止访问文件夹、添加站点地图,并选择 AI 爬虫(如 GPTBot)是否可以读取网站。

一分钟内生成正确的 robots.txt 文件:为所有爬虫选择默认规则,列出要屏蔽的文件夹,添加站点地图,并决定 AI 爬虫能否读取您的内容。复制结果或下载为文件。

常见问题

robots.txt 有什么作用?

它会告诉守规矩的爬虫可以请求网站的哪些部分。这只是请求,不是锁:它不能保护私人内容,恶意机器人也会忽略它。

我需要 robots.txt 文件吗?

严格来说不需要。没有该文件时,爬虫会认为可以访问所有内容。仍然建议使用该文件指向站点地图,并阻止爬虫访问购物车和管理页面等位置。

我应该屏蔽 AI 爬虫吗?

这是业务上的选择。屏蔽 GPTBot、ClaudeBot、Google-Extended 等爬虫,可以请求它们不要将您的内容用于训练,但也可能让 AI 助手更不了解您的业务。许多小型企业会允许这些爬虫访问,以便 AI 答案能够推荐他们。

更改多久生效?

Google 通常会在一天内重新读取 robots.txt。您可以在 Google Search Console 的 robots.txt 报告中请求刷新。

如何测试某个网址是否被 robots.txt 屏蔽?

使用本页面的测试工具。粘贴您的 robots.txt(或使用刚刚生成的版本),输入网址和爬虫名称(例如 Googlebot),系统会显示【允许】或【已屏蔽】,并指出作出判断的具体规则。该工具在浏览器中应用 Google 的匹配规则,不会获取您的实时文件,因此请粘贴 yourdomain.com/robots.txt 的最新版本。

如果 Allow 和 Disallow 规则同时匹配,哪条优先?

对于 Google 而言,路径更长的规则优先,因为它更具体。如果两条路径长度相同,Allow 优先。其他爬虫处理冲突的方式可能不同,因此应避免依赖平局情况。

robots.txt 规则的读取方式

适用于小型企业网站的合理默认设置

上传前测试网址

免费开始 · 无需信用卡

Product

Who It's For

Features

Resources

Company

View Sitemap