Neatbo.

robots.txt 规则测试

粘贴或导入 robots.txt 规则,用目标 URL 与爬虫产品标识测试,显示允许结论、采用的规则组、最终命中规则和行号。

浏览器本地处理输入粘贴 robots.txt 或 UTF-8 .txt 文件,加 URL 与爬虫标识输出允许结论与 JSON 规则报告单个文件最多 1 MiB · 最多 1 个
  1. 1添加输入
  2. 2调整设置
  3. 3获取结果

工具输入和文件在当前浏览器处理,不会上传。

输入内容

切换工具时在当前标签页临时保留输入。刷新或关闭后清除,较大的结果可能需要重新生成。

⌘ / Ctrl + Enter 运行
robots.txt 来源
0 个字符 · 0 字节
处理选项

先填写标记为必填的选项,其余可保留默认值。

填写爬虫产品标识,例如 Googlebot,不需要粘贴整段浏览器 User-Agent。

正在准备处理工具…

开始之前

粘贴或导入 robots.txt 规则,用目标 URL 与爬虫产品标识测试,显示允许结论、采用的规则组、最终命中规则和行号。 输入完整 URL 和爬虫产品标识后运行。

如何使用

  1. 粘贴 robots.txt 或选择 UTF-8 .txt 文件,再输入完整 URL 和爬虫产品标识。
  2. 运行后查看允许结论、采用的规则组,以及最终命中规则和原行号。
  3. 下载 JSON 查看全部命中规则与忽略行号;依赖结论前另行检查线上站点。

支持范围与限制

仅本地测试一个 HTTP(S) URL 的分组、通配符、结束锚点和 UTF-8 路径匹配;不抓取 robots.txt、不核验所属站点或服务器状态,也不能证明收录。

粘贴最多 1 MiB,或导入一份最多 1 MiB 的 UTF-8 .txt 文件;最多 5,000 行。不支持或无效的行会列出,复杂匹配有计算上限。

操作示例

示例输入

User-agent: *
Disallow: /private/
Allow: /private/public/
示例参数
{"agent": "ExampleBot", "url": "https://example.com/private/file"}

示例输出

{
  "allowed": false,
  "path": "/private/file",
  "agent": "examplebot",
  "implicitRobotsTxt": false,
  "selectedGroups": [
    {
      "agents": [
        "*"
      ],
      "line": 1
    }
  ],
  "matchedRule": {
    "allow": false,
    "pattern": "/private/",
    "line": 2
  },
  "matchedRules": [
    {
      "allow": false,
      "pattern": "/private/",
      "line": 2
    }
  ],
  "ignoredLines": []
}

出现问题时

仅本地测试一个 HTTP(S) URL 的分组、通配符、结束锚点和 UTF-8 路径匹配;不抓取 robots.txt、不核验所属站点或服务器状态,也不能证明收录。 粘贴最多 1 MiB,或导入一份最多 1 MiB 的 UTF-8 .txt 文件;最多 5,000 行。不支持或无效的行会列出,复杂匹配有计算上限。

常见问题

如何找到命中的 robots 规则?

运行后查看允许结论、采用的规则组,以及最终命中规则和原行号。 下载 JSON 查看全部命中规则与忽略行号;依赖结论前另行检查线上站点。

页面示例应该得到什么结果?

/private/file 应被禁止,/private/public/file 由更具体规则允许;等效的 Allow 与 Disallow 规则优先 Allow。

哪些情况不适用?

仅本地测试一个 HTTP(S) URL 的分组、通配符、结束锚点和 UTF-8 路径匹配;不抓取 robots.txt、不核验所属站点或服务器状态,也不能证明收录。 粘贴最多 1 MiB,或导入一份最多 1 MiB 的 UTF-8 .txt 文件;最多 5,000 行。不支持或无效的行会列出,复杂匹配有计算上限。

文档与延伸阅读

相关工具