robots.txt 生成

仅在当前浏览器处理

文本上限:2000000 个字符

此工具不会上传你的输入。

避免上线写成 Disallow: /。百度、必应、Google 仍要读根路径那份文件。我们不去爬你。Sitemap 行只是提示,不保证收录。

上线写成整站禁止——本页起草 robots.txt。你仍要放到网站根。不是百度站长或 Search Console。预发环境复制生产配置,把 Disallow: / 一起带上去,是常见事故。

Meta / OG 走 Meta 标签草稿。状态码走速查。路径草稿走 Slug

根目录草稿

  • 避免整站 Disallow: /。不抓取你的线上文件,不提交 sitemap,不覆盖 noindex。
  • 文件请自己放到站点根。HTTPS 下也要能打开同一份。
  • /admin/admin/ 匹配范围不同,写错会误伤或漏拦。
  • 不承诺排名。不是 noindex。不去爬你的源站。

怎么用

  1. 列出你真正想写的 UA 和路径。预发和线上不要混用同一份「全站禁止」。
  2. 复制文本。只有 XML 真的存在才写 Sitemap:
  3. 部署后自己打开 https://你的域名/robots.txt。再用站长平台做抓取诊断。

使用前先看清的限制

不承诺排名。不是 noindex。不去爬你的源站。抓取≠收录。

常见问题

会帮我提交 sitemap 吗?

不会。Sitemap: 只是提示。百度搜索资源平台、Search Console 另走。提交了也不保证入库。

能覆盖 noindex 吗?

不能。robots.txt 挡住爬虫时,有时连 noindex 都看不见。预发环境要小心。抓取和收录不是一回事。

针对某家搜索引擎的指令?

起草常见 Allow/Disallow。Crawl-delay 各家支持不同。百度蜘蛛的 User-agent 名称以官方文档为准。

能审计线上文件吗?

不抓取。写好后你自己部署再访问 https://你的域名/robots.txt。

被 Disallow 的 URL 还会出现在结果里吗?

可能。外链仍可能让引擎知道这个 URL。不想出现要用可抓取页面上的 noindex,或走站长平台移除。本页不保证。

相关工具