AI CRAWLER CONTROL

AI robots.txt 生成器:保护内容,同时保留搜索流量

Robotswise 帮助网站所有者生成可读、可下载的 robots.txt 规则,用于表达对 AI 爬虫访问的偏好。所有配置在浏览器本地完成,不会上传你的站点信息。

robots.txt 能做什么?

它是面向合作型爬虫的抓取规则,不是登录保护、版权保护或隐藏敏感页面的安全方案。需要从搜索结果中移除的页面,应使用 noindex、身份验证或删除页面本身。

适合哪些场景

  • 禁止 GPTBot、ClaudeBot、CCBot 等训练型爬虫访问公开内容。
  • 允许 Googlebot 与 Bingbot 保持正常抓取,避免影响自然搜索发现。
  • 保留 AI 搜索引用型爬虫,同时限制训练抓取。

发布前检查

  1. 确认没有意外封锁 Googlebot、Bingbot 或公开页面。
  2. 将文件放在域名根目录,例如 https://your-domain.com/robots.txt
  3. 填写真实 sitemap 地址,并在 Google Search Console 与 Bing Webmaster Tools 提交。