浏览器辅助检查 无服务端额度 每次 1 个 URL

AI 爬虫检查

检查指定 URL 能否被主流 AI 爬虫(GPTBot、Claude-Web、Google-Extended、CCBot 等)访问。覆盖 robots.txt 策略、sitemap 可发现性、canonical/noindex 标记、基础结构化数据、重定向链。结果按「事实」「风险」「建议」分类呈现。

查看检查维度 检查维度说明
输入完整 URL(含 https://)。工具会尝试请求 robots.txt,如 CORS 阻拦则引导手动检查。

用途

在向 AI 搜索投递内容之前,确认技术层面没有阻碍 AI 爬虫正常抓取。本工具适用于站长、SEO 从业者、内容运营者,用于排查 AI 搜索可见性的底层技术障碍。

输入边界

方法解释

工具逐个执行以下检查,每项标记为 事实(可复现的客观结果)、风险(可能阻碍收录的问题)或 建议(锦上添花的优化):

  1. robots.txt 策略 — 请求该域名的 robots.txt,检查 GPTBot、Claude-Web、Google-Extended、CCBot 是否被 Disallow
  2. HTTP 状态与重定向链 — 跟踪重定向,确保最终状态为 200
  3. meta robots / X-Robots-Tag — 检查 noindex、nofollow 指令
  4. canonical URL — 检查 rel="canonical" 是否自引用或被指向其他页面
  5. sitemap 可发现性 — 检查 robots.txt 中是否声明 Sitemap,以及该 URL 是否出现在 sitemap 中
  6. 基础结构化数据 — 检测页面是否包含 JSON-LD 或 Microdata

检查维度(6 项)

示例

假设输入 https://example.com/blog/geo-guide,输出大致如下:

限制

隐私说明

本工具仅对您输入的 URL 发起一次性 HTTP 请求用于检测。我们不会存储提交的 URL、响应内容或检测结果。检测期间产生的临时数据在页面关闭后自动清除。详见隐私政策

相关指南

AI 爬虫接入清单 →

为 AI 爬虫配置 robots.txt →