AI 机器人是由 AI 服务或搜索服务派出的自动程序。它们会读取公开网站内容,可能用于训练模型、回答用户问题、创建 AI 搜索结果或一般搜索索引。
“数据分析”中的“AI 机器人”分页让您查看哪些已知 AI 机器人访问过您的公开网站,以及它们是否被允许或阻止。本文档仅说明如何读取记录;如果您想更改哪些机器人可以读取网站,请阅读“管理 AI 机器人读取您的网站”。
一般人类访客不会出现在此分页。AI 机器人不会执行一般网站的前端 JavaScript 跟踪,因此它们会以服务器端记录独立统计。
目的分类是根据已知机器人的公开信息整理的,并不代表每一次访问都能精确得知最终用途。
系统比对来源 IP 和运营方公布的网络范围后,确认此次请求更可信地来自该官方机器人。
请求的名称看起来像已知 AI 机器人,但来源 IP 无法匹配官方范围。这可能是第三方冒充的名称,不要直接将其视为官方 AI 服务的真实访问。
部分服务没有可供比对的公开 IP 信息,或本次请求无法完成验证。无法验证不等于恶意,只代表系统无法确认真伪。
记录中的“已允许”表示请求可以继续读取公开网站;“已阻止”表示它符合您在“控制台 → 搜索、AI 与跟踪 → AI 机器人阻止”中的阻止规则,公开网站将响应拒绝访问。
阻止记录仍然很有价值。它可以让您确认规则确实在运行,以及哪些机器人持续尝试访问。
页面明细会列出机器人访问过的网址。如果某个重要页面一直没有被已知机器人读取,不代表它一定不会出现在搜索结果;抓取频率由各服务自行决定,网站刚发布或内容较少时尤其需要时间。
不一定。访问只表示机器人读取过公开网站。是否训练、收录、引用或在回答中呈现,仍由各服务自行决定。
不一定。网站刚发布、流量较少、机器人尚未安排访问,或机器人不在当前识别列表中,都可能让报表暂时没有数据。
先确认该请求是否造成异常流量。如果只是少量记录,通常无需立即处理;如果您发现持续异常,请保留日期、截图和网址后联系客服。