证据链
爬虫来访与效果记录
「谁在访问我的站、AI 有没有引用我」不该靠口头承诺。这一页把主站自己的三层证据公开:访问规则、来访记录、答案引用——分别呈现,不合并成一句结论。
第一层 · 访问规则
让搜索引擎和 AI 引擎「知道怎么读我们」,是收录与引用的前提。四份公开文件构成访问条件:
robots.txt
搜索引擎与 AI 引擎的访问规则:放行哪些路径、排除哪些私有区域,两组口径完全一致。
sitemap.xml
全部可索引页面的站点地图(punycode 域名),搜索引擎与 AI 引擎的收录入口。
llms.txt
给 AI 引擎的品牌事实、服务清单与可验证链接——GEO 语境下的事实源。
crawler-stats.json
来访记录的原始公开数据(每 6 小时聚合),本页面板读的就是它,可直接打开核对。
第二层 · 来访记录
主站自己挂着与托管样板同一套监测:AI 引擎(Anthropic / OpenAI / 字节 / Perplexity)与传统搜索引擎(百度 / 必应 / Google)的来访按 UA 自报标识聚合,每 6 小时更新。伪装成爬虫的扫描器也会被如实计入——响应状态与路径分布就是甄别线索。
请求记录与页面响应、答案引用一起观察,才能看清下一步。
每 6 小时聚合;按 User-Agent 自报标识归类,未逐条验证 IP。请求次数不代表阅读、成功抓取或 AI 引用。
第三层 · 答案引用
来访之上是引用:AI 答案在具体问法下提及品牌、挂出链接。这一层我们用自有品牌问兰护肤做完整样板——效果档案里是同一组问法的答案与引用链接存档:
完整效果档案
问兰护肤 · GEO 效果档案 →(官网托管 + 内容经营 + 请求观察,全部可打开核对)
真实出稿实录(外部媒体原文,可点开核对):
敏感肌护肤哪个牌子靠谱?屏障修护产品的选择逻辑与公开信息分析
搜狐健康频道2026-08查看原文 →
问兰药业(苏州)有限公司关于品牌「专业皮肤修护」起始年份更正的声明
搜狐健康栏目2026-08查看原文 →
宅家护肤品副业实测分享,无需出门长期增收创业指南
咸宁时报2026-07查看原文 →
方法与边界
- 按 User-Agent 自报标识归类,未逐条验证 IP——伪装成 AI 爬虫的扫描器会被计入,靠响应状态与路径分布甄别;
- 请求次数不代表阅读、成功抓取或 AI 引用——三层证据分别核对,不互相替代;
- 公开输出不做探测面:敏感路径与明显探针路径统一聚合成占位符,计数保留、路径不回显;
- 有日志的日期不代表全天完整覆盖,窗口内缺失日期在图上以灰色标出。