这份清单用来快速判断官网在技术上能不能被 AI 引擎正确读取。逐项检查即可,不需要技术背景。

一、爬虫可达性

  • robots.txt 是否放开了 GPTBot、OAI-SearchBot、ClaudeBot、PerplexityBot、Bytespider 等 AI 爬虫
  • sitemap.xml 是否存在、能否正常访问、是否包含关键页面
  • 服务器日志里能不能看到 AI 爬虫的访问记录
  • 是否存在验证码、登录墙、IP 限制拦住了公开页面

二、内容可抽取性

  • 禁用 JS 与图片后,页面核心文字是否依然存在
  • 公司全称、业务范围、服务区域、联系方式是否以纯文本形式出现
  • 关键信息有没有被放在图片里
  • 标题层级(H1/H2/H3)是否完整、有无跳级

三、实体一致性

  • 公司全称与工商登记名一致
  • 官网、百科、企业信息平台、行业媒体上的业务描述是否统一
  • 成立时间、服务区域、典型客户类型是否各渠道一致

四、结构化数据

  • 是否部署了 Organization 标记企业实体
  • 服务页是否使用 Service / Offer 标记
  • 问答页是否使用 FAQPage 标记
  • 文章与案例页是否使用 Article 标记

五、基础体验

  • 页面加载速度是否在合理区间
  • 移动端与桌面端返回的内容是否一致
  • 重定向链是否过长

五项里有任何一项不达标,都应该先修完再做内容。具体改造方案参见 官网 GEO 改造与结构化数据部署服务