网页在 Google 排名第一,并不代表 AI 智能体就能读懂它。isitagentready 这类检测工具关注的是另一个问题:当 ChatGPT、Perplexity、Claude 或 Google AI Overviews 背后的爬虫访问你的网站时,能否在不执行 JavaScript、不猜测页面布局的情况下,准确获取你希望被引用的文本?我们为客户做这项检测时,经常发现排名靠前的网页依然无法通过。问题几乎都出在机器读取层,而不是内容质量。
isitagentready 检测的是机器能否读取,而不是人眼能否阅读
传统 SEO 工具通常关注关键词密度、外链和页面速度评分。isitagentready 这类工具换了一个视角:假设自己是一个没有浏览器、只能发起 HTTP 请求的 AI 智能体,看看能从网页中获得什么。这个差别至关重要。用户通过浏览器打开网页时,JavaScript 会执行、图片会加载、页面布局也会完整呈现;但大多数 AI 爬虫抓取的是原始 HTML,并不会等待前端框架运行完毕。如果核心内容依赖 JavaScript 渲染,智能体最终看到的可能只是一个近乎空白的页面骨架。
因此,即使网站的 Lighthouse 评分很高,也未必适合被 AI 引用。速度快、交互流畅衡量的是人类用户的浏览体验;机器能否准确提取内容,则是另一套标准。下面这 8 项指标构成了这套标准的基本框架。
AI 智能体可读性的 8 项指标
- 爬虫访问权限:robots.txt 和 llms.txt 是否允许 GPTBot、ClaudeBot、PerplexityBot、Google-Extended 等 AI 智能体访问。
- 服务端渲染:无需执行 JavaScript,原始 HTML 中就包含核心内容。
- HTTP 健康状况:响应状态码是否为 200,是否存在多余重定向,canonical 设置是否正确。
- 语义化 HTML:标题层级是否合理,是否使用 article、main、nav 等语义标签。
- 结构化数据:是否通过 JSON-LD 标注 Article、FAQPage、Organization 等 Schema。
- 元数据:title、meta description 和 Open Graph 是否完整,描述是否准确。
- 可提取的答案结构:关键信息是否以问答、定义、表格等便于提取的形式呈现。
- Markdown 友好度:核心内容能否干净地转换为纯文本或 Markdown,不受导航和样式噪声干扰。
前 3 项决定内容能否被看到
爬虫访问权限排在第一位,因为它是一项一票否决指标。如果 robots.txt 屏蔽了 GPTBot,或者所用 CDN 默认拦截非浏览器 User-Agent,那么后面 7 项做得再好也没有意义——智能体根本进不来。修复方法很直接:检查 robots.txt 是否明确允许主流 AI 爬虫访问,并增加一份 llms.txt,用纯文本列出最希望被引用的网页及其简要说明。很多企业甚至不知道自己屏蔽了 AI 爬虫,而这往往是我们在检测第一天最常发现的问题。
第二项是服务端渲染。打开网页时,请使用“查看网页源代码”,而不是“检查元素”。如果在源代码中看不到正文,智能体很可能也看不到。单页应用(SPA)尤其容易出现这个问题:所有内容都由前端加载,原始 HTML 中只有一个空的 div。解决办法是引入服务端渲染或静态生成,让首次响应就能返回完整文本。第三项 HTTP 健康状况则是在清理技术基础:确认网页返回 200,而不是软 404;删除层层重定向;让 canonical 指向唯一正确的 URL;并避免代理缓存重复版本或过期版本。

中间 3 项决定内容能否被理解
进入网页后,智能体还要能分辨哪里是标题、哪里是正文、哪里是导航。语义化 HTML 就是它识别页面的地图:一个网页只有一个 h1,标题层级不跳级,核心内容放在 main 或 article 中,侧边栏和页脚也使用对应标签。人眼不会在意页面是否用一连串没有语义的 div 排版,但机器看到的只是一组组难以区分的同质化区块。结构化数据则为页面增加一层明确标注:通过 JSON-LD 直接告诉智能体“这是一篇文章、作者是谁、发布日期是什么”,或使用 FAQPage 标记问题与答案。目的就是把“让机器猜”变成“直接告诉机器”。
第六项元数据常被当作无关紧要的细节,却是智能体判断页面主题的第一条线索。title 应准确说明网页讲什么,而不是堆砌关键词;meta description 应当脱离上下文也能作为一个完整句子被引用;Open Graph 标签则决定链接在被转述时如何呈现。这三个字段加起来不到 20 行代码,却会直接影响智能体是否愿意将你的网页纳入答案。
最后 2 项决定内容能否被引用
只有看得懂还不够,智能体还要能直接提取并使用其中一段内容。所谓可提取的答案结构,是指把核心结论写成完整、自洽的句子,最好紧跟在相应问题或小标题之后,而不是铺垫三段后才给出答案。表格、定义和步骤清单都有清晰边界,容易拆分,因此尤其适合智能体提取。Markdown 友好度是最后一道质量检查:网页转换为纯文本后,正文是否依然连贯易读,还是被导航栏、广告和社交按钮切得支离破碎。有效内容与噪声的比例越高,被准确引用的概率也越高。
完成检测后,应该先修哪一项?
8 项指标不必同时优化。可以按照“能被看到、能被理解、能被引用”三个层级安排顺序:先解决爬虫访问权限和服务端渲染这两项一票否决问题,再补充结构化数据和语义标签,最后打磨答案结构。我们为 B2B SaaS 客户开展 GEO 审计时,通常能在 30 天内通过前两个层级的优化,让大多数网页达到及格线。由于这两个层级解决的是“智能体根本读不到”的问题,往往也能最快改善品牌曝光。
isitagentready 会给出一个分数,但这个分数无法告诉你,哪项问题对业务影响最大,也无法判断值得投入多少资源修复。如果你已经完成检测,却不知道该从哪里开始,可以预约一次 30 分钟的 GEO 诊断。我们会使用你的实际网站地址逐项检查这 8 项指标,并指出最应该优先修复的问题。



