智能体就绪度清单
AI 智能体通过无障碍树、结构化数据和发现文件来读取你的网站,而不是渲染后的截图。这份清单涵盖我们在数千次审计中测量的 30 项具体信号,并按智能体实际消费网站的方式分组。我们已审计目录的平均分:不足 50%,大部分网站还没有准备好。
1. 智能体交互:机器能解析你的页面吗?
- 语义化 HTML 地标元素:
<main>、<nav>、<article>、层级有序的标题、<html>上的lang、图片的 alt 文本。无障碍树就是智能体的数据模型。 - 干净可抓取的标记:真实的标题和 Meta 描述;内容无需执行 JavaScript 即可获取。
- 低提取阻力:答案靠近页面顶部;首段简短;没有行话壁垒。
- 可索引性:没有误加的
noindex或 robots 限制;可被索引是出现在 AI 答案中的前提。 - 每个页面只有一个规范 URL:智能体不应看到重复页面。
- 布局稳定性与页面体积:明确的图片尺寸(无布局偏移)、精简的 DOM、尽量少的阻塞渲染资源。
2. 机器提取:智能体能引用你吗?
- 用真正的 HTML 表格和列表呈现对比与规格数据:智能体提取的是结构,而不是结构的截图。
- 原子化句子:智能体可以整句摘出而不丢失含义的自足表述(目标:40% 以上的句子)。
- 实体密度:写明产品、地点、人物和数字;含糊的文案无法被引用。
- 定义句式:清晰的「X 是……」句式让智能体可以直接作答。
- 答案胶囊:每个小节以一段 15-30 词、自成一体的答案开头。
3. 结构化数据:机器可直接消费的事实
- Schema.org JSON-LD:至少包含 Organization/WebSite;在相关页面加上产品、文章和 FAQ 类型。
- 广度:属性要充实(地址、logo、sameAs、日期),不要留空壳。
- 在合适的场景为语音界面加上 Speakable 标记。
4. AI 发现:智能体能找到并使用你吗?
- llms.txt:精选的机器摘要(完整指南)。我们探测的 48,005 个网站中只有 6.4% 拥有它。
- robots.txt 中的 AI 爬虫规则:对 GPTBot、ClaudeBot、PerplexityBot 作出明确决定(指南)。
- 带 lastmod 的 sitemap.xml:让机器可以高效地枚举并重新抓取你的页面。
- 内容订阅源(RSS/Atom):智能体用它跟踪变化。
- 语言/区域信号:
lang、hreflang。 - 声明 AI 使用权限:一份 ai.txt 或许可说明可消除歧义。
5. 信任:智能体敢与你交易吗?
- 一致的身份信息:名称、地址、电话处处一致,并用 Organization schema 锚定。
- 可见的作者署名和日期:人和机器都把它们当作问责依据。
- 方法透明度:展示内容或产品是如何产出、测试或审核的。
- 在读者合理预期之处提供 AI 辅助声明。
- 高质量的标题/Meta:唯一、描述准确、长度合适。
- 新鲜度:更新关键页面并刷新日期;陈旧的网站会被视为已被弃置。
网站年限、HTTPS 和当前活跃状态同样影响信任:智能体(或它的用户)在交易前会权衡「这个网站存在多久了、是否仍在维护」。我们在每份档案上都会展示这些信息。
给自己打分
上述每一项都会在我们的免费审计中自动测量:给出通过/未通过、具体发现,并按影响力排序修复建议。
方法细节:方法论。看看谁领先:AI 就绪度最高的网站。
常见问题
- 什么是智能体就绪度?
- 指一个网站可被 AI 智能体读取、信任并与之交易的程度,通过结构化数据、语义化 HTML、发现文件和信任标记等具体信号来测量,而不是靠主观判断。
- 智能体就绪度和 SEO 是一回事吗?
- 两者有重叠(干净的 HTML、结构化数据对两者都有帮助),但智能体就绪度的核心是机器消费:无障碍树、机器可读摘要、明确的爬虫权限和可引用的内容。
- 智能体就绪度分数是如何计算的?
- 在 MarkosWeb 上,分数是确定性检查项的通过比例,与 Google Lighthouse 的智能体浏览评分一致,从不编造 0-100 的分数。分数只能通过修复未通过的检查项来提升,无法购买。