简而言之:生成引擎优化 (GEO) 是使您的网站可被 AI 搜索发现、检索和引用的学科 — Google AI 概述、AI 模式、ChatGPT 搜索、Perplexity、Claude。这 37 项检查按依赖顺序运行:爬虫访问优先,测量最后。它们不是排名因素,完成所有 37 项并不能保证什么 — 但未能完成早期检查则保证不可见。可访问 ≠ 合格 ≠ 被检索 ≠ 被引用。
我是 James,Mercury Technology Solutions 的首席执行官。这是我们在任何 GEO 参与之前运行的框架 — 按依赖顺序排列,因为在第 1 层访问损坏的情况下修复第 3 层内容就像是在没有引擎的汽车上打磨。 如果您想要针对您自己域名运行的机器可读版本,请访问 GEO 评分卡(免费)或完整的GEO审核(48小时基线)。
第1层 — 访问:7项检查
1. Googlebot可以访问目标页面。没有robots.txt阻止、登录墙或防火墙规则。通过搜索控制台的URL检查进行验证。
2. OAI-SearchBot、GPTBot和ChatGPT-User是独立的决策。OAI-SearchBot会在ChatGPT搜索中显示您。GPTBot是训练爬虫——一种政策选择,而不是可见性要求。ChatGPT-User是用户触发的抓取。允许GPTBot是不需要出现在 ChatGPT 搜索中。
3. PerplexityBot ≠ Perplexity-User。PerplexityBot 构建了使您可见的索引。Perplexity-User 根据用户请求获取内容,并通常忽略 robots.txt。分别检查这两者。
4. Anthropic 的机器人是三个门,而不是一个。ClaudeBot(训练)、Claude-User(用户获取)、Claude-SearchBot(搜索检索)。将每个与您的政策对齐。
5. 您的 WAF/CDN 并没有阻止 robots.txt 允许的内容。如果 CDN 对爬虫返回 403/429,则允许规则毫无意义——这是我们在 GEO 审计中发现的最常见的技术 SEO 盲点。审计服务器日志和实际的 HTTP 响应,而不仅仅是配置文件。
6. 重要内容呈现。谷歌处理JavaScript;不要假设每个AI爬虫都这样。测试代表性页面,并在可能的情况下检查实际检索的输出。绝不要向爬虫提供在核心内容上有实质性差异的内容。
7. 网站地图是最新的——但不是被崇拜的。网站地图有助于发现;它既不保证索引也不保证引用。而且不——谷歌不要求llms.txt、AI特定的Markdown镜像或任何特殊的机器文件来满足AI概述的资格。这些是可选的附加项,而不是基础。
第1.5层——搜索资格:2个检查
8. 页面已被谷歌索引。没有索引,就没有支持链接的AI概述。这是技术SEO,而不是地理SEO:在修改任何段落之前先修复索引。内容的精炼无法弥补缺失的索引。
9. 页面符合摘要资格。审查 nosnippet、data-nosnippet、max-snippet、noindex — 以及搜索控制台的 "搜索生成 AI" 控制(全球可用;默认包含,但子属性可以继承排除)。忽略关于页面 "必须在自然排名前 10" 才能出现在 AI 概览中的神话。谷歌没有发布这样的门槛。
记住这个链条:可访问 ≠ 合格 ≠ 被检索 ≠ 被引用。每个门都是独立的;每个失败都有不同的解决方法。
第 2 层 — 实体清晰度:5 项检查
10. 组织名称一致。官方名称、简称、法定名称 — 在关键页面上采用统一的命名规范。
11. 结构化数据实体标识符是稳定的。相同的 @id 代表同一实体,遍布各处。
12. sameAs 链接仅指向真正识别该实体的页面。并非每个社交资料都符合资格。
13. 作者信息真实且一致。有名的人,稳定的个人简介。AI 引擎是实体解析机器;匿名的 "管理员" 署名是无用的负担。
14. 商业和联系信息在各页面之间一致。NAP 一致性很无聊,直到它成为 AI 无法确认你是同一公司的原因。
这些都不是公开的排名因素。它们是消除模糊性的工具——而模糊性是引用的无声杀手。
第3层 — 内容清晰度:8项检查
15. 直接回答重要问题。本节的第一句话回答了标题的问题。这是GEO中杠杆效应最大的习惯——也是AI搜索直接从良好SEO中继承的纪律。
16. 标题描述其部分内容。如果一个标题可以出现在任何网站的任何页面上,那它就是装饰,而不是结构。
17. 重要陈述有明确的主题。"它改善了性能" — "它"是什么?代词混乱是无法检索的。
18. 条件与结果并列。"削减成本40%"而不"针对20人以下的团队"是一个AI引擎学会不信任的说法。
19. 证据与主张并列。来源、日期、方法——相邻,而不是三次滚动之外。
20. 概念关系被陈述。展示数字和想法如何连接;检索提升片段,而片段必须携带自己的上下文。
21. 表格和列表有明确的标签。在上下文中有意义的标题。
22. 不要将内容切割成微小部分"为了AI。"谷歌明确表示不要求人为地碎片化内容。写作要以理解为目标,而不是为了传闻中的解析器。
第4层 — 证据:4个检查
23. 原始证据锚定重要主题集群。第一方数据、小规模研究、真实基准。商品内容会被总结;证据会被引用。
24. 重要数字需包含范围、日期和方法。"74.5%的触发率"如果没有样本、时间窗口、分母和排除规则就毫无意义。
25. 平台事实来自当前官方来源。爬虫政策会发生变化。引用截至某个日期的文档,并重新审视它。
26. 不确定性已被陈述。如果语言和主题在您的样本中混淆,请说明。AI 引擎和复杂的买家更青睐经过校准的声明而非自信的声明。我们称之为您品牌未验证声明的累积成本真相债务。它会复利。
第 5 层 — 结构化数据一致性:4 项检查
27. 结构化数据与可见内容匹配。与页面相矛盾的标记是一种负担,而不是提升。
28. 仅使用适合页面的架构类型。没有 FAQ 的页面上的 FAQ 标记是垃圾信息形状。
29. 作者和修改日期反映现实。虚假的新鲜感是可检测且有害的 — Perplexity 的时效加权使其成本高昂。
30. Schema 验证 ≠ 引用。通过验证器意味着语法解析。仅此而已。
第 6 层 — 链接架构:3 项检查
31. 集群内容链接回其支柱。 32. 支柱链接到重要的集群。 33. 没有近似重复意图的页面相互竞争——关键词自相残杀是最古老的SEO失误,而AI检索使其成本更高,而不是更低。内部链接架构是经典SEO进行GEO工作的方式:这就是你如何教导谷歌和LLM检索器哪个页面拥有哪个问题——背后的原则是我们如何构建GEO服务网格。
第7层 — 双语层:2个检查
34. 规范指向同语言页面。 35. hreflang 是相互的。对于同时运行英语和繁体中文的香港网站,这就是双语实现悄然破裂的地方——英语和中文页面并不是同一个意图的翻译;它们是两个研究工作。(这对我们的香港SEO和GEO工作至关重要。)
第8层 — 测量:2个检查
36. 提示集和协议是有版本的。固定的提示、平台、市场、语言、运行次数 — 有意更改,并附有版本说明。
37. 在优化之前,存在基线和正常变动范围。没有它们,"改善"就是无法证伪的叙述。这是大多数机构跳过的检查,因为这使他们需要承担责任。
如何进行37项检查
分三次进行,像SEO审核一样带有地理视角:首先是访问和资格(检查1–9 — 硬性门槛),其次是内容和证据(15–26 — 实际获得引用的地方),测量始终开启(36–37 — 让你保持诚实的循环)。实体、结构化数据、链接和双语层按依赖关系插入。
常见问题
生成引擎优化应该从哪里开始?从基线开始 — 首先检查37,矛盾的是。没有起始测量,你无法证明改进。
阻止 Google-Extended 会将我们从 AI 概述中移除吗?不会。Google-Extended 管理训练和基础用途。AI 概述在 nosnippet 控制家族下的 Googlebot 上运行。不同的开关,不同的范围。
如果所有 37 项检查都通过,但仍然没有引用,缺少什么?通常传统的可见性——该页面根本不在该查询的检索池中。这是一个SEO问题,任何段落优化都无法解决。
如果时间紧迫,哪些检查可以跳过?第一层的检查都不能跳过。绝对不可以。如果被迫进行优先排序:1–9,15,23–24,36–37。
停止猜测AI看到的内容。开始测量它。良好的SEO让你可被发现;GEO让你可被引用——在2026年你需要两者。运行免费的GEO评分卡进行初步阅读,或预约GEO审计并获得完整的37项检查,通过每个引擎的基线。如果你购买的结果是引用,目标页面是被AI引用.
水星科技解决方案:加速数字化。
