TL;DR:审查AI SEO机构的最快方法不是“你提供GEO吗?”而是三个问题:你今天如何衡量我的AI可见性?基线是什么?你到底会改善什么?一个在提案中无法回答这些问题的机构无法证明它之后造成了任何结果。以下是将操盘人(真正的操盘人)与幻灯片软件区分开的七个问题,以及两个证明点——一个引用截图和一个20个工具的堆栈——几乎告诉你什么都没有。
我是James,Mercury Technology Solutions的首席执行官,来自香港——一个AI SEO、GEO和AEO在同一会议上被提及的市场,仿佛它们是同一产品。它们并不是。而在2026年,机构选择问题已经反转:每个人都声称具备能力,几乎没有人声称具备测量能力。由于这个预算通常位于更广泛的数字转型计划中,测量问题最终将是你的首席财务官会问的。
为什么AI SEO机构突然变得无法比较
传统的搜索引擎优化(SEO)有一个共享的评分标准:展示次数、排名、点击、转化。人工智能搜索打破了这一标准。两个机构都可以报告“35%的AI可见性评分”,但测量的内容却完全不同——不同的平台、提示集、市场、语言、测试窗口,以及对什么算作引用与提及的不同定义。
只有在其底层方法论可比的情况下,评分才是可比较的。因此,永远不要问“分数是多少?”而要问“这个分数是如何测量的?”谷歌自己在2026年对第三方SEO工具的指导中明确指出:没有任何外部工具拥有谷歌的内部排名数据,专有评分是解释,而不是福音。方法论才是产品。其他一切都是包装。
值得询问的7个问题,按顺序排列
1. 我们今天的AI可见性基线是什么——你是如何测量的?
第一个问题从来不是“你能提高多少?”而是“我们现在在哪里?”
一个真实的基线会明确其条件:哪些提示、哪些AI平台、哪个市场、哪种语言(英语与繁体中文在香港并不是脚注)、什么日期、每个提示多少次运行,以及什么算作引用与品牌提及。一个自信的回答听起来像:“测量时间为8月1日至7日,40个固定商业提示,香港市场,每个平台单独测量,每个提示三次运行,引用和提及独立跟踪。”
一个令人担忧的回答听起来像:“在你签字后我们会弄清楚测量。”快跑。
这正是我们合作开始时的原因。GEO审计 — 一个48小时的基线,而不是保留提案。如果你想先获得更简洁的免费版本,请运行GEO评分卡,看看今天AI如何引用你。
2. 你实际上使用哪些AI平台 — 它们有什么不同?
ChatGPT、Perplexity、Gemini、Claude和谷歌的AI概述并不是一个表面。它们甚至不是以相同的方式检索网络:
ChatGPT — OAI-SearchBot在ChatGPT搜索中显示网站;GPTBot正在进行训练爬取(这是一个单独的政策决定);ChatGPT-User是用户触发的获取。
困惑 — PerplexityBot 自建索引;Perplexity-User 根据请求获取并在很大程度上忽略 robots.txt。
克劳德 — ClaudeBot(训练)、Claude-User(用户获取)、Claude-SearchBot(搜索检索)是三个不同的入口。
人工智能概述 / 人工智能模式 — 特性 内部 Google 搜索,依赖 Googlebot 和 Google 的索引。Google-Extended 不控制它们;nosnippet 和其他相关设置控制。
如果一个机构说 "ChatGPT、Gemini 和 Perplexity——这都是 GEO,方法基本相同," 那你听到的是星座运势,而不是方法论。问问他们的声明中哪些部分来自平台文档,哪些来自他们自己的测试。
3. 给我看一个前后内容重写的例子——并解释每一个变化
不是案例研究 PDF。一个页面。前 → 后 → 为什么。
合理的理由:文案没有直接回答问题,声明没有来源,缺少条件,一个段落混合了三个意图,标题承诺了段落没有提供的内容。不合理的理由:"我们添加了更多的 AI 关键词,以便 LLMs 会喜欢它。" 这不是优化;这就像用你在地板上找到的盐给牛排调味。
谷歌 2026 年的生成 AI 指导不需要特殊的 "AI 写作格式。" 所以强烈的问题是:你改变了什么,解决了什么问题,以及你将如何测试它是否有效?
4. 你将帮助我们制作什么原创研究?
如果每个公司的 GEO 计划都是 "什么是 GEO?"、"AI SEO 的 5 个好处" 和 "10 个 ChatGPT 提示," 那么每个人都聚焦于相同的商品内容——而商品内容是 AI 引擎在不引用任何人的情况下总结的。
在任何严肃的 AI SEO 或 GEO 参与中,机构的工作是帮助你制造竞争对手无法复制的证据:第一方数据、小型市场研究、具有明确方法论的基准、转化为答案资产的专业知识。第一方数据并不保证引用——它保证你不是在重新措辞与其他人相同的搜索结果页面。这就是我们所称之为的核心LLM-SEO:引用是通过证据赢得的,而不是形容词。
5. 你如何单独处理英语和繁体中文?
在香港,这个问题消除了市场的一半。失败模式是:英语文章 → AI 翻译 → 发布。双语机构应该解释 URL 结构、每种语言的关键词研究、hreflang 互惠、同语言规范 — 更重要的是,香港的繁体中文搜索者是否使用完全不是英语翻译的术语。在我们自己的 SERP 采样中,中文查询触发 AI 概述的频率明显高于英语查询 — 主题混淆,因此我们将其视为观察,而不是定律。关键是:一个无法讨论差异的机构并没有在衡量它。
6. 报告在前六个月会显示什么?
拒绝“SEO 需要六个月,我们再谈。”领先指标从第一周就存在:爬虫访问状态、索引修复、基线引用和提及计数、及时覆盖、已完成的内容更改 — 到现在为止,来自 Google Search Console 的第一方数据生成 AI 报告和 Bing Webmaster Tools 的 AI 性能报告。这些指标没有可互换性 — Bing 引用不是 Google AI 概述印象 — 严肃的报告会说明这一点。如果你想知道 KPI 如何结合在一起,那就是LLM KPI 框架对话。
7. 如果 AI 概述在六个月内再次变化,这项工作会怎样?
AI 搜索仍处于起步阶段。任何提供固定剧本的机构都在描述一个已经变化的表面。持久的 SEO 和 GEO 工作——可爬行性、可索引性、真正有用的内容、原创证据、干净的实体信息、可重复的测量——能够经受住界面变化。利用某一临时平台特性的战术则无法做到。
我最喜欢的致命问题:“在过去六个月中,你的机构改变了哪些看法?”一个从未修订基准的机构并不一致。它没有进行测量。
两个几乎没有证明力的证据点
单一引用截图。它证明了一个出现、一个提示、一个时刻。它并不能证明一致性、声音份额或收入。截图只是一个事件,而不是一个测量系统。
20个工具的堆栈。工具列表告诉你机构的软件预算,而不是其方法论。一个在书面、可重复的协议下运行的工具胜过二十个临时使用的工具。每次都是如此。
一行测试
停止问“你们做GEO吗?”开始问“给我看看基线协议。”无论提案中说的是AI SEO、GEO还是LLM SEO,协议就是产品。如果你现在正在评估这个市场上的机构,我们的香港最佳GEO机构对比页面公开列出了标准——包括我们会输的那些。如果你想要证据而不是推销,香港GEO + AIO案例研究展示了在双语市场中衡量引用工作的样子。
先测量。后签署。这才是真正的 AI SEO 和 GEO 参与的样子。
水星科技解决方案:加速数字化。
