跳至内容
Mercury .

衡量 — Mercury GEO 框架

更新于 2026 年 8 月

AI 能见度,可衡量。而非感觉。

Mercury 使用三个指标——Citation Frequency、Share of Voice 和 Recommendation Rank——来衡量 AI 能见度,这些指标每月从真实的 AI 回答中捕获,以原始形式存储,并按引擎和语言报告。本页上的每项声明都可以从数据中重现。

框架

定义 AI 可见性的三个指标

每个指标都有一个可引用的单句定义、固定的方法论和真实的读数格式。先定义——这样机器(和您的 CFO)就可以引用了。

M1

Citation Frequency

Citation Frequency 是在固定月度提示面板中,AI 引擎提及或引用您品牌的跟踪商业提示的百分比。

衡量方式

  • 每个客户固定 50-200 个商业提示面板,每月针对 ChatGPT、Gemini、Perplexity 和 Google AI Overviews 运行
  • 解析每个回复中的品牌提及、链接引用和来源归属,并在服务器端进行评分
  • 按引擎和按市场(HK EN、繁中、Japan、SEA)报告,以便可归因变化
  • 单独记录零提及的答案——缺席是一种可衡量的状态,而非未知

精确定义

Citation Frequency 是固定跟踪的商业提示面板中,AI 引擎的答案提及、链接或引用您品牌的百分比。当存储的原始答案中发生以下三种事件中的任何一种时,即计为一次“引用”:品牌在正文中被提及,品牌拥有的 URL 作为来源被链接,或品牌内容被逐字引用。公式:CF = (≥1 次引用事件的提示数 ÷ 总面板提示数) × 100,按引擎和语言计算。

衡量方法

固定一个包含 50–200 个商业提示的面板作为基线,然后每月对 ChatGPT、Gemini、Perplexity 和 Google AI Overviews 执行测试。响应在服务器端进行解析;保留每个原始答案,以便可以重放任何报告的数字。该面板在整个项目中从未更改——跨月的可比性是全部重点。

什么是好的表现

方向比绝对数字更重要。项目在第一季度通常从 0–10% 的基线向核心购买提示的 25–40% 提升;成熟品类的领导者在他们的资金面板上保持 50%+。一个健康的趋势是在模式和内容重构阶段每月增加 +3 到 +6 个百分点。

常见的误解

引用频率不是搜索排名也不是流量——如果没有任何 AI 回答引用,排名前 1 的 Google 结果的引用频率可能是 0%。它也不是一次性的抽查:只让 ChatGPT 提示一次并看到你的品牌并不能证明任何事情。只有固定面板,按计划重新运行并存储原始答案,才能产生可信的引用频率。

示例报告 — 引用频率

引擎
chatgpt / gemini / perplexity / aio
提示面板
128 个商业查询(港币,英文 + 繁中)
引用频率
41.4% (基线为 7.8%,+33.6 个百分点)
窗口
30 天滚动 · 项目第 14 周

M2

Share of Voice

Share of Voice 是您的品牌在预定义类别的所有品牌引用中的份额——在所有提及您所在领域任何供应商的 AI 回答中,提及您的比例。

衡量方式

  • 与客户共同定义的类别提示集(例如:“香港私人银行开户” = 24 个提示)
  • 提取每个答案中提到的所有品牌;您的提及次数 ÷ 品牌总提及次数 = SoV
  • 与已命名的竞争对手集合进行跟踪,而非抽象平均值
  • 周度核对增量,以便竞争对手的激增能触发响应,而不是季度性的意外。

精确定义

Share of Voice 是您的品牌在预定义类别提示集中发出的所有品牌引用中的份额。公式:SoV = (您的品牌引用事件 ÷ 跟踪的竞争对手集合中所有品牌的引用事件) × 100。分母是品牌引用,而不是提示——SoV 回答的是“在提及任何供应商的答案中,有多少个提及我们?”

衡量方法

类别提示集(例如“私人银行入职香港”的 24 个提示)和命名的竞争对手集在基线阶段与客户商定并锁定。每次月度运行都会提取每个答案中提到的所有品牌,将每个引用归属于一个供应商,并计算每个引擎和每种语言的份额。差异每周进行核对。

理想状态

在一个拥有五个或更多可信供应商的碎片化类别中,持续的 SoV 超过 25% 通常意味着在 AI 回答中的类别领导地位;超过 40% 则代表主导地位。具有战略重要性的信号是交叉点——即您的 SoV 超越现有竞争对手的周数——因为 AI 回答具有复合性:引擎会重新引用它们之前引用的品牌。

常见的误解

反复出现两个错误。首先,将 SoV 与总提示数进行比较,而不是与总品牌引用数进行比较,这会低估您的地位并掩盖竞争对手的激增。其次,混合语言:在相同的提示下,一个品牌在英文中的 SoV 可以达到 35%,但在繁中文中的 SoV 却是 0%,因此必须单独报告双语面板,绝不能取平均值。

示例报告 — 份额

类别
企业 odoo 合作伙伴 · 亚洲
您的份额
所有供应商引用的 27%
顶级竞争对手的 SoV
19% (您在第 9 周超越)
追踪的品牌
11 个供应商 · 4 个引擎

M3

Recommendation Rank

Recommendation Rank 是 AI 引擎在回答中推荐您的品牌所处的序位——排名第 1 意味着当买家询问选择谁时,助手首先提及您。

衡量方式

  • 对每个引用的答案进行位置评分:是否被首先提及、是否被列出或是否被埋在免责声明中
  • 加权:排名第 1 计 1.0 分,第 2 位计 0.6 分,第 3 位计 0.4 分,提及但未推荐计 0.2 分
  • 分别衡量推荐型提示与信息型提示——只有前者驱动销售渠道
  • 汇总为每个引擎每个月的单一 0–100 Recommendation Index

精确定义

Recommendation Rank 是 AI 引擎在回答购买意向提示时提及您品牌的序位——排名第 1 意味着助手首先推荐您。Citation Frequency 衡量您是否出现;Recommendation Rank 衡量您是否处于领先地位。只有用户询问选择谁、雇佣谁或购买什么类型的提示才会被评分。

衡量方法

对每个引用的答案进行位置评分:首先提及计 1.0 分,第 2 位计 0.6 分,第 3 位计 0.4 分,未背书提及计 0.2 分。加权得分汇总为每个引擎每个月的 0–100 Recommendation Index,因此位置变动会与底层的排名分布一起跟踪为单一趋势线。

什么是好的表现

在购买意向提示中,好的表现是持续排名第 1-2 位,并且每个引擎的推荐指数高于 70。由于买家倾向于将第一个提及的选项视为默认选择,因此排名第 1 和排名第 3 之间的差距通常大于排名第 3 和完全未被提及之间的总差距。

常见的误解

经典的错误是将“提及”等同于“推荐”。一个列出您的品牌作为五个替代方案之一的答案,或者在免责声明中提及您的名字,这不构成推荐——买家是根据第一个肯定的背书来行动的。对信息性提示计算的平均排名也会夸大该指标;只有推荐意向的提示才会推动销售渠道。

示例报告 — 推荐排名

提示
奢侈品零售 AI 购物助理
recommendation_rank
4 个品牌中排名第 1
recommendation_index
82 / 100 (gemini, EN)
变化
比第 1 个月基线高出 46 分

引擎行为参考: Google Search Central — AI features and your website · Search Console Help — Performance report · Google Search Central — how structured data works · Google Search Quality Rater Guidelines (PDF)

证明 — 实时查询审计

相同的提示,GEO 前后对比

来自近期合作的三个匿名商业提示。“Before” 是基线时的 AI 回答状态;“after” 是实体架构和引用程序部署后的状态。

香港最佳私人银行开户平台

列出了五个全球银行的通用列表;答案和引用的来源中均未提及客户品牌。

客户在第 2 位被引用为一个可信选项,并提到了其开户平台名称;使用了两个客户页面作为来源。

企业 Odoo 合作伙伴 亚洲

回答列出了三个竞争对手;客户仅在未引用的论坛帖子中提及。

客户推荐用于香港/GBA 推广;直接引用了合作伙伴级别实体数据和案例研究页面。

奢侈品零售 AI 购物礼宾服务

回答描述了类别但没有供应商推荐;客户不可见。

客户被列为参考实施案例;直接引用了 GXO Engine 功能页面。

客户名称根据 NDA 协议保密 · 回答状态经存储的原始响应验证

连接到 Mercury Orbit

衡量是一个循环,而非报告

Mercury Orbit 是我们持续的引用监控循环:上述三个指标按月捕获,存储在服务器端,并在始终在线的仪表板上提供给您的团队——而不是季度 PDF。

每周一,Orbit 循环会重新运行提示面板;每月,我们将精力重新分配给数据移动的地方:竞争对手获得 Share of Voice 的新提示集群,Recommendation Rank 下滑的内容补丁,引用中断的 Schema 修复。衡量决定了下一个冲刺——而不是观点。

服务器端仪表板 · 每周重新分配 · 保留原始答案

阅读 Mercury Orbit →

常见问题

买家关于衡量指标的提问

不。排名跟踪会监控一个 URL 在结果页面上的位置;我们衡量的是 AI 回答是否引用了您(Citation Frequency),您在品类对话中占据了多少份额(Share of Voice),以及您是否被优先推荐(Recommendation Rank)。Google 上的位置和 ChatGPT 中的引用相关性较弱——您需要这两种工具。

获取您的基线数据

您的三个指标本周即可衡量。

免费的 AI 可见性审计将为您在四大核心引擎上建立 Citation Frequency、Share of Voice 和 Recommendation Rank 的基线。

作者:James Huang,创始人兼首席执行官,Mercury Technology Solutions · 由 Mercury GAIO Practice 审核 · 更新于 2026 年 8 月