6 min remaining
0%
SEO

如何衡量 AI 搜尋能見度:引用率、聲量份額與噪音底線

單一的 AI 能見度分數在沒有其協議的情況下毫無意義。三個重要的 GEO 指標——引用率、聲量份額、顯著性——以及使它們可比較的 SEO 等級規則。

6 min read
Progress tracked
6 分鐘閱讀·

簡而言之:沒有單一的跨平台 AI 能見度分數,任何向你銷售此類分數的儀表板都在隱藏其方法論。根據固定的協議測量三個指標——引用率、競爭性聲量份額和顯著性:凍結的提示集、指定平台、市場、語言、運行次數、排除規則,所有這些在測試開始之前都需定義。建立基準,了解你的噪音底線,然後再稱變化為改進。

我是 James,水星科技解決方案的 CEO。當前 AI SEO 中最昂貴的句子是「你的 AI 能見度分數是 70。」七十什麼,如何測量,針對哪些提示,在哪個平台上,在哪個市場中,使用哪種語言?沒有協議的分數就像是帶有儀表板的占星術。這是我們實際運行的 GEO 測量框架——以及保持其誠實的規則。

三個核心指標

1. 引用率:AI 答案中有多常引用您的領域?

引用率 = 引用您領域的有效運行次數 ÷ 總有效運行次數。

18 次引用運行 ÷ 60 次有效運行 = 30% 引用率。當分母不明確時,百分比才有意義。六十個提示測試一次和三十個提示測試兩次都產生 60 次運行——它們不是相同的測量。平台、市場、語言和運行次數都會改變這個數字的意義——這就是為什麼在任何認真的 GEO 報告中,引用率從不會在沒有其協議的情況下出現。

2. 競爭聲量份額:您與指定競爭對手的出現頻率如何?

競爭聲量份額 = 您的品牌出現次數 ÷ 您的品牌加上一組固定的指定競爭對手的總出現次數。如果您出現 35 次,而指定競爭對手的總出現次數為 65 次:35%。

有兩條規則使這個可比較。首先,競爭對手集在期間之間保持不變——在一月與三月比較自己與三個競爭對手和十個競爭對手會產生兩個共享公式而無其他的數字。其次,每次運行只計算一次品牌出現,無論答案中提到您一次還是五次。

3. 突出性:您在答案中扮演了什麼角色?

引用率計算存在;突出性對其進行分類。四個層級:

| 等級 | 分類 | 規則 | |---|---|---| | P1 | 主要推薦 | 該品牌是主要推薦 | | P2 | 指名替代品 | 幾個選項之一,並不明顯是主要的 | | P3 | 引用來源 | 引用的領域以支持一個事實;品牌不被推薦 | | P4 | 簡單提及 | 被提及但未標註或推薦 |

"品牌 A 是我們的首選推薦。品牌 B 和 C 也值得考慮" — A 是 P1,B 和 C 是 P2。如果角色確實模糊,則向下分類。誇大自己的重要性是測量計畫自欺欺人的方式。

保持誠實的測量規則

什麼算是有效的運行。在預期條件下的完整回應 — 提交完整的提示,正確的平台,正確的市場,正確的語言,沒有截斷。每個被排除的運行都會記錄其原因。而基本規則是:在獲得你喜歡的答案之前,永遠不要重新運行失敗的提示。那不是測量;那是購物。

引用和提及是不同的領域。引用將資訊歸屬於您的領域或將其鏈接為來源。提及則是在沒有歸屬的情況下提到您。不被引用 ≠ 不被提及 — 模型可以從訓練數據中提到您,而不必接觸您的網站。將這兩者結合成一個 "出現" 指標,您就破壞了告訴您是否您的內容正在運作。

重複出現每次計算一次。在一個回答中有三個鏈接到您的域名 = 一次被引用的運行。額外的突出性在突出度中捕捉,而不是通過膨脹計數來實現。

噪音底線:沒有人想發布的數字

在相同條件下運行相同的凍結提示集兩次。基準 1:30% 引用率。基準 2:27%。那 3 點的差距就是您觀察到的噪音底線 — 當沒有任何故意改變時,AI 可見性移動的量。

現在是紀律:如果後續測量從 30% 移動到 32%,這不是一個改進。它在噪音之中。報告中保留個別基準 — 永遠不要只有平均值 — 因為噪音底線本身隨時間而變化。這不是一個正式的信心區間;它是一個觀察到的變異度量,將信號與天氣分開。任何 AI SEO 代理商報告的月對月「增長」小於其自身的噪音底線,都是在將變異性當作進步來銷售給你。

取樣協議是測量的一部分

在信任任何數字之前 — 無論是你的、供應商的還是我們的 — 協議必須明確:確切的提示措辭、AI 平台和表面、市場和地點、語言、每個提示的運行次數、競爭者集、測試窗口和頻率、帳戶/個性化設置、引用和提及定義、計數規則以及排除規則。

在回合之間更改其中任何一項,這兩個回合就無法比較 — 即使使用相同的指標名稱。這個協議是 SEO 報告和 GEO 報告之間的真正區別:排名有一個真實的來源;引用則沒有。語言值得特別強調:英語提示和繁體中文提示不會檢索到相同的文件。它們是兩個測量,而不是一個。將它們混合在一起,你就平均了兩個不相關的系統。

第一方數據的適用性

Google Search Console 的生成 AI 性能報告和 Bing Webmaster Tools 的 AI 性能數據是其自身平台的第一方證據 — 一方面是展示次數,另一方面是引用和基礎查詢。它們是真實的,但是平台鎖定的。在 ChatGPT、Perplexity 和 Gemini 之間的跨平台比較仍然需要根據你自己的協議進行提示取樣。兩者並不互相取代。

對於一個小到中型的測量計劃:30–60 個固定提示,重複運行,季度頻率,一位分析師的規則寫下來。這足以將運動與噪音區分開來 — 這就是一個認真的 AI SEO 測量計劃的樣子。這是我們背後的協議GEO 審計 — 每個參與的 48 小時基準 — KPI 層級記錄在 LLM KPI 框架。如果您想在購買之前查看測量結果,請運行免費的 GEO 成績單

停止收集分數。開始發布協議。

水星科技解決方案:加速數位化。