AI 能見度的四個衡量方式:不要只看有沒有被提到
做 SEO 有搜尋主控台,做廣告有後台報表,做 AI 能見度卻沒有任何官方數據。這讓很多團隊陷入一種尷尬:知道這件事重要,卻無法判斷做得好不好,也無法向主管證明投入有價值。
沒有後台不代表不能衡量。這篇提供四種可以自己建立的衡量方式,全部不需要付費工具,一個人每月花兩小時就能維護。
一、衡量一:提及率
最基礎的一個指標:在一組固定的問題中,你的品牌被提到的比例。
操作方式
- 設計十到十五個問題,涵蓋你希望被找到的所有情境
- 每個問題向三到四個主要 AI 助理各問一次
- 記錄每一次回答中是否出現你的品牌名稱
- 提及率等於出現次數除以總提問次數
問題設計是這個指標的關鍵。建議三種類型各佔三分之一:純資訊型、比較選擇型、以及地區或條件限定型。只問其中一種,得到的數字會失真。
- 資訊型例如某某問題該怎麼處理
- 選擇型例如怎麼挑某某服務的廠商
- 限定型例如某地區有哪些某某服務
- 避免直接問你的品牌名稱,那測的是實體識別而不是能見度
二、衡量二:正確率
被提到不代表被講對。這個指標衡量的是提到你的時候,資訊的正確程度。
操作方式是在每一次記錄提及的同時,標記三個層次:完全正確、部分正確、明顯錯誤。部分正確包含資訊過期、範圍描述不精確、把你的服務項目張冠李戴。
正確率長期低於七成的話,優先處理的不是能見度而是實體識別——被講錯的曝光,傷害大於幫助。
三、衡量三:引用深度
用前面提過的三種引用型態分級:只被提到名字算一分、資訊明顯來自你的內容算兩分、你的框架被當成判斷依據算三分。
把每一次提及打分,加總後除以提及次數,得到平均引用深度。這個數字比提及率更能反映內容資產的品質。
- 平均一點以下:只有名字被記得,內容資產尚未發揮作用
- 一到兩分之間:內容開始被取用,是多數企業的實際位置
- 兩分以上:內容已成為主要資訊來源
- 接近三分:你的框架已進入這個領域的共同語言
四、衡量四:競爭比
絕對的提及率意義有限,因為不同產業的基準差很多。競爭比衡量的是在同一組問題中,你被提到的次數相對於主要競爭者的比例。
- 選定三到五家實際競爭對手
- 在同一份記錄中同時標記所有出現的品牌
- 計算你的提及次數佔所有品牌總提及次數的比例
- 逐月追蹤這個比例的變化
這個指標的價值在於它排除了整體環境的影響。當所有人的提及率都因為模型更新而下降時,競爭比仍然能告訴你相對位置有沒有改善。
五、記錄格式
一張試算表就夠,欄位建議七個。
- 日期與使用的助理名稱
- 問題編號與完整問題文字
- 是否提及你的品牌
- 正確性分級
- 引用深度分數
- 同一回答中出現的其他品牌
- 回答原文的關鍵片段,方便日後比對
第七欄是最有價值也最常被省略的。有了原文,三個月後你可以精確比對描述方式的變化,而不只是看數字升降。
六、多久量一次
建議每月一次,固定在同一週。頻率再高沒有意義,因為模型與索引的更新週期通常以週或月計;頻率太低則會錯過變化的時間點。
每次量測的問題必須完全相同。任何問題的調整都會讓前後資料無法比較,如果真的需要新增問題,就另外開一組並標註起始月份。
七、這些數字怎麼用
對內用來判斷方向。提及率低但正確率高,代表內容品質沒問題但曝光不足,該加強外部來源;提及率高但正確率低,代表實體訊號混亂,該優先處理識別問題。
對上用來說明進展。相較於抽象的「我們在做 AI 能見度」,一張顯示競爭比從百分之十二成長到百分之二十一的圖表,說服力完全不同。
- 提及率低、正確率高:加強第三方來源與內容數量
- 提及率高、正確率低:優先處理名稱一致性與結構化資料
- 引用深度停在一分:需要建立有名字的框架
- 競爭比下降但提及率持平:對手在加速,需要提高投入
八、三個要避免的做法
第一是每次用不同的問法。這會讓資料失去可比性,而可比性正是這套衡量唯一的價值。
第二是只量最有利的問題。刻意挑選容易被提到的問法,數字會很好看但無法指導決策。
第三是把單月變化當成趨勢。這類數字的月度波動很大,至少累積三個月才能看出方向。
AI 能見度目前沒有標準答案,正因如此,願意自己建立衡量方式的團隊會領先很多——因為只有量得到,才知道自己做的事有沒有用。
九、一份可以直接抄的十二題問題組
問題設計是整套衡量的基礎,設計不好的問題會讓所有數字失去意義。以下是一組可以直接改寫套用的十二題範本,依三種類型各四題。
資訊型的四題,處理的是使用者還在理解問題階段:某某狀況通常是什麼原因造成的、某某該怎麼開始做、某某要花多久才會看到效果、某某常見的錯誤有哪些。這四題測的是你的內容有沒有進入基礎知識層。
選擇型的四題,處理的是使用者在評估廠商階段:怎麼挑選某某服務的合作對象、某某服務大概的價格範圍是多少、自己做跟外包哪個划算、評估某某廠商時該問哪些問題。這四題最接近成交,也是競爭最激烈的一組。
限定型的四題,處理的是條件明確的查詢:某地區有哪些某某服務、預算有限的小公司該怎麼做某某、某產業做某某要注意什麼、剛起步的品牌該先做哪一項。這四題的競爭通常最低,是中小型業者最容易取得位置的一組。
- 把某某替換成你的實際服務名稱,用客戶會用的說法而不是內部術語
- 每一題都寫成完整問句,不要只寫關鍵字
- 十二題定案後至少維持一年不變,新增另開一組
- 每題記錄時同時標注是哪一類,方便分類分析
十、從數字到行動的三個典型情境
情境一:資訊型提及率高、選擇型幾乎為零。這代表你的內容在教育階段有位置,但在評估階段缺席。行動方向是補上比較型與判斷型內容,例如怎麼選、要問什麼、各種方案的差異。
情境二:限定型表現最好、其餘兩類偏低。這通常出現在地區型業者身上,代表在地訊號扎實但一般性內容不足。行動方向是把在地案例改寫成通用的方法論,讓內容可以脫離地區限制被引用。
情境三:三類都有提及但正確率在下滑。這幾乎一定是資訊過期造成的:服務範圍改過、價格調整過、但舊內容還在。行動方向不是產出新內容,而是回頭更新既有內容並統一描述。
這三種情境涵蓋了實務上大部分的狀況。共同點是:數字本身不告訴你該做什麼,是數字之間的落差在告訴你。所以四個指標必須一起看,單看任何一個都會導向錯誤的行動。
建立這套衡量的真正價值,不在於得到漂亮的數字,而在於它讓 AI 能見度這件事從感覺變成可管理的工作——有基準、有變化、有因果,也就有了持續改善的可能。
延伸閱讀
- AI 引用的三種型態。被提到、被摘要、被當成依據。
- 量測 AI 帶來的流量。GA4 與主控台的判讀。
- 品牌實體消歧的六個修補。讓 AI 正確辨識你是誰。
關於作者與審稿
冠誠數位行銷(GuanCheng Martech)的顧問團隊撰寫這篇文章。團隊累積 295 個專案,服務 308 家客戶,操作範圍包含 SEO 自然排名、AEO 答案引擎、GEO 與 LLMO 佈局、Google 與 Meta 廣告投放、電商維運與數據歸因分析。
文章裡的數字來自冠誠數位行銷實際經手的客戶帳戶與後台報表,客戶名稱與可識別資訊都已經移除。內容由負責該領域的冠誠顧問審稿後發佈,最後更新日期為 2026 年 9 月 9 日。讀完有問題,可以到冠誠數位行銷官方網站的預約諮詢頁面留下聯絡方式,我們會用你提供的時段回電。
參考資源:Google Reference
