首頁資源中心 › AI 能見度怎麼量:四個指標,把「有沒有效」變成看得到的數字

AI 能見度怎麼量:四個指標,把「有沒有效」變成看得到的數字

投了錢做 GEO,三個月後老闆問一句「所以到底有沒有效」,多數人答不出來。不是因為沒做事,是因為沒有在一開始就把 AI 能見度 測量的方法定下來。搜尋排名有 Search Console 可以查,AI 回答卻沒有官方後台,你得自己建一套取樣與記錄的流程。這篇給你四個指標、一份每月照做的流程,以及三個會讓數字失真的陷阱。

先講清楚:AI 能見度在量的是什麼

AI 能見度指的是當使用者向 AI 助理提問時,你的品牌出現在那段答案裡的程度。它不是排名,因為 AI 的答案沒有第一名第二名;它也不是流量,因為很多對話結束在答案本身,使用者根本沒點進任何網站。

這件事跟傳統 SEO 的差別,我們在 SEO 和 GEO 差在哪 裡拆得更細。這裡只要先接受一個前提:既然沒有官方數據,你的測量結果本質上是抽樣調查。抽樣調查要有意義,靠的不是樣本多大,而是每次抽樣的方法一模一樣。

測量的價值不在單次數字多漂亮,而在每次都用同一把尺,讓變化本身變得可信。

指標一:提及率——你到底有沒有被講到

提及率是最基礎的一層:在你設定的題目中,AI 的回答提到你品牌名稱的比例。它回答的是「我們存在於 AI 的認知裡嗎」。

怎麼設計題組

題組是整套測量的地基,設計原則有三個:

  • 用客戶的講法,不要用你的講法。 客戶問「台北有推薦的驗屋公司嗎」,不會問「驗屋服務供應商評選」。
  • 涵蓋不同購買階段。 從「這是什麼」到「怎麼選」到「誰比較好」,各階段都要有題目。
  • 題目數量固定在 20 題上下。 太少不夠代表性,太多會讓你懶得每月執行。

題組一旦定案就不要再改。想加新題目,就開一個新的題組分開記錄,不要混進舊的。

怎麼記錄結果

每題記三欄就夠:有沒有提到你、提到的是哪些競品、答案裡有沒有附連結。用試算表逐月往下累積,欄位固定不動。

提及率的算法很單純:提到你的題數除以總題數。第一次測出 5% 或直接掛零都不必意外,那只是你的起點。

指標二:引用率——AI 有沒有真的讀你的頁面

提及和引用是兩回事。AI 說得出你的名字,可能只是因為訓練資料裡有;但它在答案下方附上你的網址,代表它在這次回答裡實際檢索並採用了你的頁面。

引用率的意義比提及率更高,原因有兩個。第一,它證明你的內容是可被拿來當證據的材料,而不只是一個被記得的名字。第二,它會真的帶來點擊,是唯一能接上流量數據的一層。

記錄的時候要順手記下「被引用的是哪一頁」。跑幾個月之後你會發現,帶來引用的通常是規格表、價格說明、問答頁這類具體內容,而不是品牌故事。這個發現會直接告訴你下一批內容該寫什麼。

指標三:位置與語氣——被講到,但被怎麼講

同樣是被提到,出現在第一個推薦和出現在「其他選擇還有」的差別很大。這一層看的是質,不是量。

實務上記三件事就夠:

觀察項目好的訊號該處理的訊號
出現順序前三個被提到排在名單最後或被歸為備選
描述內容講得出你的專長與適用對象只有公司名,沒有任何描述
資訊正確性服務範圍、地區、專長都對講錯服務項目或把你歸錯產業

最後一列最值得注意。AI 講錯你的業務,比完全沒提到你更難處理,而且它通常源自你自己網站上語焉不詳的敘述。發現描述錯誤,第一件事是回頭檢查官網有沒有把「你是誰、幫誰、做什麼」寫清楚。

指標四:AI 帶進來的實際流量

前三個指標都在測 AI 的行為,這一個測的是生意。

從 GA4 看來源

在流量報表裡把來源含有 AI 助理網域的工作階段拉出來單獨看。這類流量的特徵通常是量不大、但停留時間與轉換率相對高,因為使用者是帶著答案來驗證,不是隨機點進來的。

從 Search Console 對照

AI 摘要造成的曝光與點擊變化,也會反映在搜尋數據上,這部分的判讀方式我們在 Google Search Console 老闆版導覽 裡談過。重點是同時看曝光和點擊:曝光穩定但點擊下滑,通常代表答案在版面上被 AI 摘要往下推,這個現象的規模在 AI 摘要正在吃掉你的點擊 有更完整的討論。

把四個指標組成一份每月測量表

四個指標分開看沒有力量,組起來才會說話。每月固定執行這五個動作:

  1. 用同一份題組、同一批 AI 工具,把 20 題跑完。
  2. 逐題記錄提及、引用、位置與描述正確性。
  3. 從 GA4 與 Search Console 抓當月的 AI 來源流量。
  4. 把四個數字填進同一張表,跟前兩個月並排。
  5. 寫三行說明:哪個數字動了、可能因為什麼、下個月要試什麼。

第五步是最多人跳過、也最重要的一步。沒有這三行,你累積的只是一堆數字,不是判斷。AI 能見度 測量要能支撐決策,靠的正是這種每月一次的小結。

三個讓數字失真的陷阱

題目換來換去。 這是最常見也最致命的一個。這個月測 20 題、下個月換 15 題新的,兩組數字之間沒有任何可比性,你等於每個月都在重新開始。

只測品牌名。 只問「某某公司好嗎」,測到的是知名度不是能見度。真正該測的是客戶還不知道你的時候會問的那種問題——他描述的是自己的狀況,不是你的名字。客戶用 AI 找廠商的完整動線,你的客戶現在怎麼用 ChatGPT 找廠商 裡有更細的拆解。

把單次結果當趨勢。 同一個問題問兩次,AI 可能給出不同答案,這是模型本身的隨機性。一次測量只是一個點,至少累積 3 次才看得出方向。單月數字掉了就急著改策略,通常是在追雜訊。

從有感覺,到有數字

多數品牌在 GEO 上的真正問題,不是做得不夠,是不知道自己做得如何。四個指標建立起來之後,「最近好像有比較常被提到」會變成一個可以跟上個月並排的數字,而下一批內容該寫什麼,也會從猜測變成有依據的判斷。

先花一個下午把題組定下來,跑第一次,拿到你的基準線。有了基準線,後面每個月只是重複同一件事。

想確認你的題組設計得對不對,或想看看同產業的測量表長什麼樣,歡迎透過 LINE(@APM168)找我們聊,我們提供免費諮詢,會直接告訴你現在的做法有沒有盲點。

SEO/GEO 成效受搜尋引擎與 AI 模型演算法、市場競爭等因素影響,實際結果因專案而異,本文不構成排名或被引用之保證。


常見問題

Q:多久測一次比較合理?

一個月一次是多數情況的合理頻率。AI 模型的回答本身就有隨機性,測太密會把雜訊當成變化,一週測一次通常只會讓你焦慮;測太疏又抓不到模型更新造成的落差。固定在每月同一週執行,累積三次以上才開始判讀趨勢。

Q:一定要用付費工具嗎?

不一定。手動測量的成本主要是時間,20 題的題組大約一到兩小時可以跑完並記錄。付費工具的價值在於自動化與歷史留存,當你要追蹤的題目超過五十題、或需要跨多個模型比對時才明顯划算。剛開始先用試算表手動跑,先確定你要看什麼,再決定要不要為自動化付錢。

Q:測出來完全沒被提及,代表 GEO 失敗了嗎?

不代表,但代表起點在哪裡你現在知道了。多數品牌第一次測都是接近零,這是正常的基準線。真正的問題不是這次的數字,而是三到六個月後這個數字有沒有動。如果連續幾次都沒有任何變化,那要回頭檢查的是內容本身有沒有可被引用的材料,而不是繼續加測量頻率。

Q:不同的 AI 工具測出來結果差很多,該信哪一個?

都要看,但不要混在一起算。不同模型的訓練資料、檢索來源與更新頻率都不同,把它們的結果平均會抹掉最重要的訊息。正確做法是分開記錄、分開看趨勢,你會發現某些模型對你的產業特別友善,那就是資源該優先投入的方向。

Q:競爭對手一直出現在答案裡,我該直接模仿他們的內容嗎?

先看他被引用的是哪一頁、那一頁提供了什麼你沒有的材料,再決定要補什麼。通常對手勝出的原因不是文筆,而是他有具體的規格、流程、價格區間或問答,而你只有形象文案。模仿版面沒有用,補上你自己版本的具體資訊才有用。

Q:測量要花多少人力才撐得住?

穩定下來之後,一個月大約半天的工作量:跑題組、貼答案、標記結果、寫三行變化說明。真正花時間的是第一次建立題組與判讀標準,那通常需要一到兩天。把標準寫成文件,之後誰接手都測得出可比較的數字。

本文經 AstraPath 編輯流程 查證與更新。