首頁/學習 GEO/答案有多少是你的
站外 GEO · 先把問題量出來

一則 AI 答案裡,究竟有多少屬於你?

在判斷站外工作值不值得做之前,先把站內工作永遠觸及不到的那一塊量出來。已發表的平均數不是你的份額,而兩者之間的那道算術,正是 GEO 方案出錯的地方。

本頁內容
分享本文
分享到 X 分享到 LinkedIn
簡短回答

在典型的商業問題上只佔少數,而且值得拿來做計劃的那個數,是你在自己的 prompt 集上測出來的,不是從某項研究裡讀來的。你今天就能改的頁面只是三個桶裡的一個,旁邊還有講你的第三方頁面,以及跟你無關的頁面。唯一一份公開的 AI 引用學術分類,把它最大的單一類別(標籤就叫 Official)定在 ChatGPT 上佔引用的 34.22%、Google 的 AI 介面上 46.35%、Perplexity 上 44.07%;這意味著在每一個被測引擎上,大多數引用都不是官方來源,而且這個份額涵蓋的是答案點名的每一個主體,不只是你。1

關鍵要點
  • 「最大的單一類別」和「答案的大部分」是兩個不同的說法。Official 在被測的三個引擎上都居首,但最高只到 46.35%,所以有 54% 到 66% 的引用是別的東西。
  • 這個類別是共享的。在那份資料集裡,一則 Google AI 答案平均引用 12.06 個來源,而官方那一塊要分給答案點名的每一個主體,所以單一品牌分到的是分數的分數。
  • 你能觸及的份額還要更小:一個自有頁面必須先能被抓取、而且與某條子查詢相關,它的文字才算數。
  • 用你自己的引用日誌去測你自己的份額。在 95% 信賴水準下,大約要記錄 200 則答案,七個百分點的變化才勝得過雜訊。
定義

什麼才算你擁有的頁面?

這裡的「擁有」需要一個狹窄的操作性定義:一個被引用的 URL,位於一個你今天不必問任何人就能改動其文字的網域上。按這個定義,每一條引用都會落進三個桶之一。自有是你的網站、你的說明文件、你的更新日誌、你的定價頁。可影響是那些提到你、而你只能靠給別人一個修改理由才推得動的第三方頁面:合輯、評測目錄、社群討論串、新聞報導。都不是是剩下的那些,在多數問題上它們才是答案的主體。

有兩樣東西經常被算錯。一個位於你租而不是你有的網域上的頁面,比如市集平台的商品頁,或別人平台上的個人檔案頁,行為更像可影響頁面:營運方可以在不通知你的情況下改模板、改 canonical、改 robots 規則。另外,沒有連結的品牌提及根本不是引用。那是另一個量,六種能見度把它分開處理;而你在引用中的自有份額和在正文中的自有份額是兩個不同的數字,修法也不同。

分母

為什麼最大的引用類別不等於你的份額?

類別份額和品牌份額的分母不一樣,而沒有人把中間那道除法當眾做過一遍。

先從那張表本身說起。2026 年 4 月一篇附帶公開資料集的預印本,在 ChatGPT、Google 與 Perplexity 上分析了 602 條受控 prompt 和 21,143 條搜尋層引用。它的來源類型構成是:ChatGPT 上 Official 34.22%、News 31.17%、Vertical 22.13%;Google 上 Official 46.35%;Perplexity 上 Official 44.07%。1 在三個引擎上,Official 都是最大的單一類別;也在三個引擎上都只是整體中的少數,因為即使取最高的那個值,仍有 53.65% 的引用去了不是官方的地方。

這兩半必須一起說,因為單說任何一半都會指向錯誤的方向。只引前一半,你會得出「AI 答案主要由品牌網站構成、你自己寫的東西決定結果」的結論。只引後一半,你會得出「官方來源幾乎不出現」的結論,而同一張表就否掉了它。經得起推敲的讀法是:官方來源是進入一則答案最強的單一入口,同時仍把答案的大部分留給了別人。

接著做除法。同一份資料集給出的每則回答平均引用數是:ChatGPT 6.88、Google 12.06、Perplexity 16.35,中位數分別為 6、12、17。1 套上官方份額,一則中位數的 Google 答案帶著五到六條官方站點引用,而它們分散在這個問題所需要的那些廠商與機構之間。在一份點名六款產品的候選清單上,你的網站最好也只是六分之一,所以單一品牌的誠實預期,是一則答案裡個位數的低百分比。

請照印出來的標籤讀。那一欄就叫 Official,論文沒有給出定義;它的外部效度小節也寫明,來源類型分類中含有未知與雜訊值。1 請把排序當成有資訊量的,把小數點後的位數當成沒有;什麼會被引用走完了這套分類的其餘部分。

觸及範圍

站內工作能觸及答案的多少?

只有自有那一桶,而且只有其中為當下這個問題被檢索到的那部分。有兩項審計量出了排名與檢索之間的落差。Findings of ACL 2026 上一項 4,706 條查詢的 Google AI Overviews 審計,資料採集於 2025 年 9 月的美國與德國,寫道:「on average 53% (27%) of domains that AIO consults are not contained in top-10 (top-100) Organic search results」。2 另一項 55,393 條查詢、採集於 2026 年 3 月 13 日至 4 月 21 日的預印本發現,AI Overview 引述的網域中有 29.8% 不出現在對應的第一頁上。3 一項數的是被查閱的網域,另一項數的是被引述的網域,所以請把兩個採集窗口都寫出來,而不是從任一項裡取一個點值。

這是雙向的。一個在可見問題上毫無排名的頁面,仍可能因為其中某條子問題被檢索到,這正是一個說明文件頁能進入其首頁永遠觸及不到的答案的原因。這也意味著,你的排名對答案的槓桿,比對它下面那十條藍色連結要弱,儘管 Google 表示其「在 Google 搜尋上的生成式 AI 功能根植於我們核心的搜尋排名與品質系統」(該頁更新於 2026 年 7 月 10 日)。8 可檢索性擋在這一切前面,那是可檢索性上限的主題。

自有這一桶裡到底有多少可動空間,被測過兩次,兩次的答案都不大。C-SEO Bench 是 NeurIPS 2025 上一項涵蓋六個領域、十種方法的基準,它發現最好的內容方法把零售領域的引用名次移動了 0.36 位,而把來源移到上下文的第一位是 2.77 位,並且寫道「out of 54 cases, we uncover only three where the ranking improvements are statistically significant」。4 KDD 2026 上一項涵蓋十種策略的競技場研究發現,只編輯正文這一種做法在它的三項能見度指標上得到 0.53、0.84、0.47,而基線是 0.58、1.00、0.50,也就是比什麼都不改分別低 9%、16%、6%。5 修復順序在技術檢查清單裡。

方法

怎麼測出你自己的自有份額?

用你自己的引用日誌去數,因為每一個已發表的平均數,平均的都是一套不屬於你的查詢組合。做法就是一張試算表:按排程跑一組固定的 prompt,記錄每一則答案裡每一個被引用的 URL,而不只是屬於你的那些,再把每一個標成自有、可影響或都不是。然後把兩個數字分開。自有引用份額是自有 URL 除以全部被引用的 URL,說的是你供給了答案的多少。自有答案覆蓋率是至少含一個自有 URL 的答案所佔的比例,說的是你到底多常出現。後者總是比較大的那個,而用前者的名字去報後者的值,就是這個數字被灌水的方式。

把所有人的 URL 都記下來,才讓這個數字值得擁有,因為同一份日誌同時也是「當下正在決定你這個品類的第三方頁面」清單。要記錄的十個欄位給出了記錄結構。人們會跳過的那個欄位是完整的被引用 URL 而不是網域,而一個過期的比較頁和一個公司首頁不是同一個問題。

有一支團隊每週跑四十條 prompt,卻只記錄自己的網域有沒有出現,於是花了一季報告一條平線。把同一段時間改用「記下每一個被引用的 URL」重跑一遍,才看見底下有兩個在動的部件:自有份額從一個很小的基數上大約翻了一倍,而某個在約三分之一答案裡被引用的合輯,還掛著他們早已不再收的價格。該做的動作是給一位評測作者發一封信,而在自己網站上做多少功夫都不會把它翻出來。

精度

要多少則答案,這個份額才有意義?

自有引用份額是一個比例,所以它的不確定性只取決於樣本量,別無其他。本站引用的是 95% Wilson 區間,它在最壞情況 p = 0.5 下的半寬,等於 1.96 除以「n 加 3.84 之後開平方,再乘以 2」。5 則答案大約是 ±33 個百分點,30 則是 ±17,200 則是 ±7。一個在 30 則答案上從 4% 走到 6% 的自有份額並沒有動,無論那一欄相對變化寫了什麼。統計檢定力把這道算術完整走了一遍。

另外兩個波動來源跟你毫無關係。2026 年那篇批判性綜述轉述的一項研究發現,在溫度為零下重複執行同一條 prompt,會改變 9% 到 28% 的判定,也就是說把取樣旋鈕關到底,跑與跑之間的變異依然存在。6 同一篇綜述裡另一項在四個引擎上跟蹤 45 天的研究,測得逐日的來源層 Jaccard 相似度為 0.34 到 0.42,意味著被引用來源中有很大一部分一夜之間就換掉了;它跑在一個規模很小的瑞士查詢集合上,所以請讀方向而不是係數。6

由此得到的是一套報告節奏,而不是一塊儀表板。固定 prompt 集和執行次數,把區間印在點估計旁邊,並且按季而不是按週去比。一個這麼小又這麼吵的數字仍然站得住腳,因為它的職責是為一個決定定尺寸。

後果

這個拆分會改變下一個小時花在哪嗎?

它改變的是每一類小時的天花板,而不是它們各自的價值。站內工作作用於自有那一桶,其效應量不大,其檢索前提近乎二元。站外工作作用於可影響那一桶,一則商業答案裡的大多數引用就住在那裡。由此得出的順序並不體面:先讓自有頁面能被抓取,因為那裡的一個零會把下游全部抵消;再去弄清你實際的自有份額是多少;然後把剩下的小時花在你的日誌說正在決定答案的那些第三方頁面上。

這項測量有兩樣東西不是。它不是營收數字:2026 年那篇批判性綜述把「引用分數能預測點擊、轉換或營收」的證據評為極低6 而皮尤在 2025 年 3 月涵蓋 900 名美國成年人、68,879 次搜尋的面板發現,點擊 AI 摘要內部的來源「只發生在全部造訪的 1% 裡」。7 它也不是名次。這裡唯一站得住腳的結果語言,是提及份額、引用份額和聲量佔比,而且每一個都要標明具體引擎、prompt 集與日期。

把自有份額做高並不自動就是目標。在一個誠實答案應該比較五家廠商的問題上,一則主要由某一家自己的頁面拼出來的答案會更差,而且沒有哪個引擎會去拼它。經得起證據檢驗的目標是:引擎實際用到的那些來源,把你描述對了。這正是站外階段其餘部分要講的事。

本文的誠實邊界

34.22% 到 46.35% 這組數字出自單獨一篇預印本:它的 602 條 prompt 是設計出來的,而不是從真實使用者行為裡抽樣的;它的 Official 一欄從未被定義;它自己的外部效度小節也寫明來源類型分類含有未知與雜訊值。更要緊的是,沒有任何已發表的研究報告過自有引用份額在各個品牌之間如何分布。本文的算術是拿一個類別平均數去除以一個引用條數,而不是直接測量按品牌的份額,所以它給出的是一個數量級,不是一個值。扎實的部分是那兩項檢索落差審計,其中一項經過同行評議;以及「去測你自己的份額」這條指令,它不依賴上面這些數字最後是多少。

產品在哪裡派得上用場,在哪裡派不上

上面的一切就是一份固定 prompt 清單加一張試算表,不花錢。Bavior 不會提高你的自有份額,不替你寫或改你網域上的頁面,不爬你的網站,也沒辦法把一個抓不到的頁面變得抓得到;你日誌裡的那些第三方頁面同樣不是我們能改的。它做的是採集這一步:按排程把一組固定的 prompt 打到五個引擎上,記錄每一個被引用的 URL,你的和所有人的,於是自有份額從一種印象變成一個數字。當被引用的來源是一串正在進行的討論串時,它會用你掌控的帳號草擬一則回覆,任何內容送出之前都要先由你審核。結果按每個引擎的提及份額、引用份額和聲量佔比回報,絕不報成名次。免費 AI 能見度檢測免費 GEO 健檢不需要付費方案;付費方案為按月付費每月 $99 起,或按年付費每月 $79.17(截至 2026 年 8 月 30 日)。

出處,全部核查於 2026 年 8 月 30 日
  1. Zhang、He、Yao,《From Citation Selection to Citation Absorption》,2026 年 4 月 28 日,arXiv:2604.25707(預印本,附公開資料集);來源類型表與每則回答引用數表,§10.2「The source-type taxonomy contains unknown and noisy values」:arxiv.org/abs/2604.25707
  2. Kirsten 等,《Characterizing Web Search in The Age of Generative AI》,Findings of ACL 2026;4,706 條查詢,2025 年 9 月,美國與德國;「on average 53% (27%) of domains that AIO consults are not contained in top-10 (top-100) Organic search results」:aclanthology.org/2026.findings-acl.526
  3. Xu、Iqbal & Montgomery,《Measuring Google AI Overviews》,2026(預印本);55,393 條查詢,2026 年 3 月 13 日至 4 月 21 日;「29.8% of AIO reference domains do not appear anywhere on the corresponding first page」:arxiv.org/abs/2605.14021
  4. Puerto 等,《C-SEO Bench: Does Conversational SEO Work?》,NeurIPS 2025 Datasets & Benchmarks Track,arXiv:2506.11097;表 3 零售部分,§6.2:arxiv.org/abs/2506.11097
  5. Kim 等,《SAGEO Arena》,KDD 2026,arXiv:2602.12187;表 2「Body Text only」:arxiv.org/abs/2602.12187
  6. 《A Critical Survey of Generative Engine Optimization (2023–2026)》,2026 年 7 月 15 日,arXiv:2607.14035(綜述預印本);表 5、溫度為零下的判定翻轉區間,以及那項 45 天 Jaccard 跟蹤研究:arxiv.org/abs/2607.14035
  7. 皮尤研究中心,2025 年 7 月 22 日;900 名美國成年人、68,879 次搜尋,2025 年 3 月;點擊 AI 摘要內部的來源「occurred in just 1% of all visits」:pewresearch.org
  8. Google Search Central,《Google’s Guide to Optimizing for Generative AI Features on Google Search》,更新於 2026 年 7 月 10 日(第一方文件);「rooted in our core Search ranking and quality systems」:developers.google.com/search/docs/fundamentals/ai-optimization-guide
常見問題

你想知道的,都在這裡。

一則 AI 答案裡,有多少比例來自品牌自己能控制的頁面?

在多數商業問題上是個位數的低百分比,不過沒有研究按品牌逐一測過。唯一一份公開學術分類裡最大的來源類別標籤是 Official,依引擎不同佔引用的 34.22% 到 46.35%,但它涵蓋答案點名的每一個機構。用一則答案通常引用的 6 到 17 個來源去除,單一品牌分到的那一塊就很小了。請去測你自己的那個數,而不是拿這一個當假設。

「官方來源是最大的類別」是不是意味著 AI 答案主要由品牌網站構成?

不是,而且只說那一半會誤導人。在被測的三個引擎上,Official 都是最大的單一類別,但它最高也只到 46.35%,所以有 54% 到 66% 的引用來自新聞、垂直媒體、討論串或別的東西。這兩個事實出自同一張表。有用的讀法是:官方來源是進入一則答案最強的單一入口,同時把答案的大部分留給了別人。

我要記錄多少則答案,自有份額這個數才有意義?

如果你想看出七個百分點的變化,大約需要 200 則。自有引用份額是一個比例,95% Wilson 區間在最壞情況下等於 1.96 除以「n 加 3.84 之後開平方,再乘以 2」:5 則答案約為正負 33 個百分點,30 則是 17,200 則是 7。引擎自身的變異還要疊加上去,所以請按季比較,而不是按週。

如果答案的大部分都是別人的頁面,站內工作還值得做嗎?

值得,但預期回報比多數方案假設的要小。站內工作是唯一能推動自有那一桶的東西,而能被抓取、與問題相關是其餘一切的前提。它做不到的是覆蓋一則商業答案裡的大多數引用。請先修可檢索性,因為那裡的一個零會把其餘全部抵消,然後把站外工作當成處理另一桶的那部分。

Bavior 編輯部

負責研究與維護 Bavior 關於 Reddit 行銷和 AI 搜尋可見度的所有內容。文中每一個數字都註明了來源出處與查證日期,所有外部連結均非聯盟推廣連結。

發現數字有誤?告訴我們,我們會重新查證:support@bavior.com

答案的大部分屬於別人。
先弄清有多少屬於你。

免費試用