因為沒有引擎公開 prompt 頻次,而其他人都不在能數清它的位置上。Google 明確說明了自己公開的是什麼:「出現在 AI 功能(例如 AI Overviews 與 AI Mode)裡的網站,其流量會計入 Search Console 的整體搜尋流量」,並在成效報告裡歸在「網頁」搜尋類型下,也就是和一般搜尋聚合在一起,從不按產生它的那個問題逐條列出。2 接著,Search Console 自己的說明文件又把你最想要的那部分拿走了:在查詢分頁上,被匿名化的稀有結果不會進入表格,而表格最多顯示 1,000 列,抹掉的恰好就是問句型需求所在的那條長尾。3 其餘引擎則根本沒有公開任何可比的東西。
就算日誌被直接交到你手上,也有四項結構性性質會讓聚合失效。基數:prompt 是句子,兩個意圖完全相同的買家寫出的句子經常幾乎沒有共同詞彙,所以這個分布不是一個可數的頭部,而是一條由近乎唯一的字串組成的巨大長尾。會話上下文:觸發那則答案的句子可能是「那便宜的那個呢?」,它的意思活在三輪之前,從不出現在文字裡。個人化:儲存的記憶與帳號歷史,會讓同樣的字句為不同的人檢索出不同的東西。非確定性:2026 年那篇批判性綜述報告,在溫度可控的介面上,溫度為零的重複執行會改變 9% 到 28% 的判定;另有一項跨四個引擎、為期 45 天的研究觀察到,按日計算的來源級 Jaccard 約為 0.34 到 0.42。4 頻次表需要一個穩定的觀測單位,而 prompt 不是。