因为没有引擎公开 prompt 频次,而其他人都不处在能数清它的位置上。Google 明确说明了自己公开的是什么:“出现在 AI 功能(例如 AI Overviews 和 AI Mode)里的站点,其流量会被计入 Search Console 的整体搜索流量”,并在效果报告中以“网页”搜索类型呈现,也就是和普通搜索聚合在一起,从不按产生它的那个问题逐条列出。2 而 Search Console 自己的帮助文档,又把你最想要的那部分拿走了:在查询标签页上,被匿名化的稀有结果不会进入表格,表格本身最多显示 1,000 行,于是疑问式需求所在的那条长尾,恰好就是缺掉的那部分。3 其余引擎则根本没有公开任何可比的东西。
就算日志被直接交到你手上,也有四条结构性性质会让聚合失效。基数:prompt 是句子,两个意图完全相同的买家写出的句子经常几乎没有共同词汇,所以这个分布不是一个可数的头部,而是一条由近乎唯一的字符串组成的巨大长尾。会话上下文:触发那条答案的句子可能是“那便宜的那个呢?”,它的含义活在三轮之前,从不出现在文字里。个性化:存储的记忆与账号历史,会让同样的字句为不同的人检索出不同的东西。非确定性:2026 年那篇批判性综述报告,在温度可控的界面上,温度为零的重复运行会改变 9% 到 28% 的判定;另有一项跨四个引擎、持续 45 天的研究观察到,两次运行之间按天计算的来源级 Jaccard 约为 0.34 到 0.42。4 频次表需要一个稳定的观测单位,而 prompt 不是。