因为检索是按子查询跑的,所以一个子问题是通往答案的一个独立入口,而不是头部词的一次换句话说。Google 在文档里写明了这个机制:它的 AI 界面可能跨子话题和数据源发起多次相关搜索来生成一条回答。1 一个能回答其中某次搜索的页面,可以因此被检索到,而在可见的那个问题上毫无排名。
“什么有排名”与“什么被引用”之间的落差是被测量过的,而且应当作为一个带日期的区间来引用,而不是一个点值。发表于 Findings of ACL 2026、数据采集于 2025 年 9 月的一项对 Google AI Overviews 的 4,706 条查询审计写道:“平均而言,AI Overview 查阅过的域名中有 53%(27%)不在自然结果前十(前一百)之内”;一项 55,393 条查询、采集于 2026 年 3 月 13 日至 4 月 21 日的预印本测得,AI Overview 引述的域名中有 29.8% 不出现在对应的首页上。23 大约 30% 到 53%,跨两个相隔六个月的采集窗口,而且动词不同:一项数的是被“查阅”的域名,另一项数的是被“引述”的域名。SIGIR 2026 上一项 11,500 条查询的研究测得 Google 自然结果、AI Overviews 与 Gemini 之间 URL 层面的 Jaccard 相似度为 0.11 到 0.18。4 扇出是解释这么大落差的最合理机制,而“合理”正是那个诚实的词:没有任何研究能对扇出这一步下探针。
一份发表于 2025 年 12 月的厂商研究,覆盖 10,000 个关键词与 173,902 个 URL,报告称“一个页面在多少条重构扇出查询上有排名”与“它被 AI Overview 引用的可能性”之间的 Spearman 相关系数为 0.77。5 请仔细读:它是相关性的、是厂商发布的,而且它的扇出查询正是本文所描述的那类重构,而不是引擎真正发出的那些。它是对这套做法的佐证,不是关于机制的证据。