在多数商业问题上只是其中一小部分,即便官方来源整体上是最大的单一类别。34–46% 的官方来源份额,是分摊给答案里所有品牌的,包括你的竞品;清单的其余部分是新闻、垂直出版物和讨论帖,你都控制不了。一项对 Google AI Overviews 的 4,706 条查询学术审计(数据采集于 2025 年 9 月,覆盖美国与德国)发现,它查阅过的域名中 53% 不在自然结果前十、27% 不在前一百。5 一项 55,393 条查询、采集于 2026 年 3 月 13 日至 4 月 21 日的预印本,把可比的“首页”缺口测为 29.8%;所以站得住脚的说法是一个区间,大约 30% 到 53%,并写明两个采集时间窗,而不是从任一项研究里取一个点值。8 一项 11,500 条查询的 SIGIR 2026 研究从另一个角度说明了同一件事:对同一条查询,Google 自然结果、AI Overviews 与 Gemini 各自返回的来源,平均 Jaccard 相似度不到 0.2。10 另外,Kirsten 统计的是 AI Overviews “查阅过”的域名,这和它“引用”的域名不是同一回事。
由此得出两个实际结论。第一,值得写的页面,是那些能凭自身条件被选中的页面:真正回答了某个子问题的文档、把价格写成文字的定价页、诚实到可以被引用的对比页。关于“什么才让一个页面具备资格”,Google 自己的文档说得很直白:它必须被索引、并有资格在搜索里带摘要展示,而且不需要添加任何特殊的结构化数据。6 它另一份优化指南还补充说,这些功能“植根于我们核心的搜索排序与质量系统”。9
第二,“能被抓到”是前提,不是细节。2026 年一篇预印本(经那篇批判性综述转述)发现,AI 答案中已经被引用过的 URL 里有 27.1% 抓不下来,原因是不可访问、已删除或非文本;而在成功抓取到的 19,154 个文本页面中,约 16% 被作者的检测器标记为 AI 生成。7 一个躲在登录墙、插页广告或反爬网关后面的页面,无论写得多好都出局了,这是技术 GEO 的主题。