你对第三、四、五阶段拥有输入,对第一、二阶段则完全没有。理解发生在触碰任何文档之前,输入只有用户的措辞、对话历史和引擎自己的先验。扇出是引擎依据它自己对子话题的模型,从那个意图生成的。这两个阶段都不读你的站点,所以任何号称能改善它们的技巧,不是贴错了标签,就是空的。
在第三阶段,你的输入是收录、可抓取性和相关性。Google 对自己的界面直接写明了准入规则:页面"必须已被收录,并且有资格带摘要出现在 Google 搜索里,满足搜索的技术要求",并补充说,不需要任何特殊文件或 schema.org 标记才能出现。1 它的 AI 优化指引点明了这条规则背后的机制:检索增强生成之所以能改善答案,是"依靠我们核心的搜索排名系统,从我们的搜索索引中检索出相关且时效性好的网页"。6 在第四阶段,你的输入是段落结构,也就是某个具体子问题的答案是否坐落在一个可整块抬走的段落里。在第五阶段,你的输入是措辞。
还有很大一部分管线你完全没有输入,而它并不是一个阶段:它是别人的页面。第三和第四阶段跑在一个由整个网络构建的索引之上,所以在多数商业问题上,被检索出来的候选大多是第三方评测、榜单和讨论帖。2026 年一项覆盖四个品牌、跨三个引擎、共 47,097 条引用的厂商研究,把"被引用材料中品牌自有的比例"估在约 2%;四个品牌只能算示例而非常数,但量级本身就是重点。9