因为最容易下手的那个阶段,恰好也是最容易被单独测量的那个阶段,而这两件事叠加起来长出了一个行业。改写一个页面,一个人一个下午就能做完,不用碰基础设施,所以建议都挤到了那里。测量一次改写也很容易:把一组固定文档递给模型,只改措辞,所以早期实验也挤到了那里。结果是:一大批关于“已经在模型上下文里的文档会怎样”的真实发现,被推广成了关于“开放网络上的页面会怎样”的主张。
2026 年那篇领域批判性综述在自己的置信度表里画出了这条线。“一份已经被放进上下文的文档能因果性地改变自己的排序、被引用或被使用”评为高置信度,并注明该证据“未涉及自然检索”。“一项白帽干预能在多个引擎上持久改善自然可发现性”评为低。“引用分数能预测点击、转化或收入”评为极低。3 这个领域里几乎每一次失望,都住在第一行与另外两行之间的那道缝里。这套诊断法据以归位的那条管线,就是AI 搜索如何工作这一阶段。