因为这两份文档回答的根本不是同一个问题。“五人团队最好的项目跟踪工具”要的是一个集合:若干个被点名的候选,每个都带一条理由,并且有一条“到这里它就不再是对的选择”的边界。而厂商页面是一份关于单一实体的文档,它的任务是结束比较,而不是进行比较。检索是拿文档去对“实际被发出的那条查询”打分的,所以一份本身就长成答案形状的页面,在结构上就赢下了这次匹配,这发生在质量或信任被称量之前。
换到引擎那一侧去看这次失败,它就不再像是对你文笔的判决。要用一堆单厂商页面搭出一份候选清单,系统必须分别找到每个候选、判断哪些候选根本该进这个集合、再从一堆“各自都是为了赢下这场比较而写”的文档里自己构造出这份对比。一份榜单把这三件事全部预先解决好交过来,而这里面没有一条要求那份榜单是独立的、写得好的,甚至也不要求它是新的。
这个领域唯一一份系统性综述对同一条边界给出了评级:它把“查询与文档的相关性、以及在上下文中的位置,是主要决定因素”评为高置信度,把“一项白帽干预能在多个引擎上持久改善可发现性”评为低。3 与被发出查询的相关性,是这套系统里证据最强的那一块;而相关性恰恰就是单厂商页面在结构上欠缺的地方。