以疑问词开头的查询,以及七个词及以上的查询:这两个集合取并集,就是你自己数据里最接近 prompt 的东西。请把词表白纸黑字定下来,好让筛选可复现,并且优先用已发表的词表,而不是自己拍脑袋写一份。长度阈值是同一种行为的代理指标,用来捞出那些「写成了句子、却没在开头放疑问词」的查询。
句式这道筛子背后,是这个领域里最锐利的证据。在一项跨 40 天、于 2026 年春季发出的 55,393 条热门查询中,Google AI Overviews 的整体触发率是 13.7%,但疑问句式查询为 64.7%,非疑问句式只有 9.5%:相差 6.8 倍,卡方 10,002.2,p < 10⁻³⁰⁰。1 这么大的效应在这里很罕见,而且它测的是线上真实搜索,不是模拟。
长度之所以配得上第二道筛子的位置,是因为它能脱离句式独立推高这个数字。同一项研究里,触发率在两词查询上是 3.4%,四词 20.0%,五词 33.9%,六词及以上 58.1%;只看非疑问式查询,它也从单词的 9.9% 升到六词及以上的 38.7%。1 一条长查询在做的事,关键词并没有在做,无论它是不是以 how 开头。这项研究的最高一箱是「六词及以上」,所以七词这条线落在最强的那一箱里,而不是它的边缘;一份覆盖 1.46 亿个结果页的厂商数据集测得,七词及以上的查询有 46.4% 出现 AI Overviews,但其方法从未公开。2
两道筛子描述的都是「AI 答案何时出现」,而不是「有多少人在问」。请在操作时把这个区分一直放在心上,因为它决定了产出是干什么用的:这个来源告诉你,你现有需求里哪些是 prompt 的形状;它无法告诉你,那些你从未有过排名的 prompt 是哪些。后者来自通话与工单。