不是,而且实测的错误率高到足以改变你的写法。哥伦比亚大学 Tow 数字新闻中心在 2024 年 11 月用 20 家出版机构的 200 条引文测试 ChatGPT Search,发现 200 条回答中有 153 条部分或完全错误,而模型只有 7 次表达了不确定。3 2025 年 3 月的后续研究在八个引擎上跑了 1,600 条查询,构成是 20 家出版机构乘 10 篇文章乘 8 个助手,结果超过 60% 的查询被答错;最差的那个助手 94% 的情况下是错的,在它测试的 200 条提示词中产生了 154 条指向错误页面的引用。授权协议并未带来准确性上的好处,而屏蔽了爬虫的出版机构依然被引用。4
独立研究从别的角度指向同一处。2023 年一项对生成式搜索引擎的评测发现,平均而言只有区区 51.5% 的生成句子被其引用完全支撑,而只有 74.5% 的引用能支撑它所对应的那句话。5 2026 年一项审计把 7,491 条 Google AI Overviews 拆成 98,020 条原子论断,逐条与旁边所引的页面核对:11.0% 得不到支撑,其中 4.1% 与所引内容直接矛盾或冲突,另有 7.0% 在所引来源正文里根本没被提到。8 更大的失败方式是「遗漏」而不是「矛盾」:常见情形不是引擎在跟你的页面唱反调,而是引擎把某句你从没说过的话记到你的页面名下。另一项 2026 年研究测得可信来源占比为 71.4% 到 86.3%,随助手和话题而异。8 不同方法、不同分母,同一个结论:一句话上挂着链接,几乎不能告诉你这句话对那个来源来说是不是真的。
所以为「被引用」而优化,和为「被正确表述」而优化不是一回事,而后者才是保护你的那个。一个只有在邻居在场时才成立的句子,会在邻居不在的情况下被摘走。