不是,而且實測的錯誤率高到足以改變你的寫法。哥倫比亞大學 Tow 數位新聞中心在 2024 年 11 月,用 20 家出版機構的 200 條引文測試 ChatGPT Search,發現 200 條回答中有 153 條部分或完全錯誤,而模型只有 7 次表達了不確定。3 2025 年 3 月的後續研究在八個引擎上跑了 1,600 條查詢,構成是 20 家出版機構乘 10 篇文章乘 8 個助手,結果超過 60% 的查詢被答錯;最差的那個助手 94% 的情況下是錯的,在它的 200 條 prompt 中產生了 154 條指向錯誤頁面的引用。授權協議並未帶來準確性上的好處,而阻擋了爬蟲的出版機構依然被引用。4
獨立研究從別的角度指向同一處。2023 年一項對生成式搜尋引擎的評測發現,平均而言只有區區 51.5% 的生成句子被引用完全支撐,而只有 74.5% 的引用能支撐它所對應的那句話。5 2026 年一項審計把 7,491 條 Google AI Overviews 拆成 98,020 條原子論斷,逐條與旁邊所引的頁面核對:11.0% 得不到支撐,其中 4.1% 與所引內容直接矛盾或衝突,另有 7.0% 在所引來源正文裡根本沒被提到。8 更大的失敗是遺漏,不是矛盾:常見情形不是引擎在跟你的頁面唱反調,而是引擎把一句你從沒說過的話記到你的頁面名下。另一項 2026 年研究測得可信來源占比為 71.4% 到 86.3%,隨助手和話題而異。8 不同方法、不同分母,同一個結論:一句話上掛著連結,幾乎不能告訴你這句話對那個來源來說是不是真的。
所以為「被引用」而優化,和為「被正確表述」而優化不是一回事,而後者才是保護你的那個。一個只有在鄰居在場時才成立的句子,會在鄰居不在的情況下被摘走。