有兩項被報告的測量決定了這套工作流的形狀,而且兩者指向同一個方向。2026 年那篇生成式引擎優化的批判性綜述報告,Kirsten 等人發現溫度為零時的重複執行會改變 9% 到 28% 的判定;Schulte 等人在四個引擎、45 天、一個很小的瑞士查詢集合上,測得來源層面的日間 Jaccard 重合度為 0.34 到 0.42。1 Jaccard 是交集除以聯集,所以 0.34 代表:在相鄰兩天被引用的所有來源裡,只有大約三分之一是兩天都出現的。
把這兩個數字放在一起讀,它們說的是:每週那份引用清單是對一個正在移動的母體所做的一次抽樣,而不是世界的一個狀態;上週二以來變掉的東西,大部分與你無關。一套按週對著數字變動做反應的流程,反應的是它自己的儀器。所以這一週被設計成收集:它累積記錄,抓住單次觀測能誠實確立的那些事件,把反應留給噪聲會被平均掉的時間尺度。給定樣本量下的區間有多寬是算術,算在面板規模和統計檢定力裡。每週跑依然值得,因為頻率買到的是反應時間和那些會過期的事件;它只是買不到顯著性。