一份清單只有在項目按依賴關係排序時才有價值,而技術類項目之間的依賴格外重。下面十項裡有四項,一次命令列抓取就能定論。三項需要留存一個月的伺服器日誌,以及一個會查日誌的人。三項根本不是修復:它們是關於你希望別人的機器能讀到什麼的決策。按這個順序跑不是為了整齊,而是因為只有在這個順序下,結果才有意義。
依賴只朝一個方向流。如果一次普通抓取回來的是一道挑戰而不是頁面,那麼之後你查的每一份日誌都會是沉默,而這份沉默的原因跟引擎對你有沒有興趣毫無關係。如果 robots.txt 禁掉了搜尋側令牌,一個月的抓取資料讀起來就像冷淡,團隊於是得出 AI 引擎不理會自己這個品類的結論,而事實是站點自己叫它們別來。如果正文只在水合之後才存在,那麼一次引用測量測的是 JavaScript 打包檔,而不是文字。這三種都是長得跟真陰性一模一樣的假陰性,所以清單靠上的失敗是一條停止指令,而不是一條留著往下帶的備註。
成本指向同一個方向。第一層是一台筆電加十分鐘。第二層要佔掉一個人一天,還需要你未必有的日誌留存。第三層要開一次會。便宜的檢查為貴的檢查把關,因此對第一層失敗的反應是:修掉它,等廠商的系統跟上,再從頭跑一遍。每一項背後的道理都在它自己的文章裡,並從該項目直接連出;這一頁新增的是順序和執行方式。