出現率是一個樣本比例:每一次執行,要嘛點了你的名,要嘛沒有。每次執行都是一次伯努利抽樣,其機率 p 觀察不到,而且只屬於「某條 prompt、在某個引擎上、在某一週」;你看到的,是點了你名字的那部分執行所佔的比例。本頁所有區間都是 95% Wilson 分數區間,也就是 Brown、Cai 與 DasGupta 建議拿來取代教科書常態近似的那一種。11 在 50% 出現率下,它的半寬是 1.96 除以「(n + 3.84) 的平方根的兩倍」,其中 n 是這個數字背後的觀測次數。
有兩個約定,讓它在你還沒有任何資料之前就能用。取 p = 0.5 來算,因為 p(1−p) 在那裡最大,按最壞情況規劃,意味著你承諾過的區間絕不會比你實際拿到的更窄。另外,數的是觀測而不是 prompt 條數:n 等於條數乘以執行次數,並且按每個引擎分開算。
把它反過來用,就能直接算出面板該多大。要達到半寬 w,你需要 n = 0.96/w² − 3.84 次觀測:±10 個百分點約需 92 次,±7 需 192 次,±5 需 380 次。本頁每一個 n 都是這筆算術的結果,而不是研究發現,所以沒有一個標注到論文;下面的出處,是給「算術在哪裡失效」和「引擎在底下移動了多少」用的。