두 비율을 비교할 때는 평범한 두 비율 공식을 씁니다. 이 페이지의 모든 수치가 거기서 나옵니다. n = (zα/2 + zβ)² × [p₁(1−p₁) + p₂(1−p₂)] ÷ (p₂ − p₁)². 관례적인 설정, 즉 양측 5% 유의수준이라 zα/2 = 1.96, 검정력 80%라 zβ = 0.84로 두면 앞의 상수는 2.8² = 7.84입니다.
각 항은 데이터를 모으기 전에 여러분이 정하는 값입니다. p₁은 출발점 비율이고, 추측이 아니라 실측합니다. p₂는 검출할 수 있기를 바라는 비율이며, 이것은 비즈니스 판단입니다. 다음 분기에 무엇에 돈을 쓸지를 바꿀 만한 최소 개선 폭입니다. δ = p₂ − p₁는 그 차이이고 소수로 씁니다. 그리고 n은 각 기간의 관측 수이며, 관측 1건은 프롬프트 하나를 엔진 하나에서 한 번 실행한 것입니다.
한 줄만 손으로 계산해 두면 나머지는 검산할 수 있습니다. 30%에서 40%로: 0.30 × 0.70 = 0.21, 여기에 0.40 × 0.60 = 0.24를 더해 합이 0.45, 7.84를 곱하면 3.528, δ² = 0.01로 나누면 352.8입니다. 즉 전에 관측 353건, 후에 353건입니다.
이 가운데 AI 검색에만 해당하는 것은 하나도 없습니다. 이진 결과를 비교할 때의 산술 그 자체이고, 위의 판본은 유통되는 둘 중 작은 쪽입니다. 대부분의 계산기가 돌리는 것은 Casagrande, Pike, Smith의 연속성 보정 공식이며, 그쪽이 더 큰 n을 돌려줍니다. 그러니 이 페이지의 모든 수치를 하한으로 읽으십시오.6 한 비율의 정밀도와 두 비율 차이의 검출은 다른 계산입니다. 앞쪽에 맞춰 크기를 정한 패널은 뒤쪽에는 으레 너무 작습니다. 정밀도에 맞춘 크기 산정은 프롬프트 리서치의 패널 규모에서 다룹니다.