Estatísticas que você pode defender
Correção para comparações múltiplas
Teste quatro variantes a 0,05 cada e você tem quase uma chance em cinco de um vencedor falso. Uma correção é o que evita isso.
Cada variante a mais é mais uma chance de o ruído parecer um vencedor. Com quatro comparações julgadas a 0,05 cada, a chance de pelo menos uma cruzar por sorte fica perto de vinte por cento, e o vencedor que você lança tem tanta chance de ser um artefato quanto uma melhoria de verdade.
Uma correção aperta a barra para compensar isso. O Pertento oferece três, além de nenhuma, e aplicar uma muda só o veredito de significância. O valor p, o escore z e os intervalos ficam intocados, então trocar de método nunca muda a evidência, só o padrão que você está usando para julgá-la.
Com uma única variante, as quatro opções se reduzem ao mesmo limite. Em vez de deixar você descobrir isso testando cada uma, o console diz isso diretamente, e informa o limite real que o método escolhido está aplicando para o seu número de comparações.
Uma correção fica fixa em vez de escolhida sempre que a plataforma age por conta própria. A fila de atenção, a fila de implementação e a regra de parada automatizada leem todas o mesmo método, porque uma fila não pode oferecer um menu suspenso, e duas telas discordando sobre quem venceu é exatamente o erro que isso evita.