Statistik du kan stå på mål for

Styrkeberegning

Chancen for at dette eksperiment kunne opdage den forskel, det viser lige nu, hvis den forskel er reel.

Mod den observerede effektLøbendeMål på 80 procent

Statistisk styrke er chancen for, at et eksperiment ville opdage en reel forskel af en given størrelse. Under omkring firs procent betyder et nulresultat "ikke nok data endnu" frem for "ingen effekt", og at behandle de to som samme ting er sådan en god idé bliver opgivet.

Pertento dimensionerer beregningen mod den forskel, eksperimentet faktisk måler, ikke mod et fast målløft valgt på forhånd. At dimensionere mod et hardkodet fem procent svarer på "hvornår kunne jeg opdage fem procent", hvilket ikke er det spørgsmål, nogen stiller til et kørende eksperiment. Spørgsmålet er, hvornår den effekt, jeg ser, bliver entydig.

Der er en bevidst sikring i den beregning. Den målte forskel føres aldrig tilbage gennem gulvet for målbar effekt, som selv er udledt af den nuværende stikprøve. At gøre det gør svaret selvopfyldende og melder tilstrækkelige data for et eksperiment, der har alvorligt for lav styrke.

Når den målte forskel er for lille at dimensionere mod overhovedet, fordi en effekt tæt på nul kræver en ubegrænset stikprøve, falder beregningen tilbage på et målløft og siger, hvilken af de to den brugte. Et præcist udseende tal uden angivelse af, hvad det antog, er værre end et ærligt.

Bedre eksperimenter, bedre konvertering

Test on all visitors with the world’s lightest script and make confident decisions powered by real-time reporting.