Plattform · Statistik du kan stå för

Frekventistiskt och bayesianskt, sida vid sida

Lyft, konfidensintervall, sannolikheten att den här varianten är bäst och förväntad förlust, i en och samma vy, uppdaterad i realtid.

Läsa ett resultat

Vad siffrorna säger, och vad de inte säger

Titta tidigt utan att fuska, larmet som går innan ni agerar, och intäkt per variant i kontots valuta.

  • Sekventiell testning som legitimt kan utse en vinnare tidigt, med korrigering för multipla jämförelser
  • Larm för snedvriden urvalsfördelning som flaggar opålitliga resultat innan ni agerar på dem
  • Intäkt och genomsnittligt ordervärde per variant, med stöd för flera valutor
  • Ett golv för upplösbar effekt, så ett obesvarbart test säger det i stället för att köra i all evighet
  • Förklaringar på vanlig svenska för varje statistik: ingen doktorsexamen krävs
RealtidFlera valutorStyrkeberäkning
Ett experiments statistikskärm: ett lyft på 12,4 % vid ett p-värde på 0,0184, konverteringsgrad över tid för kontrollen och två varianter, och en signifikanstabell vars slutsats i klarspråk säger att resultatet är tryggt att driftsätta.

Sekventiell testning

Titta tidigt utan att fuska

Ett test med fast horisont är bara giltigt om ni tittar en gång, i slutet. Sekventiell testning låter er kontrollera varje dag och stoppa i samma stund som beviset passerar gränsen.

  • Giltig inferens vid varje titt, inte bara den sista
  • Korrigering för multipla jämförelser när flera varianter körs samtidigt
  • En rekommendation i ord, inte bara ett tal
  • Holm-Bonferroni, Benjamini-Hochberg eller Šidák, eller ingen, angivet oavsett
Ett diagram för sekventiell testning: beviset klättrar dag för dag mellan en nedre och en övre streckad gräns och passerar den övre på dag nitton, med Holm-Bonferroni-korrigering över tjugoen tittar.

Tillit

Larmet som går innan ni agerar

En snedvriden urvalsfördelning betyder att fördelningen inte skedde som ni konfigurerade den, och resultatet går inte att läsa. Pertento kontrollerar löpande och blockerar automatisering när det utlöses.

  • Löpande kontroller av snedvriden urvalsfördelning per variant
  • Automatiseringen vägrar agera på flaggad data
  • Orsaken angiven i klarspråk
  • Tre tillitsgrindar: en snedvriden urvalsfördelning, en dag utan trafik, eller en störning från ett annat pågående test
Tillitsskärmen: ett experiments trafikfördelning stämmer med konfigurationen, ett annat är flaggat för snedvriden urvalsfördelning med 54/46 mot en konfigurerad jämn fördelning.

Pengar

Intäkt per variant, i kontots valuta

Konverteringsgrad är en approximation. Pertento rapporterar intäkt och genomsnittligt ordervärde per variant, så att en vinst som säljer billigare produkter inte ser ut som en vinst.

  • Intäkt och genomsnittligt ordervärde per variant, i en vald valuta
  • Konverteringar räknade över alla valutor, eftersom en konvertering är en konvertering
  • Intäkt läst som ett andra mål för implementeringskön, så att en vinst enbart på intäkt ändå skeppas
  • Signifikans och intervall på intäkt såväl som på konverteringar
Intäktsvyn för ett experiment: en positiv effekt på intäkt och genomsnittligt ordervärde, med intäkt och antal order uppdelade per variant.

Siffrorna

Vad resultattabellen faktiskt berättar

Sex tal gör det mesta av jobbet på den här skärmen, och två av dem är de som oftast misstolkas. Konsolen förklarar varje tal på plats; det här är vad de är till för.

Två intervall, inte ett

Ett Wilson-intervall för varje variants egen andel, som håller sig mellan noll och hundra procent även vid små urval, och ett lyftintervall för skillnaden mot kontrollen. Det andra är det som avgör en diskussion: om det passerar noll är varianten verkligen före.

Sannolikheten att en variant är bäst

Den bayesianska halvan rapporterar chansen att varje variant är den bästa av de testade. Till skillnad från ett p-värde svarar den på den fråga ni faktiskt ställde, och därför är det oftast siffran folk läser först.

Förväntad förlust

Vad ni skulle avstå från genom att driftsätta den här varianten om den visar sig inte vara den bästa. En liten förväntad förlust betyder att beslutet är billigt även när det är fel, och det är ofta det som avgör snarare än signifikans.

Golvet för upplösbar effekt

Den minsta förändring som den här mängden trafik tillförlitligt kan upptäcka. En skillnad under golvet blir inte signifikant av att ni väntar vid nuvarande trafiknivå, hur länge ni än låter testet löpa. Det här är felläget som ser ut som "inget resultat" och egentligen är "inte nog med trafik för att någonsin kunna avgöra".

Dagar kvar, på riktigt

Framskrivet från trafiktakten under det fönster testet faktiskt var live, och dimensionerat mot den skillnad som mäts snarare än mot ett fast mål. När målet ligger längre bort än ett år säger den det i stället för att skriva ut ett fyrsiffrigt antal dagar.

Förklaringar på vanlig svenska

Varje siffra bär sin egen definition, skriven för att säga vad den berättar snarare än för att definiera begreppet. Där ett tal är lätt att missförstå säger förklaringen det rakt ut.

Under ytan

Vad talen är uppmätta över

Ett resultat är bara så bra som det det beräknades från: vilken händelse som räknas som målet, vilken valuta pengarna är i, och om samma matematik låg bakom både larmet och skärmen.

Tre namngivna korrigeringar

Holm-Bonferroni, Benjamini-Hochberg och Šidák, eller ingen. En korrigering ändrar bara utfallet signifikant, aldrig p-värdet, intervallet eller z-värdet, och med en enda variant sammanfaller alla fyra i samma gräns. Konsolen säger det i stället för att låta er prova var och en.

Primära och sekundära mål

En webbplats markerar vilka av sina händelser som får användas som målsättning; varje experiment väljer sitt primära mål ur den poolen och listar resten som stödmått. En händelse som senare nedgraderas fortsätter rapportera på experiment som redan valt den, så ett avslutat resultat ändras aldrig i efterhand.

Tidsserie per variant

Dagliga sessioner, konverteringar och intäkt per variant, som råa antal snarare än förberäknade andelar. Varje annan siffra på sidan är ett kumulativt tal, och inget av dem kan visa om ett resultat håller sig stabilt eller fortfarande vandrar.

Kombinationsrapportering

När flera experiment körs samtidigt frågar kombinationsrapporten om två ändringar samverkar och om ordervärdet skiljer sig mellan kombinationer. Den beräknas enbart från konverteringar, vilket är precis nog för den frågan och inte nog för "vilken kombination konverterar bäst".

Flera valutor, hållet hederligt

Konverteringar räknas över alla valutor, eftersom en konvertering är en konvertering oavsett vad den betalades i. Intäkt är det inte: att lägga SEK till EUR ger en meningslös summa, så intäkt kräver att en valuta väljs, och konsolen tvingar er att välja den.

En enda implementation av matematiken

Larmet som mejlar er och skärmen ni landar på kör samma kontroll av urvalsfördelningen, och stoppmotorn läser dess utfall genom samma kod som instrumentpanelen renderar. Ett larm som motsäger den skärm det länkar till är sämre än inget larm.

Frågor

Innan ni litar på siffrorna

Kan vi ta de här talen till en ekonomichef?

Det är vad andra halvan av den här sidan är till för. Ett resultat kommer med skillnadens storlek, intervallet runt den, och hur sannolikt det är att det är slumpen, beräknat på två oberoende sätt och visat sida vid sida. Intäkt mäts per variant snarare än härleds från konverteringsgrad, så en variant som konverterar oftare och säljer billigare läses inte som en vinst. Och plattformen anger sin egen osäkerhet i stället för att dölja den, och det är den delen som håller vid granskning: ett resultat som ännu inte är avgörande säger det, i ord, i stället för att presenteras som avgjort.

Behöver vi en dataanalytiker för att läsa det?

Nej, och designen utgår från att ni inte har någon. Varje siffra bär sin förklaring på plats, skriven för att säga vad talet berättar snarare än för att definiera begreppet, och flera finns just för att förebygga en felläsning: differenskolumnen säger rakt ut att den i sig inte säger något om huruvida glappet är verkligt. Vid sidan av siffrorna står en rekommendation i vanliga ord. Vad den inte gör är att förenkla genom att dölja, så den som vill se p-värdet och intervallet hittar båda.

Hur vet vi att en vinnare är verklig och inte tur?

Tre försvar, och de är värda att jämföra med vad ni använder i dag. Att testa flera varianter samtidigt ökar chansen att en ser ut som en vinnare av ren tur, så ribban skärps för att kompensera, och konsolen anger den gräns den tillämpar i stället för att låta er räkna ut den. Att titta på ett resultat varje dag blåser upp andelen falska positiva, så det test som är giltigt att läsa löpande är skilt från det som inte är det, och plattformen stoppar inte ett experiment i förtid om inte båda är överens. Och före allt det kontrollerar den att trafiken faktiskt delades som ni konfigurerade, för om den inte gjorde det håller inget som räknats fram ur den.

Vår trafik är inte enorm. Fungerar det här för oss?

Ibland ja och ibland faktiskt nej, och det är här plattformen är mest användbar innan ni har lagt tre månader på att ta reda på det. Varje experiment rapporterar den minsta skillnad som er trafik tillförlitligt kan upptäcka. Om effekten ni jagar ligger under det golvet löser ingen mängd tålamod upp den, och konsolen säger det i stället för att låta ett test ligga på "inte signifikant" i oändlighet. Att veta vilka av era sidor som kan besvara en fråga och vilka som inte kan är värt mer på en liten webbplats än på en stor.

Måste vi välja frekventistiskt eller bayesianskt i förväg?

Nej. Båda beräknas för varje experiment och visas tillsammans, så det här är en läspreferens snarare än ett konfigurationsbeslut ni kan göra fel. Den frekventistiska halvan rapporterar hur osannolikt resultatet vore om ändringen inte gjorde något. Den bayesianska halvan rapporterar sannolikheten att varje variant är bäst, och vad det skulle kosta er att välja fel. Team tycker oftast att den andra är lättare att agera på och den första lättare att försvara, och det är precis därför ingen av dem togs bort.

Allt som ingår

Hela funktionsuppsättningen

Pertento är en plattform för konverteringsoptimering för webbplatser och e-handel, byggd både för interna team och för CRO-byråer som driver experimentprogram över en kundlista.

Integrationer

Fungerar med den stack ni redan kör

En kodsnutt läggs in på vilken webbplats som helst, eller kör helt på serversidan. Inget att bygga om.

En kodrad

Klistra in en enda tagg på 0,9 KB i er head och ni är live. Inget byggsteg, inga beroenden.

Google Tag Manager

Driftsätt och sköt experiment direkt via GTM. Ingen utvecklartid krävs.

API för serversidan

Kör tester utanför webbläsaren: priser, sök och routning, utan flimmer.

  • Shopify
  • BigCommerce
  • Shopware
  • Centra
  • Geins
  • Saleor
  • WordPress
  • Optimizely CMS
  • Storyblok
  • Next.js
  • Vue
  • Astro
  • Matomo
  • Amplitude
  • RudderStack
  • Slack
  • WooCommerce
  • Salesforce
  • Wix
  • Litium
  • commercetools
  • Medusa
  • Drupal
  • Contentful
  • Webflow
  • Nuxt
  • Angular
  • Remix
  • Piwik PRO
  • Mixpanel
  • Tag Manager
  • Webhooks
  • Adobe Commerce
  • PrestaShop
  • Squarespace
  • Norce
  • Shopify Hydrogen
  • Vendure
  • Umbraco
  • Sanity
  • Framer
  • React
  • SvelteKit
  • GA4
  • Adobe Analytics
  • Segment
  • Klaviyo

Inte med på listan? Om det renderar HTML kan Pertento testa det:läs hur var och en ansluter.

Bättre experiment, bättre konvertering

Test on all visitors with the world’s lightest script and make confident decisions powered by real-time reporting.