O p-valor NÃO é a probabilidade de B ser melhor: é a probabilidade de ver uma diferença assim se ela não existisse. E só é válido se decidiste o tamanho antes e não paraste ao ver um bom resultado (separador «Olhar antes de tempo»).
Escreve os visitantes e as conversões de cada variante (A é o controlo). Primeiro verifica-se a distribuição do tráfego (SRM): se não coincidir com a pedida, o resultado não é fiável e é preciso procurar a causa. Depois vês a diferença com o seu intervalo de confiança, que diz quanto, não só se. Com poucos dados ou uma taxa a 0 % ou 100 % usa-se o teste exato de Fisher, porque a aproximação normal declara vencedores que não o são.
O p-valor é a probabilidade de ver uma diferença assim ou maior se na realidade não existisse. Não é a probabilidade de B ser melhor: isso dá-o a parte bayesiana, P(B > A). Com mais de duas variantes corrige-se por comparações múltiplas (Holm ou Benjamini-Hochberg): comparar várias variantes ao mesmo tempo dá mais ocasiões de acertar por acaso.
O p-valor NÃO é a probabilidade de B ser melhor: é a probabilidade de ver uma diferença assim se ela não existisse. E só é válido se decidiste o tamanho antes e não paraste ao ver um bom resultado (separador «Olhar antes de tempo»).