Standardowy test
Test z dla dwóch proporcji z połączonym oszacowaniem, czyli to, co pod spodem raportuje większość platform do testów A/B.
Narzędzia / Kalkulator istotności statystycznej
Wpisz odwiedzających i konwersje dla obu wariantów. Otrzymasz wartość p, względny przyrost i prostą odpowiedź, czy różnica jest istotna.
z = (p̂B − p̂A) ÷ √( p̄(1 − p̄)(1/nA + 1/nB) )
Wpisz wartości, by zobaczyć wynik
Odwiedzający, którzy zobaczyli wersję kontrolną, i ilu z nich dokonało konwersji.
Te same dwie liczby dla pretendenta. Konwersje nie mogą przekraczać liczby odwiedzających.
Dostajesz oba współczynniki konwersji, względny przyrost, statystykę z, wartość p oraz to, czy przekracza 0,05.
To, że wariant B prowadzi, nie znaczy jeszcze, że wariant B jest lepszy. To narzędzie oddziela realną różnicę od zwykłego szumu.
Test z dla dwóch proporcji z połączonym oszacowaniem, czyli to, co pod spodem raportuje większość platform do testów A/B.
Istotny przyrost 0,2% i nieistotny przyrost 40% wymagają zupełnie innych decyzji. Pokazujemy obie liczby.
Werdykt korzysta z konwencjonalnej granicy 0,05 i wprost to mówi, zamiast chować wartość p za odznaką.
Porównaj wskaźniki rejestracji albo zakupów między dwiema wersjami strony.
Sprawdź, czy różnica w otwarciach albo kliknięciach to coś więcej niż szum.
Porównaj odsetek odpowiedzi tak przy dwóch sformułowaniach tego samego pytania.
z = (p̂_B − p̂_A) ÷ √( p̄(1 − p̄) × (1/n_A + 1/n_B) ) gdzie p̄ = (x_A + x_B) ÷ (n_A + n_B)
p̄ to połączony współczynnik konwersji obu wariantów, używany dlatego, że hipoteza zerowa mówi o równości obu wskaźników. Wartość p to dwustronne prawdopodobieństwo normalne dla tego z.
Użyj testu z dla dwóch proporcji. Połącz współczynniki konwersji obu wariantów, policz błąd standardowy różnicy, podziel przez niego zaobserwowaną różnicę i zamień to z na dwustronną wartość p.
Jeśli p jest poniżej 0,05, różnicę zwyczajowo nazywa się istotną statystycznie.
Że tak duża różnica byłaby mało prawdopodobna, gdyby oba warianty działały naprawdę tak samo. Nie znaczy to, że różnica jest duża ani że ma znaczenie biznesowe.
Zanim zdecydujesz o wdrożeniu, zawsze przeczytaj przyrost obok wartości p.
To zależy od bazowego wskaźnika i od najmniejszego przyrostu, który warto wykryć. Wykrycie małego względnego przyrostu przy niskiej bazie może wymagać dziesiątek tysięcy odwiedzających na wariant.
Kalkulator wielkości próby podaje punkt wyjścia dla docelowego marginesu błędu.
Nie. Ciągłe zaglądanie i zatrzymywanie się przy pierwszym zielonym wyniku podnosi odsetek fałszywie dodatnich znacznie powyżej 5%.
Ustal wielkość próby z góry, dobij do niej, a potem odczytaj wynik raz.
Werdykt korzysta ze standardowego poziomu 95%, czyli p < 0,05. Dokładna wartość p jest zawsze widoczna, więc możesz zastosować ostrzejszy próg, jeśli Twój kontekst tego wymaga.
Nie masz dość dowodów, że warianty się różnią. To nie jest dowód, że są takie same. Albo prowadź test dalej do większej próby, albo przyjmij, że ewentualna realna różnica jest zbyt mała, by ją gonić.
Nie bezpośrednio. Porównywanie kilku wariantów naraz zwiększa szansę fałszywie dodatniego wyniku, więc potrzebna jest poprawka albo test ogólny. Kalkulator chi kwadrat obsługuje tabelę konwersji z wieloma wariantami.
Nie. Wszystko dzieje się w Twojej przeglądarce.
Zbierasz świeże odpowiedzi z ankiety? Wypróbuj Formms dla formularza z krótkim linkiem i QR.
Formms buduje ankietę z promptu, a potem możesz wkleić liczby z powrotem do tych kalkulatorów w każdej chwili.
Zobacz formularz demo →