Calcolatore per test A/B
Calcola la significatività statistica di un test A/B (valore p, punteggio z) oppure la dimensione del campione necessaria. Test z bilaterale per due proporzioni. Nessuna registrazione richiesta.
Variante A (controllo)
Variante B (test)
Verdetto
Non significativo: raccogli più dati
Confidenza: 84,71% · valore p: 0,1529
Tasso di conversione A
10%
Tasso di conversione B
12%
Incremento
+20%
Punteggio z
1,429
Formula del test z a due proporzioni
z = (p₂ − p₁) / √(p̄ · (1 − p̄) · (1/n₁ + 1/n₂))
p̄ è il tasso di conversione aggregato di entrambi i gruppi. Il valore p bilaterale viene calcolato tramite la distribuzione normale standard.
Come usare il calcolatore
Un solo strumento copre entrambe le attività di un analista di prodotto: pianificare un test prima dell'avvio e valutarne la significatività al termine.
Scegli una modalità
Utilizza l'interruttore in alto per alternare tra Significatività (analizzando i dati raccolti) e Dimensione del campione (pianificando un test futuro).
Inserisci i dati
Per la significatività: visitatori e conversioni per ciascuna variante. Per la dimensione del campione: tasso di conversione di base, MDE, livello di significatività e potenza statistica.
Leggi il risultato
Ottieni un verdetto con valore p e punteggio z, ovvero il numero esatto di utenti che devi assegnare a ciascuna variante del test.
Perché usare questo calcolatore
Due strumenti in uno
Pianificare la dimensione del campione prima del test. Controllare successivamente la significatività statistica. Non è necessario passare da un servizio all'altro.
Formule trasparenti
Usiamo il classico test z per due proporzioni e la formula standard della dimensione del campione. Nessuna formula opaca: i calcoli sono mostrati nella pagina.
Funziona per qualsiasi metrica binaria
Tasso di conversione, CTR, fidelizzazione, clic sui pulsanti: tutto ciò che viene misurato come «accaduto/non accaduto» per utente unico.
FAQ sui test A/B
Quale valore p è considerato significativo?
Tradizionalmente p < 0.05, che corrisponde al 95% di confidenza che la differenza tra le varianti non sia casuale. Nei settori sensibili (medicina, finanza) le persone utilizzano una soglia più rigorosa di 0.01.
Cos'è MDE?
L'effetto minimo rilevabile è il più piccolo miglioramento che il test può rilevare con la potenza scelta. Se il valore di base è 10% e MDE = 10%, il test rileverà qualsiasi aumento fino all'11% o superiore. Un MDE più piccolo richiede un campione molto più grande.
Cos'è la potenza statistica?
È la probabilità di rilevare correttamente un effetto quando esiste davvero. Il valore predefinito nel settore è 80%: con questa potenza, un test non rileverà un miglioramento reale nel 20% dei casi. Per decisioni ad alto rischio usa il 90%.
Posso interrompere anticipatamente il test se è già significativo?
No. Controllare ripetutamente i risultati intermedi aumenta notevolmente il tasso di falsi positivi: il valore p reale sarà molto più alto di quello mostrato. Esegui il test fino alla dimensione N pianificata e valuta il risultato solo al termine. Se devi interromperlo in anticipo, usa test sequenziali o metodi bayesiani.