ConvertiloConvertilo

Calcolatore per test A/B

Calcola la significatività statistica di un test A/B (valore p, punteggio z) oppure la dimensione del campione necessaria. Test z bilaterale per due proporzioni. Nessuna registrazione richiesta.

Variante A (controllo)

Variante B (test)

Verdetto

Non significativo: raccogli più dati

Confidenza: 84,71% · valore p: 0,1529

Tasso di conversione A

10%

Tasso di conversione B

12%

Incremento

+20%

Punteggio z

1,429

Formula del test z a due proporzioni

z = (p₂ − p₁) / √(p̄ · (1 − p̄) · (1/n₁ + 1/n₂))

p̄ è il tasso di conversione aggregato di entrambi i gruppi. Il valore p bilaterale viene calcolato tramite la distribuzione normale standard.

Come usare il calcolatore

Un solo strumento copre entrambe le attività di un analista di prodotto: pianificare un test prima dell'avvio e valutarne la significatività al termine.

Scegli una modalità

Utilizza l'interruttore in alto per alternare tra Significatività (analizzando i dati raccolti) e Dimensione del campione (pianificando un test futuro).

Inserisci i dati

Per la significatività: visitatori e conversioni per ciascuna variante. Per la dimensione del campione: tasso di conversione di base, MDE, livello di significatività e potenza statistica.

Leggi il risultato

Ottieni un verdetto con valore p e punteggio z, ovvero il numero esatto di utenti che devi assegnare a ciascuna variante del test.

Perché usare questo calcolatore

Due strumenti in uno

Pianificare la dimensione del campione prima del test. Controllare successivamente la significatività statistica. Non è necessario passare da un servizio all'altro.

Formule trasparenti

Usiamo il classico test z per due proporzioni e la formula standard della dimensione del campione. Nessuna formula opaca: i calcoli sono mostrati nella pagina.

Funziona per qualsiasi metrica binaria

Tasso di conversione, CTR, fidelizzazione, clic sui pulsanti: tutto ciò che viene misurato come «accaduto/non accaduto» per utente unico.

FAQ sui test A/B

Quale valore p è considerato significativo?

Tradizionalmente p < 0.05, che corrisponde al 95% di confidenza che la differenza tra le varianti non sia casuale. Nei settori sensibili (medicina, finanza) le persone utilizzano una soglia più rigorosa di 0.01.

Cos'è MDE?

L'effetto minimo rilevabile è il più piccolo miglioramento che il test può rilevare con la potenza scelta. Se il valore di base è 10% e MDE = 10%, il test rileverà qualsiasi aumento fino all'11% o superiore. Un MDE più piccolo richiede un campione molto più grande.

Cos'è la potenza statistica?

È la probabilità di rilevare correttamente un effetto quando esiste davvero. Il valore predefinito nel settore è 80%: con questa potenza, un test non rileverà un miglioramento reale nel 20% dei casi. Per decisioni ad alto rischio usa il 90%.

Posso interrompere anticipatamente il test se è già significativo?

No. Controllare ripetutamente i risultati intermedi aumenta notevolmente il tasso di falsi positivi: il valore p reale sarà molto più alto di quello mostrato. Esegui il test fino alla dimensione N pianificata e valuta il risultato solo al termine. Se devi interromperlo in anticipo, usa test sequenziali o metodi bayesiani.