Una baseline bassa costa traffico
Più la conversione è rara, più visitatori servono per distinguere un cambiamento reale dal rumore. In linea di massima, dimezzare il tasso di conversione di base raddoppia il traffico necessario a ogni variante.
Strumento gratuito
Prima di lanciare un esperimento, scopri quanti visitatori servono a ogni variante perché il risultato sia davvero affidabile. Inserisci i tuoi numeri e il calcolatore si aggiorna all'istante, tutto nel tuo browser.
Cosa determina il numero
Più la conversione è rara, più visitatori servono per distinguere un cambiamento reale dal rumore. In linea di massima, dimezzare il tasso di conversione di base raddoppia il traffico necessario a ogni variante.
L'effetto minimo rilevabile entra nella formula al quadrato, quindi domina tutto il resto. Voler rilevare un aumento del 5% invece del 10% costa circa quattro volte il traffico: decidi quale dimensione di miglioramento cambierebbe davvero la tua decisione, e testa per quella.
Converti il numero qui sopra in settimane intere di traffico, poi esegui il test per tutto quel tempo. Fermarsi appena un risultato diventa significativo è il modo più comune in cui i team rilasciano modifiche che poi non reggono.
La formula
Il calcolatore usa la formula standard della dimensione del campione per confrontare due tassi di conversione. Per ogni variante:
n = (zα/2 + zβ)² × [p₁(1 − p₁) + p₂(1 − p₂)] ÷ (p₂ − p₁)²
p₂ = p₁ × (1 + MDE).Una baseline del 5%, un aumento relativo del 10%, confidenza al 95% e potenza all'80%:
Due varianti richiedono 62.464 visitatori in totale. È la cifra che il calcolatore mostra prima che tu cambi qualsiasi valore.
In sintesi
Visitatori necessari per variante con confidenza al 95% e potenza all'80%. Leggi in orizzontale per l'aumento relativo che vuoi rilevare.
| Tasso di base | Aumento del 5% | Aumento del 10% | Aumento del 20% | Aumento del 30% |
|---|---|---|---|---|
| 1% | 637.014 | 163.094 | 42.691 | 19.824 |
| 2% | 315.207 | 80.680 | 21.106 | 9.795 |
| 5% | 122.123 | 31.232 | 8.156 | 3.778 |
| 10% | 57.761 | 14.749 | 3.839 | 1.772 |
| 20% | 25.580 | 6.507 | 1.680 | 769 |
Spiccano due schemi. Dimezzare l'aumento che vuoi rilevare quadruplica circa il campione. E un passaggio con una conversione bassa, come un tasso di acquisto dell'1%, richiede un traffico diverse volte superiore rispetto a un passaggio al 10%, come un clic verso la pagina dei prezzi.
Durata del test
Trasforma la dimensione del campione in una durata prima del lancio:
days = visitors per variant × number of variants ÷ daily visitors who enter the test
Poi arrotonda per eccesso a settimane intere. I visitatori dei giorni feriali e del fine settimana si comportano in modo diverso, quindi un test che termina a metà settimana dà troppo peso ad alcuni giorni.
Conta solo i visitatori che raggiungono davvero la pagina o il passaggio testato, non il traffico totale del sito. Un test sul checkout include solo le persone che arrivano al checkout.
Anche con molto traffico, esegui il test per almeno una settimana intera. Decidi la data di fine in anticipo e non fermarti prima perché il risultato sembra significativo al terzo giorno. Controllare ripetutamente e fermarsi alla prima lettura significativa fa salire il tasso di falsi positivi ben oltre il livello di confidenza che hai scelto.
Confidenza e potenza
La confidenza protegge dai falsi positivi: dichiarare un vincitore quando non c'è una vera differenza. Al 95%, un test tra due varianti identiche mostra un risultato “significativo” circa il 5% delle volte.
La potenza protegge dai falsi negativi: non accorgersi di un effetto reale. Con una potenza dell'80%, se l'aumento reale è esattamente il tuo effetto minimo rilevabile, il test lo rileva 8 volte su 10.
Aumentare l'una o l'altra costa traffico. Con una baseline del 5% e un aumento del 10%:
| Confidenza | Potenza | Per variante | vs. predefinito |
|---|---|---|---|
| 90% | 80% | 24.601 | −21% |
| 95% | 80% | 31.232 | predefinito |
| 95% | 90% | 41.812 | +34% |
| 99% | 80% | 46.470 | +49% |
Il livello di confidenza qui è bilaterale: il test può trovare la variante migliore o peggiore del controllo. Un test unilaterale al 95% usa z = 1,645, lo stesso valore del bilaterale al 90%, quindi richiede gli stessi 24.601 visitatori per variante. Questo risparmio è onesto solo se tratteresti allo stesso modo “peggiore” e “nessuna differenza”. Se una variante perdente cambierebbe ciò che fai, mantieni il test bilaterale.
Errori comuni
Poco traffico
Quando il test ha completato tutta la sua durata, verifica il risultato con il calcolatore di significatività per test A/B.
FAQ
Questo strumento usa la formula standard per due proporzioni basata sul tuo tasso di conversione di base, sull'effetto minimo rilevabile, sul livello di confidenza scelto e sulla potenza statistica per stimare i visitatori necessari per variante.
L'effetto minimo rilevabile è la più piccola variazione relativa del tasso di conversione che vuoi che il test sia in grado di rilevare in modo affidabile. Effetti più piccoli richiedono campioni più grandi.
Tassi di base più bassi, effetti più piccoli, confidenza più alta e potenza più alta aumentano tutti la dimensione del campione necessaria per evitare falsi positivi e falsi negativi.
Per variante, n = (z per la confidenza + z per la potenza)² × [p₁(1 − p₁) + p₂(1 − p₂)] ÷ (p₂ − p₁)², dove p₁ è il tasso di base e p₂ è la baseline aumentata dell'effetto minimo rilevabile. Con confidenza al 95% e potenza all'80% i valori di z sono 1,96 e 0,842; una baseline del 5% e un aumento del 10% danno 31.232 visitatori per variante.
La potenza è la probabilità che il test rilevi un effetto quando esiste davvero, della dimensione che hai specificato. Una potenza dell'80% è il valore predefinito abituale: se l'aumento reale è pari al tuo effetto minimo rilevabile, il test lo trova 8 volte su 10 e lo manca 2 volte. Portare la potenza al 90% riduce gli errori ma richiede circa il 34% di visitatori in più.
Dividi il campione totale (visitatori per variante moltiplicati per il numero di varianti) per i visitatori giornalieri che entrano nel test, poi arrotonda per eccesso a settimane intere. Esegui il test per almeno una settimana intera così ogni giorno della settimana è rappresentato, e fissa la data di fine prima di iniziare invece di fermarti quando il risultato sembra significativo per la prima volta.
Relativo. Un effetto del 10% su una baseline del 5% significa rilevare uno spostamento dal 5% al 5,5%. Per rilevare dal 5% al 6%, inserisci 20.
Sì. Il risultato è per variante, quindi moltiplicalo per il numero di varianti, controllo incluso. Confrontare più varianti con il controllo aumenta la probabilità di un falso vincitore, quindi valuta un livello di confidenza più rigoroso per ogni confronto.
Correlati
PulsePanda abbina i tuoi esperimenti a registrazione delle sessioni, heatmap, funnel e feedback, così capisci il perché dietro la vittoria.
Inizia gratis