OpenAdLibraryOpenAdLibrary
Creatività Pubblicitaria & Funnel

Quanto Tempo Eseguire Test A/B per Annunci: Matematica della Dimensione del Campione Applicata

La durata di un test A/B è aritmetica, non folklore: campione richiesto diviso per volume giornaliero. Ecco la matematica della dimensione del campione resa utilizzabile, più i limiti inferiori, superiori e le regole di interruzione che mantengono i test accessibili.

Illustrazione editoriale: Quanto Tempo Eseguire Test A/B per Annunci: Matematica della Dimensione del Campione Applicata

Esegui un test A/B per annunci finché ogni variante non ha raccolto abbastanza conversioni per rendere visibile la differenza che ti interessa — non per un numero fisso di giorni. Come regola pratica, ciò significa almeno una settimana completa per coprire i cicli dei giorni della settimana, e tra 50 e qualche migliaio di conversioni per variante a seconda di quanto piccola sia la differenza che vuoi rilevare. La durata è un risultato dell'aritmetica, non una preferenza di calendario: giorni necessari = campione richiesto per variante ÷ volume giornaliero per variante. Questo articolo ti fornisce quell'aritmetica, i limiti inferiori e superiori che la sovrascrivono, e la sequenza di test più economica da usare quando la matematica indica che non puoi permetterti la significatività.

La durata è un risultato, non una scelta di calendario#

La maggior parte dei consigli ti fornisce una risposta fissa — sette giorni, quattordici giorni, un mese. I giorni sono l'unità sbagliata. Una campagna che genera 40 conversioni al giorno risolve un test di landing page in circa una settimana; lo stesso test su una campagna che genera 4 al giorno richiede più di due mesi, a quel punto il risultato è contaminato da tutto ciò che è cambiato nel frattempo. Tre input determinano la tua reale durata:

  • Il tasso di base della metrica che stai testando — CTR per le creatività, conversion rate per le landing page e le offerte.
  • La più piccola differenza degna di essere rilevata. Rilevare un incremento del 10% costa molto più traffico rispetto a rilevare un incremento del 50%, e la maggior parte dei piccoli incrementi non vale la spesa necessaria per vederli.
  • Volume giornaliero per variante — determinato dal tuo budget e dalle tue offerte.

Fissa i primi due e il campione richiesto scaturisce da una formula. Dividi per il terzo e ottieni la tua durata. Se la risposta risulta più lunga di circa quattro settimane, la mossa corretta è solitamente cambiare il test, non prolungarlo — più dettagli di seguito.

La matematica della dimensione del campione, senza il grado di statistica#

Il metodo rapido standard per un test a due varianti al 95% di confidenza e 80% di potenza:

n per variante ≈ 16 × p × (1 − p) ÷ d²

dove p è il tuo tasso di base espresso in decimale e d è la differenza assoluta che vuoi rilevare. Due esempi pratici:

  • Test creativo a livello di CTR. CTR di base 0,5%, rilevando un incremento relativo del 20% (0,1 punti assoluti): n ≈ 16 × 0,005 × 0,995 ÷ 0,001² ≈ 80.000 impression per variante. Le collocazioni native forniscono impression rapidamente ed economicamente, quindi questo può risolversi in giorni.
  • Test di landing page a livello di conversione. Tasso di conversione di base 2%, rilevando un incremento relativo del 25% (0,5 punti assoluti): n ≈ 16 × 0,02 × 0,98 ÷ 0,005² ≈ 12.500 click per variante. A $0.40 CPC ciò rappresenta un test a cinque cifre per una singola coppia di pagine.
Cosa stai testando Baseline Incremento da rilevare Campione per variante
CTR (creativo) 0.5% 20% relativo ~80.000 impression
CTR (creativo) 0.5% 50% relativo ~13.000 impression
CVR (landing) 2% 25% relativo ~12.500 click
CVR (landing) 2% 50% relativo ~3.100 click
CVR (pagina offerta) 5% 25% relativo ~4.900 click

Due insegnamenti emergono da quella tabella. Primo, i piccoli incrementi sono brutalmente costosi: dimezzare la differenza rilevabile quadruplica il campione. Secondo, testare a livello di impression costa una piccola frazione rispetto al test a livello di click. Questa asimmetria dovrebbe modellare l'intero programma di testing: testa gli angoli creativi a livello di CTR, testa i funnel a livello di conversione, e non testare affatto cambiamenti di colore di pulsante — il campione necessario per rilevarli raramente si ripaga da solo.

Il limite inferiore: una settimana completa, qualunque dica la matematica#

Anche quando il volume ti consegna il campione in due giorni, esegui almeno sette giorni. Il pubblico nei giorni feriali e nel weekend si comporta diversamente — persone diverse, dispositivi diversi, intenti diversi. Il mix dei publisher sulle reti native ruota durante la settimana man mano che i cicli di notizie e i programmi di contenuti cambiano, così il traffico del martedì non è lo stesso del sabato. Il ritardo di conversione aggiunge un secondo bias: i click di una variante di giovedì possono convertire il sabato, così un taglio precoce favorisce sistematicamente la variante che ha ricevuto le impression per prima. Un test che termina a metà settimana ha campionato una fetta distorta del tuo traffico reale, e il "vincitore" potrebbe semplicemente essere lo specialista dei giorni feriali.

Il limite superiore: i test lunghi marciscono dall'interno#

Oltre tre‑quattro settimane, un test A/B smette di essere un esperimento controllato. Creative fatigue indebolisce entrambe le varianti — raramente alla stessa velocità, il che capovolge silenziosamente le classifiche a metà test. I concorrenti entrano e escono dall'asta e modificano la qualità del tuo traffico. La stagionalità si insinua sotto l'intera comparazione. Se la formula indica che ti servono sei settimane di traffico, leggilo come un verdetto: la differenza che stai cercando è troppo piccola per essere rilevata al tuo volume. Testa invece un cambiamento più ampio — un diverso hook or angle, una diversa struttura del funnel — dove la differenza rilevabile è grande e il campione è accessibile.

Non sbirciare — o almeno non agire sugli sbirci#

Il classico fallimento: controllare il dashboard quotidianamente e dichiarare vittoria il primo giorno in cui i numeri sembrano significativi. Guardare ripetutamente i dati in accumulo gonfia i falsi positivi drasticamente — con lo sbirciare giornaliero, una regola di "si è raggiunta la significatività a un certo punto" si attiva molto più spesso del tasso di errore del 5% pubblicizzato. La regressione verso la media poi spiega la maggior parte dei reclami "il mio vincitore ha smesso di vincere": la variante che è balzata in vantaggio al giorno due stava cavalcando rumore, e ritorna indietro. La disciplina è semplice: pre-impegna la tua dimensione del campione, monitora quotidianamente solo per condizioni di stop‑loss — tracciamento interrotto, spesa incontrollata, una variante che performa catastroficamente — e valuta il vincitore una sola volta, alla fine.

Regole di interruzione per quando non puoi permetterti la significatività#

La maggior parte degli acquirenti native e affiliate non può finanziare 12.500 click per variante, e fingere il contrario produce rigore fittizio. L'alternativa onesta è l'eliminazione a tappe — più grezza della verifica di significatività, e pratica standard tra gli acquirenti che testano decine di creatività al mese:

  1. Eliminazione CTR (giorni 1–3). Fornisci a ogni creatività qualche migliaio di impression, poi elimina tutto chiaramente sotto la media. Non stai dimostrando nulla — stai triage così il budget si concentra sui potenziali vincitori.
  2. Guardrail di spesa (rolling). Una regola comune dei professionisti: metti in pausa qualsiasi variante che ha speso 2–3× il tuo target CPA senza conversioni. Non è statistica; è sopravvivenza.
  3. Significatività sui finalisti. Una volta che due o tre sopravvissuti assorbono la maggior parte della spesa, esegui un vero test a livello di conversione tra loro usando la matematica sopra. Finanzi un test reale invece di dieci falsi.

Accorcia il campione: parte da annunci già sopravvissuti#

Ogni variante che non devi testare è denaro risparmiato, e l'informazione più economica su cosa funziona è ciò che i concorrenti continuano a pagare per far girare. Un annuncio che è attivo da oltre 30 giorni ha superato il controllo di redditività del proprietario ogni giorno di quel periodo. L'indice di OpenAdLibrary di oltre 725.000 creatività native live su 49 network (giugno 2026) registra le date di prima e ultima comparsa per ogni creatività, trasformando la ad longevity in un segnale filtrabile anziché in un'intuizione — i longest-running native ads nel tuo settore sono una griglia di partenza pre‑testata. Costruisci il tuo test attorno a due o tre angles already proven in the wild e stai testando variazioni su un vincitore invece di ipotesi fredde; puoi sfogliare le creatività concorrenti live gratuitamente con lo native ad research tool. Meno varianti, ma migliori, significano campioni più piccoli, test più brevi e meno budget speso in scoperta.

Un esempio pratico, dall'inizio alla fine#

Supponiamo tu gestisca un'offerta lead‑gen con payout di $60 e una campagna che genera circa 1.500 click al giorno tra le tue celle di test.

  • Fase creativa: quattro creatività competono a livello di CTR. Alcune migliaia di impression ciascuna si risolvono in 2–3 giorni; elimina fino alle due migliori.
  • Fase landing: due landing page a livello di conversione. CVR di base intorno al 3%, rilevando un incremento relativo del 30% (0,9 punti assoluti): n ≈ 16 × 0,03 × 0,97 ÷ 0,009² ≈ 5.700 click per variante, circa 11.400 totali. A 1.500 click al giorno ciò corrisponde a otto giorni — chiamalo una settimana completa più copertura del weekend.
  • Verdetto: un ciclo di test dura 10–12 giorni dal lancio a un vincitore difendibile, con la spesa perdente limitata dalla regola di guardrail anziché lasciata correre nella speranza.

Questo è il profilo realistico di "quanto tempo": pochi giorni di triage economico, una settimana più di misurazione focalizzata, e una lunghezza di calendario dettata dal tuo volume di click — non da un numero magico di giorni.

Domande frequenti

Quante conversioni servono per variante in un test A/B per annunci?
Come regola pratica, 50–100 conversioni per variante rilevano grandi differenze (30%+ relative) con una ragionevole confidenza, mentre piccoli incrementi del 10–15% possono richiedere migliaia. La formula n ≈ 16 × p(1−p) ÷ d² fornisce il numero preciso per il tuo tasso di base e la differenza che vuoi rilevare. Se il tuo volume non può raggiungerlo entro circa quattro settimane, testa invece un cambiamento creativo più ampio.
Sono sufficienti 3 giorni per eseguire un test A/B per annunci?
No. Anche quando una campagna ad alto volume raccoglie un grande campione in tre giorni, hai campionato solo parte del ciclo settimanale — i pubblici nei giorni feriali e nel weekend convertono diversamente, e il ritardo di conversione significa che i click iniziali non hanno ancora completato la conversione. Esegui almeno sette giorni completi. L'eccezione è l'eliminazione precoce basata sul CTR, dove si eliminano i chiari perdenti anziché dichiarare un vincitore statisticamente valido.
Devo testare gli annunci su CTR o tasso di conversione?
Entrambi, in fasi diverse. I test a livello di CTR richiedono solo impression, che sono economiche e rapide, quindi usali per eliminare creatività deboli presto. I test a livello di tasso di conversione misurano ciò per cui vieni effettivamente pagato ma richiedono 10–100× più budget, quindi riservali per i finalisti e per cambiamenti di landing page o funnel. Testare tutto a livello di conversione è il modo in cui i piccoli account consumano budget per una rigore che non possono permettersi.
Cosa succede se interrompo un test A/B non appena raggiunge la significatività?
Inflazioni drasticamente il tuo tasso di falsi positivi. Controllare quotidianamente e fermarsi al primo risultato significativo significa che molti "vincitori" sono rumore che sarebbe retrocesso con più dati — il classico problema del peek. Pre-impegna una dimensione del campione, usa i controlli giornalieri solo per condizioni di stop‑loss come tracciamento interrotto o spesa incontrollata, e valuta una sola volta quando il campione è completo.
Perché la variante vincente del mio annuncio ha smesso di vincere dopo il test?
Di solito regressione verso la media: il vantaggio iniziale della variante conteneva fortuna, e la sua performance a lungo termine si avvicina alla media. L'affaticamento creativo amplifica questo — un vincitore fresco si indebolisce man mano che il pubblico lo vede ripetutamente. Entrambe sono ragioni per ritestare periodicamente i campioni e trattare ogni singolo risultato di test come una stima con intervalli di errore, non come un fatto permanente.
Il Team di OpenAdLibrary
Scritto daIl Team di OpenAdLibrary
Intelligence pubblicitaria e ricerca sulla pubblicità nativa

Sviluppiamo OpenAdLibrary, la piattaforma aperta per la trasparenza pubblicitaria. Ogni giorno i nostri sistemi catturano annunci nativi live su Taboola, Outbrain, MGID, Revcontent, Teads, Yahoo e MSN, identificano il vero inserzionista dietro ciascuno e seguono il clic fino alla sua landing page. Queste guide distillano ciò che osserviamo in quei dati, permettendoti di analizzare il mercato più rapidamente.