Cât timp să rulezi testele A/B pentru anunțuri: Matematica dimensiunii eșantionului, în practică
Durata testului A/B este aritmetică, nu folclor: eșantionul necesar împărțit la volumul zilnic. Iată matematica dimensiunii eșantionului făcută utilizabilă, plus plafoanele, limitele și regulile de eliminare care mențin testele accesibile.

Rulează un test A/B pentru anunțuri până când fiecare variantă a colectat suficiente conversii pentru a face vizibilă diferența care contează pentru tine — nu pentru un număr fix de zile. Ca regulă practică, asta înseamnă cel puțin o săptămână întreagă pentru a acoperi ciclurile zi-din-săptămână și undeva între 50 și câteva mii de conversii pe variantă, în funcție de cât de mică diferență vrei să detectezi. Durata este un rezultat al aritmeticii, nu o preferință de calendar: zilele necesare = eșantionul necesar per variantă ÷ volumul tău zilnic per variantă. Acest articol îți oferă acea aritmetică, plafoanele și limitele care o pot înlocui și secvența de testare mai ieftină de folosit atunci când matematica spune că nu-ți poți permite semnificația.
Durata este un rezultat, nu o alegere de calendar#
Majoritatea sfaturilor îți oferă un răspuns fix — șapte zile, paisprezece zile, o lună. Zilele sunt unitatea greșită. O campanie care generează 40 de conversii pe zi rezolvă un test de pagină de destinație în aproximativ o săptămână; același test pe o campanie care generează 4 pe zi durează peste două luni, moment în care rezultatul este contaminat de tot ce s-a schimbat între timp. Trei intrări decid durata reală:
- Rata de bază a metricii pe care o testezi — CTR pentru creații, rata de conversie pentru paginile de destinație și oferte.
- Cea mai mică diferență care merită detectată. Detectarea unei creșteri de 10% costă mult mai mult trafic decât detectarea unei creșteri de 50%, iar majoritatea creșterilor mici nu merită cheltuiala necesară pentru a le vedea.
- Volumul zilnic per variantă — stabilit de bugetul și licitațiile tale.
Fixând primele două, eșantionul necesar rezultă dintr-o formulă. Împarte la a treia și ai durata. Dacă răspunsul iese mai lung de aproximativ patru săptămâni, mișcarea corectă este de obicei să schimbi testul, nu să-l duci la capăt — mai multe despre asta mai jos.
Matematica dimensiunii eșantionului, fără diplomă în statistică#
Scurtătura standard pentru un test cu două variante la 95% încredere și 80% putere:
n per variantă ≈ 16 × p × (1 − p) ÷ d²
unde p este rata ta de bază ca zecimală și d este diferența absolută pe care vrei să o detectezi. Două exemple practice:
- Test creativ la nivel de CTR. Bază CTR 0,5%, detectarea unei creșteri relative de 20% (0,1 puncte absolute): n ≈ 16 × 0,005 × 0,995 ÷ 0,001² ≈ 80.000 de impresii per variantă. Plasamentele native livrează impresii rapid și ieftin, așa că acest test se poate rezolva în câteva zile.
- Test de pagină de destinație la nivel de conversie. Bază rata de conversie 2%, detectarea unei creșteri relative de 25% (0,5 puncte absolute): n ≈ 16 × 0,02 × 0,98 ÷ 0,005² ≈ 12.500 de clickuri per variantă. La un CPC de 0,40$, acesta este un test de cinci cifre pentru o singură pereche de pagini.
| Ce testezi | Bază | Creștere de detectat | Eșantion per variantă |
|---|---|---|---|
| CTR (creativ) | 0,5% | 20% relativă | ~80.000 de impresii |
| CTR (creativ) | 0,5% | 50% relativă | ~13.000 de impresii |
| CVR (pagină de destinație) | 2% | 25% relativă | ~12.500 de clickuri |
| CVR (pagină de destinație) | 2% | 50% relativă | ~3.100 de clickuri |
| CVR (pagină de ofertă) | 5% | 25% relativă | ~4.900 de clickuri |
Două lecții reies din acest tabel. În primul rând, creșterile mici sunt brutal de scumpe: înjumătățirea diferenței detectabile quadruplează eșantionul. În al doilea rând, testarea la nivel de impresie costă o fracțiune din testarea la nivel de click. Această asimetrie ar trebui să modeleze întregul tău program de testare: testează unghiurile creative la nivel de CTR, testează pâlniile la nivel de conversie și nu testa deloc modificări de dimensiunea culorii butoanelor — eșantionul necesar pentru a le detecta rareori se amortizează.
Limita minimă: o săptămână întreagă, indiferent ce spune matematica#
Chiar și atunci când volumul livrează eșantionul în două zile, rulează cel puțin șapte. Audiențele din timpul săptămânii și din weekend se comportă diferit — oameni diferiți, dispozitive diferite, intenții diferite. Mixul de editori pe rețelele native se rotește de-a lungul săptămânii pe măsură ce ciclurile de știri și programările de conținut se schimbă, așa că traficul de marți nu este traficul de sâmbătă. Întârzierea conversiilor adaugă o a doua părtinire: clickurile de joi ale unei variante se pot converti sâmbătă, așa că o tăiere timpurie favorizează sistematic varianta care s-a întâmplat să primească primele impresii. Un test care se încheie la mijlocul săptămânii a eșantionat o felie deformată a traficului tău real, iar „câștigătorul” poate fi pur și simplu specialistul de peste săptămână.
Limita maximă: testele lungi putrezesc din interior#
După trei până la patru săptămâni, un test A/B încetează să mai fie un experiment controlat. Oboseala creativă degradează ambele variante — rareori cu aceeași viteză, ceea ce inversează discret clasamentele la mijlocul testului. Concurenții intră și ies din licitație și schimbă calitatea traficului tău. Sezonalitatea se deplasează pe sub întreaga comparație. Dacă formula spune că ai nevoie de șase săptămâni de trafic, citește asta ca pe un verdict: diferența pe care o vânezi este prea mică pentru a fi detectată la volumul tău. Testează o schimbare mai mare — un cârlig sau unghi diferit, o structură de pâlnie diferită — unde diferența detectabilă este mare și eșantionul este accesibil.
Nu te uita — sau cel puțin nu acționa pe baza privirilor#
Modul clasic de eșec: verifică dashboardul zilnic și declară victorie în prima zi în care numerele par semnificative. Privirile repetate asupra datelor în acumulare inflamează fals pozitivele dramatic — cu priviri zilnice, o regulă de oprire „a atins semnificația la un moment dat” se declanșează mult mai des decât rata de eroare anunțată de 5%. Regresia la medie explică apoi majoritatea plângerilor de tip „câștigătorul meu a încetat să mai câștige”: varianta care a sărit înainte în ziua a doua mergea pe zgomot și se întoarce înapoi. Disciplina este simplă: angajează-te în avans la dimensiunea eșantionului, monitorizează zilnic doar pentru condiții de stop-loss — urmărire stricată, cheltuieli scăpate de sub control, o variantă care performează catastrofal — și evaluează câștigătorul o singură dată, la sfârșit.
Reguli de eliminare pentru când nu-ți poți permite semnificația#
Majoritatea cumpărătorilor nativi și afiliați nu pot finanța 12.500 de clickuri per variantă, iar a pretinde altceva produce o rigoare falsă. Alternativa onestă este eliminarea în etape — mai brută decât testarea semnificației, dar practică standard printre cumpărătorii care testează zeci de creații pe lună:
- Eliminare pe CTR (zilele 1–3). Dă fiecărei creații câteva mii de impresii, apoi elimină tot ce este clar sub grup. Nu demonstrezi nimic — triezi pentru ca bugetul să se concentreze pe câștigătorii plauzibili.
- Barieră de cheltuieli (continuu). O regulă practică comună: oprește orice variantă care a cheltuit de 2–3× CPA țintă fără conversii. Asta nu este statistică; este supraviețuire.
- Semnificație pe finaliști. Odată ce doi sau trei supraviețuitori poartă majoritatea cheltuielii, rulează un test propriu la nivel de conversie între ei folosind matematica de mai sus. Finanțezi un test real în loc de zece false.
Scurtează eșantionul: începe de la anunțuri care au supraviețuit deja#
Fiecare variantă pe care nu trebuie să o testezi înseamnă bani economisiți, iar cea mai ieftină informație despre ce funcționează este ceea ce concurenții continuă să plătească pentru a rula. Un anunț care a rulat 30+ de zile a trecut de verificarea de profitabilitate a proprietarului său în fiecare zi a acelei perioade. Indexul OpenAdLibrary de peste 725.000 de creații native live pe 49 de rețele (iunie 2026) înregistrează datele de primă și ultimă apariție pentru fiecare creativ, ceea ce transformă longevitatea anunțului într-un semnal filtrabil, nu într-o presupunere — cele mai longevive anunțuri native din verticala ta sunt o grilă de start pre-testată. Construiește-ți testul în jurul a două sau trei unghiuri deja dovedite în teren și testezi variații pe un câștigător, în loc de ghicitori reci; poți răsfoi creațiile live ale concurenților gratuit cu instrumentul de cercetare a anunțurilor native. Mai puține variante, mai bune înseamnă eșantioane mai mici, teste mai scurte și mai puțin buget ars pe descoperire.
Un exemplu practic, de la cap la coadă#
Să spunem că rulezi o ofertă de generare de lead-uri cu plată de 60$, cu o campanie care face aproximativ 1.500 de clickuri pe zi pe celulele tale de test.
- Etapa creativă: patru creații concurează la nivel de CTR. Câteva mii de impresii fiecare se rezolvă în 2–3 zile; elimină până la primele două.
- Etapa paginii de destinație: două pagini de destinație la nivel de conversie. Bază CVR în jur de 3%, detectarea unei creșteri relative de 30% (0,9 puncte absolute): n ≈ 16 × 0,03 × 0,97 ÷ 0,009² ≈ 5.700 de clickuri per variantă, aproximativ 11.400 total. La 1.500 de clickuri pe zi, asta înseamnă opt zile — să zicem o săptămână întreagă plus acoperirea weekendului.
- Verdict: un ciclu de testare rulează 10–12 zile de la lansare până la un câștigător defensabil, cu cheltuielile pierzătoare limitate de regula barierei, nu lăsate să ruleze pe speranță.
Aceasta este forma realistă a „cât timp”: câteva zile de triaj ieftin, o săptămână-plus de măsurare focusată și o durată calendaristică dictată de volumul tău de clickuri — nu de numărul magic de zile al cuiva.







