OpenAdLibraryOpenAdLibrary
Kreativa reklam & konverzní funily

Jak dlouho běží A/B testy reklam: Praktický výpočet velikosti vzorku

Délka A/B testu je aritmetika, ne folklór: požadovaný vzorek dělený denním objemem. Zde je výpočet velikosti vzorku zpřístupněný pro praxi, plus minimální a maximální limity a pravidla pro ukončení, která udrží testy cenově dostupné.

Ilustrační obrázek: Jak dlouho běží A/B testy reklam: Praktický výpočet velikosti vzorku

Spusťte A/B test reklamy tak dlouho, dokud každý variant nenasbírá dostatek konverzí, aby byl rozdíl, na kterém vám záleží, viditelný – ne po pevný počet dnů. Jako pracovní pravidlo to znamená alespoň jeden celý týden, abyste pokryli týdenní cykly, a někde mezi 50 a několika tisíci konverzemi na variantu v závislosti na tom, jak malý rozdíl chcete detekovat. Délka je výstupem aritmetiky, ne kalendářní preference: potřebné dny = požadovaný vzorek na variantu ÷ váš denní objem na variantu. Tento článek vám poskytne tuto aritmetiku, minimální a maximální limity, které ji přebíjejí, a levnější sekvenci testování, kterou použít, když matematika říká, že si významnost nemůžete dovolit.

Délka je výstup, ne kalendářní volba#

Většina rad vám předá pevnou odpověď – sedm dní, čtrnáct dní, měsíc. Dny jsou špatná jednotka. Kampaň generující 40 konverzí denně vyřeší test landing page za asi týden; stejný test na kampani generující 4 konverze denně trvá přes dva měsíce, a do té doby je výsledek kontaminován vším, co se mezitím změnilo. O skutečné délce rozhodují tři vstupy:

  • Výchozí míra metriky, kterou testujete – CTR pro kreativa, konverzní míra pro landing page a nabídky.
  • Nejmenší rozdíl, který stojí za detekci. Detekce 10% nárůstu stojí mnohem více traffic než detekce 50% nárůstu a většina malých nárůstů nestojí za výdaje potřebné k jejich odhalení.
  • Denní objem na variantu – určený vaším rozpočtem a nabídkami.

Stanovte první dvě a požadovaný vzorek vypadne ze vzorce. Vydělte třetím a máte svou délku. Pokud vyjde odpověď delší než asi čtyři týdny, správným krokem obvykle je změnit test, ne ho doždímat – více o tom níže.

Výpočet velikosti vzorku, bez statistiky#

Standardní zkratka pro dvouvariantní test na 95% spolehlivosti a 80% síle:

n na variantu ≈ 16 × p × (1 − p) ÷ d²

kde p je vaše výchozí míra jako desetinné číslo a d je absolutní rozdíl, který chcete detekovat. Dva vypočítané příklady:

  • Test kreativa na úrovni CTR. Výchozí CTR 0,5 %, detekce 20% relativního nárůstu (0,1 bod absolutně): n ≈ 16 × 0,005 × 0,995 ÷ 0,001² ≈ 80 000 impresí na variantu. Nativní placementy servírují imprese rychle a levně, takže to lze vyřešit za dny.
  • Test landing page na úrovni konverzí. Výchozí konverzní míra 2 %, detekce 25% relativního nárůstu (0,5 bodu absolutně): n ≈ 16 × 0,02 × 0,98 ÷ 0,005² ≈ 12 500 kliků na variantu. Při CPC 0,40 $ je to pětimístný test pro jednu dvojici stránek.
Co testujete Výchozí míra Nárůst k detekci Vzorek na variantu
CTR (kreativo) 0,5 % 20 % relativně ~80 000 impresí
CTR (kreativo) 0,5 % 50 % relativně ~13 000 impresí
CVR (lander) 2 % 25 % relativně ~12 500 kliků
CVR (lander) 2 % 50 % relativně ~3 100 kliků
CVR (nabídková stránka) 5 % 25 % relativně ~4 900 kliků

Z této tabulky vyplynou dvě lekce. Za prvé, malé nárůsty jsou brutálně drahé: poloviční detekovatelný rozdíl zčtyřnásobí vzorek. Za druhé, testování na úrovni impresí stojí zlomek ceny testování na úrovni kliků. Tato asymetrie by měla formovat celý váš testovací program: testujte kreativní úhly na úrovni CTR, testujte funnely na úrovni konverzí a vůbec netestujte změny velikosti barvy tlačítka – vzorek potřebný k jejich detekci se zřídka zaplatí.

Minimum: jeden celý týden, bez ohledu na matematiku#

I když objem dodá váš vzorek za dva dny, spusťte test alespoň na sedm. Publikum ve všední dny a o víkendu se chová jinak – jiní lidé, jiná zařízení, jiný záměr. Mix publisherů na nativních sítích se v týdnu otáčí s novinovými cykly a plány obsahu, takže traffic v úterý není traffic v sobotu. Zpoždění konverze přidává druhou chybu: kliky na variant ze čtvrtka mohou konvertovat v sobotu, takže rané ukončení systematicky zvýhodňuje ten variant, který náhodou dostal své imprese jako první. Test končící uprostřed týdne vzorkoval zkreslený výsek vašeho skutečného traffic a 'vítěz' může být prostě specialista na všední dny.

Maximum: dlouhé testy se uvnitř kazí#

Po třech až čtyřech týdnech A/B test přestává být kontrolovaným experimentem. Kreativní únava oslabuje oba varianty – zřídka stejnou rychlostí, což tiše obrací pořadí uprostřed testu. Konkurenti vstupují a opouštějí aukci a mění kvalitu vašeho traffic. Sezónnost se pod celým srovnáním posouvá. Pokud vzorec říká, že potřebujete šest týdnů traffic, berte to jako verdikt: rozdíl, který hledáte, je příliš malý na to, abyste ho při vašem objemu detekovali. Místo toho otestujte větší rozdíl – jiný hook nebo angle, jinou strukturu funnelu – kde je detekovatelný rozdíl velký a vzorek cenově dostupný.

Nenahlížejte – nebo alespoň podle nahlédnutí nejednejte#

Klasický způsob selhání: denně kontrolovat dashboard a vyhlásit vítěze první den, kdy čísla vypadají významně. Opakované pohledy na akumulovaná data dramaticky nafukují falešně pozitivní výsledky – při denním nahlížení se pravidlo zastavení 'dosáhl významnosti v nějakém bodě' spustí mnohem častěji než inzerovaná 5% chybovost. Regrese k průměru pak vysvětluje většinu stížností typu 'můj vítěz přestal vítězit': variant, který vyskočil dopředu druhý den, jel na šumu, a teď se vrací zpět. Disciplína je jednoduchá: předem si stanovte velikost vzorku, denně monitorujte pouze pro podmínky stop-loss – rozbité sledování, nekontrolovaný výdaj, katastrofický výkon variantu – a vyhodnoťte vítěze jednou, na konci.

Pravidla pro ukončení, když si nemůžete dovolit významnost#

Většina nativních a affiliate buyerů nemůže financovat 12 500 kliků na variantu a předstírání opaku produkuje falešnou přísnost. Čestnou alternativou je stupňované vyřazování – hrubší než testování významnosti, a standardní praxe mezi buyery, kteří testují desítky kreativ měsíčně:

  1. Vyřazení na CTR (dny 1–3). Dejte každému kreativu několik tisíc impresí, pak zrušte vše jasně pod průměrem. Nic nedokazujete – třídíte, aby se rozpočet soustředil na potenciální vítěze.
  2. Omezení výdajů (průběžné). Běžné praktické pravidlo: pozastavte jakýkoli variant, který utratil 2–3× vaše cílové CPA s nulovými konverzemi. To není statistika; je to přežití.
  3. Významnost pro finalisty. Jakmile dva nebo tři přeživší nesou většinu výdajů, proveďte mezi nimi řádný test na úrovni konverzí pomocí výše uvedené matematiky. Financujete jeden skutečný test místo deseti falešných.

Zkraťte vzorek: začněte od reklam, které už přežily#

Každý variant, který nemusíte testovat, jsou ušetřené peníze, a nejlevnější informace o tom, co funguje, je to, co konkurenti neustále platí za provoz. Reklama, která běží 30+ dnů, prošla kontrolou ziskovosti svého majitele každý den tohoto běhu. Index OpenAdLibrary s 725 000+ živými nativními kreativy napříč 49 sítěmi (červen 2026) zaznamenává datum prvního a posledního spatření pro každé kreativo, což mění dlouhověkost reklamy na filtrovatelný signál místo odhadu – nejdéle běžící nativní reklamy ve vašem oboru jsou předtestovaný startovní grid. Postavte svůj test kolem dvou nebo tří úhlů již prověřených v praxi a testujete variace na vítězi místo studených odhadů; živá kreativa konkurentů si můžete prohlédnout zdarma pomocí nástroje pro výzkum nativních reklam. Méně, lepších variant znamená menší vzorky, kratší testy a méně rozpočtu spáleného na objevování.

Příklad od začátku do konce#

Řekněme, že provozujete lead-gen nabídku s výplatou 60 $ s jednou kampaní, která dělá zhruba 1 500 kliků denně napříč vašimi testovacími buňkami.

  • Fáze kreativ: čtyři kreativa soutěží na úrovni CTR. Několik tisíc impresí na každé se vyřeší za 2–3 dny; vyřaďte na dva nejlepší.
  • Fáze landing page: dva landery na úrovni konverzí. Výchozí CVR kolem 3 %, detekce 30% relativního nárůstu (0,9 bodu absolutně): n ≈ 16 × 0,03 × 0,97 ÷ 0,009² ≈ 5 700 kliků na variantu, celkem asi 11 400. Při 1 500 kliků denně je to osm dní – řekněme celý týden plus víkendové pokrytí.
  • Verdikt: jeden testovací cyklus trvá 10–12 dní od spuštění k obhajitelnému vítězi, s prohranými výdaji omezenými pravidlem omezení výdajů místo ponechání běžet na naději.

To je realistická podoba 'jak dlouho': pár dní levného třídění, týden-plus soustředěného měření a kalendářní délka diktovaná vaším objemem kliků – ne něčí magickým počtem dnů.

Často kladené otázky

Kolik konverzí potřebuji na variantu v A/B testu reklamy?
Jako pracovní pravidlo platí: 50–100 konverzí na variantu odhalí velké rozdíly (30 %+ relativně) s rozumnou spolehlivostí, zatímco malé rozdíly 10–15 % mohou vyžadovat tisíce konverzí. Přesný počet udává vzorec n ≈ 16 × p(1−p) ÷ d² pro vaši výchozí míru a rozdíl, který chcete detekovat. Pokud váš objem nedosáhne potřebného počtu zhruba do čtyř týdnů, raději otestujte větší rozdíl v kreativu.
Stačí na A/B test reklamy 3 dny?
Ne. I když vysoce objemová kampaň nasbírá velký vzorek za tři dny, vzorkovala jste pouze část týdenního cyklu – publikum ve všední dny a o víkendu konvertuje jinak a zpoždění konverze znamená, že rané kliky ještě nedokončily konverzi. Spusťte test alespoň na sedm plných dnů. Výjimkou je rané vyřazování na základě CTR, kde třídíte zjevně slabé kandidáty, nikoli neprokazujete statisticky platného vítěze.
Mám testovat reklamy na CTR nebo na konverzní míru?
Obě, v různých fázích. Testy na úrovni CTR potřebují pouze imprese, které jsou levné a rychlé, takže je použijte pro brzké vyřazení slabých kreativ. Testy konverzní míry měří to, za co jste skutečně placeni, ale vyžadují 10–100× větší rozpočet, takže je vyhraďte pro finalisty a pro změny na landing page nebo ve funnelu. Testovat vše na úrovni konverzí je způsob, jak malé účty pálí rozpočet na přísnost, kterou si nemohou dovolit.
Co se stane, když A/B test zastavím hned, jak dosáhne statistické významnosti?
Dramaticky zvýšíte míru falešně pozitivních výsledků. Denní kontrola a zastavení při prvním významném čtení znamená, že mnoho 'vítězů' je jen šum, který by se s více daty vrátil k průměru – klasický problém nahlížení do dat. Předem si stanovte velikost vzorku, denní kontroly používejte pouze pro podmínky stop-loss (jako rozbité sledování nebo nekontrolovaný výdaj) a vyhodnoťte vítěze jednou, až bude vzorek kompletní.
Proč můj vítězný variant reklamy přestal vítězit po skončení testu?
Obvykle jde o regresi k průměru: raný náskok varianty obsahoval štěstí a jeho dlouhodobý výkon je blíže průměru. Kreativní únava to ještě zhoršuje – čerstvý vítěz slábne, jak ho publikum opakovaně vidí. Oba důvody vedou k periodickému přetestování vítězů a k tomu, abyste každý jednotlivý výsledek testu brali jako odhad s chybovými pásy, ne jako trvalý fakt.
Tým OpenAdLibrary
Napsal/aTým OpenAdLibrary
Reklamní inteligence a výzkum nativní reklamy

Vytváříme OpenAdLibrary, otevřenou platformu pro transparentnost reklamy. Každý den naše systémy zachycují živé nativní reklamy napříč sítěmi Taboola, Outbrain, MGID, Revcontent, Teads, Yahoo a MSN, identifikují skutečného inzerenta za každou z nich a sledují kliknutí až na cílovou stránku. Tyto průvodce shrnují, co v těchto datech vidíme, abyste mohli rychleji zkoumat trh.