OpenAdLibraryOpenAdLibrary
Ad Creative & Funnels

Creative Testing Budgets: Hvor meget skal du bruge, før du dømmer

At dømme en kreativ test for tidligt er den dyreste fejl i native mediekøb. Her er, hvordan du dimensionerer dit testbudget ud fra konverteringer, ikke gætværk.

Redaktionel illustration: Creative Testing Budgets: Hvor meget skal du bruge, før du dømmer

Planlæg med cirka 3 til 5 gange din gennemsnitlige omkostning pr. konvertering, pr. kreativ variant, før du kalder en test vundet, tabt eller uafklaret. Under det forbrug læser du normalt bare støj: en variant, der "vinder" på 4 konverteringer, kan lige så nemt være en variant, der var heldig, og en variant, der "taber" på nul konverteringer i sin første time, har måske bare brug for flere visninger, før algoritmen overhovedet finder sin målgruppe.

Hvorfor et fast dollarbeløb ikke fungerer på tværs af annoncører#

Mediekøbere spørger "hvor meget skal jeg bruge på at teste en kreativ" og forventer et enkelt svar, men det ærlige svar skalerer med dine egne tal, ikke et universelt tal. En annoncør, der konverterer til $8 CPA, har brug for et helt andet testbudget end en, der konverterer til $80 CPA, selvom begge kører på samme netværk i samme vertical. Det dollarbeløb, der betyder noget, er ikke forbrug, det er konverteringer: du har brug for nok af dem pr. variant til at stole på sammenligningen.

Det er derfor, "brug $500 på at teste en ny annonce" er dårligt råd i sig selv. For et lead-gen-tilbud, der konverterer til $12 CPA, køber $500 cirka 40 konverteringer, rigeligt til at sammenligne to varianter med en vis tillid. For et ecommerce-tilbud, der konverterer til $60 CPA, køber de samme $500 omkring 8 konverteringer, langt fra nok til at stole på et resultat i nogen retning. Ram dit testbudget i konverteringer først, og oversæt derefter det til dollars ved hjælp af din egen CPA eller CPL, ikke omvendt.

Konverteringstællingsminimum, der faktisk betyder noget#

Som et praktisk minimum ønsker de fleste mediekøbere mindst 20 til 30 konverteringer pr. variant, før de drager en konklusion, og betydeligt flere (50-plus) hvis de to varianter er tætte i performance i stedet for at den ene er en indlysende vinder. Hvis variant A konverterer med 2x hastigheden af variant B efter 10 konverteringer hver, er det gab sandsynligvis reelt, og du behøver ikke vente på flere data for at handle. Hvis variant A konverterer med 1.2x hastigheden af variant B efter 10 konverteringer hver, kunne det gab nemt vende med yderligere 20 konverteringer, og at dræbe variant B lige nu er et gæt forklædt som en beslutning.

Situation Hvad det normalt betyder Hvad du skal gøre
En variant er en klar outlier tidligt (2x+ gab) Sandsynligvis en reel forskel Kan handle tidligt, men hold øje
Varianter er tætte (under 1.5x gab) Ikke nok signal endnu Bliv ved med at bruge, indtil du når konverteringsminimum
Nul konverteringer efter rimeligt forbrug Kunne være kreativiteten, kunne være rækkevidde Tjek visninger og CTR, før du dræber den
God CTR, ingen konverteringer Landing page eller tilbudsmismatch, ikke et kreativt problem Diagnosticer funnellen, før du bebrejder annoncen

Budgettering for kreativ volumen, ikke kun individuelle tests#

Testbudget er ikke en engangsomkostning, det er en løbende procentdel af forbruget. Et mønster, vi ser på tværs af konti, der skalerer succesfuldt på native, er at allokere et sted mellem 15% og 30% af det samlede budget til aktiv testning til enhver tid, mens resten går til bekræftede vindere. Skub det forhold for lavt, og din konto stagnerer på et aldrende sæt kreativer, der til sidst rammer creative fatigue; skub det for højt, og du lader aldrig en vinder køre længe nok til faktisk at betale sin egen testomkostning tilbage.

Annoncørerne, der håndterer dette godt, har en tendens til at behandle testbudget som en rullefunktion af, hvor mange aktive vindere de i øjeblikket har, ikke en fast månedlig post. Få levende vindere og en stagnerende konto kræver mere testforbrug; flere stærke performere, der allerede bærer volumen, kræver mindre, da du beskytter margin i stedet for at jage efter den.

Hvad "at dømme for tidligt" faktisk koster dig#

Den dyre fejl er ikke at bruge for meget på testning, det er at dømme en test, før den har nok data, og dræbe en kreativ, der ville være blevet en langsigtet vinder. Fordi ad longevity er et af de tydeligste offentlige signaler på, at en kreativ faktisk er profitabel (annoncører betaler ikke for tabere), kan du tjekke din egen instinkt op mod det eksterne marked: hvis en meget lignende vinkel til den, du lige dræbte, stadig kører 20-plus dage andre steder i din vertical, er det et signal om, at din stikprøvestørrelse, ikke vinklen, var problemet.

At dræbe en kreativ tidligt har også en sammensat omkostning ud over det spildte medie: den fjerner et datapunkt, du kunne have brugt, og den kan skubbe dig mod at jagte mere omkostningstung kreativ variation, når den faktiske løsning var tålmodighed med en eksisterende variant. Dette er et større problem med UGC-stil og native-format annoncer, der tager længere tid at producere end et simpelt overskriftsskift; du vil have, at din dømmegrænse skal være endnu mere konservativ på dem, da produktionsomkostningerne ved at erstatte dem er højere.

En simpel ramme for at sætte dit eget testbudget#

  1. Hent din blended CPA eller CPL fra de sidste 30 til 60 dages forbrug.
  2. Gang det med 20 til 30 for at få dit minimumskonverteringsminimum pr. variant.
  3. Gang konverteringsminimum med din CPA/CPL for at få dit minimumstestforbrug pr. variant i dollars.
  4. Tilføj en buffer på 25% til 50% oveni for varianter, der underperformer dit gennemsnit og har brug for mere forbrug for at nå samme konverteringsminimum.
  5. Sæt en hård stop-loss (et forbrugsloft langt over minimum, hvor du dræber en variant uanset konverteringer, normalt 2 til 3 gange minimum) så en virkelig død kreativ ikke dræner budgettet i det uendelige, mens du venter på konverteringer, der aldrig kommer.

Gennemgået eksempel: at omdanne rammen til reelle tal#

Lad os sige, din konto kører et nutra-tilbud, der konverterer til en blended $35 CPA over de sidste to måneder. Ved at bruge rammen ovenfor: 25 konverteringer (midtpunktet af 20 til 30 minimum) gange $35 giver et minimumstestforbrug på $875 pr. variant. Tilføj en 35% buffer for underperformende varianter, og du budgetterer med cirka $1,180 pr. kreativ, du tester seriøst. Hvis du tester fire overskriftsvarianter mod én eksisterende kontrolbillede, er det tæt på $4.700 i samlet testforbrug for den runde, hvilket straks skal fortælle dig, om fire er for mange varianter at køre på én gang givet din kontos daglige budget, eller om du skal udsprede varianterne over to eller tre uger i stedet for at lancere dem alle samtidigt.

Det er også her en stop-loss betyder noget. Sæt den til, lad os sige, 2.5 gange minimum ($2.190 i dette eksempel), og du beskytter dig selv mod, at en virkelig død kreativ æder en uforholdsmæssig stor del af dit testbudget, mens du venter på konverteringer, der statistisk set ikke kommer. En variant, der har brændt $2.190 af med 4 konverteringer mod et $35 CPA-mål, er ikke en variant, der har brug for mere tålmodighed, det er en variant, der skal dræbes og erstattes.

Netværksforskelle, der ændrer regnestykket#

Konverteringsminimumslogikken holder på tværs af netværk, men hvor hurtigt du når den, gør ikke. En Taboola eller MGID kampagne, der kører bred rækkevidde i en Tier 1 geo, kan brænde gennem konverteringsminimum for et $10 CPL-tilbud på en dag eller to. Den samme test på en mindre eller mere nicheplacering, eller i en Tier 2/3 geo, hvor volumen er tyndere, kan tage en hel uge at ramme det samme minimum, selv ved identisk dagligt forbrug, simpelthen fordi der er færre kvalificerede visninger tilgængelige at servere. Før du antager, at en kreativ "fejlede", skal du tjekke, om den faktisk fik nok levering til overhovedet at nå dit konverteringsminimum, da en udhungret test og en virkelig svag kreativ ser identiske ud på et dashboard, hvis du kun kigger på bestået/ikke-bestået-kolonnen.

Det er også værd at budgettere forskelligt for en helt ny vinkel versus en variation på en bekræftet en. En helt ny vinkel, du aldrig har kørt før, bærer mere risiko, så den fortjener hele konverteringsminimummet før dom. En mindre variation på en kontrol, der allerede er en bekræftet vinder (en ny overskrift på det samme billede, for eksempel), kan ofte dømmes med en lidt mindre stikprøve, da du tester én variabel mod en baseline, du allerede stoler på, i stedet for at evaluere noget fra nul.

Hvordan OpenAdLibrary passer ind i testløkken#

Før du bruger en dollar på at teste en ny vinkel fra bunden, er det værd at tjekke, om vinklen, eller noget tæt på den, allerede kører og overlever på markedet. OpenAdLibrary's ad intelligence tool lader dig hente live kreativer efter vertical og netværk og tjekke, hvor længe lignende vinkler har kørt, hvilket giver dig en grov ekstern benchmark for, om en vinkel er værd at teste i første omgang. Den erstatter ikke dine egne konverteringsdata, men den kan stoppe dig fra at bruge hele dit testbudget på at genopdage en vinkel, markedet allerede har valideret, eller gen-teste en, det allerede har dræbt.

Kombiner den eksterne tjek med ad creative analysis rammen for at score hooks, vinkler og CTAs før lancering, og dit testbudget rækker længere, fordi færre af de varianter, du bruger det på, var svage kandidater til at begynde med.

Ofte stillede spørgsmål

Hvor meget skal jeg bruge på at teste en ny native annoncekreativ?
Budgetter med cirka 20 til 30 konverteringer pr. variant, før du dømmer den, oversat til dollars ved hjælp af din egen CPA eller CPL. En fast regel på $500 ignorerer, at et tilbud med en $10 CPA og et tilbud med en $80 CPA har brug for helt forskellige testbudgetter for at nå samme konverteringsminimum.
Hvor mange konverteringer har jeg brug for, før jeg kan stole på en kreativ test?
De fleste mediekøbere ønsker mindst 20 til 30 konverteringer pr. variant, og flere hvis varianterne er tæt på hinanden i performance. Et 2x performance-gab efter kun 10 konverteringer er sandsynligvis reelt; et 1.2x gab efter 10 konverteringer kan nemt vende med flere data.
Hvor stor en procentdel af budgettet skal gå til test versus bekræftede vindere?
Et almindeligt interval er 15% til 30% af det samlede forbrug på aktiv testning til enhver tid, mens resten går til bekræftede performere. Konti med få nuværende vindere bør læne sig mod den høje ende; konti med flere stærke performere, der allerede kører, kan læne sig lavere.
Hvad er en stop-loss i kreativ testning?
En stop-loss er et hårdt forbrugsloft, typisk 2 til 3 gange dit konverteringsminimumsbudget, hvor du dræber en variant uanset hvor få konverteringer den har produceret. Det beskytter dit testbudget mod, at en virkelig død kreativ dræner forbrug i det uendelige.
Har alle native netværk og geografier brug for det samme testbudget?
Nej. Placeringer med højere volumen i Tier 1 når dit konverteringsminimum hurtigere end mindre eller Tier 2/3 geografiske placeringer ved samme daglige forbrug, simpelthen fordi der er færre kvalificerede visninger tilgængelige. Tjek leveringen, før du antager, at en langsom test faktisk har fejlet.
OpenAdLibrary-teamet
Skrevet afOpenAdLibrary-teamet
Ad-intelligence & native annoncering research

Vi bygger OpenAdLibrary, den åbne ad-transparency-platform. Hver dag indsamler vores systemer live native annoncer på tværs af Taboola, Outbrain, MGID, Revcontent, Teads, Yahoo og MSN, identificerer den rigtige annoncør bag hver enkelt og følger klikket til dens landingsside. Disse guides destillerer, hvad vi ser i disse data, så du kan undersøge markedet hurtigere.