OpenAdLibraryOpenAdLibrary
术语解释

增量性测试:定义与工作原理

增量性测试通过使用对照组作为比较基准,分离出广告渠道实际导致的报告转化量。

编辑插图:增量性测试:定义与工作原理

增量性测试是一种受控实验,用于衡量广告渠道实际导致的报告转化量,而非平台像素简单声称归功的转化量。你阻止一组用户或地区看到特定渠道的广告,然后将结果与看到广告的组进行比较。两组之间的差异就是该渠道真实、增量的贡献。其余的都是无论如何都会发生的转化。

为什么平台报告的数值会夸大结果#

每个广告网络都希望为销售获得功劳。如果有人已经打算通过有机搜索或品牌搜索点击购买,并且恰好在此过程中看到了重定向广告,标准的转化跟踪仍然可以将该功劳归因于其归因窗口内的广告。甚至更虚的功劳,即平台在某人仅看到广告后就计算一次转化,也加剧了问题;这种机制称为浏览归因。增量性测试通过提出一个更直接的问题来消除这种噪音:如果这个渠道本月支出为零,这个转化还会发生吗?

这与跟踪像素自身回答的问题不同,这就是为什么每月运营六位数原生或社交预算的团队最终会在其平台仪表盘之外,而不是替代它们,建立一个增量性项目。

团队如何在实际中运行#

两种设计涵盖了大多数实际情况。地理级别测试在一个匹配的地区集合中完全暂停一个渠道,并将转化率与继续支出的地区进行比较。用户级别测试使用广告平台内置的转化提升工具,该工具由多个需求方平台原生提供,用于向随机抽取的受众部分隐藏广告。

无论哪种方式,数学计算都是一样的:增量提升等于测试组的转化率减去对照组的转化率。一个在平台上显示出强劲自我报告ROAS的渠道,一旦干净的对照组移除了无论如何都会转化的用户,可能显示出接近零的增量提升。

它的用途#

媒介购买者运行增量性测试是为了决定跨网络的预算分配,而不仅仅是孤立地审计一个渠道。我们在索引中看到一种模式:同时在多个网络上运行相同创意角度的品牌通常假设所有网络都在发挥作用,而提升测试却显示一个渠道主要是在重新捕获另一个渠道已经创造的需求。

在运行正式测试之前,大多数团队会先观察其垂直领域内的竞争对手实际在扩展什么,因为一个充斥着长广告寿命的渠道是增量预算往往有效的一个不错代理。OpenAdLibrary的广告情报工具允许你在将测试广告支出投入对照组之前,检查跨网络的创意重叠和运行时长。

常见错误#

对照组需要足够大且足够随机,以检测真实信号,而不仅仅是噪音。在低流量渠道上进行一周的测试通常无法达到统计显著性。团队还经常在季节性高峰或全站促销期间运行测试,这会同等污染两组,使提升数字毫无意义。在代表性时间段内运行测试,通过适当的功效计算确定对照组规模,并且不要因为中期数字看起来好或坏就提前停止。

常见问题

增量性测试应运行多长时间?
大多数地理区域对照组需要至少2到4周才能达到统计显著性,但这取决于基线转化量和预期效果大小。低流量账户通常需要更长时间,有时6到8周,才能将真实提升与正常的周间波动区分开来。
增量性测试与A/B测试有什么区别?
A/B测试通常比较同一渠道内的两个创意变体或落地页。增量性测试则比较渠道完全开启与完全关闭的情况,回答该渠道本身是否增加价值,而非哪个广告版本表现更好。
增量性测试能否取代平台归因?
不能完全取代。平台归因对于日常优化决策(如暂停表现不佳的广告组)仍然有用。增量性测试适合周期性的更大问题,如渠道预算分配,每季度或每半年运行一次,而非持续进行。
增量性测试对小预算有效吗?
更困难。小账户通常缺乏在合理窗口内检测到统计显著提升的转化量。地理级别测试有时可以通过聚合整个区域的转化来绕过这个问题,但非常低支出的账户可能需要方向性信号而非精确测量。
OpenAdLibrary 编辑团队
作者OpenAdLibrary 编辑团队
广告情报与原生广告研究

我们构建了 OpenAdLibrary,一个开放的广告透明度平台。我们的系统每日捕捉 Taboola、Outbrain、MGID、Revcontent、Teads、Yahoo 和 MSN 上的实时原生广告,识别每个广告背后的真实广告主,并追踪点击至其落地页。这些指南提炼了我们在数据中的发现,助您更快地研究市场动态。