OpenAdLibraryOpenAdLibrary
竞争对手广告研究

历史广告数据:广告库到底能回溯多远

没有涵盖多年原生广告的主存档。历史广告数据的深度仅取决于工具自身的持续采集时长,了解这一点会改变你的研究方法。

编辑插图:历史广告数据:广告库实际能追溯到多远

历史广告数据,即广告主投放了什么以及投放了多久的记录,仅能追溯到持续、独立的观察开始之时,因为几乎没有广告网络会保留或发布自己的存档。Meta 的广告库是个例外:它长期保留政治和社会议题广告,而大多数其他广告仅在投放期间或之后短暂显示。Taboola、Outbrain 和 MGID 等原生网络根本不保留公开存档。实际上,历史广告数据源能“追溯到多远”恰好等于该源持续采集该网络的时间长度,不会更远。

这个答案与大多数人的预期不同。人们普遍假设某处存在一个全面的存档,可以追溯到多年前的每个网络,就像 Google 的 Wayback Machine 覆盖网站那样。但事实并非如此。广告库和广告情报工具是通过持续抓取实时投放来构建的;在某个工具开始采集该网络之前就已投放并结束的广告,根本不在任何人的数据中,而且永远不会,因为曝光已经消失。

为什么原生网络没有官方存档#

Meta、Google 和 TikTok 构建其透明度库主要是出于监管压力,最初是选举广告审查,最近则是欧盟《数字服务法案》对超大型平台规定的义务。Taboola、Outbrain、MGID 和 Revcontent 等原生广告网络未达到触发这些义务的“超大型在线平台”门槛,因此没有法律要求强制它们构建或维护此类存档。请参阅我们的解释文章 什么是广告透明度工具,了解这些义务如何跨网络映射。

没有监管推动,商业激励也很小:广告存档是一项研究和合规成本,对网络本身没有直接的产品收益。结果是,任何想要回顾六个月前 Taboola、Outbrain 或 MGID 上投放了什么广告的人,只有一个选择:一个在该时间段内已经持续采集的第三方工具。如果没有工具在监控,那份历史就不存在于任何地方,句号。

对于广告情报工具,“深度”到底意味着什么#

在评估数据源时,“能追溯到多远”实际上可以分解为两个值得直接提出的独立问题:

问题 为何重要
该网络的持续采集何时开始? 设定你所能搜索的最早时间下限。没有工具能显示其自身采集开始之前的广告。
采集是持续进行还是定期抽样? 持续采集能捕捉所有持久性数据点;抽样采集(例如每周一次)可能会完全错过短期测试,并低估广告实际投放时长。

一个持续采集了六个月的工具,能为你提供真正可靠的六个月持久性图景。一个采集了两年但每月仅抽样一次的工具,会错过大部分短期测试,并可能对其捕捉到的广告的投放时长做出错误陈述,因为它只知道该广告存在于两次月度快照之间的某个时间点,而非其实际起止日期。

持久性数据实际有什么用处#

历史广告数据的主要实际价值不是为了怀旧,而是利用观察到的投放时长作为性能的代理指标。一个广告主持续投放数周的广告很可能是盈利的;几天后撤下的广告可能不盈利。我们关于广告持久性作为获胜信号的文章涵盖了读取这一信号的机制,而我们追踪的投放时间最长的原生广告展示了在实时索引中真正持续投放的创意是什么样子。

这只有在底层数据反映持续观察而非抽样观察时才能成立。如果你的工具的“首次出现”日期实际上是“在月度爬取中首次发现”,那么一个实际已投放45天的广告可能只显示10天的记录历史,低估了其真实性能信号。当你在决定某个角度是否值得为自己的创意测试进行改编时,这个差距至关重要。

OpenAdLibrary 如何处理这个问题#

OpenAdLibrary 运行持续采集而非定期快照,从首次发现到投放结束全程追踪广告素材。截至 2026 年 6 月,该索引包含 725,882 个广告素材和 6,887,746 次广告观察,涵盖 49 个网络,源自 1,307,705 次追踪的落地页捕获。每个广告素材都带有从我们采集实际发现其在线时的真实首次出现日期,而非估计值,这使得投放时长分析有意义而非粗略猜测。

这并不意味着该索引能追溯到多年前;而是意味着它持有的数据反映了真实的持续观察,而非存在缺口。如果你在比较数据源,请直接询问任何供应商他们对特定网络的采集实际何时开始,以及是否是持续采集。这是一个合理的问题,任何合法的广告情报工具都应该直截了当地回答。你可以通过 OpenAdLibrary 的原生广告间谍工具 探索持续采集在实践中的样子。

对研究的实际影响#

如果你在研究竞争对手的长期策略,请对自己诚实:你只能看到自工具开始监控该网络以来被采集到的内容,而不是广告主的全部历史。对于一个多年来一直运行相同核心角度的竞争对手,你可能只能确认最近几个月的情况,但这通常足以确定该角度是持久的而非偶然。

如果你需要真正深入的历史背景(例如,追踪一个类别的主导角度在多年间如何变化),目前没有任何单一工具能为原生网络提供这种覆盖,因为没有一个工具从原生广告早期就开始持续采集。当客户或团队问“你能给我看看他们2021年投放了什么吗?”时,诚实的回答通常是“不能”,除非某个特定工具恰好在那时采集了该网络。任何针对 Taboola、Outbrain 或 MGID 声称相反的人,很可能是在夸大其存档的实际内容。

在依赖工具之前检查其真实覆盖范围#

在为任何广告情报来源投入研究时间之前,快速进行合理性检查:在你的垂直领域搜索一个知名且长期投放的广告主,查看工具显示其广告素材的最早日期。如果该日期与工具本身的发布时间高度吻合,你看到的是其采集窗口的下限,而非广告主真实的广告系列历史。这并非致命缺陷,每个工具都有起点,但这应该设定你对任何单一查询能有效追溯多远的预期。

为什么“无存档”和“年轻存档”之间的区别很重要#

这是两个不同的问题,需要不同的应对措施。“无存档存在”意味着网络本身从未公开过这些数据,这是当今所有原生网络的情况:Taboola、Outbrain、MGID、Revcontent、MediaGo 等。这里没什么可等的;独立采集是获得任何历史视角的唯一途径。

“年轻存档”意味着存在一个第三方工具并在持续采集,但其窗口仍然相对较短,因为它运行时间不长。这个问题会随时间自行解决:任何持续采集工具运行的时间越长,其有用历史就越深,纯粹是时间流逝的函数。如果你今天在选择研究工具,第二种情况值得接受,尽管当前窗口有限,因为持续运行的工具的覆盖范围只会从这里开始增长。一个定期抽样而非持续采集的工具不会以同样的方式随年龄增长而变好;它只会积累更多缺口。

利用观察窗口设定现实的研究目标#

鉴于这些限制,更有用的研究问题通常不是“这个广告主三年前投放了什么”,而是“这个广告主在可观察窗口内持续投放了什么,该模式是稳定还是正在变化”。连续数据最后几个月中的稳定角度是一个真正强烈的信号,即使没有多年背景,因为它告诉你该广告主不需要改变方向。

如果你正在构建竞争广告情报工作流程,请围绕这一现实设计,而不是与之对抗。使用持续采集工具从今天开始向前追踪竞争对手,并将任何回溯性采集的内容视为额外奖励而非期望。六个月后,你在特定关注列表上的自有追踪历史将比任何供应商对其平台的一般性历史声明更深入,因为它建立在你的实际竞争对手之上,持续观察,正好覆盖对你的决策重要的时间段。

对评估数据源的买家的底线#

在信任任何广告情报供应商的历史声明之前,直接问两个问题:你关心的每个网络的持续采集实际何时开始,以及采集是持续还是抽样。那些直截了当回答,并且当你抽查一个已知广告主时其数据经得起考验的供应商,是值得围绕其建立研究习惯的。那些回避问题,或者其最早可见数据在你检查的每个广告主身上都可疑地与其自身发布日期的供应商,是在告诉你他们的“历史数据”实际上只是他们自己的运营历史重新贴标签。

常见问题

原生广告数据实际能追溯到多远?
仅能追溯到特定工具开始持续采集该网络之时。没有任何原生广告网络(Taboola、Outbrain、MGID、Revcontent)维护自己的公开存档,因此不存在通用的历史记录;每个独立工具的深度仅限于其开始监控的时间点。
为什么 Taboola 和 Outbrain 不像 Meta 那样发布广告存档?
Meta、Google 和 TikTok 构建透明度库主要是出于监管压力,包括欧盟《数字服务法案》对超大型平台规定的义务。原生广告网络未达到该门槛,因此没有法律要求强制它们构建或维护此类存档。
持续采集与抽样采集广告有何区别?
持续采集会不断检查正在投放的广告素材,准确捕捉每个广告的起止日期,包括短期测试广告。抽样采集仅定期检查(每周或每月),可能会完全错过短期广告,并低估存活广告的实际投放时长。
我能看到竞争对手的广告策略在多年间如何变化吗?
只有当特定工具恰好在该时间段内持续采集该网络时才有可能。对于大多数原生网络,目前没有任何来源能追溯到那么远,因此多年历史对比通常无法完全可信地实现。
如何检查广告情报工具的历史数据是否可信?
在你的细分领域搜索一个知名且长期投放的广告主,查看工具显示其广告素材的最早日期。如果该日期与工具本身的发布时间高度吻合,那只是其采集窗口的起点,而非广告主真实的广告系列开始日期。
OpenAdLibrary 编辑团队
作者OpenAdLibrary 编辑团队
广告情报与原生广告研究

我们构建了 OpenAdLibrary,一个开放的广告透明度平台。我们的系统每日捕捉 Taboola、Outbrain、MGID、Revcontent、Teads、Yahoo 和 MSN 上的实时原生广告,识别每个广告背后的真实广告主,并追踪点击至其落地页。这些指南提炼了我们在数据中的发现,助您更快地研究市场动态。