OpenAdLibraryOpenAdLibrary
Native Ad Spy Tools

Hoe ad-spytools native ads vastleggen (Supply Chain Uitgelegd)

De beste native ad-spytools maken geen screenshots van pagina's; ze lezen dezelfde JSON-feed die de widget aanroept, slaan de creatives in volledige kwaliteit op en volgen de klik naar de landingspagina zonder ooit het budget van een adverteerder uit te geven. Hier lees je precies hoe.

Diagram van de native ad-supply-chain met de publisher-widget, demandplatform, redirect- en tracking-hops, en de adverteerder-landingspagina vastgelegd door een ad-spytool

Stel je een ad-spytool voor en de meeste mensen denken aan een robot die webpagina's laadt en screenshots maakt van de advertenties die hij vindt. Dat beeld is fout, en het gat ertussen is het hele verhaal. Een screenshot legt alleen vast wat één browsersessie op één moment, in één land, kreeg aangeboden. Dat is een klein, bevooroordeeld plakje van een feed die duizenden keren per dag roteert en voor elke bezoeker personaliseert.

De tools die betrouwbare native-ad-datasets bouwen, werken een laag onder de pixels. Ze spreken dezelfde machine-naar-machine-taal die de widget van een publisher gebruikt om zijn advertenties op te halen, en ze reconstrueren het hele pad van de slot op de pagina tot de landingspagina van de adverteerder. Dit artikel loopt dat pad van begin tot eind, en het leunt op de daadwerkelijke architectuur die OpenAdLibrary gebruikt om het op schaal te doen: 589.036 creatives, 25.933 adverteerders en 5,4 miljoen advertentie-observaties over 42 netwerken (OpenAdLibrary-index, juni 2026).

Als je wilt weten wat er onder de motorkap van een native ad-spytool zit voordat je zijn data vertrouwt, dan is dit voor jou.

Hoe leggen ad-spytools native ads vast?#

Ad-spytools leggen native ads vast door dezelfde aanbevelings-API aan te roepen die de widget van een publisher vult, en vervolgens de adverteerder, headline, afbeelding en klik-URL rechtstreeks uit de JSON-respons te lezen. Ze slaan de creative in volledige kwaliteit op, lossen de klik-URL out-of-band op om de landingspagina te bereiken, en parsen de redirect-chain om elke tussenpartij in de supply-chain te labelen. Er wordt nooit op een live advertentie geklikt.

Dat is het hele spel in één alinea. De rest ontleedt elke stap, waarom de voor de hand liggende aanpakken falen, en wat een dunne dataset van een diepe scheidt. Voor het conceptuele basisprincipe eerst, begin met wat een native ad-spytool eigenlijk is en hoe het verschilt van sociale-advertentiebibliotheken.

De native ad-supply-chain, hop voor hop#

Je kunt niet iets vastleggen wat je niet begrijpt. Een native advertentie is geen statische afbeelding die in een pagina wordt gedropt. Het is het zichtbare topje van een supply-chain met verschillende bewegende onderdelen. Hier is het pad dat een enkele Taboola- of Outbrain-unit aflegt:

  1. De publisher-pagina laadt een native ad-widget. Dat is de "Around the Web" of "You May Like" box. Bij de eerste paint is het meestal een lege container.
  2. Het widget-script roept een aanbevelings-endpoint aan. Dit is een JSON-API op het domein van het demandplatform. Het geeft de publisher-ID, de slot, de geschatte geo van de gebruiker en device-signalen door.
  3. Het demandplatform voert een veiling uit. Bij programmatic native bieden adverteerders in milliseconden op die impressie, en de winnaars komen terug in de respons.
  4. De respons retourneert de advertenties als gestructureerde data. Elk item bevat een titel, een thumbnail-afbeeldings-URL, een merk- of adverteerdersnaam en een klik-tracking-URL.
  5. De klik-URL is een redirect, geen bestemming. Klik erop en je stuitert door één of meer tracker- en exchange-domeinen voordat je de echte pagina van de adverteerder bereikt, wat vaak een pre-lander of advertorial is in plaats van een productpagina.

De meest bruikbare realisatie in native ad-intelligentie: de advertentiegegevens die je wilt hebben, arriveren al als schone JSON voordat een enkele pixel is getekend. Het screenshotten van de gerenderde widget is reverse-engineering van iets dat je gewoon had kunnen lezen.

Elke stap is tegelijkertijd een vastleggingskans en een classificatieprobleem. Stappen 2 en 4 geven je de creative en de adverteerder. Stap 5 geeft je de supply-chain en de landingspagina. Tools verschillen enorm in hoeveel van deze stappen ze daadwerkelijk gebruiken.

API-only harvesting vs browser-screenshotting#

Er zijn twee fundamenteel verschillende manieren om native ads te oogsten, en de keuze heeft gevolgen voor kosten, dekking en data-kwaliteit.

Aanpak Hoe het werkt Dekking Kosten om te draaien Creative-kwaliteit
Browser-screenshot Headless browser laadt pagina's, rendert widgets, vangt pixels Laag: één rotatie per render Hoog: volledige Chromium per pagina Lossy, bijgesneden tot viewport
API-only harvest Vraagt de aanbevelingsfeed direct aan, leest JSON Hoog: veel rotaties, geos, persona's Laag: geen browser nodig Origineel asset, volledige resolutie

De browser-route is de voor de hand liggende, en veel legacy-tools begonnen daar. Het is ook duur en oppervlakkig. Voor elke pagina een echte Chromium opstarten is zwaar, traag en makkelijk te fingerprinten en blokkeren. Ergerger nog, een render laat je alleen de paar advertenties zien die aan die ene sessie worden geserveerd. Je bemonstert een slot die duizenden keren per dag personaliseert en roteert en noemt dat een dataset.

De API-only route is waar de native harvester van OpenAdLibrary op draait. In plaats van pagina's te renderen, vraagt het dezelfde aanbevelingsfeeds aan die de widgets aanroepen, over veel geografieën en roterende device- en identiteitspersona's, en leest de advertenties direct. In de praktijk is dat ongeveer een orde van grootte goedkoper per advertentie dan een browser aansturen, en dat is precies waarom het continu kan draaien en veel meer van de rotatie kan vangen. Geen browser betekent ook geen klikken op live advertenties. De data komt van de feed, niet van een gerenderde impressie.

Dat verschil zie je terug in de cijfers. Alleen al op Taboola bevat de index 157.727 creatives, en op Outbrain 84.252 (OpenAdLibrary, juni 2026). Je komt niet tot zes cijfers per netwerk door pagina's één voor één te screenshotten. Hier is een live Taboola-finance-advertentie rechtstreeks uit de feed gehaald, niet uit een render:

Taboola native finance ad about IRS tax forgiveness
Caption: A live Taboola finance ad, headline 2026 - IRS Forgives Millions By June 30th Tax Deadline, captured by OpenAdLibrary, June 2026

Dit is het verschil tussen een tool die je een handvol advertenties van een concurrent laat zien en één die je de volledige spreiding laat zien. Voor affiliates en mediabuyers is de spreiding het hele punt. Zie hoe affiliate marketers native spytools gebruiken om rotaties te vinden die het modelleren waard zijn.

De creative in volledige kwaliteit vastleggen#

Zodra de feed is geparsed, wijst de creative-afbeeldings-URL naar het originele asset van de adverteerder op een CDN. Een goede harvester haalt dat asset direct op en slaat het op in native resolutie in plaats van een bijgesneden screenshot-crop te bewaren.

Waarom het in de praktijk uitmaakt:

  • Reverse image search en dedup werken alleen op het originele asset. Bijgesneden screenshots breken perceptuele hashing en blazen je dataset op met bijna-duplicaten.
  • Creative-analyse heeft de echte pixels nodig. De hook, het gezicht, de tekstoverlay, de kleurbehandeling. Je kunt niet bestuderen wat een winnaar deed winnen vanuit een thumbnail.
  • Detectie van cross-network asset-hergebruik hangt af van het bronbestand. Het matchen van dezelfde afbeelding die tegelijkertijd op Taboola, MGID en Revcontent draait, is alleen betrouwbaar als je het origineel hebt.

Het origineel opslaan betekent ook dat de creative blijft bestaan nadat de campagne eindigt en de CDN-URL een 404 geeft, en dat is het grootste deel van de reden waarom een advertentiebibliotheek überhaupt waarde heeft. Over de index heeft OpenAdLibrary 926.259 landingspagina-captures bewaard die aan die creatives zijn gekoppeld. De campagne sterft; het record niet.

De health-vertical is waar dit het hardst uitbetaalt, omdat de creatives agressief zijn en constant worden gerecycled. Health is de op twee na grootste vertical in de index met 14.895 creatives, achter finance (17.232) en insurance (15.629). Hier is er één die 26 dagen achter elkaar op Taboola draait:

Taboola native health ad about a new hearing device
Caption: A Taboola health ad, headline Americans Are Ditching Hearing Aids for This New Device, observed for 26 days by OpenAdLibrary, June 2026

De klik naar de landingspagina volgen (zonder te klikken)#

Dit is de stap die de meeste tools overslaan, en het is waar de echte intelligentie leeft. De klik-URL in de feed is een tracking-redirect. De bestemming erachter, de landingspagina of pre-lander en de adverteerder wiens domein het is, beantwoordt de enige vraag die ertoe doet: wie runt dit eigenlijk, en waar sturen ze verkeer naartoe?

De naïeve aanpak is om de klik in een browser af te vuren. Dat kan worden geregistreerd als een factureerbare klik op een live impressie en budget verbranden dat je niet bezit. Niet acceptabel. De juiste aanpak is om de redirect-chain out-of-band op te lossen: de hops server-side opnieuw afspelen, meestal vanaf een schone residential exit in de relevante geo, om de uiteindelijke URL op te halen en de landingspagina zelf vast te leggen, zonder ooit een live factureerbare klik te triggeren.

Goed uitgevoerd, brengt dit drie dingen tegelijk aan het licht:

  • De echte adverteerder achter een generiek uitziende merknaam in de feed.
  • De pre-lander of advertorial, de brugpagina waar native buyers op vertrouwen, die nooit in de widget verschijnt.
  • De geo-gated bestemming. Dezelfde advertentie leidt vaak naar verschillende landers per land, en alleen een multi-geo-resolver vangt dat. Het onderstaande voorbeeld is geo-target op Australië, wat je volledig zou missen als je vanuit een US-exit vastlegt:
Taboola native life insurance ad targeted at Australia
Caption: A geo-targeted Taboola insurance ad, headline Australians looking for life insurance should read this, captured by OpenAdLibrary, June 2026

OpenAdLibrary traceert elke klik op deze manier naar zijn landingspagina en slaat de bestemming op naast de creative, zodat een creative nooit een wees-afbeelding is. Het is gekoppeld aan de adverteerder en de funnel waar het in voedt.

De ad-tech-supply-chain classificeren#

De hops vastleggen is één ding. Ze leesbaar maken is een ander. Tussen de widget en de lander kan een enkele advertentie door een demandplatform, een exchange, verschillende tracker-domeinen en een redirect-service gaan. Classificatie is het werk van het parsen van die chain en het labelen van elk knooppunt.

Een capabel systeem houdt een dynamisch register bij van bekende netwerken, trackers en redirect-domeinen, en matcht vervolgens elke hop daarmee om te beantwoorden:

  • Welk demandplatform serveerde de advertentie (Taboola, Outbrain, MGID, Revcontent, MediaGo, Yahoo, Microsoft Audience Network)?
  • Welke trackers en exchanges zitten in de redirect-chain?
  • Wie is de eindadverteerder, genormaliseerd over de vele merkaliassen waar dezelfde koper zich achter verschuilt?

Tracker-lijsten hardcoden is een verloren strijd. De domeinen roteren constant, dus het wordt whack-a-mole. Een register dat bijwerkt naarmate nieuwe patronen verschijnen, is de enige aanpak die standhoudt. Krijg je de supply-chain goed, dan kun je vragen beantwoorden die een platte advertentielijst nooit kan: welke adverteerders concentreren zich op welke netwerken, welke trackers signaleren een bepaalde affiliate-stack, welke redirect-services correleren met de meest agressieve offers.

Het patroon is zichtbaar in de data. Zowel Taboola als Outbrain worden gedomineerd door dezelfde drie verticals, maar de volgorde wisselt. Op Taboola is de leider health (6.048 creatives), dan finance (5.558) en insurance (4.303). Op Outbrain leidt finance (2.640), dan insurance (2.615), dan health (2.016) (OpenAdLibrary, juni 2026). Dat soort per-netwerk adverteerdersconcentratie is precies waar supply-chain-classificatie voor bestaat om bloot te leggen.

Als de terminologie nieuw is, legt de glossary-entry over de ad-supply-chain de rollen uit, en programmatic native advertising legt de veiling uit die beslist welke advertenties je in de eerste plaats vastlegt.

Dekking, geo en persona's: waarom één vastlegging niet genoeg is#

Een native slot is gepersonaliseerd. De advertenties die het serveert, hangen af van geo, device, tijdstip en afgeleide interesse. Dus een enkele vastlegging, van één IP, één device-profiel, één moment, is een bevooroordeelde steekproef van een veel grotere rotatie.

Serieus harvesting behandelt dit als een steekproefprobleem:

  • Geo-rotatie. Dezelfde widget op dezelfde publisher serveert verschillende adverteerders in de VS, VK, AU en DE. Eén geo geeft je één plakje.
  • Device- en identiteitsrotatie. Desktop-, Android- en iOS-sessies, plus geroteerde persona's, brengen verschillende vraag en verschillende creative-formaten aan het licht.
  • Cadans. Rotaties wisselen gedurende de dag af, dus vastleggen moet continu zijn, niet een eenmalige crawl.

Dit is ook waarom longeviteit en spreiding de meest eerlijke winnaarsignalen zijn die beschikbaar zijn zonder inside data. Je kunt de uitgaven van een concurrent niet zien, maar je kunt zien hoe lang een creative heeft gedraaid en hoe wijd hij zich heeft verspreid over publishers, geos en netwerken. Op dit moment zitten de langst continu geobserveerde creatives in de index op 28 dagen ononderbroken observatie. SmartAsset draait al 28 dagen lang "Ask a Pro: How Can I Avoid Paying Taxes on IRA Withdrawals?" op Outbrain:

Outbrain native finance ad from SmartAsset about IRA taxes
Caption: An Outbrain finance ad from SmartAsset observed continuously for 28 days by OpenAdLibrary, June 2026

Het is de moeite waard om hier precies te zijn: 28 dagen is de duur van ons observatievenster, geen bewering dat de creative precies 28 dagen heeft gedraaid en niet meer. De industrielore over 90-dagen-winnaars is een apart iets, nuttig als vuistregel maar niet iets wat onze index meet. Waar we achter kunnen staan, is de geobserveerde run: een advertentie die wekenlang live is geweest over tientallen placements, vertelt je iets wat een uitgavennummer niet kan.

Wat dit betekent voor de data die je daadwerkelijk krijgt#

Trek de draden samen en de harvest-methode bepaalt direct wat je met de output kunt doen.

Mogelijkheid Heeft feed-level capture nodig? Heeft click-trace nodig? Heeft supply-chain-classificatie nodig?
Zien dat een creative überhaupt heeft gedraaid Ja Nee Nee
De echte adverteerder identificeren Gedeeltelijk Ja Ja
De landingspagina of pre-lander vinden Nee Ja Nee
Cross-network asset-hergebruik detecteren Ja Nee Ja
Winnaars rangschikken op longeviteit en spreiding Ja Nee Nee

Een tool die alleen screenshots maakt, geeft je de eerste rij. Een tool die feeds oogst, klikken traceert en de supply-chain classificeert, geeft je ze allemaal. Dat is het verschil tussen een curiositeit en een onderzoeksinstrument. Bovenop schone vastlegging laagt OpenAdLibrary tooling die het gebruikt: Creative Studio om te remixen wat werkt, Optimize om erop te acteren, Copy DNA om de invalshoek te ontleden, plus een volledige API en MCP zodat je de data in je eigen stack kunt trekken.

De transparantie-meewind#

Voor iedereen die de legitimiteit hiervan afweegt, is de regulatorische reisrichting naar meer openbare advertentiegegevens, niet minder. De Digital Services Act van de EU vereist nu dat zeer grote platforms (Meta, TikTok, Google en vergelijkbare) openbare, querybare advertentierepositories onderhouden die de adverteerder, de betaler en de rundata voor elke advertentie vermelden. Native discovery-widgets vallen niet onder dat mandaat, maar het principe is gevestigd: advertenties die aan het publiek worden geserveerd, worden steeds meer behandeld als openbare informatie. Tools die alleen openbare advertenties vastleggen en nooit op live units klikken op een factureerbare manier, passen comfortabel binnen die trend. (Algemene context, geen juridisch advies. Controleer de voorwaarden van elk platform voor jouw specifieke gebruik.)

De bottom line#

Gereduceerd tot de essentie, zo werken de goede ad-spytools. Ze lezen de aanbevelingsfeed in plaats van de pagina te screenshotten. Ze slaan de originele creative op in plaats van een crop. Ze lossen de klik out-of-band op om de landingspagina te bereiken in plaats van een factureerbare klik af te vuren. En ze classificeren elke hop in de supply-chain in plaats van je een platte lijst te geven. Dekking komt van het continu roteren van geos, devices en persona's, en het meest betrouwbare winnaarsignaal is longeviteit en spreiding.

Als je leveranciers vergelijkt, zijn dat de vragen die je moet stellen. Onze geteste, gerankte uitsplitsing van de beste native ad-spytools scoort elke tool precies op deze assen. Als budget de beperking is, is er ook een gids voor het uitvoeren van native ad-onderzoek gratis.

OpenAdLibrary bouwde zijn native harvester op elk bovenstaand principe: API-only capture, creatives in volledige kwaliteit, click-getraceerde landingspagina's en een live supply-chain-register. Het is open en betaalbaar in plaats van $80 tot $400 per maand. Start gratis en blader door 200 advertenties, geen creditcard vereist.

Veelgestelde vragen

Hoe leggen ad-spytools native ads vast zonder erop te klikken?
Ze vragen dezelfde JSON-aanbevelingsfeed aan die de widget van de publisher aanroept om zijn slots te vullen, en lezen de advertentiegegevens rechtstreeks uit die respons. De adverteerder, headline, creative-afbeeldings-URL en klik-URL komen allemaal aan in de payload, dus de tool hoeft nooit een live unit te renderen of erop te klikken om de data te krijgen.
Is het schrapen van native ads van Taboola of Outbrain legaal?
Het lezen van publiek geserveerde advertentiegegevens wordt over het algemeen behandeld als het benaderen van openbare webcontent, en transparantieregulering neigt naar meer openbare advertentiegegevens, niet minder. Gerenommeerde tools leggen alleen publieke advertenties vast en klikken nooit op live units op een manier die een adverteerder factureert. Dit is algemene informatie, geen juridisch advies, dus bekijk de voorwaarden van elk platform voor jouw gebruiksscenario.
Hoe volgen spytools een klik naar de landingspagina zonder het budget van de adverteerder uit te geven?
Ze lossen de klik-URL out-of-band op, waarbij ze de redirect-chain server-side afspelen (vaak vanaf een schone residential exit in de juiste geo) in plaats van een factureerbare klik op een live impressie af te vuren. Dat levert de bestemmings-URL en de landingspagina op, inclusief eventuele pre-landers, zonder de adverteerder een cent te kosten.
Wat betekent het om de ad-supply-chain te classificeren?
Het betekent elke tussenpartij tussen de widget en de landingspagina (het demandplatform, exchanges, trackers en redirect-domeinen) parsen en labelen. Goed uitgevoerd onthult dit de echte adverteerder achter een generieke merknaam, het netwerk dat de advertentie serveerde en de volledige tracking-stack achter een creative.
Waarom missen screenshot-gebaseerde ad-spytools advertenties?
Native widgets zijn gepersonaliseerd en roteren constant, dus een enkele paginarender legt alleen de handvol advertenties vast die aan één sessie, in één geo, op één moment worden geserveerd. Feed-level harvesting over veel geos, devices en persona's vangt veel meer van de rotatie, en dat is hoe de index van OpenAdLibrary in juni 2026 157.727 Taboola-creatives en 84.252 op Outbrain bereikte.
Het OpenAdLibrary Team
Geschreven doorHet OpenAdLibrary Team
Advertentie-intelligentie & native advertising-onderzoek

Wij bouwen OpenAdLibrary, het open advertentie-transparantieplatform. Dagelijks vangen onze systemen live native advertenties op via Taboola, Outbrain, MGID, Revcontent, Teads, Yahoo en MSN, identificeren de echte adverteerder achter elke advertentie en volgen de klik naar de bestemmingspagina. Deze handleidingen distilleren wat wij in die data zien, zodat jij de markt sneller kunt onderzoeken.