OpenAdLibraryOpenAdLibrary
Native Ad Spy-værktøjer

Hvordan ad-spy-værktøjer indfanger native annoncer (forsyningskæden forklaret)

De bedste native ad-spy-værktøjer tager ikke skærmbilleder af sider; de læser den samme JSON-feed, som widget'en kalder, gemmer kreativet i fuld kvalitet og sporer klikket til landingssiden uden nogensinde at bruge en annoncørs budget. Sådan gør de det.

Diagram over den native annonceforsyningskæde, der viser udgiverens widget, efterspørgselsplatformen, omdirigerings- og sporingstrinene samt annoncørens landingsside, der indfanges af et ad-spy-værktøj

Forestil dig et ad-spy-værktøj, og de fleste mennesker forestiller sig en robot, der indlæser websider og tager skærmbilleder af de annoncer, den finder. Det billede er forkert, og forskellen er hele historien. Et skærmbillede fanger kun det, én browsersession fik serveret på ét tidspunkt, i ét land. Det er et lille, skævt udsnit af en feed, der roterer tusindvis af gange om dagen og personliggøres for hver besøgende.

De værktøjer, der bygger pålidelige native-annoncedatasæt, arbejder et lag under pixels. De taler det samme maskine-til-maskine-sprog, som en udgivers widget bruger til at hente sine annoncer, og de genopbygger hele stien fra pladsen på siden til annoncørens landingsside. Dette stykke går den sti fra ende til anden, og det bygger på den faktiske arkitektur, OpenAdLibrary kører for at gøre det i skala: 589.036 kreativer, 25.933 annoncører og 5,4 millioner annonceobservationer på tværs af 42 netværk (OpenAdLibrary indeks, juni 2026).

Hvis du vil vide, hvad der er under motorhjelmen på et native ad-spy-værktøj, før du stoler på dets data, er dette for dig.

Hvordan fanger ad-spy-værktøjer native annoncer?#

Ad-spy-værktøjer fanger native annoncer ved at kalde den samme anbefalings-API, der fylder en udgivers widget, og derefter læse annoncøren, overskriften, billedet og klik-URL'en direkte fra JSON-svaret. De gemmer kreativet i fuld kvalitet, løser klik-URL'en uden for båndbredden for at nå landingssiden og parser omdirigeringskæden for at mærke enhver mellemmand i forsyningskæden. Ingen live annonce bliver nogensinde klikket på.

Det er hele spillet i ét afsnit. Resten udpakker hvert trin, hvorfor de åbenlyse tilgange fejler, og hvad der adskiller et tyndt datasæt fra et dybt et. For den konceptuelle introduktion først, start med hvad et native ad-spy-værktøj faktisk er og hvordan det adskiller sig fra sociale annoncebiblioteker.

Den native annonceforsyningskæde, hop for hop#

Du kan ikke fange noget, du ikke forstår. En native annonce er ikke et statisk billede, der smides ind på en side. Det er det synlige toppunkt af en forsyningskæde med flere bevægelige dele. Her er stien, en enkelt Taboola- eller Outbrain-enhed rejser:

  1. Udgiversiden indlæser en native annonce-widget. Det er "Around the Web" eller "You May Like"-boksen. Ved første maling er det mest en tom beholder.
  2. Widget-scriptet kalder et anbefalings-endpoint. Dette er en JSON-API på efterspørgselsplatformens domæne. Den sender udgiver-ID'et, pladsen, brugerens omtrentlige geografiske placering og enhedssignaler.
  3. Efterspørgselsplatformen afholder en auktion. I programmatisk native byder annoncører på den impression på millisekunder, og vinderne kommer tilbage i svaret.
  4. Svaret returnerer annoncerne som struktureret data. Hvert element indeholder en titel, en miniaturebillede-URL, et brand- eller annoncørnavn og en klik-sporings-URL.
  5. Klik-URL'en er en omdirigering, ikke en destination. Klik på den, og du hopper gennem et eller flere tracker- og børsdomæner, før du når annoncørens rigtige side, som ofte er en pre-lander eller advertorial snarere end en produktside.

Den enkeltstående mest nyttige erkendelse inden for native annonceintelligens: de annoncedata, du ønsker, ankommer allerede som ren JSON, før en enkelt pixel er malet. At tage skærmbilleder af den gengivne widget er reverse engineering af noget, du bare kunne have læst.

Hvert trin er en fangemulighed og et klassifikationsproblem på samme tid. Trin 2 og 4 giver dig kreativet og annoncøren. Trin 5 giver dig forsyningskæden og landingssiden. Værktøjer adskiller sig vildt i, hvor mange af disse de faktisk bruger.

API-only høstning vs. browser skærmbilleder#

Der er to fundamentalt forskellige måder at høste native annoncer på, og valget kaskaderer til omkostninger, dækning og datakvalitet.

Tilgang Hvordan det virker Dækning Omkostninger at køre Kreativ kvalitet
Browser skærmbillede Headless browser indlæser sider, gengiver widgets, fanger pixels Lav: én rotation pr. gengivelse Høj: fuld Chromium pr. side Tabende, beskåret til viewport
API-only høstning Anmoder om anbefalingsfeedet direkte, læser JSON Høj: mange rotationer, geografiske områder, personer Lav: ingen browser nødvendig Original asset, fuld opløsning

Browser-ruten er den åbenlyse, og masser af ældre værktøjer startede der. Den er også dyr og overfladisk. At starte rigtig Chromium for hver side er tungt, langsomt og let at fingerprinte og blokere. Værre er, at en gengivelse kun nogensinde viser dig de få annoncer, der serveres til den ene session. Du prøver en plads, der personliggøres og roterer tusindvis af gange om dagen, og kalder det et datasæt.

API-only-ruten er det, OpenAdLibrarys native høster kører på. I stedet for at gengive sider, anmoder den om de samme anbefalingsfeeds, som widget'erne kalder, på tværs af mange geografiske områder og roterende enheds- og identitetspersoner, og læser annoncerne direkte. I praksis er det cirka en størrelsesorden billigere pr. annonce end at køre en browser, hvilket netop er grunden til, at den kan køre kontinuerligt og fange langt mere af rotationen. Ingen browser betyder også ingen klik på live annoncer. Dataene kommer fra feedet, ikke fra en gengivet impression.

Den forskel viser sig i tallene. På Taboola alene indeholder indekset 157.727 kreativer, og på Outbrain 84.252 (OpenAdLibrary, juni 2026). Du når ikke til seks cifre pr. netværk ved at tage skærmbilleder af sider én ad gangen. Her er en live Taboola-finansannonce trukket direkte fra feedet, ikke en gengivelse:

Taboola native finansannonce om IRS skatteforladelse
Billedtekst: En live Taboola-finansannonce, overskrift 2026 - IRS Forgives Millions By June 30th Tax Deadline, indfanget af OpenAdLibrary, juni 2026

Dette er forskellen mellem et værktøj, der viser dig en håndfuld af en konkurrents annoncer, og et, der viser dig hele spredningen. For affiliates og mediabuyere er spredningen hele pointen. Se, hvordan affiliate-markedsførere bruger native spy-værktøjer til at finde rotationer, der er værd at modellere.

Indfangning af kreativet i fuld kvalitet#

Når feedet er parset, peger den kreative billede-URL på annoncørens originale asset på en CDN. En god høster henter det asset direkte og gemmer det i oprindelig opløsning i stedet for at beholde et nedskaleret skærmbillede-udsnit.

Hvorfor det betyder noget i praksis:

  • Omvendt billedesøgning og dedup virker kun på det originale asset. Beskårne skærmbilleder ødelægger perceptuel hashing og oppuster dit datasæt med næsten-duplikater.
  • Kreativ analyse har brug for de rigtige pixels. Hook'et, ansigtet, tekstoverlayet, farvebehandlingen. Du kan ikke studere, hvad der fik en vinder til at vinde, ud fra en miniature.
  • Detektion af tværnettværks asset-genbrug afhænger af kildefilen. At matche det samme billede, der kører på Taboola, MGID og Revcontent på én gang, er kun pålideligt, når du har originalen.

At gemme originalen betyder også, at kreativet overlever, efter kampagnen slutter, og CDN-URL'en 404'er, hvilket er størstedelen af grunden til, at et annoncebibliotek har værdi overhovedet. På tværs af indekset har OpenAdLibrary beholdt 926.259 landingsside-indfangninger knyttet til disse kreativer. Kampagnen dør; optegnelsen gør ikke.

Sundhedsvertikalen er, hvor dette betaler sig hårdest, fordi kreativerne er aggressive, og de genbruger konstant. Sundhed er den tredjestørste vertikal i indekset med 14.895 kreativer, efter finans (17.232) og forsikring (15.629). Her er en, der har kørt på Taboola i 26 dage i træk:

Taboola native sundhedsannonce om et nyt høreapparat
Billedtekst: En Taboola-sundhedsannonce, overskrift Americans Are Ditching Hearing Aids for This New Device, observeret i 26 dage af OpenAdLibrary, juni 2026

Følge klikket til landingssiden (uden at klikke)#

Dette er trinnet, de fleste værktøjer springer over, og det er her, den rigtige intelligens lever. Klik-URL'en i feedet er en sporingsomdirigering. Destinationen bag den, landingssiden eller pre-landeren og annoncøren, hvis domæne den sidder på, besvarer det eneste spørgsmål, der betyder noget: hvem kører faktisk dette, og hvor sender de trafik hen?

Den naive tilgang er at udløse klikket i en browser. Det kan registreres som et fakturerbart klik på en live impression og brænde et budget, du ikke ejer. Ikke acceptabelt. Den korrekte tilgang er at løse omdirigeringskæden uden for båndbredden: afspil hop'ene server-side, normalt fra en ren residential exit i det relevante geografiske område, for at hente den endelige URL og indfange landingssiden selv, uden nogensinde at udløse et live fakturerbart klik.

Gjort godt, afslører dette tre ting på én gang:

  • Den rigtige annoncør bag et generisk brandnavn i feedet.
  • Pre-landeren eller advertorialen, brosiden, som native buyers stoler på, som aldrig vises i widget'en.
  • Den geografisk låste destination. Den samme annonce dirigerer ofte til forskellige landere efter land, og kun en multi-geo-løser fanger det. Eksemplet nedenfor er geografisk målrettet mod Australien, hvilket du helt ville gå glip af, hvis du indfangede fra en US-exit:
Taboola native livsforsikringsannonce målrettet mod Australien
Billedtekst: En geografisk målrettet Taboola-forsikringsannonce, overskrift Australians looking for life insurance should read this, indfanget af OpenAdLibrary, juni 2026

OpenAdLibrary sporer hvert klik til sin landingsside på denne måde og gemmer destinationen ved siden af kreativet, så et kreativ aldrig er et forældreløst billede. Det er knyttet til annoncøren og den tragt, det fodrer.

Klassificering af ad-tech-forsyningskæden#

At indfange hop'ene er én ting. At gøre dem læselige er en anden. Mellem widget'en og landeren kan en enkelt annonce passere gennem en efterspørgselsplatform, en børs, flere tracker-domæner og en omdirigeringsservice. Klassificering er arbejdet med at parse den kæde og mærke hver node.

Et kapabelt system opretholder en dynamisk registreringsdatabase over kendte netværk, trackere og omdirigeringsdomæner og matcher derefter hvert hop mod den for at besvare:

  • Hvilken efterspørgselsplatform serverede annoncen (Taboola, Outbrain, MGID, Revcontent, MediaGo, Yahoo, Microsoft Audience Network)?
  • Hvilke trackere og børser sidder i omdirigeringskæden?
  • Hvem er slutannoncøren, normaliseret på tværs af de mange brand-aliaser, den samme køber skjuler sig bag?

At hardkode tracker-lister er et tabende spil. Domænerne roterer konstant, så det bliver til whack-a-mole. En registreringsdatabase, der opdateres, efterhånden som nye mønstre dukker op, er den eneste tilgang, der holder. Få forsyningskæden rigtig, og du kan besvare spørgsmål, som en flad annonceliste aldrig kan: hvilke annoncører koncentrerer sig om hvilke netværk, hvilke trackere signalerer en bestemt affiliate-stak, hvilke omdirigeringsservices korrelerer med de mest aggressive tilbud.

Mønsteret er synligt i dataene. Både Taboola og Outbrain domineres af de samme tre vertikaler, men rækkefølgen vendes. På Taboola er føringen sundhed (6.048 kreativer), derefter finans (5.558) og forsikring (4.303). På Outbrain leder finans (2.640), derefter forsikring (2.615), derefter sundhed (2.016) (OpenAdLibrary, juni 2026). Den slags pr. netværk annoncørkoncentration er præcis, hvad forsyningskædeklassificering eksisterer for at afsløre.

Hvis terminologien er ny, forklarer glossarindgangen om annonceforsyningskæden rollerne, og programmatisk native advertising forklarer auktionen, der beslutter, hvilke annoncer du indfanger i første omgang.

Dækning, geografisk område og personer: hvorfor én indfangning ikke er nok#

En native plads er personliggjort. De annoncer, den serverer, afhænger af geografisk område, enhed, tid på dagen og antaget interesse. Så en enkelt indfangning, fra én IP, én enhedsprofil, ét øjeblik, er et skævt udsnit af en meget større rotation.

Seriøs høstning behandler dette som et prøvetagningsproblem:

  • Geografisk rotation. Den samme widget på den samme udgiver serverer forskellige annoncører i USA, Storbritannien, Australien og Tyskland. Et geografisk område giver dig ét udsnit.
  • Enheds- og identitetsrotation. Desktop-, Android- og iOS-sessioner plus roterede personer fremkalder forskellig efterspørgsel og forskellige kreative formater.
  • Kadence. Rotationer skifter i løbet af dagen, så indfangning skal være kontinuerlig, ikke en engangs-crawl.

Dette er også grunden til, hvorfor længde og spredning er de mest ærlige vindersignaler tilgængelige uden interne data. Du kan ikke se en konkurrents forbrug, men du kan se, hvor længe et kreativ har kørt, og hvor bredt det har spredt sig på tværs af udgivere, geografiske områder og netværk. Lige nu sidder de længst kontinuerligt observerede kreativer i indekset på 28 dages uafbrudt observation. SmartAsset har kørt "Ask a Pro: How Can I Avoid Paying Taxes on IRA Withdrawals?" på Outbrain i alle 28 af dem:

Outbrain native finansannonce fra SmartAsset om IRA-skat
Billedtekst: En Outbrain-finansannonce fra SmartAsset observeret kontinuerligt i 28 dage af OpenAdLibrary, juni 2026

Værd at være præcis her: 28 dage er spændet af vores observationsvindue, ikke et påstand om, at kreativet har kørt i præcis 28 dage og ikke mere. Branchens myte om 90-dages vindere er en separat ting, nyttig som en tommelfingerregel, men ikke noget, vores indeks måler. Hvad vi kan stå inde for, er den observerede køretid: en annonce, der har været live på tværs af snesevis af placeringer i uger, fortæller dig noget, som et forbrugstal ikke kan.

Hvad dette betyder for de data, du faktisk får#

Træk trådene sammen, og høstningsmetoden afgør direkte, hvad du kan gøre med outputtet.

Evne Har brug for feed-niveau indfangning? Har brug for klik-sporing? Har brug for forsyningskædeklassificering?
Se et kreativ kørte overhovedet Ja Nej Nej
Identificere den rigtige annoncør Delvist Ja Ja
Finde landingssiden eller pre-landeren Nej Ja Nej
Opdage tværnettværks asset-genbrug Ja Nej Ja
Rangere vindere efter længde og spredning Ja Nej Nej

Et værktøj, der kun tager skærmbilleder, giver dig den første række. Et værktøj, der høster feeds, sporer klik og klassificerer forsyningskæden, giver dig dem alle. Det er forskellen mellem en kuriositet og et forskningsinstrument. Oven på ren indfangning lagrer OpenAdLibrary værktøjer, der bruger det: Creative Studio til at remixe det, der virker, Optimize til at handle på det, Copy DNA til at nedbryde vinklen, plus en fuld API og MCP, så du kan trække dataene ind i din egen stack.

Gennemsigtighedsmodvinden#

For alle, der vejer legitimeringen af alt dette, er den regulatoriske retning mod mere offentlige annoncedata, ikke mindre. EU's Digital Services Act kræver nu, at meget store platforme (Meta, TikTok, Google og lignende) opretholder offentlige, søgbare annoncerepositorier, der viser annoncøren, betaleren og køredatoerne for hver annonce. Native discovery-widgets er ikke dækket af det mandat, men princippet er etableret: annoncer serveret til offentligheden behandles i stigende grad som offentlig information. Værktøjer, der kun indfanger offentlige annoncer og aldrig klikker på live enheder på en fakturerbar måde, sidder behageligt inden for den tendens. (Generel kontekst, ikke juridisk rådgivning. Tjek hver platforms vilkår for din specifikke brug.)

Bundlinjen#

Skåret ned til det essentielle, her er hvordan de gode ad-spy-værktøjer virker. De læser anbefalingsfeedet i stedet for at tage skærmbilleder af siden. De gemmer det originale kreativ i stedet for et udsnit. De løser klikket uden for båndbredden for at nå landingssiden i stedet for at udløse et fakturerbart klik. Og de klassificerer hvert hop i forsyningskæden i stedet for at efterlade dig en flad liste. Dækning kommer fra at rotere geografiske områder, enheder og personer kontinuerligt, og det mest troværdige vindersignal er længde og spredning.

Når du sammenligner leverandører, er det de spørgsmål, du skal stille. Vores testede, rangerede opdeling af de bedste native ad-spy-værktøjer scorer hvert enkelt på netop disse akser. Hvis budgettet er begrænsningen, er der også en guide til at køre native annonceforskning gratis.

OpenAdLibrary byggede sin native høster på hvert princip ovenfor: API-only indfangning, fuldkvalitetskreativer, klik-sporede landingssider og en live forsyningskæderegistreringsdatabase. Den er åben og overkommelig snarere end $80 til $400 om måneden. Start gratis og gennemse 200 annoncer, ingen kreditkort krævet.

Ofte stillede spørgsmål

Hvordan fanger ad-spy-værktøjer native annoncer uden at klikke på dem?
De anmoder om den samme JSON-anbefalingsfeed, som udgiverens widget kalder for at fylde sine pladser, og læser derefter annoncedataene direkte fra det svar. Annoncøren, overskriften, URL'en til det kreative billede og klik-URL'en kommer alle i payload'en, så værktøjet behøver aldrig at gengive eller klikke på en live enhed for at få dataene.
Er det lovligt at scrape native annoncer fra Taboola eller Outbrain?
At læse offentligt serverede annoncedata behandles generelt som adgang til offentligt webindhold, og gennemsigtighedsregulering bevæger sig i retning af mere offentlige annoncedata, ikke mindre. Anerkendte værktøjer indfanger kun offentlige annoncer og klikker aldrig på live enheder på en måde, der fakturerer en annoncør. Dette er generel information, ikke juridisk rådgivning, så gennemgå hver platforms vilkår for din brugssituation.
Hvordan følger spy-værktøjer et klik til landingssiden uden at bruge annoncørens budget?
De løser klik-URL'en uden for båndbredden, ved at afspille omdirigeringskæden server-side (ofte fra en ren residential exit i det rigtige geografiske område) i stedet for at udløse et fakturerbart klik på en live impression. Det returnerer destinations-URL'en og landingssiden, inklusive eventuelle pre-landere, uden at det koster annoncøren en krone.
Hvad betyder det at klassificere annonceforsyningskæden?
Det betyder at parse enhver mellemmand mellem widget'en og landingssiden (efterspørgselsplatformen, børser, trackere og omdirigeringsdomæner) og mærke hver enkelt. Gjort rigtigt, afslører det den rigtige annoncør bag et generisk brandnavn, det netværk, der serverede annoncen, og den fulde trackings-stak bag et kreativ.
Hvorfor misser ad-spy-værktøjer baseret på skærmbilleder annoncer?
Native widgets er personliggjorte og roterer konstant, så en enkelt sidegengivelse fanger kun den håndfuld annoncer, der serveres til én session, i ét geografisk område, på ét tidspunkt. Feed-niveau høstning på tværs af mange geografiske områder, enheder og personer fanger langt mere af rotationen, hvilket er måden, hvorpå OpenAdLibrarys indeks nåede 157.727 Taboola-kreativer og 84.252 på Outbrain i juni 2026.
OpenAdLibrary-teamet
Skrevet afOpenAdLibrary-teamet
Ad-intelligence & native annoncering research

Vi bygger OpenAdLibrary, den åbne ad-transparency-platform. Hver dag indsamler vores systemer live native annoncer på tværs af Taboola, Outbrain, MGID, Revcontent, Teads, Yahoo og MSN, identificerer den rigtige annoncør bag hver enkelt og følger klikket til dens landingsside. Disse guides destillerer, hvad vi ser i disse data, så du kan undersøge markedet hurtigere.