OpenAdLibraryOpenAdLibrary
광고 크리에이티브 & 퍼널

테스트할 광고 크리에이티브 수: 대부분의 바이어가 너무 적게 테스트하는 이유

중요한 숫자는 얼마나 많은 광고를 시작하는가가 아니라, 얼마나 많은 진짜 앵글을 테스트하는가이다. 시나리오별 실무 수치, 그 배경이 되는 예산 계산, 그리고 테스트를 정직하게 유지하는 종료 규칙을 다룬다.

에디토리얼 일러스트레이션: 테스트할 광고 크리에이티브 수(그리고 대부분의 바이어가 너무 적게 테스트하는 이유)

새로운 네이티브 광고 캠페인의 경우, 경험 많은 미디어 바이어는 일반적으로 최소 3개의 진정으로 다른 앵글을 아우르는 610개의 크리에이티브를 시작하고, 데이터가 확보되면 가장 좋은 35개를 유지하며, 매주 2~3개의 새로운 챌린저를 투입합니다. 숫자 자체보다 구성이 더 중요합니다. 대부분의 바이어가 '크리에이티브 테스트'를 한다고 말하지만 실제로는 하나의 앵글을 외형적으로만 변형하여 테스트합니다. 즉, 비슷한 세 개의 이미지 위에 같은 내용을 말하는 세 개의 헤드라인을 사용하는데, 이것이 대부분의 크리에이티브 테스트가 아무 성과도 내지 못하는 이유입니다.

이 글은 시나리오별 실무 수치, 실제로 배울 수 있는 것을 결정하는 예산 계산, 그리고 테스트가 조용히 마진을 잠식하는 것을 막는 종료 기준을 제공합니다.

광고 수가 아닌 앵글 수를 세십시오#

앵글은 설득의 틀, 즉 이 제품이 이 사람에게 왜 중요한지에 대한 이유입니다. 변형은 동일한 틀의 다른 표현입니다. '의사들이 무릎 통증에 대해 말해주지 않는 것'과 '의사들이 숨기는 무릎 통증 비법'은 하나의 앵글, 두 가지 변형입니다. 이 구분이 게임의 전부입니다. 앵글 간 성능 차이는 동일한 앵글의 변형 간 차이보다 훨씬 크기 때문입니다. 이 둘을 구분한 적이 없다면 후크 vs 앵글 vs 주장부터 시작하세요.

실용적인 시작 구조는 그리드입니다: 각각 23가지 방식으로 실행된 34개의 앵글. 관절 건강 제품의 경우 메커니즘 앵글(통증이 지속되는 이유), 반대 의견 앵글(표준 조언의 잘못된 점), 가치 앵글(가격 비교)이 될 수 있습니다. 9개의 광고, 3개의 실제 가설. 앵글 목록을 구축하는 유용한 지름길: 라이브 네이티브 인벤토리에서 반복되는 프레임은 잘 문서화되어 있습니다. 가장 일반적인 네이티브 광고 앵글을 참조하세요. 경쟁사의 현재 믹스는 시장이 이미 보상하는 앵글이 무엇인지 알려줍니다.

시나리오별 크리에이티브 수#

일반적인 실무자 범위(출발점으로 취급하고 법칙으로 여기지 마십시오):

시나리오 시작 수 구성
새로운 제안, 새로운 네트워크 6–10 3–4개 앵글 × 2–3개 실행
입증된 제안, 새로운 지역 또는 네트워크 4–6 입증된 앵글 + 2–3개의 현지화된 챌린저
승자 확장 주당 3–5개 신규 챔피언과 함께 시작되며, 결코 챔피언을 대체하지 않음
리타겟팅 2–4 더 적고, 퍼널 단계에 맞춘 메시지

비대칭은 의도적입니다: 불확실성이 높을 때는 넓게 테스트하고(새 제안, 새 시장), 이미 작동하는 것을 방어할 때는 좁게 테스트합니다. 새 제안에 대해 두 개의 광고만 시작하는 바이어는 검소한 것이 아니라, 동전 던지기 하나를 사서 연구라고 부르는 것입니다.

예산 계산: 배울 수 있는 비용#

시작하는 모든 크리에이티브는 지출 약정입니다. 크리에이티브가 판단을 내릴 수 있을 만큼 충분한 트래픽을 확보한 후에야 정보를 제공하기 때문입니다. 판단은 매우 다른 가격표를 가진 두 단계로 이루어집니다:

  • CTR 판단은 저렴합니다. 클릭률은 네이티브 네트워크가 빠르게 제공하는 노출에서 안정화됩니다. 약한 헤드라인과 이미지는 일찍 식별됩니다. 이것이 시작 그리드의 대부분이 죽어야 하는 곳입니다. (CTR은 네이티브의 첫 번째 정렬 지표이며, 네트워크 자체의 전달 알고리즘도 이를 활용합니다.)
  • 전환 판단은 비쌉니다. 크리에이티브가 구매자를 생성하는지 판단하려면 클릭이 필요하며, 클릭 비용은 CPC × 볼륨입니다. CTR 컷에서 살아남은 크리에이티브만이 이 단계에 도달해야 합니다.

따라서 실무 공식은: 테스트 예산 ≈ 전환 단계에 도달하는 크리에이티브 수 × 판단까지 필요한 클릭 수 × CPC입니다. 네이티브 CPC는 지역과 수직 분야에 따라 크게 변동합니다. 바이어가 보고하는 범위는 네이티브 광고 CPC 벤치마크를 참조하세요. 따라서 감당할 수 있는 크리에이티브 수는 예산에서 결정되며, 그 반대가 아닙니다. 예산이 세 개의 크리에이티브에 대한 전환 판단만 지원한다면, 8개를 시작하고 CTR이 5개를 죽게 한 후, 실제 비용은 생존자에게 사용하십시오.

대부분의 바이어가 너무 적게 테스트하는 이유#

세 가지 이유, 모두 수정 가능합니다. 첫째, 손실 회피: 손실 크리에이티브에 지출하는 것은 낭비처럼 느껴지지만, 정보 자체가 결과물입니다. 적당한 지출 후 앵글이 실패했다는 것을 아는 것은, 그것을 전혀 테스트하지 않고 그렇게 한 경쟁자에게 지는 것보다 저렴합니다. 둘째, 제작 마찰: 변형은 만들기 쉽고, 앵글은 연구가 필요하므로 바이어는 변형을 기본으로 하고 그것을 테스트라고 부릅니다. 셋째, 아무도 미래를 예산에 반영하지 않습니다. 얇은 크리에이티브 벤치는 크리에이티브 피로가 도래했을 때(모든 채널에서 도래합니다) 교체할 준비가 된 것이 없어 계정이 위기에서 위기로 흔들리게 만듭니다.

차이에 대한 논증은 내면화할 가치가 있습니다: 공정한 테스트에서 최고와 최악의 앵글 간의 격차는 일반적으로 당신이 통제할 수 있는 가장 큰 성능 레버입니다. 입찰 변경보다, 게재위치 조정보다 더 큽니다. 예산을 보호하기 위해 크리에이티브를 덜 테스트하는 것은 작은 레버를 최적화하면서 큰 레버를 무시하는 것입니다.

725,000개 이상의 라이브 크리에이티브가 보여주는 것#

OpenAdLibrary의 인덱스는 49개 네트워크(2026년 7월)의 29,000개 이상의 광고주로부터 725,000개 이상의 네이티브 광고 크리에이티브를 보유하고 있습니다. 광고주당 평균 약 25개의 크리에이티브이며, 경쟁이 치열한 수직 분야를 지배하는 광고주들은 훨씬 더 많이 운영합니다. 테스트 패턴은 원시 데이터에서 확인할 수 있습니다:

  • MediaGo 광고주가 홈 서비스 콘텐츠(뉴질랜드 주택 청소 요금)를 운영하면서 거의 동일한 헤드라인 변형을 동시에 여러 개 운영했습니다. 이는 입증된 단일 앵글에 대한 교과서적인 변형 테스트입니다.
  • 한 스킨케어 브랜드가 Taboola와 MGID에서 동시에 '한국인들은 이렇게 한다'라는 동일한 앵글을 운영했습니다. 이는 확장 전 하나의 앵글에 대한 교차 네트워크 검증입니다.
  • 한 기념 주화를 판매하는 이커머스 광고주가 MGID에서 동일한 크리에이티브의 두 가지 헤드라인 처리를 나란히 운영했습니다. 이는 최소한이지만 실제적인 A/B 구조입니다.

승자 간의 패턴은 산업화된 테스트입니다: 많은 동시 변형, 확장 전에 검증된 앵글, 그리고 패자에 대한 감상적인 태도 없음. 자신의 수직 분야에서 테스트 행동을 직접 읽을 수 있습니다. 광고 인텔리전스 인덱스에서 경쟁사의 라이브 크리에이티브 세트를 가져와 동시 변형 수를 세어보세요. 분석 워크플로는 승리하는 네이티브 광고 크리에이티브 분석 방법승리하는 네이티브 광고 앵글 찾는 방법에서 다룹니다.

종료 기준: 시작하기 전에 결정하세요#

테스트와 도박을 구분하는 규율은 사전 설정된 종료 규칙입니다. 시작하기 전에 다음을 적어 두십시오:

  • CTR 최저치. 크리에이티브당 적절한 노출 샘플 후, 캠페인의 중앙값 CTR보다 현저히 낮은 것은 모두 제거됩니다. 스스로와 재협상하지 마십시오.
  • 전환 최저치. 적절한 클릭 샘플 후, 전환당 비용이 목표보다 훨씬 높은 것은 모두 제거됩니다. CTR이 아름다워도 마찬가지입니다. CTR이 높은데 전환되지 않는 것은 가장 비싼 광고입니다.
  • 챔피언 조항. 입증된 승자는 나쁜 하루 하나나 시끄러운 게재위치 하나로 죽지 않습니다. 챔피언은 비슷한 볼륨과 비슷한 게재위치에서 판단하십시오. 그렇지 않으면 최고의 자산을 잡음 쫓느라 죽일 수 있습니다.
  • 혼동 요인 확인. 어떤 것을 제거하기 전에 차이가 게재위치 인공물이 아닌지 확인하십시오. 약한 퍼블리셔에서만 실행된 크리에이티브는 실제보다 나빠 보입니다.

그런 다음 주기를 유지하십시오: 매주 검토하고, 규칙에 따라 제거하며, 제거할 때마다 새로운 챌린저로 교체하여 그리드가 얇아지지 않도록 하십시오. 테스트 볼륨은 한 번의 이벤트가 아니라 지속적인 리듬입니다.

숫자를 현실로 만드는 주간 리듬#

종합하면 운영 루프는 다음과 같습니다. 월요일: 종료 규칙에 따라 그리드 검토 — 실패한 것은 은퇴시키고, 이유를 실행 기록에 남깁니다. 주중: 앵글 백로그에 따라 교체품을 제작하며, 초기 강세를 보이는 것의 변형과 매주 하나의 신선한 앵글에 편향되어 파이프라인을 정직하게 유지합니다. 금요일: 새로운 챌린저를 시작하여 주말 노출을 모으고 다음 검토 시 데이터를 가지고 오도록 합니다. 기록은 보이는 것보다 중요합니다. 몇 달 후에는 시장이 보상하는 앵글에 대한 개인 지도가 되며, 이는 다음 시작 그리드를 첫 번째보다 더 똑똑하게 만드는 자산입니다. 이 루프를 실행하는 바이어는 '테스트할 크리에이티브 수는 얼마나 되나요?'라는 질문을 더 이상 하지 않습니다. 답은 구조적이 됩니다: 입증된 35개의 광고를 라이브로 유지하고, 그 뒤에 항상 23개의 챌린저가 비행 중인 상태를 유지할 수 있을 만큼 충분히.

자주 묻는 질문

Taboola 캠페인당 테스트해야 할 광고 크리에이티브는 몇 개인가요?
일반적인 실무자 시작점은 34개의 진정으로 다른 앵글을 아우르는 610개의 크리에이티브이며, 클릭률 데이터가 확보되면 가장 좋은 3~5개로 줄입니다. Taboola는 초기에 참여를 유도하는 크리에이티브를 선호하므로, 넓은 그리드로 시작해 CTR이 약한 절반을 제거하는 것이 두 개의 광고를 시작하고 추측하는 것보다 비용이 적게 듭니다.
헤드라인과 이미지 중 먼저 테스트해야 할 것은 무엇인가요?
헤드라인입니다. 네이티브 게재위치에서 헤드라인은 설득의 대부분을 담당하며 클릭률 차이가 더 크게 나타나므로, 적절한 이미지와 함께 여러 헤드라인 처리를 테스트하면 앵글을 가장 빠르게 정렬할 수 있습니다. 헤드라인 앵글이 입증되면 이미지 변형은 승자에서 추가 CTR을 얻기 위한 저렴한 2단계 테스트가 됩니다.
크리에이티브를 판단하기 전에 얼마나 오래 실행해야 하나요?
시간보다는 두 단계로 판단하세요. 클릭률은 적절한 노출 샘플 이후에 판단할 수 있으며, 네이티브 네트워크는 이를 빠르게 제공합니다(종종 며칠 내). 전환 성과는 적절한 클릭 샘플이 필요하며, 이는 CPC와 예산에 따라 달라집니다. 시작 전에 두 기준을 모두 사전 설정하고, 달력이나 기분이 아닌 규칙에 따라 종료하세요.
한 번에 너무 많은 크리에이티브를 테스트할 수 있나요?
네. 전환 판단 단계에 도달하는 모든 크리에이티브는 CPC로 클릭 비용이 발생하므로, 너무 넓은 그리드는 예산을 분산시켜 어떤 것도 읽을 수 있는 샘플을 축적하지 못하게 합니다. 실질적인 상한선은 예산이 전환 판단까지 감당할 수 있는 크리에이티브 수입니다. 그보다 넓게 시작하는 것은 CTR이 대부분의 필드를 먼저 제거하도록 허용할 의향이 있는 경우에만 가능합니다.
가장 큰 네이티브 광고주들이 왜 그렇게 많은 크리에이티브를 운영하나요?
크리에이티브 다양성이 그들이 통제할 수 있는 가장 큰 성능 레버이고, 볼륨 테스트가 꼬리 부분의 승자를 찾는 방법이기 때문입니다. OpenAdLibrary의 인덱스는 29,000개 이상의 광고주당 평균 약 25개의 크리에이티브를 보여주며, 경쟁이 치열한 수직 분야의 지배적인 광고주들은 훨씬 더 많이 운영합니다. 동시 변형 테스트, 네트워크 간 앵글 검증, 지속적인 챌린저 순환은 라이브 크리에이티브 세트에서 확인할 수 있습니다.
OpenAdLibrary 팀
작성자OpenAdLibrary 팀
광고 인텔리전스 및 네이티브 광고 리서치

우리는 오픈 광고 투명성 플랫폼인 OpenAdLibrary를 구축합니다. 매일 저희 시스템은 Taboola, Outbrain, MGID, Revcontent, Teads, Yahoo 및 MSN에서 라이브 네이티브 광고를 캡처하고, 각 광고 뒤의 실제 광고주를 식별하며, 클릭을 따라 랜딩 페이지까지 추적합니다. 이 가이드는 해당 데이터에서 확인한 내용을 정제하여 시장을 더 빠르게 연구할 수 있도록 돕습니다.