テスト vs スケーリングの予算配分:教条ではない70/20/10
70/20/10は福音のように繰り返されますが、正しいテスト対スケーリング配分は、固定されたパーセンテージではなく、勝者インベントリと疲労率に依存します。代わりに、このフレームワークをお使いください。

テストとスケーリングの予算配分の一般的な出発点は、実証済みの勝者に約70%、すでに機能しているものの近いバリエーションに20%、真に新しいクリエイティブまたはオファーのテストに10%ですが、その70/20/10は調整のための出発点として扱い、盲目的に従うルールとしては扱わないでください。正しい配分は、現在の勝者の数、最高のクリエイティブの疲労の速さ、そして悪いテスト週を乗り切るための余力に依存します。
比率が重要ではない理由#
70/20/10(または80/15/5、60/30/10、誰に聞くかによります)のフレームワークは、他の情報がない人にとって妥当なデフォルトであるため繰り返されます。しかし、それは間違った質問に答えています。バイヤーが実際に行う必要がある決定は「テストに何パーセントを使うべきか」ではなく、「キャンペーンを危険にさらさずに今週いくら失っても大丈夫か、そして勝者のパイプラインを維持するために同時にいくつのクリエイティブコンセプトを実行する必要があるか」です。
これらの2つの質問は、アカウントサイズによって非常に異なる配分を生み出します。1日500ドルを支出し、10%をテストに充てるバイヤーは、新しい勝者を見つけるために1日50ドルしかなく、典型的なネイティブテストのコストでは、1つの新しいアングルの方向性を把握するのにほとんど十分ではありません。1日10,000ドルを支出するバイヤーは、テストに1日1,000ドルあり、4つまたは5つの実際のテストを並行して実行できます。パーセンテージは同じですが、実際のテスト能力は異なります。
配分を決める実際のインプット#
勝者インベントリ。 現在機能している広告が1つあり、それが早期の疲労兆候を示している場合、10%よりも積極的にテストする必要があります。なぜなら、悪い週が1つあれば勝者がゼロになるからです。異なるアングルで5つの安定した勝者がある場合、スケーリングに重点を置き、より控えめにテストすることができます。
疲労率。 ネイティブクリエイティブの疲労タイムラインはバーティカルとネットワークによって異なりますが、パターンは一貫しています:フリークエンシーが高まり、同じオーディエンスセグメントが広告を繰り返し見るにつれてパフォーマンスが低下します。典型的な勝者が劣化し始めるまでの日数を追跡し、その時点より前に代替を準備できるようにテスト予算を設定します。基礎となるメカニズムについては、クリエイティブ疲労を参照してください。
アカウントの余力。 支出を減らさなければならなくなるまでに、ビジネスは何週間の悪い週を吸収できますか? 余力が薄い場合、新しい勝者を見つける速度が遅くなっても、より小さく控えめなテスト配分が推奨されます。トレードオフは現実であり、それを取り除く公式はありません。
学習あたりのテストコスト。 低Tierの地域での安価なRevcontentまたはMGIDのテストでは、数百ドルで方向性を把握できます。金融や保険のような競争の激しいTier-1バーティカルでのTaboolaのテストでは、データが信頼できるようになるまでにかなり多くの支出が必要です。テスト配分の予算は、任意のドル額ではなく、実際の回答を得るためのコストに基づいて設定します。
固定比率ではなく実用的なフレームワーク#
- パーセンテージではなくテストの下限を設定する。 少なくとも2つの実際のクリエイティブまたはアングルのテストを統計的に有用なサンプルまで実行するために必要な最低週間ドル額を決定します。それが総支出に関係なくあなたの下限です。
- 残りを埋めるために勝者への配分をスケールする が、単一のクリエイティブまたはパブリッシャーに割り当てる額には上限を設けます。パブリッシャーレベルのパフォーマンスデータは、比例的にすべてを盲目的にスケールするのではなく、トリミングする価値のある弱い部分があることを示すことが多いからです。
- 反復のための中間層を確保する(まったく新しいコンセプトではなく):勝っているフックのバリエーション、実証済みの見出しの新しい画像、異なるCTA。これは完全に新しいコンセプトよりもテストが安く、ヒット率が高く、これが70/20/10の「20%」が実際に行っていることの大部分です。
- 毎月ではなく毎週見直す。 勝者が疲労し、新しいテストが成功または失敗するにつれて、正しい配分は変わります。固定された月次の配分は、クリエイティブの劣化が四半期ではなく日または週で測定されるチャネルではすぐに古くなります。
テスト予算は実際にどこに使うべきか#
すべてのネットワークや地域が同じテスト支出に値するわけではありません。安価な地域やネットワークでは、より速く安く方向性を把握できます。Tier-2の地域でMGIDやRevcontentで新しいアングルをテストしてから、Tier-1のTaboolaキャンペーンに投入するのは、間違った答えのコストが低いためよくあるパターンです。アングルが安価に機能するなら、プレミアムインベントリにスケールする方がはるかに安全です。また、類似のアングルがすでに他の場所で実証されているかどうかを確認することも有益です。ゼロからコンセプトをテストする予算を使う前に、すでにあなたのバーティカルで公開されている勝っているネイティブ広告クリエイティブの分析を行うことで、自分でお金を払って見つける前にアングルに将来性があるかどうかがわかります。
アカウントサイズ別の実例#
2つのアカウントがどちらも名目上70/20/10の配分を実行しているとします。アカウントAは1日400ドルを支出し、その10%のテスト配分は1日40ドルで、ほとんどのネイティブネットワークでは、Tier-1バーティカルで1週間以内に1回のコンバージョンに達するのに十分ではなく、2つのコンセプトを比較することはもちろんできません。アカウントBは1日8,000ドルを支出し、その10%は1日800ドルで、3つまたは4つの実際のテストを同時に実行し、数日以内に信頼できる読み取りを得るのに十分です。
アカウントAの修正は通常「テストを減らす」ことではなく、テストの下限をパーセンテージではなく固定ドル額にするように比率を再構築することです:たぶん総支出のシェアとして何を表すかに関係なく1日150ドル。テストの質を有用なデータを生成できる点以下に下げるのではなく、スケーリング配分をわずかに削ることで賄います。実際のサンプルに到達できないテストは安くはなく、何も学ばずにお金を使う方法であり、まったくテストしないよりも悪いです。
配分を変更する必要があるシグナル#
定期的なレビューを待つのではなく、注意すべき具体的なトリガーをいくつか挙げます:
- 最高のクリエイティブのパフォーマンスが2週連続で低下している。 それは早期の疲労シグナルであり、テストパイプラインにはすでに候補が準備されている必要があり、勝者が完全に劣化してからゼロから始めるのではありません。
- 最近のテストのヒット率が異常に高い。 直近5回のテストのうち3回が実行可能な勝者になった場合、それはあなたが引き出しているバーティカルまたはアングルプールが現在異常に肥沃である証拠であり、固定比率に固執するよりも一時的により多くのテストに傾けることで、より速く複利効果を得られます。
- 一貫したテスト支出にもかかわらず、1か月間新しい勝者がゼロだった。 これは比率を変更するというよりも、テストコンセプトの出所を調べるシグナルです。弱いコンセプトにさらに多くのテスト予算を投入しても、予算をより早く消費するだけです。
配分に関するよくある間違い#
- 結果に関係なく比率を固定と見なす。 テストが高いヒット率で勝者を生み出している場合、それはさらに傾けるシグナルであり、機械的に10%で上限を設けることではありません。
- 一度に多くの変数をテストする。 見出し、画像、ランディングページを同時に変更するテストでは、どの変更が重要だったかわかりません。予算が許す限り変数を分離します。
- テストを早すぎる段階で打ち切る。 支出の1日目または2日目で判断される資金不足のテストは、通常、シグナルではなくノイズで判断されます。決定する前に、実際に必要なサンプルに合わせてテスト予算を設定します。
- 「スケーリング」支出を再検討しない。 勝者に割り当てられたお金は設定したら終わりではありません。勝者を勝ち続けさせるためには、継続的なパブリッシャーレベルおよびデバイス/地域の入札規律が必要です。
配分が機能しているかどうかを知る方法#
4週間のローリングウィンドウで単純な比率を追跡します:テストに費やしたドル対生産された新しい勝者。その比率が悪化している場合(見つかった勝者あたりのテストドルが増加)、問題は通常配分のパーセンテージではなく、テストに投入されるコンセプトの質です。現在バーティカル全体で実際に機能しているものから情報を得たより良いインプットが、予算比率を再編成するよりも早くそれを修正します。
70/20/10は新しいアカウントの初日には良い出発点です。4週目までには、あなた自身の疲労率、勝者数、テストヒット率が数字を決めるべきであり、ブログ記事で読んだルールではありません。







