2026年8月21日、データドームの脅威研究担当副社長であるジェローム・セギュラは、鉄道メディアで広まった数字を発表しました:ある大手小売業者のDDR5メモリカードでは、ボットが全トラフィックの91%を占めており、約10回の自動リクエストが1回の生の訪問に相当します。今年の春には、その比率は6:1でした。数ヶ月で、商品のページに対する自動化の圧力はほぼ倍増しました。
合法的に価格と在庫を収集している人々にとって、リプライシング、MAP管理、品揃え分析などは、これは悪いニュースです。「競合のスカルパーが先を行っている」からではなく、今や小売業者が通常の価格監視とスカルパーボットの行動プロファイルに基づいて防御を設定しているためです。
何が見つかったのか、そしてどれほど信じるべきか
公表された事実は、データドームの2つの報告書から成り立っています。3月の分析では、1つのキャンペーンの詳細が提供されました:1時間あたり50,000件以上のリクエスト、91の製品が監視されており、平均して551リクエストが1つのカードに対して行われる、つまり6.5秒ごとに在庫を確認することになります。1つの操作は、ブロックされる前に1000万件以上のリクエストを行いました。8月の更新では、91%のトラフィックと10:1の比率が追加されました。
ここで、数字がマーケティングのノイズに変わることなく、正直な注意点を挙げます:
- これは1つの無名の小売業者であり、市場全体のスナップショットではありません。
- データドームはサンプリングウィンドウと方法論を公表しておらず、「悪いボット」と見なされるものは彼らの裁量に委ねられています。
- この会社は、まさにこのトラフィックをブロックする製品を販売しています。利害の対立はデータを無効にするわけではありませんが、修正を必要とします。
- 最も重要なこと:ページへのリクエストは購入ではありません。このメトリックは、リスティングに対する監視の圧力を示しており、ボットによって実際に購入された商品の割合を示しているわけではありません。
最後のポイントは、他のすべてのポイントよりも重要です。91%の「ボットトラフィック」は、91%のスカルパーではありません。この割合には、すべての自動化が含まれます:価格アグリゲーター、他のリプライサー、割引追跡サービス、分析クローラー、そしてあなた自身の監視が含まれます。小売業者は1つの全体的な流れを見ており、それに対して1つの一般的なルールで反応します。
なぜこれが起こるのか:メモリが希少な資産になった
コンテキストはシンプルです。1年前に約$72だった32GB DDR5-6000キットは、8月には平均$392で販売されています。64GBキットは約485%値上がりし、$1118になりました。8月初めのDDR4チップのスポット価格は記録的な$42.45を記録しました。トップの128GBセットはほぼ10倍に増加しました。原因はゲーム用メモリではなく、生産能力はAIアクセラレーター、HBM、サーバーメモリを消費しています。業界予測によれば、データセンターは2026年に世界のメモリチップ生産の約70%を占めるとされており、供給不足は2027年第4四半期まで続く見込みです。
商品が5倍高騰し、棚から消えると、小売価格と転売価格の違いは転売インフラを正当化します。これが強度の原因です。ターゲットは消費者小売を超え、MicronやApacerのような供給業者のページ、DIMMソケットやCAMM2コネクタの製造業者(Amphenol、TE Connectivity)にまで及びます。転売業者はサプライチェーンの上流に移動しました。
合法的な監視が苦しむ理由
以下はデータドームの報告書からのボットの行動の説明です。自分のスクレイパーのチェックリストとして読んでください:
- キャッシュバイパス。 各HTTPリクエストにユニークなパラメータが追加され、新しいページを取得するためにCDNからの応答ではなくなります。
- 人間のリズム。 通常の活動時間を模倣した昼夜の負荷プロファイル。
- しきい値以下のテンポ。 ボリュメトリックアラートが発動しないように、頻度が調整されています。
- フラットなセッション。 1つのカードにアクセスし、退出します。カート、検索、カタログの移動はありません。
次に、典型的な企業の価格監視を見てみましょう。彼らは自分のデータベースからSKUへの直接リンクをたどります。彼らは昨日のキャッシュされた価格をキャッチしないようにパラメータを追加します。彼らは「バンされないように」経験則で調整された固定間隔で動作します。そして、彼らは決してカートに何も入れません。これが同じシグネチャです。 違いは意図だけであり、意図はアンチボットエンジンでは測定されません。
実際の結論は不快です:スカルパーに対する保護の強化は、自動データ収集にも自動的に影響を与え、「説明する」相手はいません。私たちはすでに別のプラットフォームで似たような効果を検討しました — Amazonが行動のしきい値に基づいて通常の顧客をボットとしてマークし始めた時のことです。
今すぐデータ収集で何を変えるべきか
ここでIPプールを変更してもあまり効果はありません:信号は行動によって与えられ、アドレスではありません。実際にブロックの割合を減少させる作業の順序は次のとおりです:
- 均一なテンポを排除する。 6.5秒ごとのリクエストはメトロノームの精度で行われます — これは「人間らしくない」、これは署名です。広範囲のジッター(例えば、1つのポジションに対して20〜180秒)と曜日ごとの異なる分布が必要です。
- 各リクエストでキャッシュを壊すのをやめる。 URL内のユニークなキャッシュバスターは、自動化の最も安価なマーカーです。新鮮さを確認する必要があるのは選択的であり、ボラティリティの高いSKUのみに限ります。他はそのまま取得します。
- セッションに深さを与える。 カテゴリまたは検索を介して入場し、1つまたは2つの隣接商品を見た後にターゲットカードに進みます。トラフィックは高くなりますが、「フラット」プロファイルを排除します。
- ボラティリティに基づいてSKUの優先順位を付ける。 価格が週に1回変わる商品は、30分ごとに問い合わせる必要はありません。頻度は変動に従うべきであり、リストのサイズに従うべきではありません。
- タスクのクラスごとにプールを分割する。 小売監視、検索結果の確認、レビュー収集は同じアドレスから行われるべきではありません:1つのシナリオでの保護の発動は他のシナリオを殺すべきではありません。大手チェーンの製品カードには、レジデンシャルプロキシが最も安定して機能し、データセンタープールは公開APIや独自の確認に残すのが理にかなっています。
- ギガバイトではなく成功したレコードをカウントする。 保護が強化されると、リトライの割合が増加し、ギガバイトあたりの価格は現実を反映しなくなります — なぜ$/GBが嘘をつくのか、成功したレコードのコストをどう計算するかについては別途検討しました。リスティングへの10件中9件のリクエストが自動化されている状況では、「データベース内の有効な価格のコスト」というメトリックが唯一の正直なものになります。
自分がすでにカットされていることをどう理解するか
商品ページでのブロックは、正直な拒否のようには見えません。むしろ静かで、監視は依然としてデータベースにゴミを書き続けます。これをキャッチするための兆候は次のとおりです:
- タスクのボリュームが変わらないのに429および403の割合が増加する — これは、レスポンスコードをログに書き込んでいる場合、最も簡単な指標です。
- 常に「在庫なし」が表示される。 クラシックなソフトな応答:ページは表示され、価格はそのままですが、ストックのブロックが置き換えられています。監視は有効なHTMLを見ており、警告を発しません。
- 価格が「固定」する。 1週間前のキャッシュされたバージョンが返されます — ボットがパラメータでキャッシュを壊し始めた理由と同じ効果です。
- 特にカードでの応答の遅延が増加する 一方、カテゴリや検索は正常に開かれます:疑わしいセグメントにスロットリングが適用されました。
- サンプルの急激なばらつき。 一部のSKUのデータが更新され、他の一部が完全に停止している場合 — あなたはすでに部分的にフィルターにかかっていますが、完全にはかかっていません。
実務的なアプローチは、価格を手動または独立した別のソースから確認できる「コントロール」商品を数点保持し、1日に1回それらを照合することです。コントロールグループとブラウザで見えるものとの不一致は、パーサーを修正するのではなく、リクエストプロファイルを修正する必要があることを意味します。
なぜ単なるIPローテーションではもはや問題を解決できないのか
アドレスの変更がますます効果を失っている理由は、ブロックの決定が複数のレイヤーで同時に行われ、IPはそのうちの最初のものであるためです。
- ネットワーク層。 アドレスと自律システムの評判、データセンター範囲の割合、同じサブネットからのリクエストの密度。ここではローテーションが実際に役立ちます。
- トランスポートおよびクライアント層。 TLSフィンガープリンティング、ヘッダーの順序、クライアントのバージョン。2021年のライブラリで珍しい暗号の組み合わせは、ビジネスロジックに到達する前に自らを明らかにします。
- 行動層。 データドームが説明したその層:インターバル、セッションの深さ、カートと検索の不在、キャッシュバスター。この層はIPに全く依存していません — 各リクエストでアドレスを変更しても、同じボットであり続けることができます。
したがって、8月のストーリーの主な実践的な主張は、プールの質への投資は、行動の修正と共にのみリターンをもたらすということです。最初のものは、いずれにせよ第三層でフィルタリングされるトラフィックの支払いです。
今後の展望
メモリの不足は数年続くため、商品ページへの圧力は減少しません。小売業者は明らかな方法で応答します:購入制限、行列、在庫確認のための必須認証、単純なIP制限の代わりに行動スコアリング。これらの対策の一部はすでにチケットやスニーカーの分野では標準となっており、今やコンピュータハードウェアや産業コンポーネントにも広がっています。
外部データに依存しているチームにとって、これはアプローチの変更を意味します:「IPローテーションを設定して収集する」時代は、商品が希少な場所では終わりました。機能するのは、現実的なテンポ、意味のあるセッションの深さ、プールの分割、結果のコストの冷静な考慮です。価格収集を構築している場合は、私たちの分析からの基本的なスキームを使用して始め、eコマースのためのプロキシ:価格のスクレイピングと競合の監視からの行動修正をその上に重ねてください。
最後に、91%という数字は、ボットが多すぎるという信号ではなく、希少商品ページが自動化が自動化と競い合う場になったという信号です。このような環境では、より頻繁に問い合わせる者ではなく、フィルターに引っかかりにくい者が勝ちます。
