2026년 8월 초, 수십 명의 아마존 고객들은 상품 카드에서 단 8개의 리뷰만 보인다는 것을 발견했습니다 — 정렬도, 필터도 없고, 나머지를 열 수 있는 옵션도 없었습니다. 아무런 경고도 없었습니다. 고객 지원팀은 이것이 "커뮤니티 콘텐츠 수집 및 추출과 관련된 이용 약관 위반"이라고 설명했습니다. 즉, 플랫폼이 실제 사람들을 스크래퍼로 오해한 것입니다.
이 이야기는 다른 사건과 날짜가 겹치지 않았다면 단순한 해프닝처럼 보였을 것입니다: 2026년 8월 4일, 제9 순회 항소 법원은 아마존이 AI 에이전트 Perplexity Comet에 대해 부과한 법적 금지를 해제했습니다. 자동화에 대한 법적 싸움은 실패했으며, 거의 동시에 기술적 압박이 급격히 강화되었습니다. 무엇이 일어났는지, 그리고 이것이 공개 데이터를 수집하는 모든 사람들에게 왜 게임의 규칙을 바꾸는지를 살펴보겠습니다.
무슨 일이 있었나: 8개의 리뷰와 5일간의 항소
대규모 제한 사항에 대한 보고는 2026년 8월 3일과 4일에 TechSpot, Android Authority 및 Shopifreaks에서 이루어졌습니다. 피해자들의 상황은 동일합니다:
- 모든 상품에서 전체 목록 대신 단 8개의 리뷰만 이용 가능;
- 리뷰 정렬 및 필터링 도구가 사라짐;
- 제한에 대한 알림이 없음 — 사용자가 스스로 알게 됨;
- 차단을 해제하려면 지원팀에 문의하고 최대 5영업일을 기다려야 함.
피해자 중 한 명인 프레드 홀은 7월 중순에 공기 청정기를 조사하던 중 제한에 직면했습니다. 채팅 운영자는 사용자 콘텐츠 추출과 관련된 이용 약관 위반을 언급했고, 항소는 몇 일 후 아무런 설명 없이 승인되었습니다. 두 번째 사례는 더 주목할 만합니다: 숀 카우프만은 모든 상품에서 동일한 8개의 리뷰 제한을 받았습니다. 그는 VPN, 광고 차단기 또는 AI 브라우저를 사용하지 않으며, 경쟁 상품을 오랫동안 비교하고 리뷰를 주의 깊게 읽는 것이 유일한 특징입니다. 아마존은 그에게 10달러를 제공했으며, 5일 후에 접근을 복원했습니다.
회사의 공식 댓글은 다음과 같습니다: "고객이 리뷰에 접근할 수 없었던 개별 사례가 있었음을 이해하며, 접근을 보장하기 위해 노력했습니다." 아마존은 그러나 중요한 세부 사항을 공개하는 것을 거부했습니다: 영향을 받은 계정 수, 감지기를 작동시키는 행동, 제한 시작 날짜, 항소 심사 원칙 등. 논의에 따르면, 개별 불만은 2025년 11월부터 존재해 왔으며 — 즉, 이 메커니즘은 오래전부터 작동해 왔고, 8월에 단지 눈에 띄게 된 것입니다.
왜 지금인가: 법원이 아마존의 편리한 도구를 빼앗았다
맥락을 이해하기 위해 아마존과 Perplexity 간의 갈등 연대기를 살펴볼 필요가 있습니다.
- 2024년 11월 — 2025년 11월. 아마존은 Perplexity에 대해 사용자 대신 에이전트 구매를 중단하라는 경고를 최소 5차례 보냈다고 주장합니다.
- 2025년 8월. 아마존은 Comet에 대한 기술적 장벽을 설정합니다. 아마존의 주장에 따르면, Perplexity는 24시간 이내에 에이전트를 일반 Chrome 세션으로 위장하여 우회했습니다.
- 2026년 3월 10일. 샌프란시스코의 맥신 체스니 판사는 임시 금지 명령을 발부합니다: Comet은 아마존의 비밀번호 보호 구역에 접근하거나 사용자를 대신해 구매할 수 없습니다. 핵심 문구는 에이전트가 "아마존 사용자의 허가를 받았지만 아마존의 승인은 받지 않았다"는 것입니다.
- 2026년 8월 4일. 제9 순회 법원이 금지를 해제합니다. 법원은 아마존이 컴퓨터 사기 및 남용법(CFAA)에서 승소할 가능성이 낮다고 판단했습니다: 사용자가 어시스턴트에게 작업을 맡길 때, 아마존 서버에 접근하는 것은 사용자 자신이며, Perplexity가 아닙니다. CFAA는 고의적인 무단 접근과 연간 5000달러 이상의 손해를 입증해야 하며 — 법원은 이러한 요소를 발견하지 못했습니다.
아마존은 "존중을 표하며" 판결에 동의하지 않는다고 응답했으며, 재심을 요청할 권리를 보유한다고 밝혔습니다. 샌프란시스코 법원에서 사건은 아직 종료되지 않았으며 — 임시 금지 명령만 해제되었습니다. 그러나 시장에는 이미 신호가 전달되었습니다: 사람의 직접적인 지시에 따라 작동하는 에이전트의 행동을 해킹으로 간주하려는 시도는 현재로서는 통과되지 않습니다.
Perplexity는 이 모든 시간 동안 소송이 안전을 보호하는 것이 아니라 광고 수익을 보호한다고 주장했습니다: 에이전트는 사람이 보는 광고 결과를 우회하여 상품을 구매합니다. 이 주장은 그리 터무니없는 것이 아닙니다: 아마존의 광고 사업은 2025년까지 560억 달러로 평가되었으며, 이 모든 수익은 실제 구매자가 직접 진열장을 보는 것에 의존합니다.
법원이 도움이 되지 않을 때 플랫폼이 남기는 것은 무엇인가
아마존은 오랫동안 두 전선에서 싸움을 벌여왔습니다. 법원 외에도, 회사는 robots.txt를 통해 AI 크롤러의 접근을 지속적으로 차단하고 있습니다: 차단된 목록에는 메타, 구글, 화웨이 및 미스트랄의 봇이 포함되어 있으며, 그보다 이전에는 앤트로픽, 퍼플렉시티 및 구글 프로젝트 마리너의 크롤러도 포함되었습니다. 비교를 위해, 월마트와 이베이는 robots.txt에 이러한 차단을 설정하지 않았습니다. 문제는 robots.txt가 요청일 뿐이며, 자발적으로 준수하는 사람에게만 작용한다는 것입니다.
따라서 논리적인 단계는 동의가 필요 없는 수준으로 보호를 이전하는 것입니다. 리뷰와 관련된 이야기가 바로 그렇습니다: 특정 봇을 이름으로 차단하는 대신, 플랫폼은 세션의 행동을 평가하기 시작하고, 패턴이 기계와 유사한 사용자에게 결과를 줄입니다. 리뷰는 마켓플레이스에서 가장 가치 있고 복사하기 쉬운 자산이므로, 실험은 바로 그들로부터 시작되었습니다.
이러한 접근 방식의 실제 문제는 오탐지입니다. 행동 분류는 상호작용의 동적에 의존합니다: 이동의 리듬과 속도, 일시 정지, 전환의 순서, 깊이 및 반복성. 열 개의 공기 청정기를 체계적으로 비교하고 각 제품의 모든 리뷰를 열어보는 사람은 이러한 메트릭에 따라 파서처럼 보입니다. 카우프만의 사례는 교육용 일러스트레이션입니다: 깨끗한 IP, 일반 브라우저, 자동화 없음, 그럼에도 불구하고 차단되었습니다.
주요 결론: 깨끗한 IP는 더 이상 통행증이 아니다
공개 데이터를 수집하는 사람들에게 이 이야기에서 불쾌한 점이 있습니다. 이전에는 논리가 간단했습니다: IP의 평판이 나쁘면 차단, 평판이 좋으면 접근 허용. 이제 아마존은 완벽한 네트워크 신호에 반하여 결정이 내려질 수 있음을 보여주었습니다. 사용자는 자국의 홈 프로바이더를 통해, 실제 Chrome에서, 수년간의 구매 이력을 가지고 앉아있지만 — 그럼에도 불구하고 연속으로 너무 많은 리뷰를 읽기 때문에 제한을 받습니다.
이는 데이터 수집 인프라의 우선순위를 변경합니다. 질 좋은 주거용 프록시는 여전히 필요합니다 — 없이는 첫 번째 필터를 통과할 수 없고, 현지 구매자와 동일한 결과를 볼 수 없습니다. 그러나 더 이상 충분한 조건이 아닙니다: 좋은 IP 위에 기계적 리듬으로 작동하는 로봇이 있다면, 감지기는 두 번째 레이어에서 당신을 잡아낼 것입니다. 이 레이어가 어떻게 구성되어 있는지에 대한 자세한 분석은 행동 생체 인식 및 프록시에 대한 우리의 자료에서 확인할 수 있습니다.
실제로 해야 할 일
- “개인”과 “업무”를 물리적으로 분리하세요. 경쟁자의 가격과 리뷰를 모니터링할 때, 구매자 계정에 로그인하는 동일한 브라우저와 IP를 사용하면 데이터와 계정 모두 위험에 처합니다. 별도의 프로필, 별도의 출발 주소, 별도의 세션을 유지하세요.
- 하나의 풀 — 하나의 작업. Buy Box 모니터링, 리뷰 수집 및 재고 확인은 동일한 주소 세트를 통해 진행되어서는 안 됩니다: 이러한 작업은 요청 패턴이 다르며, 이를 혼합하는 것은 구성 요소 중 어떤 것보다 더 눈에 띄는 복합 지문을 수집하는 것입니다.
- 세션당 깊이를 제한하세요. 8개의 리뷰는 우연한 숫자가 아닙니다: 이는 플랫폼이 정상적인 관심으로 간주하는 임계값입니다. 모든 피드를 한 번에 끌어내기보다는 다양한 세션을 통해 리뷰를 부분적으로 수집하세요.
- 인간의 리듬을 유지하세요. 무작위 일시 정지, 불규칙한 전환 속도, 자연스러운 순서(상품 카드 → 리뷰 → 결과로 돌아가기)는 요청의 총알처럼 수천 개의 주소를 회전하는 것보다 비용이 적게 듭니다.
- 오류뿐만 아니라 저하를 모니터링하세요. 아마존 접근 방식에서 가장 교활한 점은 403을 반환하지 않는다는 것입니다. HTTP 200을 반환하지만 콘텐츠가 축소된 상태로 반환합니다. 응답 코드만 확인하는 파서는 수개월 동안 3000개의 리뷰 중 8개만 데이터베이스에 기록하고 경고 신호를 전혀 보내지 않을 것입니다. 완전성을 확인하세요: 요소 수, 페이지네이션의 존재, 필터 블록의 존재 등을 확인하세요.
- 예비를 마련하세요. 2026년 웹 스크래핑 상태 조사(Apify 및 The Web Scraping Club)에 따르면, 65.8%의 전문가가 작년보다 더 많은 프록시를 사용하게 되었고, 58.3%는 예산을 늘렸습니다 — 기가바이트 가격이 전반적으로 하락했음에도 불구하고. 가격이 오르는 것이 아니라 필요한 양과 복잡성이 증가하고 있습니다. 43.1%의 팀이 내구성을 위해 이미 2~3개의 공급자를 보유하고 있습니다.
반대 트렌드도 염두에 두어야 합니다: 일부 플랫폼이 필터를 숨기는 동안, 산업은 "좋은" 자동화 기계를 합법화하려고 시도하고 있습니다 — 요청의 암호화 서명 및 에이전트의 명시적 식별을 통해. 이것이 어떻게 작동하는지는 Web Bot Auth 및 서명된 에이전트에 대한 기사에서 다루었습니다. 문제는 서명된 에이전트가 본질적으로 플랫폼의 자비에 자신을 맡긴다는 것입니다: 아마존은 기꺼이 봇임을 알아차리고 거부할 것입니다.
앞으로 몇 달간 영향을 받을 사람들
정직한 차단 대신 조용한 결과 축소는 쉽게 복제할 수 있는 방법입니다. 아마 다른 플랫폼에서도 이를 볼 수 있을 것입니다: 이는 CAPTCHA보다 저렴하고, 이탈률 메트릭을 손상시키지 않으며, 스크래퍼에게 자신이 감지되었다는 명확한 신호를 주지 않습니다.
데이터의 완전성이 중요한 시나리오, 즉 상품 분석을 위한 리뷰 분석, 평판 모니터링, 사용자 콘텐츠에 대한 모델 학습, 판매자 경쟁 정보 수집이 가장 위험합니다. 마켓플레이스와 작업하는 경우, 필터 우회를 위한 기본 관행을 다시 읽는 것이 유용합니다 — 예를 들어, 아마존 가격 파싱 시 안티봇 보호 우회에 대한 우리의 분석을 참고하고 응답의 불완전성을 확인하는 절차를 추가하세요.
일반 사용자에게도 영향을 미칩니다. 봇으로 오해받은 사용자는 마켓플레이스에 들어간 이유인 상품에 대한 리뷰를 읽을 수 있는 기능을 잃게 됩니다. 경고도, 설명도, 복원에 대한 명확한 기한도 없이 — 오직 지원팀에 이메일을 보내고 5영업일을 기다려야 합니다.
결론
2026년 8월은 갈림길을 기록했습니다. 제9 순회 법원은 사실상 "사람의 지시에 따라 행동하는 에이전트는 사람이다"라고 말하며, 그를 컴퓨터 남용법에 적용할 수 없다고 밝혔습니다. 플랫폼은 이 응답을 이해하고, 법원 없이 결정이 내려지는 행동 필터로 전투를 옮겼습니다. 아마존의 댓글에 따르면, 8개의 리뷰로 제한된 실제 구매자에 대한 부수적 피해는 그들을 그리 걱정하지 않는 것 같습니다.
실천을 위한 결론은 간단합니다: 데이터 수집 인프라는 "좋은 IP를 찾는" 문제가 아닙니다. 좋은 IP는 입장권일 뿐이며, 그 이후에는 행동과 요청 수에 따라 평가됩니다. 예산, 요청 깊이 및 응답의 완전성을 계획하고, 데이터가 도착했는지 확인하는 것뿐만 아니라, 도착해야 할 양이 도착했는지도 확인하세요.
```