모든 Amazon 제휴 자동화 도구는 결국 같은 질문을 받습니다:상품 페이지를 스크래핑하는 게 정말 괜찮은가? 정직한 답에는 두 가지 측면이 있습니다——기술적으로 Amazon 약관을 위반하는지, 그리고 실제로 단속되는지——이 둘은 서로 다릅니다.

여기서 말하는 "스크래핑"이란 정확히 무엇인가

이 맥락에서 "스크래핑"이란 공개적으로 보이는 상품 페이지——제목, 가격, 이미지, 평점——를 브라우저와 같은 방식으로 읽는 것을 뜻하며, API 키가 필요 없습니다. 이는 대부분의 제휴 도구가 시작하는 방식입니다. Amazon의 공식 상품 API(Product Advertising API, 그리고 더 새로운 Creators API 인터페이스)는 완전히 새로운 계정에는 열려 있지 않기 때문입니다. 먼저 유효하고 자격을 갖춘 Associates 계정이 필요합니다.

자격을 갖추면 왜 API 경로가 더 나은가

API는 구조화되고 라이선스가 부여된 동일한 데이터 접근을 제공합니다——스크래핑에는 없는 두 가지 실질적인 이점이 있습니다. 첫째, 안정성:페이지 레이아웃은 바뀌기 마련이고, 오늘 만든 스크래퍼는 내일 조용히 고장 날 수 있습니다;API 계약은 안정적입니다. 둘째, 더 중요한 점은 컴플라이언스입니다:Amazon 제휴 프로그램 정책은 표시하는 가격이 정확하고 최신이어야 한다고 요구하며, API는 페이지 전체를 계속 다시 가져오지 않고도 이를 대규모로 유지하기 위해 설계된 메커니즘입니다.

자격을 갖추는 기준

계정이 롤링 30일 동안 10건의 유효한 판매를 달성하면, Amazon은 Creators API 접근을 활성화합니다——이는 새 계정을 폐쇄로부터 지켜주는 것뿐인 "180일 내 3건 판매"(첫 번째 기준에 대한 가이드 참고)보다 더 높은, 또 다른 기준입니다. 실무적으로 이는 모든 제휴 사이트가 스크래핑으로 시작해서 실제 트래픽과 판매가 생긴 후에야 API로 졸업한다는 뜻입니다——이 초기 단계를 건너뛸 방법은 없습니다.

"규정을 준수하는 스크래핑"은 실무에서 어떤 모습인가

  • robots.txt와 속도 제한을 준수한다——고빈도 요청으로 페이지를 연속 공격하는 것은 API 접근 여부와 관계없이 IP 대역이 차단되는 원인이 되는 행동입니다.
  • 만료된 가격을 현재 가격으로 절대 표시하지 않는다——이는 데이터 출처와 무관하게 프로그램 정책 위반이며, 감사 팀이 실제로 확인하는 항목 중 하나입니다.
  • Amazon 약관에 따라 상품 이미지를 핫링크하고, 재호스팅하지 않는다——Amazon의 상품 사진을 다운로드해 자신의 미디어 라이브러리에 영구 저장하는 것은 API/스크래핑 약관이 특별히 막으려는 사용 방식입니다.
  • 자격을 갖추는 즉시 API로 전환한다——스크래핑이 작동을 멈추기 때문이 아니라, API야말로 오래가는 허용된 경로이며 "페이지 레이아웃이 또 바뀐 건 아닐까" 하는 고장 모드도 없애주기 때문입니다.

Pinery Flow는 이를 어떻게 처리하는가

Flow는 모든 사이트를 HTML 스크래핑으로 시작합니다——첫날에는 API 인증 정보가 필요 없습니다——그리고 계정이 30일 동안 10건의 판매라는 기준을 넘고 설정에서 활성화하면, 자동으로 Amazon Creators API로 전환됩니다. 어느 방식이든 상품 이미지는 항상 핫링크되며, 미디어 라이브러리에 다운로드되는 일은 없습니다.