每個 Amazon 聯盟自動化工具遲早都會被問到同一個問題:爬取商品頁面真的沒問題嗎?誠實的答案有兩部分——技術上是否違反 Amazon 的條款,以及實際上會不會被追究——而這兩者並不相同。

這裡說的「爬蟲」到底是什麼

在這個脈絡下,「爬蟲」指的是讀取公開可見的商品頁面——標題、價格、圖片、評分——方式跟瀏覽器一樣,不需要 API 金鑰。這是多數聯盟工具起步的方式,因為 Amazon 的官方商品 API(Product Advertising API,以及較新的 Creators API 介面)並不對全新帳號開放。你得先擁有一個有效、符合資格的 Associates 帳號。

為什麼一旦符合資格,API 路線更好

API 提供的是結構化、有授權的相同資料存取——比爬蟲多了兩個實際優勢。第一,穩定性:頁面版型會變,今天寫好的爬蟲明天可能悄悄失效;API 合約則是穩定的。第二,也更重要的一點是合規:Amazon 聯盟計畫政策要求你顯示的價格必須準確且即時,而 API 正是為了在不用不斷重新抓取整頁的情況下,大規模維持這一點所設計的機制。

符合資格的門檻

當帳號在滾動 30 天內累積 10 筆有效銷售,Amazon 就會啟用 Creators API 存取——這是比「180 天內 3 筆銷售」(只是用來保住新帳號不被關閉)更高的另一道門檻(見我們的首道門檻指南)。實務上,這代表每個聯盟網站都是從爬蟲起步,等有了真實流量與銷售之後才升級到 API——沒有辦法跳過這個早期階段。

「合規的爬蟲」在實務上長什麼樣

  • 遵守 robots.txt 與速率限制——用高頻請求連續轟炸頁面,正是導致 IP 段被封鎖的行為,不管你有沒有 API 存取權。
  • 絕不把過期價格當成現在的價格顯示——這無論資料來源為何都是違反計畫政策的行為,也是稽核團隊實際會檢查的一項。
  • 依 Amazon 條款熱連結商品圖片,而非重新託管——把 Amazon 的商品攝影下載並永久存進自己的媒體庫,正是 API/爬蟲條款特別要防止的使用方式。
  • 一旦符合資格就切換到 API——不是因為爬蟲會失效,而是因為 API 才是長久、被允許的路線,還能消除「頁面版型是不是又變了」這種失效模式。

Pinery Flow 如何處理這件事

Flow 讓每個網站都從 HTML 爬蟲起步——第一天不需要任何 API 憑證——並在你的帳號跨過 30 天內 10 筆銷售的門檻、且你在設定中啟用後,自動切換到 Amazon Creators API。無論哪種方式,商品圖片都保持熱連結,絕不會下載進你的媒體庫。