Skip to main content

使用异步端点大规模抓取亚马逊数据

本指南展示如何使用异步 /trigger 端点大规模抓取亚马逊数据。当您有超过 20 个 URL、需要发现功能或想要将数据传送到 webhook 或 S3 时,可以使用此方法。
不确定是否使用同步或异步?请阅读 了解同步与异步请求

前置要求

步骤 1:触发收集

/trigger 端点发送 POST 请求,包含您的输入 URL:
您应该会看到一个 200 响应,其中包含 snapshot_id
保存此 ID。您需要它来检查进度和下载结果。

步骤 2:监控进度

轮询快照状态,直到显示 ready。根据 URL 数量,这可能需要 30 秒到几分钟。
状态值:

步骤 3:下载结果

状态为 ready 后,下载抓取的数据:
您已成功触发、监控并下载了批量亚马逊抓取任务。

使用 webhook 跳过轮询

如果您不想轮询状态,请向请求添加 endpoint 参数以自动接收结果:
参见 如何通过 webhook 接收亚马逊数据 了解完整设置。

限制和约束

故障排除

您已超过并发请求限制。减少并行请求的数量或将输入合并为更少的较大批次。每个批次可以包含最多 1 GB 的输入数据。
检查所有输入 URL 是否为有效的亚马逊 URL。查看快照响应中的错误详情,或在您的 Bright Data 仪表板的 日志选项卡 中查看。
某些 URL 可能在整个任务成功的情况下单独失败。检查快照响应中的任何 errors 字段。在单独的请求中重试失败的 URL。

后续步骤

设置 webhook

无需轮询即可接收结果。

传送到 S3

将结果直接发送到您的 S3 存储桶。