Skip to main content
本指南介绍如何向每个 Bright Data Reddit 爬虫 API 端点发送同步请求。完成后,你将拥有收集帖子、发现帖子和收集评论的可用示例。

前提条件

请求结构

每个同步请求都遵循相同模式:
端点之间唯一变化的是 dataset_id 和输入形式。
同步请求最多支持 20 个 URL,超时限制为 1 分钟。如果请求时间更长,API 会自动返回 snapshot_id。参见 异步请求

帖子 — 按 URL 收集

通过 URL 爬取特定 Reddit 帖子。 数据集 ID: gd_lvz8ah06191smkebj4
你应该看到 200 响应。这需要 10 到 30 秒。 完整帖子 — 按 URL 收集模式

帖子 — 按子版块 URL 发现

爬取来自特定子版块的最近帖子,可选按 newtophot 排序。 数据集 ID: gd_lvz8ah06191smkebj4
发现端点最好通过 /trigger 异步使用,因为它们可能返回许多结果。下面的同步示例仅用于快速测试。
完整按子版块 URL 发现模式

帖子 — 按关键词发现

查找匹配搜索词的 Reddit 帖子,按日期过滤。 数据集 ID: gd_lvz8ah06191smkebj4
完整按关键词发现模式

评论 — 按 URL 收集

爬取来自 Reddit 帖子或特定评论线程的所有评论,可选按年龄过滤。 数据集 ID: gd_lvzdpsdlw09j6t702
完整评论 — 按 URL 收集模式

相关内容

异步批量请求

在单个异步请求中爬取数千个帖子或运行关键词发现任务。

API 参考

完整端点规范、参数和响应模式。