前提条件
- 一个带有有效 API 密钥的 Bright Data 账户
- 已完成 快速开始
请求结构
每个同步请求都遵循相同模式:dataset_id 和输入形式。
同步请求最多支持 20 个 URL,超时限制为 1 分钟。如果请求时间更长,API 会自动返回
snapshot_id。参见 异步请求。帖子 — 按 URL 收集
通过 URL 爬取特定 Reddit 帖子。 数据集 ID:gd_lvz8ah06191smkebj4
200 响应。这需要 10 到 30 秒。
完整帖子 — 按 URL 收集模式
帖子 — 按子版块 URL 发现
爬取来自特定子版块的最近帖子,可选按new、top 或 hot 排序。
数据集 ID: gd_lvz8ah06191smkebj4
发现端点最好通过
/trigger 异步使用,因为它们可能返回许多结果。下面的同步示例仅用于快速测试。帖子 — 按关键词发现
查找匹配搜索词的 Reddit 帖子,按日期过滤。 数据集 ID:gd_lvz8ah06191smkebj4
评论 — 按 URL 收集
爬取来自 Reddit 帖子或特定评论线程的所有评论,可选按年龄过滤。 数据集 ID:gd_lvzdpsdlw09j6t702
相关内容
异步批量请求
在单个异步请求中爬取数千个帖子或运行关键词发现任务。
API 参考
完整端点规范、参数和响应模式。