Skip to main content
本教程向你展示如何使用 Bright Data Reddit 爬虫 API 爬取 Reddit 帖子并获得结构化 JSON 数据。

前提条件

  • 一个 Bright Data 账户(每月含 5,000 个免费积分)
  • 已安装 cURL、Python 3 或 Node.js 18+
1

获取你的 API 密钥

访问你 Bright Data 账户中的 用户设置页面 并复制你的 API 密钥。如果你还没有账户,在 brightdata.com 注册。新账户每月可获得 5,000 个免费积分,无需信用卡。请参阅免费套餐
你的 API 密钥仅在创建时显示一次。请复制并安全地存储。
2

发送请求

我们将使用帖子 — 按 URL 收集端点进行同步请求。将 YOUR_API_KEY 替换为你的实际密钥:
你应该看到 200 状态码。这需要 10 到 30 秒。
3

查看响应

Bright Data Reddit 爬虫 API 返回一个包含结构化帖子数据的 JSON 数组:
每个帖子对象包括帖子详情、社区统计、互动指标和附带的媒体。查看 完整响应模式
你已经使用 Bright Data Reddit 爬虫 API 成功爬取了第一个 Reddit 帖子。

常见问题

可以。在输入数组中添加更多对象。同步请求最多支持 20 个 URL。对于更大的批次或按关键词或子版块发现,请使用 异步 /trigger 端点
可以,使用单独的评论数据集。使用数据集 ID gd_lvzdpsdlw09j6t702 并传入帖子 URL:
你也可以传入 days_back 将结果限制为最近 N 天内发布的评论。
确认你的 API 密钥正确且未过期。从 账户设置 生成新密钥。详见 认证指南
同步请求有 1 分钟超时限制。如果请求超过此限制,它会自动切换到异步模式并返回 snapshot_id。对于大批量请求,请使用 异步工作流
确认 Reddit 帖子 URL 可公开访问且格式正确。URL 应遵循 https://www.reddit.com/r/{subreddit}/comments/{post_id}/{slug}/ 模式。私有子版块和已删除的帖子无法被爬取。

后续步骤

发送第一个请求

使用 cURL、Python 和 Node.js 探索每个端点的完整示例。

异步批量请求

在单个批量任务中爬取数百个帖子或运行关键词发现。

API 参考

端点规范、参数和响应模式。