简体中文翻译
本教程展示如何使用 Bright Data YouTube Scraper API 抓取 YouTube 频道并获取结构化 JSON 数据。前置条件
- 一个 Bright Data 账户(每月含 5,000 个免费积分)
- 已安装 cURL、Python 3 或 Node.js 18+
1
获取您的 API 密钥
前往 Bright Data 账户中的用户设置页面并创建一个 API 密钥,或使用已有的密钥。如果您还没有账户,请在 brightdata.com 注册。新账户每月可获得 5,000 个免费积分,无需信用卡。请参阅免费套餐。
2
发送请求
我们将使用频道端点发送同步请求。将 您应该看到
YOUR_API_KEY 替换为您的实际密钥:200 状态码和一个 JSON 数组。202 表示抓取需要超过 1 分钟,请参阅下方说明。处理时间取决于目标网站状况和爬虫负载。同步请求最多等待 1 分钟。如果 Bright Data YouTube Scraper API 需要更长时间,响应为 HTTP
202,返回 snapshot_id 而不是频道数据,采集将继续以异步方式进行。请通过异步工作流获取结果,或使用 Webhook 投递接收结果。3
查看响应
常见问题
我可以在一个请求中抓取多个频道吗?
可以。将更多对象添加到输入数组中。同步请求支持最多 20 个 URL。对于更大的批次,请使用异步/trigger 端点。
收到 401 或 403 错误?
请验证您的 API 密钥是否正确且未过期。从账户设置生成新密钥。详见身份验证指南。请求超时?
同步请求的超时时限为 1 分钟。如果请求超过此限制,API 返回 HTTP202 和 snapshot_id,并以异步方式完成任务。对于大型批次,请使用异步工作流。
响应数据为空或不完整?
请验证 YouTube 频道 URL 是否可公开访问且格式正确。URL 应遵循https://www.youtube.com/@handle 的格式。
必须直接调用 API 吗?
不必。还有三种客户端封装了相同的端点和数据集 ID,本页的请求可以原样通过任一客户端运行。后续步骤
端点
每个端点一个请求,附实际抓取的响应。
异步批量请求
在单个批处理作业中抓取数百个 URL。
设置 Webhook
抓取完成时自动接收结果。