工作原理
你向 Bright Data Instagram Scraper API 发送一个或多个 Instagram URL。Bright Data 处理爬取基础设施并返回清晰的结构化 JSON。dataset_id 来指定数据类型(资料、帖子、短视频或评论)并以 JSON、NDJSON 或 CSV 格式返回结果。
响应内容示例
Bright Data Instagram Scraper API 返回的单条记录。可在快速开始中亲自发送该请求。支持的数据类型
资料
粉丝数、简介、认证状态、资料图片。按用户名发现资料。
帖子
标题、点赞、评论、话题标签、照片和视频。按资料 URL 发现帖子。
短视频
视频 URL、浏览次数、播放次数、缩略图。发现短视频或收集资料中的所有短视频。
评论
评论文本、点赞、回复、评论者信息,适用于任何帖子或短视频。
请求方式
Bright Data Scraper API 支持两种请求方式,请根据您的数据量和延迟需求选择。
详见了解同步与异步请求。
功能与限制
常见问题
数据是否实时爬取?
数据是否实时爬取?
是的。每个请求都触发实时爬取。没有缓存或过期数据。处理时间取决于目标网站状况和爬虫负载。Bright Data Instagram Scraper API 不公布固定的响应时间。同步请求最多等待 1 分钟,之后返回
snapshot_id 并继续以异步方式采集。发现(discovery)请求始终以异步方式运行,耗时更长,具体取决于结果数量。响应时间为什么会发生变化?
响应时间为什么会发生变化?
Instagram 会调整其页面的提供方式,Bright Data Instagram Scraper API 的采集器也会相应更新。即使成功率保持不变,采集器更新也可能改变一次爬取所需的时间。对于生产环境的工作负载,请基于异步工作流或 Webhook 投递进行构建,这样较长的运行时间不会破坏集成。
URL 收集和发现有什么区别?
URL 收集和发现有什么区别?
URL 收集爬取你提供的特定 Instagram 页面(例如资料 URL)。发现查找与搜索条件匹配的 Instagram 内容(例如资料中的所有帖子)并爬取结果。发现仅通过异步请求提供。
与使用代理或 Web Unlocker 抓取有何不同?
与使用代理或 Web Unlocker 抓取有何不同?
使用代理或 Web Unlocker 抓取时,您仍需编写和维护自己的解析逻辑,并在目标网站页面结构变化时随时更新。Bright Data Scraper API 处理整个链路:代理轮换、反爬绕过与解析。您只需发送 URL 或关键词,即可获得干净的结构化 JSON,无需自建抓取基础设施或维护解析器。
后续步骤
快速入门
5 分钟内爬取你的第一个 Instagram 资料。
发送你的第一个请求
cURL、Python 和 Node.js 的完整代码示例。
API 参考
端点规范、参数和响应架构。