跳转到主要内容
本指南介绍如何安装 Bright Data Python SDK 并调用其全部功能:URL 抓取、搜索引擎、平台专用 scrapers(LinkedIn、Amazon、Instagram、TikTok、YouTube、Reddit、Pinterest、ChatGPT、Perplexity、Digikey)、Discover API、Scraper Studio、数据集与 Browser API。 Final Banner Pn

安装与配置

通过 pip 安装包:

配置

您必须提供您的 API token。可在 Bright Data 控制面板 中找到。 选项 1:环境变量(推荐)
选项 2:直接初始化

基本用法

简单脚本使用 SyncBrightDataClient。需要高并发时配合 asyncio 使用 BrightDataClient

发起抓取和网络搜索

当处理多个查询或 URL 时,请求会并发执行以获得最佳性能。

使用平台专用 scrapers 提取结构化数据

从 Amazon、LinkedIn、Facebook、Instagram、TikTok、YouTube、Reddit、Pinterest、ChatGPT、Perplexity 与 Digikey 提取结构化数据。

使用 AI 排序搜索网页(Discover API)

运行您的自定义 Scraper Studio scrapers

Datasets API

访问预先采集的数据快照。
在 IDE 中将鼠标悬停在 BrightDataClient 类或其任意方法上,即可查看可用参数、类型提示与使用示例。SDK 提供完整的 IntelliSense 支持。

使用 dataclass 负载实现类型安全

SDK 提供带运行时校验和辅助属性的 dataclass payloads。

连接至 Scraping Browser

通过 Browser API 将 Playwright 连接到 Bright Data 的云端浏览器。

使用 CLI 工具

SDK 提供命令行界面以便在终端中使用。

异步用法获取更高性能

并发操作时,将 URL 列表传递给 scrape_url,并在异步上下文管理器中运行。

资源

GitHub 仓库

查看源代码、示例并贡献代码

示例目录

覆盖所有功能的 10+ 个示例

PyPI 页面

包列表与发布历史

更新内容